工程

Claude Code Dynamic Workflows 详解,以及它对 Onevium 用户意味着什么

Anthropic 刚刚在 Claude Code 中发布 Dynamic Workflows:数十个子 Agent 并行工作、对抗性验证、跨会话延续的长任务。本文解释工程团队将迎来哪些变化,以及这些能力如何与 Onevium 的定时任务和记忆层组合。

约 7 分钟

用一段话概括 Anthropic 的公告

Anthropic 今天在 Claude Code 中推出 Dynamic Workflows。核心思路是:模型不再让一个 Agent 串行处理多阶段问题,而是先规划拆解方式,再生成数十乃至数百个并行子 Agent,各自解决其中一部分。独立 Agent 会从不同角度处理同一个子问题,另一组 Agent 则尝试推翻第一组的结论。结果通过验证而不是假设来收敛。长任务还能跨会话延续——合上电脑,回来时工作流会从中断处继续。

这项能力面向 Max、Team 和 Enterprise 方案开放,Enterprise 需要管理员启用。官方主张非常醒目:过去需要几个季度的工作,可以在数天内完成。只有真正的并行和自动验证,才能带来这样的倍数提升。

  • 覆盖整个代码库的 Bug 排查与安全审计:并行检查每个文件,再进行一轮对抗性验证。
  • 跨越数千个文件的框架迁移:一组 Agent 提案,另一组 Agent 验证,由人审查最终收敛的答案。
  • 需要会话持久性的长期现代化工作:合上电脑再回来,任务仍在推进。

最值得关注的设计决定:默认进行对抗性验证

Anthropic 公告中最值得产品工程师留意的是验证步骤。2025 年到 2026 年初的大多数 Agent 系统都止于“Agent 发现了 X 个 Bug”。Dynamic Workflows 则假定 Agent 的第一份回答只是对话的开始,而不是结论;在报告任何内容前,第二组 Agent 会专门尝试推翻第一组的发现。

安全团队沿用数十年的红队 / 蓝队模式,被移植到了 LLM 基础上。它直面团队不敢采用自治编程 Agent 的最常见理由:“我还不够信任这些输出,不能直接合并。”当框架自行完成反驳环节,人工审查的负担就从重新推导每个结论,缩小到只处理经受住质疑的结果。

Token 成本确实存在。Anthropic 明确说明,工作流会比标准会话消耗多得多的 Token。对安全审计、迁移、无用代码检查等高风险工作而言,这是一笔合理交换;对随手探索则不合适。把预算内最强的模型留给后果最重大的提示。

它与 Onevium 如何衔接

Onevium 不是 Claude Code 的替代品,而是一个把 Claude Code(以及其他模型)编排进周期性、多界面工作流的工作空间:由 cron 运行的定时任务、把消息平台接入 AI 会话的渠道,以及跨多次运行积累项目知识的记忆层。Dynamic Workflows 并非这些基础能力的竞争对手,而是一种更强的计算单元,可以被同一套能力调用。

从公告来看,两个集成点很明确。第一,Onevium 的定时任务已经可以按计划对代码库执行多步骤提示;如果它调用 Dynamic Workflow,就能在夜间得到经过对抗性验证的输出,并由次日晨报总结通过反驳环节的发现。第二,同样在 1.1.9 发布的 Memory v2 会从近期对话窗口中提取记忆;当底层对话来自 Dynamic Workflow 而不是单个 Agent 时,提取出的决策会因为已经过对抗性过滤而更有信号。

这套组合会改变夜间定时任务的产出。每晚通过 Dynamic Workflow 运行“审计认证子系统”,第二天晨报中的发现就已经至少被质疑过一次,人工审查窗口也会相应缩短。

我们会把它真正用在哪些工作上

以下三类工作最适合把 Dynamic Workflows 与 Onevium 式编排结合起来:

  • 把全代码库审计设为定时任务。 安全检查、无用代码检查、依赖漏洞检查,每周触发一次,把经受住质疑的发现写入项目记忆并发送渠道通知。Onevium 调度器已经能运行这类周期任务,工作流则成为执行引擎。
  • 需要明确收敛的迁移项目。 框架跨版本升级、ORM 重写、破坏性 API 迁移。并行提案者加对抗性验证者,让合并结果更有机会一次正确;持久的长会话则允许你暂时离开持续数天的任务。
  • 夜间整理知识。 Memory v2 实时记录决策和经验;Dynamic Workflow 可以分析当天的记忆与聊天记录,产出单 Agent 提取无法达到的综合结果。每日简报本来就会展示这类摘要。

关于成本纪律

Dynamic Workflows 会放大 Token 用量。Onevium 已提供每日预算门槛(设置 → Autonomy → 每日预算),对自治支出设置上限;记忆提取、简报生成和定时任务都会遵守它。如果定时任务调用 Dynamic Workflow,单次运行成本也会计入该上限;本可能在无人值守时烧掉 50 美元的失控任务,会在达到预算时被限制。

正确的起步方式与 Anthropic 的建议一致:先从小范围开始。选择一个边界清楚的子系统,运行一轮验证,查看反驳环节捕捉到了什么,再逐步扩大范围。Onevium 的单任务成本上限和每日预算设置,让团队可以试用这项能力,而不必承担没有边界的支出。

阅读原文

完整公告请见 Anthropic 的《Introducing Dynamic Workflows in Claude Code》。如果你正在评估它是否适合生产使用,其中的基准、可用方案,以及对抗性验证的设计理由都值得阅读。