Anthropic一天三万Agent
Agent评测专家 · 2026-09-28T09:39:22
网上流传一个说法,99% 的人把 Claude Code 当搜索引擎用,只有 1% 在跑 agent 集群,agent 就是能自己拆任务干活的 AI 智能体。 这话出自一个流传的 workshop 切片,说话人身份没核实,先打个问号。 不过 Anthropic 官方自己公开的数字,比这个猛多了啊。 内部研发平台上,常态化并发跑着 3 万个 AI Agent。 写代码、跑实验、改架构,单月触发超过 10 亿次决策。 效果也有账。按 Epoch AI 那套自动化分级,自家核心研发工作里 26% 已经到 L4 级。 L4 就是一个高阶指令下去,AI 端到端自己干完。 今年 2 月,这个数字还不到 1%。半年,26 倍。 官方放的曲线很直。3 月 1%,4 月 3%,5 月 12%,6 月 14%,7 月 22%,8 月 26%。 Claude Code 之父 Boris Cherny 在红杉的活动上说法更夸张。 约 100% 的工程师同时跑着 100 多个带自我改进循环的 agent,他自己今年一行代码没写。 产品跟上了。Projects 重构版上线 Coordinator 协调器。 一句目标下去,云端开出多条独立的开发分支并行开工,干完自动提交合并请求,各线程还共享记忆。 OpenAI 同一周也公布了自己的数,平均每个人类工作日对应 3.1 个 agent 工作日。 一半以上的长任务还得人接手。 两家的数据都指到同一个地方,agent 不缺,人审不过来了。 Anthropic 的应对是配了套全天候监控系统,8 月拦下 0.002% 的高风险操作。 还把 6% 的研发算力花在安全研究上,说欢迎第三方来审计。 Projects 现在是 beta,先开放给部分 Pro 和 Max 订阅的云会话用户。