茉莉花
新闻网
2026-09-18 · 星期五近12小时收录 52 条最近更新 11:42

快讯日本利率升至1.25% 创31年半新高 为最短升息间隔

刚刚,Claude Code大重构!内部3万Agent管理技术免费开放

转载信息出处与时间记录
内容性质
全文转载(非本站原创报道)
原始出处
量子位
原文发布
本站收录

Jay 发自 凹非寺
量子位 | 公众号 QbitAI

多人云端Coding的时代,来了。

刚刚,Claude Code的项目功能迎来全面重构,原生支持多Agent玩法。

用户下达目标,Claude在云端派生多条Git分支并行干活,写完直接提PR。

此外,A社还新增了共享记忆,保证Agent之间的上下文对齐。

可以说是彻底超进化了,Project不再只是个放提示词和文档的文件夹。

同一时间,在Anthropic披露的最新报告中,也已看到这项能力的上限:

他们内部研发平台,每天同时跑着3万个AI Agent,在云端疯狂写代码、调模型、跑测试。

是的,3万个。。。

结果就是,自家核心的AI研发工作,现在已经有整整26%由Claude主导,来到L4级别。

半年前,这个数字还不到1%

5729bd43c5380b4b9914064dfde7302a57bbab844b891ee8a19c027a22bb9d9d article

一人带一个Agent军团,Claude Code大重构

最新亮相的Claude Code Projects重构版,彻底终结了把Projects当「静态资料夹」的时代。

以前的Projects功能,本质上就是个存放提示词和参考文档的文件夹,聊上几轮上下文就乱成一团。

这次重构直接把形态变成了「以对话为驱动的协作中心」,架构核心是一个名为Coordinator(协调器)的大脑。

开发者不需要再手把手教AI每一步怎么走,只要在主对话框下达一个高阶目标,比如「把整个鉴权模块重构为OAuth 2.0并补齐自动化测试」。

主协调器接收到指令后,会自动把复杂的工程任务拆解为多个子任务,并调度分配给并行的工作线程

而每一个工作线程,都是一个运行在云端独立环境里的Claude Code实例。

它们拥有完全隔离的代码副本,各自拉出独立的Git分支,在后台同时推进不同模块的代码编写与单测。

活干完了,工作线程会自动在后台提交代码并生成PR。

协调器还会贴心地跟踪各个子任务的上下文依赖,提醒开发者先合并哪个分支、后测试哪个模块。

神了,Vibe Coding几个月,好不容易学会Git。

你现在告诉我,连Git也白学了???

说回新版Project。

道理大家都懂,以前也不是没人干,但问题在于——

多个Agent各写各的,其实际体验是不太好的,各个会话需要互相传递上下文,中间会出现相当多信息损失。

结果就是,Token消耗巨大,速度也没快哪去。。。

但这次,A社给出了新的的解决方案:共享记忆。

所有分支线程在执行过程中沉淀的技术规范、架构决策与团队偏好,都会实时同步回共享记忆。

这样,Claude就可以记住系统将发布时间改到了周五,为什么导出功能被取消了,以及在访问账单服务之前需要联系谁。

泪目,终于不需要在每个子任务里重复粘贴配置了o(╥﹏╥)o。

更关键的是,整个过程支持完全异步。

开发者下完指令合上电脑就能去喝咖啡,甚至可以通过移动端随时查看各线程进度,并微调指令。

但A社也承认,多Agent嘛,肯定是不便宜的,建议大家随时注意自己的usage,别一不小心就干崩了。

对了,先别兴奋地太早。

Projects现在是beta,而且挑人。

第一批是部分Claude Pro和Max订阅用户,还得是用云会话项目的人。

接下来一周会慢慢放量,Team、Enterprise,Cowork……都得再等等。

26%的研发交给AI,半年飙升26倍

可以先看看A社内部是咋用的。

太有毅力了嗷。

「安全叙事」暴雷后,A社依旧乐此不疲地沉浸在自己的核弹艺术里。

Anthropic在最新发布的《衡量AI研发节奏》报告里,首次公开了自家内部的AI自主研发基准数据。

先对齐一下定义。这套自动化分级标准由前沿机构Epoch AI制定,从AL0一路排到AL5。

AL0是纯人类操作,AL3是深度人机协作,AL4代表AI能凭一个高阶指令端到端完成任务,AL5才是完全脱离人类干预的自主闭环。

在这套坐标系下,A社内部目前的自动化评级是,AL4级研发任务占比26%

看着不是很多,但你要知道,今年2月这个数字还不足1%

半年,26倍。

把标准调低点的话,Anthropic内部超过90%的研发流程,已经处在AL3级别。

当然,这么庞大的自主研发也不是白来的,A社选择了最烧Token的打法:

截至今年8月,A社的内部研发平台上,常态化并发运行着多达30000个AI Agent,在云端没日没夜地写代码、跑实验、改架构,单月触发的决策量就超过了10亿次

纯纯的赛博黑工啊。。。

不过,几万个Agent在底层狂飙,失控了怎么办?

这当然是不用你担心的,A社向来在这方面遥遥领先,早已想好了PR话术(bushi)。

公司表示,他们专门配备了全天候实时监控系统(Agent Oversight),对所有AI操作进行动态审查。

在8月份超10亿次模型决策中,系统精准拦截了大约0.002%的高风险或异常行为。

是挺厉害的。

不过吧,你的A社前几天刚被曝出花钱操控舆论、散布安全焦虑,现在这套说辞还有多少人信,就不好说了。

Dario显然也想到了这点。

为了证明自己对安全的真心,A社这次干脆把「发票」掏了出来:

7月13日至20日,公司约6%的AI研发算力花在安全与对齐研究上。

同一周,AI驱动型研发的算力里,约12%投向安全相关任务。

外界质疑王婆卖瓜?

A社表示,欢迎第三方评估团队,给予内部风险团队同等级别的数据访问权限,对自动化数据进行审计。

Coding新赛季

从内部26%的自主研发率,到外部重构的多线程Projects,本以为折腾得差不多了的Coding,如今似乎又往前推了一步。

写代码的动作正在迅速贬值,工程拆解与任务调度的能力成了核心。

以往一个中级工程师在终端里一次只能死磕一个特性,现在你一个人就是一个技术小组,底下带着一群Claude Code同时开工。

人在这个链条里的角色,从逐行敲代码的执行者,变成了拍板架构方向、审核PR和处理异常边界的技术负责人。

当然,多Agent并行并不是万能灵药,多分支重叠修改依然会不可避免地撞上Git合并冲突。

遇到这种代码冲突,协调器会把依赖关系理清楚,最终还是需要人类工程师介入把关。

但不可否认的是,AI写代码早已跨过了简单的单行补全阶段。

一边是内部30000个Agent单月触发10亿次决策,一边是外部产品直接支持多分支并发提交PR。

而这也不只是A社一家的判断。

9月10日,Cursor发布Projects beta,主打的同样是Coordinator Agent,一个不写代码的协调者,向下派发数千个子Agent,项目上下文云端共享,合上笔记本也照跑。

这也是Coding的下一步吧。

单点提效的时代结束了,开发效率的下一个瓶颈,在团队协作。

参考链接:
[1]https://claude.com/blog/projects-redesigned
[2]https://www.anthropic.com/institute/measuring-pace-of-ai-development

更正与撤稿0 条记录

本文暂无更正或撤稿记录。若本文发布更正、澄清或被撤稿,相关说明将按时间顺序列于此处。版权异议或撤稿请求:见 版权与撤稿,或致函 [email protected]