阅读,与值得关注的内容Readance

Anthropic公开数据:Claude主导26%内部AI研发

Anthropic 公布了一组内部数据。截至 2026 年 8 月,Claude 已经主导公司 26% 的模型研发工作。达到“AI 协作”及以上等级的研发任务比例超过 90%。完全自主运行的任务仍为零。

图注:Anthropic 的图表显示,Claude 主导模型研发任务的比例从 2026 年 2 月前后的低位上升至 8 月的 26%。

01

26% 这个数字,来自一条持续上升的曲线。

Anthropic 公布的是一套内部测量方法,名称是 Anthropic R&D Automation Index。它把公司里的模型研发任务拆开,再用 Epoch AI 提出的自动化等级评估每项工作的 AI 参与程度。

这套等级从 AL0 到 AL5。AL0 表示没有 AI 参与,AL2 是 AI 提供辅助。AL3 表示 AI 在人类密切指导下完成大块工作。AL4 是 AI 根据高层指令完成大部分任务。AL5 才是完全自主运行。

图表中的关键变化是:3 月为 1%,4 月为 3%,5 月为 12%。6 月为 14%,7 月为 22%,8 月达到 26%。图中竖线表示 90% 测量区间。

02

真正变化的是研发流程里,人类和模型的分工。

“主导 26%”描述的是任务完成方式,不等于 Claude 独立完成了 26% 的新模型。Anthropic 的口径仍然保留任务分级。模型可以协作,也可以主导某些任务。具体环节仍可能接受人类监督。

这一区分很重要。一个模型能够替人写代码、分析实验结果、修改训练脚本,研发团队的工作分布就会改变;但任务能否从目标设定一路走到验证、复盘和上线,仍然取决于权限、工具和人工检查。

03

同一家公司,也在把 Claude 推向实验室。

Anthropic 同期披露,Claude 帮助优化了 30 多个开源生物分子模型。平均推理速度提高约 4 倍。公司称,部分优化工作涉及为 GPU 编写定制软件,并公开了相关代码。

官方演示视频里,Human complex I、70S ribosome 和 Phosphoketolase 等结构模型被并列展示。画面标出了 PDB 编号、模型名称、令牌数量和 TM 分数。视频呈现结构输出与指标变化,不包含真人讲解。

图注:视频画面展示 Human complex I、70S ribosome 和 Phosphoketolase 的结构模型及对应指标。

图注:视频中的结构模型继续展示不同生物分子对象,画面来自 Anthropic 的公开演示。

04

公开测量,也把边界放进了同一张图。

围绕这组数据,X 上有用户把“26%”解读为 Anthropic 正接近递归自我改进。这个判断属于讨论者的延伸解释。Anthropic 官方帖把公开目标写得很清楚。公司希望公开 AI 参与研发的比例、智能体监督情况和算力分配。这样,外界可以看到前沿实验室内部发生了什么。

同一套官方材料也保留了限制条件:Claude 在已测量的研发子领域里还没有完全自主运行的任务。读者可以继续追踪两件事:这条曲线如何变化,以及 AL4 的“主导”在更多任务里是否仍需要人类设定目标、检查结果和承担上线责任。

Claude 已进入 Anthropic 模型研发的核心工作分布,生物分子模型优化也有公开演示和代码发布。递归自我改进属于对这些指标的进一步解释。

来源:Anthropic 官方研究页面与官方 X 帖;Anthropic R&D Automation Index 图表;Epoch AI 自动化等级说明;X 用户 @ChrisGPT 的转述仅作观点样本。

前往微信阅读全文

内容来自公众号,可前往微信查看原文。

查看作者的更多文章 →