Anthropic:Claude已主导26%内部AI研发工作

🤖 由 文心大模型 生成的文章摘要

Anthropic发布了一套衡量前沿AI实验室研发进度的方法,并首次公开内部数据,核心关注三项指标:AI参与AI研发的程度、AI智能体的监督情况,以及算力在研发与安全研究之间的分配。

在AI参与研发方面,Anthropic提出“研发自动化指数”,采用AL0至AL5六级体系,从无AI参与、AI辅助、AI协作、AI主导,到完全自主运行。截至2026年8月,Claude尚未实现完全自主运行,但已“主导”约26%的AI研发工作,处于“AI协作”及更高等级的工作占比超过90%。而这一比例在2026年2月还不到1%,半年内急剧上升。Anthropic认为,这有助于观察距离“递归自我改进”——即AI完全自主开发下一代AI——还有多远。

为建立指标,Anthropic从2026年7月的内部记录中抽样约1.5万个研发任务,归纳为542个任务节点,再由Claude评估AI参与程度。

在智能体监督方面,实时监控系统会在操作前检查并拦截危险行为。对2026年8月超10亿次智能体决策的分析显示,约0.002%的操作被拦截,相当于每4.7万次出现1次。事后监控系统每周约标记10万份对话记录,其中约50份升级至人工审核。

算力分配上,2026年7月13日至20日期间,Anthropic用于AI研发的算力中约6%投入安全研究;若仅统计基于AI的AI研发工作,安全研究算力占比约12%。公司强调这是保守估计,算力占比不能直接代表安全工作的整体投入。

Anthropic称,这些指标仍属原型测量体系,跨实验室比较面临统一方法和独立验证等问题,计划引入独立第三方评估人员。公司CEO达里奥·阿莫代伊曾呼吁协调放缓前沿AI发展,Anthropic也表示若出现协调,相关数字预计会变化。