Anthropic称Claude已主导26%内部研发
IT时代网9月18日消息,Anthropic发布了一套衡量前沿AI实验室研发进度的方法,并公布公司内部的阶段性数据。该体系主要关注3项指标:AI参与AI研发的程度、AI智能体的监督情况,以及算力在AI研发与安全研究之间的分配。
在AI参与AI研发方面,Anthropic提出“Anthropic研发自动化指数”,用于衡量Claude参与公司AI研发工作的程度。该指标采用Epoch AI提出的自动化等级体系,从AL0到AL5,分别对应没有AI参与、AI辅助、AI协作、AI主导以及完全自主运行。截至2026年8月,Claude未在任何被测量的AI研发工作中实现完全自主运行,但已主导约26%的AI研发工作,处于AI协作及更高等级的工作占比超过90%。Anthropic披露,这一比例在2026年2月还不到1%。
为建立指标,Anthropic从2026年7月的内部工作记录、协作工具与其他文档中抽样整理出约1.5万个模型研发任务,归纳为542个不同层级的任务节点,再由Claude研究这些任务的执行方式与AI参与程度,并由独立的Claude评估模型判断自动化等级。
监督方面,实时监控系统会在智能体执行操作前检查行为,发现危险操作时进行拦截或调整。Anthropic对2026年8月超过10亿次智能体决策的分析显示,约0.002%的操作被拦截,相当于每约4.7万次操作出现1次。事后监控系统每周约标记10万份对话记录做进一步检查,其中优先级最高的约50份会升级至人工审核。
算力分配上,Anthropic统计了2026年7月13日至7月20日期间的使用情况,用于AI研发的算力中约6%投入安全研究;若仅统计基于AI的AI研发工作,安全研究算力占比约12%。该公司强调,这是较为保守的估计,安全研究通常不需要像前沿模型训练那样消耗大量算力,因此算力占比不能直接代表安全工作的整体投入。
Anthropic表示,这些指标目前仍属原型测量体系,跨实验室比较还面临统一方法与独立验证等问题,公司计划引入来自多个组织的独立第三方评估人员。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。
编辑:林一舟