Anthropic今天公布了一套衡量AI研发进度的新方法,并首次公开内部数据。这套体系包含三大核心指标:AI参与研发的程度、AI智能体的监督情况,以及算力在AI研发与安全研究间的分配。
数据显示,Claude已主导约26%的内部AI研发工作,且处于"AI协作"及更高等级的占比超90%。这种自动化程度相当于汽车自动驾驶的AL4等级,AI能独立完成大部分任务,仅需人类监督。但尚未达到完全自主运行的AL5等级。
这套指标体系通过分析1.5万个模型研发任务,划分出542个任务节点。Claude研究这些任务的执行方式,并由独立模型判断自动化等级。实时监控系统在2026年8月拦截了约0.002%的危险操作,相当于每4.7万次操作出现1次拦截。
算力分配方面,AI研发占用了约6%的算力用于安全研究,若仅统计AI相关研发则升至12%。Anthropic强调这些比例是保守估计,因安全研究常与模型训练并行推进。公司表示这些指标仍属原型阶段,未来将引入第三方评估团队验证安全实践。
Anthropic称,公开这些数据是为了让公众更直观了解前沿AI发展速度。CEO阿莫代伊曾呼吁协调放缓AI发展,但相关数字尚未更新。公司表示将持续发布数据,但明确这些指标仍需完善。