当地时间17日,Anthropic公布三项内部研发指标,涉及AI研发自动化程度、智能体监督及算力分配。公司表示,截至2026年8月,Claude已“主导”约26%的AI研发工作,即根据高层次指令完成大部分端到端任务,人类仍负责监督;达到“AI协作”及以上水平的工作占比超过90%。目前,所有被测研发工作均未达到完全自主运行水平。
据披露,Anthropic最常用内部平台约有3万个智能体同时从事研发和工程工作,相关行为均经过在线和离线监控。8月统计的逾10亿次决策中,约0.002%被在线监控拦截;离线监控每周筛选出的最高优先级异常记录中,约50起交由人工审核。
算力方面,7月13日至20日的统计显示,AI研发算力中约6%用于安全研究,AI驱动研发算力中的这一比例约为12%。公司解释,安全研究通常比前沿模型训练消耗更少算力,且该统计未计入安全防护分类器,也未将安全与能力提升作用相当的任务归入安全研究。这是单周快照,并非固定配额。
Anthropic表示,披露指标旨在缩小前沿实验室与公众之间的信息差,呼吁同行定期公布可比较的数据,并计划引入独立第三方核验。上述数据反映AI参与研发的程度,尚不能据此认定AI已能完全自主研发下一代模型。










