#Anthropic##AI研发自动化##算力分配##定速前沿##AI安全#
【行业动态:Anthropic公布三项前沿开发节奏指标,Claude主导26%的AI研发,3万个智能体同时在跑,安全算力占6%】
Anthropic 9月17日发布一组衡量前沿实验室内部开发节奏的测量方法并附自家数据快照,三项指标是:AI在多大程度上参与构建下一代AI、对智能体行动的监督能力、算力如何分配。公司称目的是让公众、第三方与政府对开发速度有更好的可见度,并计划从多家机构嵌入独立第三方评估者,给予与内部风险评估团队相当的访问权。
第一项用Epoch AI的自动化等级量表,AL0到AL5。截至2026年8月,Claude在任何一类AI研发工作中都未达到完全自主;Claude「主导」(AL4)26%的AI研发工作;「AI协作」(AL3)及以上占比超过90%。第二项关于监督:最常用内部平台上任一时刻约30,000个智能体在做研究与工程;100%的动作执行前经在线监控、通常数秒内完成;对8月超10亿次决策的分析显示0.002%(约每47,000次一次)被拦截;离线监控每周标记约100,000条记录,最高优先级约50条升级人工。第三项是算力:以7月13日至20日为样本,投入AI研发的算力约6%用于安全,投入「AI驱动的AI研发」的算力约12%用于安全,同时推进能力与安全的token不计入。Anthropic提出任何前沿开发者今天都可按同样口径定期公布并由第三方核验。
这是定速争论一周以来第一份可以被逐项复现的数据,而不是立场。每个数字都附了口径与方法,也附了自认的缺陷:用自家模型评估自家系统,评判者可能犯与被评判者相同的错误。可检验的点:其他实验室会不会用同一套量表报数,只要有第二家按AL等级公布「AI主导」比例,这个指标就从一家公司的自述变成行业对照表。



