9月18日消息,在公司首席执行官达里奥·阿莫代伊公开呼吁全行业统一步调踩刹车并引发轩然大波后,人工智能独角兽Anthropic于周四正式公布了三项全新的评估指标。该公司希望通过量化自身的技术演化步伐,为外部监管和全行业监控AI研发节奏提供参考依据。

在官方说明中,Anthropic详细公开了针对AI主导研发比例、智能体行为监管以及实际算力资源分配的测算逻辑,并敦促业内其他机构同步跟进。此前,阿莫代伊曾提出过一份三步走的行业减速倡议,但因缺乏具体的执行方案而受到外界审视,此次公布的数据正是对其减速主张的落地补充。
Anthropic在声明中直言,当全球都在严肃权衡是否该给前沿技术踩刹车时,科技界有责任彻底消除实验室内部与公众认知之间的巨大鸿沟。这意味着企业必须更精准地量化AI演进过程并定期向全社会公开,让公众有权参与决定如何运用这些信息。
阿莫代伊的降速提议此前已获得OpenAI首席执行官萨姆·阿尔特曼、马斯克以及谷歌DeepMind掌舵人哈萨比斯等多位业界领袖的声援。不过阿莫代伊也明确划定了底线,减速的根本前提是不能牺牲自身的商业竞争优势,更不能动摇美国在AI领域的技术领导地位。
在具体披露的指标中,首项数据显示其Claude模型在所有受测的内部研发环节中,尚未实现完全自主闭环的接管。
第二项指标聚焦于针对智能体的实时监督与干预机制。Anthropic透露,在其内部最核心的开发平台上,任何单一时间节点都有大约30000个AI智能体在协同进行算法研究与工程开发。
第三项指标则展现了底层算力消耗的真实图景。Anthropic抽样统计了7月中旬的一周算力使用情况,结果显示,在用于AI研发的整体算力中,仅有约6%被明确划拨用于系统安全的研究;而在完全由AI主导推进的科研任务里,分配给安全研究的算力占比则提升至12%。
Anthropic表示,以往的行业评测往往只侧重于模型究竟能做到什么,而这些新指标展示的则是模型是如何一步步被制造出来的。两者结合,才能为实验室之外的第三方评估机构提供一个掌握技术演进节奏的客观抓手。Anthropic承诺未来将把公布此类数据作为一项长期惯例。

