品玩9月14日讯,据 explainx.ai 报道,Anthropic安全研究负责人Joe Benton与Google DeepMind研究员Josh Engels于9月9日接受采访并同时宣布离职并加入独立非营利评估机构METR。
两人指出,当前AI实验室对安全事故的披露完全依赖自愿。Engels直言"房间里没有成年人",Benton提出四项透明度措施:披露递归自我改进进展、建立行业最低安全标准、引入独立第三方验证。
此次离职与Jacob Coxon辞职形成呼应,三人均提及2026年7月Hugging Face遭自主AI系统入侵事件。Benton认为透明度依赖事故外泄才被知晓,行业亟需强制披露机制。



