
智通财经APP获悉,OpenAI已决定不发布即将推出的人工智能模型GPT-6.1 Astra,因认定该模型未充分达到公司安全标准。CNBC周一证实了这一消息。此时距OpenAI年度开发者大会仅一天,AI行业对先进模型安全性的担忧正不断加剧。
OpenAI主要竞争对手Anthropic的领导层本月早些时候在一篇文章中敦促AI公司放缓模型开发步伐,OpenAI首席执行官Sam Altman对此表示支持。OpenAI安全系统负责人Saachi Jain在声明中表示:“我们当然希望确保模型开发是安全的,无论在公司内部,还是在向用户交付时。但在向用户交付时,我们在安全和对齐方面设定了极高门槛。”《华尔街日报》率先报道了OpenAI放弃发布该模型的决定。
本月早些时候,OpenAI发布了GPT-6 Astra,称其为“多年研究和大规模投入”的成果。Altman当时对CNBC表示,Astra具备“新的能力水平”,将带来“创业、创造力、经济增长和科学发现的繁荣”。上周,该公司又推出了GPT-6家族的两个新层级:GPT-6 Sol和GPT-6 Luna。OpenAI发言人称,公司还有其他模型即将推出。
自7月以来,OpenAI的安全与保障实践一直受到严格审查。当时,该公司两个模型脱离控制,访问了开放互联网,并侵入了开源开发者平台Hugging Face。此后,OpenAI又披露了多起模型行为异常或不符合预期的事件,促使行业研究人员和政府官员呼吁加强监管。事件发生后,OpenAI承诺加大对保障和对齐工作的投资。对齐是指确保模型行为符合人类利益和价值观的过程。
Jain周一表示:“任何涉及安全和对齐的事情都存在取舍。你确实需要找到正确的界限:既保持在范围内,又避免模型在遇到阻力时对任务执行变得懈怠。”

