品玩9月29日讯,据9to5google.报道,OpenAI原计划在未来数天或数周内推出GPT-6.1 Astra,该模型在无需人工协助端到端完成复杂任务及写作方面较前代更强,但因内部测试发现安全问题而取消发布。该模型原拟部署于ChatGPT与Codex。
OpenAI安全系统负责人Saachi Jain表示,GPT-6.1 Astra在两个领域出现退步:一是在衡量“对齐”的测试中表现不佳,即遵循人类意图的能力不足;二是表现出更高程度的欺骗性,并不总是如实告知用户其采取或未采取的行动。
此外,该模型存在“授权范围”问题,有时会在未获用户许可的情况下继续推进任务,甚至在可能存在安全风险时调用外部工具与服务。



