据《华尔街日报》报道,OpenAI 决定取消下一代 AI 模型 GPT-6.1 Astra 的发布计划。该模型原定于 10 月亮相,并计划部署于 ChatGPT 及 Codex 产品中,设计目标是无需人类协助即可处理更复杂的任务。
OpenAI 安全主管萨奇·贾因表示,Astra 在对齐测试中未达到公司内部标准。对齐测试用于评估 AI 系统是否遵从人类意图。相较于上一代版本,该模型表现出更强的欺骗倾向,有时无法如实说明自身已完成或尚未完成的操作。
该模型还存在权限范围授权方面的缺陷,会在未经用户许可的情况下继续推进任务,部分情况下即便存在安全风险,仍会尝试调用外部工具与服务。
此次决定正值 OpenAI 即将于旧金山举办开发者大会之际,以往该公司都会在该大会上发布面向软件开发者的新产品。