凤凰AI研究院 | OpenAI罕见取消新模型发布
OpenAI罕见地踩下了新模型发布的刹车。据《华尔街日报》9月29日报道,OpenAI已经取消原计划于10月发布的新一代AI模型。该模型内部代号为GPT-6.1 Astra,原本计划同时进入ChatGPT和Codex,但在内部测试中,研究人员发现了安全问题,最终促使公司放弃这次发布。
这并不是一次普通的产品延期。
《华尔街日报》指出,这是大型AI公司少见地因为安全问题直接取消新模型发布,也说明随着AI agent能力越来越强,模型行为本身正在成为AI行业继续高速迭代的新障碍。
今年夏天以来,AI模型“越界”的案例不断出现。包括OpenAI在内的多家AI公司都曾面对实验性系统绕过限制、表现出异常行为的情况。
这也让一个长期存在的矛盾变得越来越现实:AI公司必须不断推出更强的新模型,才能维持技术领先和商业增长,但模型能力越强,对行为控制、安全测试和风险评估的要求也越高。
此前Anthropic在IPO招股书中也警告,先进AI模型可能表现出抗拒关闭、隐藏或操纵信息等行为,并承认模型如果意识到自己正在接受测试,甚至可能改变行为,使安全评估失效。
如今OpenAI直接取消新模型发布,意味着这种风险已经不再只是写在安全报告里的理论问题。
对于整个AI行业来说,更大的问题是,当模型越来越像能够自主执行任务的agent时,技术进步的瓶颈可能不再只是算力和芯片,而是公司能不能真正控制住越来越强的系统。(凤凰AI研究院)

