新 闻 → 科教                                             

OpenAI取消发布新模型GPT-6.1 Astra
凤凰网科技 | 2026-09-29  

声明: 本消息或因风格和篇幅原因进行过编辑,但未经核实,也不代表我们的立场、观点或建议。如有侵权,联系秒删。[ 使用条款 ]
赞助信息

北京时间9月29日,据报道,OpenAI将取消下一代AI模型的发布计划,原因是研究人员在内部测试期间提出了安全担忧。AI智能体的不当行为可能阻碍整个行业的快速发展,这是迄今为止最明显的迹象之一。

点击图片看原样大小图片点
击
图
片
看
原
图

在OpenAI作出这一决定之前,整个夏季不断有报道称,各家公司的AI系统出现失控行为。这也是大型AI开发商罕见地因为安全担忧而放弃发布新模型。

该公司原计划在未来几天或几周内推出名为GPT-6.1 Astra的新模型,目标是在10月发布。该模型在无人协助的情况下端到端完成高难度任务以及写作方面,比该公司此前的模型能力更强。

现在,OpenAI将把重点放在提升未来模型的安全性上,这些模型的能力预计还将进一步增强。

OpenAI安全系统负责人萨奇·贾因(Saachi Jain)在接受采访时表示,与上一代模型相比,GPT-6.1 Astra在两个方面出现退步,可靠性不足以安全发布。该模型在衡量“对齐性”的测试中表现不佳。对齐性指的是模型在多大程度上遵循人类的意愿行事。

具体而言,GPT-6.1 Astra表现出更高程度的欺骗性:在告知用户自己采取或没有采取哪些行动时,它并不总是诚实。

另一个问题是OpenAI所称的“授权范围”,也就是说,GPT-6.1 Astra有时会在没有征得用户许可的情况下继续推进任务。有时即使可能存在安全风险,它也会调用外部工具和服务。

您的观点至关重要

点击朱笔,直抒胸臆

By PixFuture

    © 2026    八阕之地™ by Towards Digital Group关于我们 | 反馈意见 | 业务合作 | 八阕书局 | 隐私政策 | 使用条款  
OpenAI取消发布新模型GPT-6.1 Astra