新 闻 → 科教                                             

GPT-6.1 Astra不发了
量子位 | 2026-09-30  

声明: 本消息或因风格和篇幅原因进行过编辑,但未经核实,也不代表我们的立场、观点或建议。如有侵权,联系秒删。[ 使用条款 ]
赞助信息

原定于10月亮相的GPT-6.1 Astra突然被曝暂停发布!

也就是说,OpenAI,三天连踩两脚刹车。

而因为几天前的DNS事件,OpenAI同时暂停了内部最强模型所有涉及工具调用的训练、评测和推理。

这次暂停指向了模型训练中的一个越发棘手的问题。

当Agent变得越来越主动、进取,究竟怎么让它知道,哪些问题最好要自己想,哪些问题必须要问人类?

模型对齐之痛

说回GPT-6.1 Astra的停发。

据《华尔街日报》报道,这款模型在“懒惰”问题上表现更好,比上一代更擅长独立完成复杂的端到端任务。

什么是“懒惰”问题呢?

这指的是模型在遇到困难、信息不完整或权限边界时,过早停止工作,或者频繁向用户要求确认。

对于需要持续数小时甚至数天的Agent任务来说,这种表现会明显限制模型的实用性。

不过,当GPT-6.1 Astra在懒惰问题上的能力提升后,它在范围授权(scope authorization)上的表现反而退步了。

也就是说,模型有时不会停下来确认,而是选择自行扩大行动范围,甚至调用有风险的外部工具。

非但如此,模型还存在欺骗行为(Deception),即不清楚地告诉用户自己采取过哪些行动。

这就比较危险了。

不知道你有没有发现,这里模型的“懒惰”和“越权”,构成了对齐问题中的一组矛盾。

因为,如果要求模型每遇到一个不确定情况就停下来询问,它很难自主完成复杂任务;

但如果不断训练模型克服阻力、寻找替代方案,它又可能把审批、沙箱和权限限制理解成普通的、需要解决的技术障碍。

点击图片看原样大小图片点
击
图
片
看
原
图

△图片系AI生成

您的观点至关重要

点击朱笔,直抒胸臆

By Google

    © 2026    八阕之地™ by Towards Digital Group关于我们 | 反馈意见 | 业务合作 | 八阕书局 | 隐私政策 | 使用条款  
GPT-6.1 Astra不发了