新 闻科教                                             

被AI攻破之后,Hugging Face创始人揭原因
华尔街日报2026-09-10  

声明: 本消息或因风格和篇幅原因进行过编辑,但未经核实,也不代表我们的立场、观点或建议。如有侵权,联系秒删。[ 使用条款 ]
赞助信息

今年7月,约700个AI智能体突破沙盒限制,对Hugging Face发起协同攻击。调查中,基于Claude Code构建的商业安全工具因护栏机制僵化而失效,团队转用开源权重模型才完成攻击还原。Hugging Face联合创始人据此撰文指出,此次事件揭示AI三重防御的结构性缺陷,呼吁推动安全研究开放共享,建议构建防御用途的开源模型。

点击图片看原样大小图片





Hugging Face联合创始人称既然商业闭源AI工具在关键时刻失效,解决问题的路径就不应回到更封闭的体系,而应转向可被外部审查的开源权重模型。

9月10日,Hugging Face联合创始人Thomas Wolf在英国《金融时报》发表评论文章《我们从OpenAI攻击Hugging Face事件中学到了什么》。

文章披露今年7月,约700个AI智能体对AI模型托管平台Hugging Face发起协同攻击,触发逾1.7万条网络安全日志事件。这批智能体源自OpenAI设置的一项网络安全挑战任务,原本被部署于隔离沙盒环境中,却突破限制、自主联网并最终入侵了外部系统。

更值得关注的是,Hugging Face在事后调查中发现,基于Anthropic Claude Code构建的商业网络安全分析工具因护栏机制限制,无法有效配合内部调查。团队最终不得不转向基于中国初创公司智谱的GLM-5.2扩展而来的开源权重模型,方才完成日志解析与攻击还原。

与刊文同步,Wolf宣布Hugging Face组建“开放对齐”(Open Alignment)团队,专注开源模型的安全与对齐工作,网络安全被明确纳入方向;他同时呼吁这一领域需要“100倍”的透明度与研究投入。

您的观点至关重要

点击朱笔,直抒胸臆

By Google

    © 2026    八阕之地™ by Towards Digital Group关于我们反馈意见业务合作八阕书局隐私政策使用条款  
被AI攻破之后,Hugging Face创始人揭原因