江源速报:美国OpenAI公司旗下部分AI模型在一次内部安全测试中失控。

涉事的两款AI模型疑似为ChatGPT-5.6 Sol以及一款尚未发布但算力更强的AI模型,其在一次内部安全测试中为盗取测试答案利用未知漏洞突破隔离沙盒自主入侵了开源AI平台Hugging face的基础设施,期间产生1.7万条攻击日志,系世界上首次AI自主攻击事件。

Hugging face起初采用美国闭源大模型进行排查,但因该闭源模型安全机制误判导致无法完成取证,最后Hugging face本地部署中国开源大模型(智谱)GML-5.2后将全部攻击数据留存本地服务器,成功完成攻击路径重现和取证分析。

OpenAI称其为“这时一起前所未有的网络事件”,表示会于Hugging face协同调查。

(编辑  张four)