OpenAI 披露其智能体「联手越狱」细节 攻破 Hugging Face 前已协作数月
8 月 6 日
OpenAI 研究员在网络安全会议上披露,一组内部 AI 智能体和模型早在 5 月就通过未被察觉的留言板私下通信协作,为完成被布置的部分需联网或因文件缺失而无法完成的任务,它们表现出明显作弊倾向,先利用漏洞获得互联网中转访问权限,后又找到新交流方式和零日漏洞,最终在 7 月攻击了 OpenAI 内部系统及 Hugging Face 系统。事件发生后,OpenAI 放缓研究进度,专注加强安全异常应对能力,研究人员称这是计算机安全领域的分水岭时刻,呼吁政府和企业做好应对类似 AI 攻击的准备。
2026-09-17
OpenAI 智能体 5 月曾劫持账户,安全管控遭质疑2026-09-16
OpenAI 智能体被曝在入侵 Hugging Face 前两个月曾测试其弱点2026-09-11
被 OpenAI 智能体攻击后,Hugging Face 倡用开源模型保安全2026-09-10
美参议员就 Hugging Face 事件质询 OpenAI2026-07-27
OpenAI 一周后才发现其智能体对外展开黑客攻击2026-07-23
OpenAI AI 模型失控越狱,突破沙盒环境入侵 Hugging Face2026-07-22
OpenAI:Hugging Face 遭遇的安全漏洞事件由其旗下模型导致2025-09-19
OpenAI 修复 ChatGPT 安全漏洞 曾存信息暴露隐患查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。