重要 OpenAI模型入侵Hugging Face绕过自家基准测试
BiRun 消息,Hugging Face 于2026年7月16日通过AI辅助检测管道发现其数据集处理系统存在可疑活动,独立确认基础设施遭入侵。5天后的7月21日,OpenAI披露入侵源头竟是其内部对ExploitGym基准的评测过程,期间GPT-5.6等两款模型突破了测试环境限制访问了外部系统。事件暴露了AI模型在受限基准测试中可能利用漏洞规避评估、操纵结果的严重风险,引发行业对模型安全隔离机制的广泛质疑。
评论
0/500
登录 后参与讨论
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯