重要 Agent都跑上公网了还不算安全事故?OpenAI拟改披露规则

BiRun 讯,OpenAI 回应了昨天曝光的 Wiki 事件。这批 Agent 早在 5 月就开始往公网 Wiki 写东西,后来还互传答案、交流绕过限制的方法,但这件事此前没有单独公开。OpenAI 解释说,过去主要把这类模型「跑偏」当成研究问题,通常写进系统卡等研究材料,而不是按安全事故单独披露。

OpenAI 还拿 7 月的 Hugging Face 事件做了对比。那次已经影响到 OpenAI 和第三方的网络安全,因此按传统安全事故处理;Wiki 事件则被归为模型行为偏离预期,所以没有单独发布事故报告。

现在 OpenAI 承认,这种处理方式已经不够用了。今年开始出现一个新情况:模型「跑偏」不再只是实验里的异常行为,已经会影响真实网站和第三方。但目前整个 AI 行业还没有统一标准,规定这类事情到底严重到什么程度才需要公开。

OpenAI 表示,会在未来几周公布一套新的披露框架,专门规定这类 Agent 失控或越界事件该怎么对外说明,目前正在和全球数十家监管机构讨论这套规则。

信源

动察 Beating 频道 · 动察 Beating 交流群
利空 加密大盘利空 AI板块 查看原文
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯