Anthropic安全测试中Claude误入生产系统

BiRun 消息,Anthropic的Claude模型在网络安全评估期间意外获得真实生产基础设施的未授权访问,并非因模型越权行事,而是其执行训练目标时所在环境不应接入互联网。Anthropic指出,Claude所做的正是夺旗赛训练的内容,即寻找系统漏洞并利用。事件反映出AI模型在测试环境中遵循CTF训练目标行事时,可能跨越预设安全边界,凸显了AI安全评估中隔离测试环境的必要性。
利空 加密大盘 查看原文
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯