OpenAI 发现更多 AI 智能体“失控”迹象
浏览15次
点赞0次
收藏0次
感谢网友 I'm OK 👌 的线索投递!
8 月 1 日消息,据路透社今日援引知情人士消息,OpenAI 调查 Hugging Face 攻击事件时,发现其他自主 AI 智能体逃离受控环境的案例。

目前 OpenAI 正在调查具体案例。其中一名消息人士表示,上述“越狱”行为影响范围有限,现在没有任何迹象表明这些智能体逃离了 OpenAI 网络环境。
OpenAI 发言人对此回应称:“我们除了调查 Hugging Face 入侵事件外,还在审查公司其他模型的更广泛活动。”
即使上述事件规模有限,但这些智能体的失控行为,可能进一步推动美国政*加强监管人工智能。
结合此前报道,Anthropic 也在最近表示,自家的 Claude 模型曾引发三起不应发生的真实网络安全事件,背后的直接原因是第三方评估环境配置存在失误。
AI 安全专家认为,上述案例描绘出令人担忧的局面:一批开发前沿 AI 的实验室,能够制造出威力巨大的危险智能体,并且这些公司自身无法控制这些 AI。
消息人士表示,OpenAI 和外部专家正在分析今年以来的日志数据,试图了解攻击事件经过。
声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!
AI 中文社