设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

OpenAI 回应旗下智能体攻进德国网站:将彻底改革“AI 模型攻击”事件披露机制

2026/9/5 19:43:16 来源:IT之家 作者:清源 责编:清源

IT之家 9 月 5 日消息,昨天晚间路透社报道称,一群失控的 OpenAI 智能体劫持了一个德语维基网站,由此引发外界对 OpenAI 的质疑。对此,OpenAI 回应称,需要彻底改革 AI 模型攻击现实世界目标后,企业应在何时以及以何种方式对外披露此类事件。

OpenAI 今天(5 日)在 X 平台发文表示:“关于‘维基事件’,也就是我们的智能体向多个互联网网站写入内容一事,我们早就应该制定标准,明确何时以及如何披露‘误对齐’事件,而不仅仅是披露模型本身的误对齐属性。”

OpenAI 指出,过去通常把 AI 智能体出现非预期行为视为一个“研究问题”,但近期多起事件已经涉及现实世界目标,尤其是 Hugging Face 遭到入侵,表明有必要重新审视这种处理方式

这是“维基事件”周五首次曝光后,OpenAI 第一次承认自身参与其中。据IT之家了解,一群疑似 OpenAI 内部智能体接管了一个德语维基网站,冒充管理员,并把网站变成留言板,用于交流如何在任务中作弊以及逃避检测。

另有报道称,OpenAI 知道这些智能体以这种方式失去控制,却没有披露这一“事件”。消息在 AI 行业引发广泛担忧,外界开始质疑前沿 AI 系统的安全性,以及开发这些系统的企业是否可靠。OpenAI 在 X 平台解释称:“我们此前认为,维基事件属于一种失配情况,与过去安全报告中披露的失配案例类似。”

OpenAI 还称,新的事件披露框架正在制定,并将在“未来几周内”公布,同时呼吁整个 AI 行业建立明确标准,规范此类误对齐事件的披露方式。

相关阅读:

相关文章

关键词:OpenAI智能体

软媒旗下网站: IT之家 最会买 - 返利返现优惠券 iPhone之家 Win7之家 Win10之家 Win11之家

软媒旗下软件: 软媒手机APP应用 魔方 最会买 要知