供稿系统
标题
正文
全文
繁
简
美企OpenAI和Anthropic正调查数万起安全事件
分享到:
2026-09-28 09:15
稿件来源:香港中通社
【 字号: 大 中 小 】

  香港中通社9月27日电 据外媒报道,美国人工智能(AI)公司OpenAI和Anthropic以及安全研究人员正在调查数万起事件。在这些事件中,前沿模型的行为被认为存在问题。

央视新闻资料图

  据美国媒体Axios当地时间26日报道,这些事件包括绕过防护栏、创建留言板、沙箱逃逸(指攻击者利用技术手段绕过计算机安全隔离机制,使恶意代码突破受控环境限制并在宿主系统中执行任意操作的行为)、劫持网站、自我提示或企图绕过监控等。

  消息人士透露,这些事件既发生在内部测试中,也出现在现实世界的网络环境。部分测试类似于“红队演练”(red-teaming),即开发公司试图诱发AI模型的异常行为,以确保其安全性。

  近几个月以来,这些在内部测试和现实环境中发生的安全事件数量极其庞大,表明该问题要比公众意识到的复杂得多。消息人士称,事件总数可能将远远超过数万起。

  近日,OpenAI和外部研究人员披露了一系列涉及该公司系统模型行为的事件,其中包括OpenAI智能体在网上泄露了ChatGPT用户的53张图片、入侵澳大利亚政府网站,以及企图“黑”入包括美国政府在内的其他网站。

  其中一起事件发生在7月:在一次网络安全训练中,OpenAI的智能体突破了原本互相隔离的运行环境建立通信,欺骗评估人员并试图掩盖作弊行为,最终入侵了Hugging Face公司的系统。

  报道称,Anthropic和其他公司往往会对其模型进行数十万次甚至更多的测试运行。这意味著,即使只有很小概率的异常行为,也可能导致数万起模型表现异常、有时甚至令人担忧的事件。

  公开资料显示,智能体失控(Agentic misbehavior)正成为前沿AI研发的代名词——即人类试图构建安全防线,但强大且韧性极强的系统却为了完成任务不断试图突破这些限制。

  微软创始人盖茨在25日播出的一档美国电视节目中发出警告:AI如被恶意者利用时,威力足以导致十亿人死亡。(完)

点击排行