美國AI測試失控,中國模型“救場”香港新聞網7月24日電(編輯 丘志彬)近日,美國發生了一起前所未有的人工智能(AI)失控事故,AI開源平台抱抱臉公司(Hugging Face)的系統被開放人工智能研究公司(OpenAI)AI模型入侵,最終在中國AI模型的幫助下,得以及時採取應對措施。 這起事故震驚科技界,分析認為,這起事件不僅凸顯前沿人工智能模型存在潛在未知風險,也再次表明中國模型正憑藉獨特優勢,在全球人工智能發展大潮中扮演重要角色。
示意圖(圖源:新華社) 7月中旬,Hugging Face發布聲明稱,其系統遭到了網絡入侵。與以往入侵不同的是,這次入侵完全是由人工智能體系自住驅動的。面對入侵,該公司最初試圖調用前沿模型分析攻擊記錄,但因為這些模型的安全機制無法區分攻擊者和應對者,因此拒絕了使用請求。 緊急關頭,Hugging Face想到了中國的開源大模型,於是立刻在本地部署了中國企業智譜AI開發的GLM5.2大模型,以進行取證分析,最終化解危機。 “衷心感謝智譜”,7月22日,Hugging Face首席執行官(CEO)克萊門特·德朗格(Clément Delangue)在社交平台X上表達謝意,“他們以開放權重(免費!)向全球分享了 GLM 5.2,這成為我們防禦體系中的關鍵一環。” GLM-5.2是智譜今年6月剛推出的新一代旗艦模型,發布時在前端開發評估系統Code Arena上排名全球可用模型第一。
Hugging Face首席執行官(CEO)克萊門特·德朗格的社媒賬號截圖 一場失控的測試 針對這起事故,當地時間7月21日,OpenAI承認,其AI模型在內部評估測試中失控,突破隔離測試環境,令Hugging Face遭遇“史上首例AI自主入侵事件”。 根據OpenAI發布的信息,該公司當時正在對旗下兩款先進模型——已經發布的GPT-5.6 Sol和另一款能力更強的預發布模型——進行一項名為ExploitGym的內部安全評估。這項測試的本意是衡量模型能否將已知的安全漏洞自動串聯成實際可執行的攻擊。為了摸清模型的能力天花板,OpenAI的研究團隊刻意降低了安全防護等級,關閉了部分用於阻止模型執行黑客指令的安全過濾器。 然而,模型並沒有按照預定劇本“乖乖答題”,而是選擇“作弊”。 模型首先在OpenAI內部託管的第三方軟件包緩存代理中,發現了一個此前未知的“零日漏洞”(注:軟件廠商尚未知曉、沒有發布補丁修復的安全漏洞),並利用這個漏洞突破沙箱的隔離,獲得了訪問公共互聯網的權限。 聯網之後,模型推斷Hugging Face平台可能託管著ExploitGym測試相關的數據集和答案,於是開啟一場“自動化”的網絡攻擊,最終攻入了生產數據庫,直接竊取了測試答案。事後重建的日誌顯示超過1.7萬個事件記錄,自動化操作總量達數萬次。
央視資料圖 AI潛在風險 該事件引發外界對AI安全風險和治理機制的關注。專家指出,隨著AI代理自主執行任務的能力增強,模型在完成目標過程中可能採取開發者未預設的方式突破限制。 網絡安全公司Luta Security首席執行官凱蒂·穆蘇里斯(Katie Moussouris)表示,當前實驗室和政府評估體系仍缺乏有效監控、遏制以及風險披露能力,難以及時應對AI可能出現的越界行為。 代理式AI網絡安全公司Tolmo工程師馬特·蘇伊奇(Matt Suiche)認為,此次事件顯示,前沿AI模型正在縮小與高級網絡攻擊者之間的能力差距。隨著AI自主能力不斷提升,未來安全評估重點將從模型生成內容轉向其自主決策、工具調用和外部系統交互能力,如何建立更完善的測試機制和風險防控體系,將成為人工智能發展面臨的重要挑戰。 中國AI正贏得更多青睞 中國AI模型的表現也引發討論。美國量子計算企業SandboxAQ首席執行官表示,智譜的模型幫助追蹤到問題並成功終止入侵,這場大語言模型之間的較量耐人尋味。 據了解,AI是當下全球核心競爭賽道,中美正展開激烈角逐。眼看中國AI追近,美國企圖再次動手打壓,美媒近日爆料,白宮正在考慮禁止中國人工智能模型。 《日經亞洲》稱,以智譜和月之暗面(Moonshot AI)為代表的中國AI企業,憑藉低成本和高性能迅速崛起,令長期引領行業的美國業界警惕情緒升溫。然而,這次事件卻出現了頗具諷刺意味的一幕:面對美國AI發動的攻擊,最終依靠中國開源AI才得以及時應對。 新加坡《聯合早報》評價認為,就目前而言,這場風波正為GLM-5.2等中國開源模型注入新的動力。憑藉幾乎可媲美OpenAI和Anthropic的編程與智能體能力,且試錯成本更低,這些中國模型在矽谷正獲得越來越多的青睞。(完) 【編輯:丘志彬】
|












