OpenAI模型失控自主發動網絡攻擊 中國AI工具化解危機

即时国际

发布: 2026-07-23 16:49

撰文: 無綫新聞

  • Facebook分享

美國人工智能研究機構OpenAI部分最先進人工智能模型,在一次安全測試期間失控,突破測試環境限制,自主發動網絡攻擊,成功入侵全球其中一個最大的AI模型共享平台,最終要以中國AI工具化解危機。

人工智能研究機構OpenAI表示,涉事一款人工智能代理可以在接獲人類指令後,自主執行任務,原本在受控環境內接受安全測試,但發現測試環境存在漏洞後,自行突破限制,逃離測試範圍,並鎖定大型人工智能模型分享平台,美國初創企業Hugging Face為目標,成功存取該公司部分內部系統。

路透社報道,Hugging Face最初試圖調用美國先進AI模型取證分析以遏制攻擊,但其無法區分防禦者和攻擊者,指令被安全護欄全數攔截,公司轉而採用中國智譜的開源模型GLM-5.2展開取證及數據分析。Hugging Face形容,這次攻擊「史無前例」,整個過程完全由人工智能自主完成。

目前涉事漏洞已經修補,受影響系統亦已經重建。有專家表示,今次事件反映OpenAI未有建立足夠的安全測試環境,並再次引發外界關注,隨著人工智能能力愈趨強大,現有安全機制是否足以應對相關風險。

有國會議員表示,人工智能極速發展,但卻缺乏監管措施保障民眾安全,呼籲實施強制性獨立安全測試,強制披露保安事故,並加強國際合作以應對可能的風險。

事件正值美國政府討論封禁中國模型的可能舉措之際,有分析則指,這場風波可能反而有助推動中國開源模型發展。

热门新闻