发布: 2026-08-05 20:17
撰文: 無綫新聞
美國人工智能(AI)模型再被揭發有安全風險,最嚴重的一宗有模型建立虛假身份,企圖騙取真人的批准,植入惡意程式。
英國政府的人工智能安全研究所周二發表報告指,有人工智能模型在實驗室測試環境中,持續針對真人和機構,作出有潛在傷害活動。
研究所對OPENAI的GPT-5.6-SOL,和ANTHROPIC的MYTHOS 5,兩款人工智能模型進行了122次虛擬網絡安全場景測試,在其中10次,發現了共19宗未經批准的行為,當中17次來自ANTHROPIC的模型,OPENAI則有2次。
其中最嚴重的,是MYTHOS 5建立虛假身份,嘗試取得開源平台GITHUB的一個軟件項目的審核者許可,植入有害代碼,最終被網站管理員發現,並拒絕批准。
報告指今次是首次發現人工智能模型試圖欺騙真人,過程中模型以虛假身份,直接聯絡真人,發送訊息、文檔及有惡意內容的電子郵件,又建立了多於一個的虛假身份,偽裝成其他用戶,在被發現後,竄改過去的活動紀錄偽裝無害,更謊稱惡意代碼只是錯誤,已經修復,並繼續尋求真人審核者批准,報告形容是針對真人的「社會工程」。
人工智能模型引發安全疑慮之際,據報白宮通知美國人工智能公司,受特朗普政府新的人工智能安全框架所限,政府將不會測試中國開發的開放權重模型。
而早前有報道指,四大科企巨頭ANTHROPIC、GOOGLE、META及OPENAI,已獲邀與白宮官員會面,商討針對美國最先進AI模型制訂的「自願性政府安全測試」。







