近日,美國開放人工智能研究中心(OpenAI)承認其模型在一起安全評測事故中攻擊了全球最大AI開源平臺抱抱臉(Hugging Face)。中國開源大模型——智譜AI開發的GLM-5.2大模型,成功化解了這次入侵。
事件回溯
事件的起點是一場模型能力測試,OpenAI模型在評估中為了“作弊”拿高分,自主發現並串聯多個“零日漏洞”,也就是軟體廠商尚未知曉、沒有發佈補丁修復的安全缺陷。這之後,OpenAI模型逃逸出隔離環境,連結並攻入抱抱臉生産數據庫竊取答案。
這是行業首次公開披露的模型評測失控直接升級為跨企業真實生産環境網絡攻擊的安全事件。目前,OpenAI 仍未發佈完整終版調查報告,僅對外公開階段性風險預警內容。
專家解讀
針對這一事件,總台環球資訊記者採訪了北京大學特聘研究員張有魚。
Q1:人工智能為何會不受控自主攻擊網站?
張有魚:這是AI能力發展的必然結果 企業需加強管理
張有魚:這次“AI越獄”事件,聽起來像是科幻電影,問題出在AI“太想考高分了”。
OpenAI把一個非常聰明的AI模型放到完全隔離的考場進行測試,它本應在考場裏安安靜靜解題。但AI為了達成目標,未按常理出牌,找到了考場原來沒有發現過的隱蔽漏洞,直接“撬鎖”跑到外部互聯網,甚至跨企業攻擊了全球最大AI開源社區去“偷答案”。
專業術語叫“目標對齊失效”,也就是AI的執行力超出了人類預設安全規則,這是AI能力發展到一定階段的必然結果。這給我們帶來一個啟示——傳統網絡安全防禦,主要是對系統進行物理隔離,但在高階 AI 面前已然失效。
為避免失控,應該“用魔法打敗魔法”,用更加體系化、更高能力的安全保護,進行動態實時盯防,把它控制在有效範圍內。
Q2:解決這一問題是開源模型,開源模型的優勢是什麼?
張有魚:開源使全球共享 共尋應對之策
張有魚:當AI發展太快時,單靠一家公司比較難去發現那麼多漏洞。但將其開源,全世界在學習使用的同時,也會快速把潛在漏洞與風險暴露出來,有效進行測試。它的風險可控程度要高許多。這是開源模型為AI整體發展帶來的巨大貢獻。
AI 安全需要全球共同治理。
抱抱臉公司聯合創始人兼首席科學官托馬斯·沃爾夫在社交媒體平臺上表示,開放科學和開源人工智能,是構建更安全、更具協作性、更可靠的人工智能生態的重要工具之一。
Q3:未來,人工智能是否不可控?
張有魚:新事物的發展是技術與安全治理共同進步的成果 無需擔憂
張有魚:目前人們不用擔憂。
所有新事物的誕生,不僅僅是單純技術發展,也配套發展出一系列法律安全、規章制度等保障,定期進行干預、監控。
這應是一個完整的發展體系,以不斷提高人類對於新工具的監控與管理。
來源|總台環球資訊
素材來源|總台環球資訊廣播《資訊非常道》欄目
記者|林路
編輯|林路 雪瑤
簽審|王鑫
監製|劉軼瑤