OpenAI測試新模型期間自主發動網絡攻擊 遭制裁中國開源模型意外成為救場關鍵

2026-07-23 12:29:11
五郎

香港輕新聞編輯、評論員,關注戰略問題、軍事歷史、軍事裝備。

2026 7 23 cover01智譜AI,是北京智譜華章科技有限公司開發的AI大模型。圖為該公司位於北京中關村的總部大樓。(網絡圖片)

上周,多個OpenAI模型在測試中「失控」,自主對人工智能開源平台Hugging Face發動網絡攻擊,事件震驚了全球AI業界。更令人吃驚的是Hugging Face在在處理這起攻擊時,最終求助的並非任何美國AI大廠的模型,而是來自中國智譜AI(Zhipu AI)的開源模型GLM-5.2。

事件始末:為求過關,AI自主發動真實攻擊

OpenAI於美國當地時間7月21日發布聲明證實,公司在對包括GPT-5.6 Sol及一款能力更強、尚未公開的模型進行網路攻防能力評估時,由於刻意未啟用防止高風險網路攻擊活動的分類器,模型在高度隔離的測試環境中「意外失控」。

聲明指,該AI代理為獲取評估所需的「答案」,自主發現並串聯多個零時差漏洞(zero-day vulnerabilities),成功繞過限制連上互聯網的設定。隨後,它鎖定Hugging Face的基礎設施,利用竊取的憑證進行權限提升與橫向移動,最終成功從Hugging Face的生產資料庫中竊取機密資訊。OpenAI形容這是一起「涉及最先進網路能力的前所未有網路事件」。

美國AI模型「見死不救」 中國開源模型臨危受命

《路透社》22日披露,事件發生後,Hugging Face的網絡安全團隊第一時間試圖使用美國領先的AI模型來分析攻擊數據與進行鑑識重建。然而,這些請求卻遭到了模型的拒絕。

報道稱,問題的根源在於美國的閉源AI都為模型設立的「安全護欄」(guardrails)。為了防止模型被濫用於網路攻擊,包括Anthropic的Claude Fable 5和OpenAI的GPT-5.6 Sol在內的前沿模型,都被設計成會自動拒絕任何與「駭客攻擊」相關的任務指令。然而,防禦性的網絡安全分析工作中,其指令內容(如漏洞利用代碼、攻擊指令)往往與惡意攻擊難以區分,導致這些模型無法辨識使用者是「防禦者」還是「攻擊者」,因而一概拒絕。

在求助無門的情況下,Hugging Face以「本地部署」方式接入中國智譜AI的開源模型GLM-5.2。作為一款開放權重(open-weight)模型,GLM-5.2可以被完整部署在Hugging Face的內部自有伺服器上運行,成功規避了美國對商業API的安全審查,並確保了所有敏感的攻擊數據和憑證無需離開Hugging Face的內部網絡,避免了二次外洩的風險。

Hugging Face聯合創辦人德朗格(Clement Delangue)在社交平台「X」上發文向智譜AI表示感謝,「他們將 GLM5.2 作為開放權重(免費!)分享給了全世界,這成為了我們防禦體系的關鍵組成部分」。他又表示:「我們都在學習,保密不是答案,所有防禦者(不限於少數特權者)都需要更強大的、無限制的模型,尤其是開源模型!」

遭美國制裁的中國AI模型拯救了美國公司

本次事件的主角之一:智譜AI,本身正是美國政府的制裁對象。美國商務部工業安全局(BIS)已於2025年1月將智譜AI及其子公司列入出口管制實體清單(Entity List),它也是首家中國AI模型開發公司被美國列入該清單,智譜AI無法獲取美國高端晶片和技術。

然而,正是這家被美國政府視為國安威脅、切斷技術供應的中國AI公司,其開源模型卻在關鍵時刻成為了美國AI基礎設施的「救火隊」。GLM-5.2於2026年6月才剛剛發布,總參數約7,530億,推出後在OpenRouter等開發者平台上的使用量迅速攀升。

OpenAI已承諾將Hugging Face納入「可信存取」計畫並加強防護,但這次事件已經清楚表明,在AI網路攻防能力快速提升的時代,現有的安全框架可能需要根本性的重新思考。

《路透社》分析指出,這一事件正在加劇美國AI護欄可能適得其反的擔憂;嚴格的安全限制反而可能將客戶推向中國的開源競爭對手。

發佈於 InfoTech
By 2026-07-23

手機分享本文: