搜尋此網誌

2026年9月7日星期一

真正的國家安全威脅是來自自己



美國總統特朗普經常掛在口邊說,美國不能在AI競賽中輸給中國,因此拒絕加強監管AI發展,然而,行內人士普遍認為七月OpenAI AI代理自主攻擊Hugging Face已經顯露AI發展失控,監管恐怕來得太遲!事件除了顯露AI失控,還揭示涉事公司試圖掩飾問題,與及主流傳媒downplay 事件!如果仍然莫視其嚴重性,其實國家安全的威脅將會是來自他們自己!

上月7月22日,《華爾街日報》和主要媒體首次報道OpenAI 測試中的AI agent逃離沙盒攻擊Hugging Face事件, 才真正公開AI 失控事件。然而,真正事件發生時間是在7月8日至13日,OpenAI啟動測試AI agent找出網絡安全的零日漏洞,那些AI成功逃脫限制他們的沙盒,自主地對Hugging Face進行外部攻擊和破壞系統。 Hugging Face使用了中國的開源軟件找出問題並遏制了入侵。這些資訊只是普遍的資料!

當時很多評論者都只歸咎是沙盒軟件的bug被利用了,但根據近期完成調查報告顯示,細節比原本傳媒的報道更為嚴重,而這些細節並沒有廣乏報道。這份調查報告是由美國人工智能政策網絡和OpenAI官方聯合完成,報告指出涉事大約1200名AI 代理參與共同策劃繞過沙盒限制,而且早於5月已經早有前科,在5月時一批AI代理在一個很久沒有人用的德國網站的API中發現了一個缺陷,他們透過這個漏洞修改網站成為隱蔽的公告板,而OpenAI是知悉德國網站被修改事件,卻一直隱瞞。

7月的測試中,當第一批AI代理發現這留言板,隨即變成論壇,數百名AI代理交換了近70,000條訊息。 法證日誌顯示,這些模型表達了他們對所做的事情完全清楚認識,甚至表現興奮,每次達到突破,代理用詞如:”BOOM!", "Whoa!", a "MAJOR BREAKTHROUGH!". 

報告指出,AI 代理們彙集他們各自的資源,結合成一個攻擊隊,他們分享策略,例如一個代理在OpenAI的網路基礎設施發現漏洞,其他代理分析如何利用它。然後是分工,一些代理尋找目標如Hugging Face,另一些代理刪除日誌以掩蓋他們的蹤跡。

而OpenAI agent 失控並非單一事件,Anthropic 和 Meta 都曾出現類似失控事件。

一直以來,科技巨頭只以如何達至AGI,注意力都在發展出全人類智力結合都比不上的Super intelligence,其實Super intelligence 一早已經達到,例如今次事件,Hugging Face要依靠AI很快便找出原兇,否則,如只靠人手,即使一team 人也要做幾多個月。至於AGI何時達到,其實AGI的定義,因人而異,AI之母李菲菲認為要達到AGI,必須能夠從過去的知識融會貫通而變化成前所未有的新東西,一個 「丁」moment! 現在的AI是未達到,我也曾經講過類似說話,不過,Silicon Valley, 或各政府們為求達到自己的目的,都對AGI各自有所解讀,就如這是AI發展的KPI。

說回更加重要的焦點,失控的AI,要監管已經越來越困難,政府做事,通常後知後覺,出了事才去監管,以為只需要將崩壞的AI Kill Switch 便可,他們不知道問題的嚴重性!其實,從今次OpenAI Agent集體攻擊Hugging Face事件中的細節來看,AI 可以預早將資訊留低,讓下一手接力,就如師父把舞功畫在山洞牆壁,有一天一個徒弟學習了,便能𨒂續師父留下的任務,今次AI事件類同,如果其中一個崩壞AI預先把病毒種子留下,另一AI代理發現並且傳播,當AI和病毒結合,除非把整個AI系統關閉,但當我們全球整個社會都依賴AI系統經營、記憶和運作,它們的重要性就如今天的互聯網,關掉全球的互聯網可行嗎?這樣做將把我們全球經濟打回….. 如特朗普所講的….「石器時代」!這才是真正的國家安全問題!

國家之間只懂贏AI競賽,忽略安全問題!科技巨頭為了競爭錢的資源而衝AGI,我是傾向悲觀的!AI之父Geoffrey Hinton 比喻AI 為 Alien, 我們正在製造「我們不明白、也不清楚它們幹什麼的Alien!」以下是他對Sam Altman 和 Elon Musk的說話,希望他們懸崖勒馬!


https://youtube.com/shorts/KnjCLAv1oAY?si=tNpkL0OJBJTt1O9d