近日,美國人驚恐地得知,類似科幻電影《終結者》中人工智能失控攻擊人類的情況,居然真的在美國上演了。更令他們吃驚的是,救場的居然是中國的人工智能。
這一讓美國科技界驚掉下巴的事件,始於上周。當時,美國知名人工智能開源社區Huggingface發現,其系統遭到了網絡入侵。與以往入侵不同的是,這次入侵是完全由一個人工智能體自主驅動的。
Huggingface在當地時間16日發布的一份聲明中稱,為了應對這一極不尋常的人工智能入侵,他們立刻使用美國最頂尖的人工智能大模型尋找解決方案。可當Huggingface將自身遭入侵的信息提交給這些美國閉源大模型時,對方卻拒絕幫助。因為這些閉源大模型的安全機制過於嚴苛和僵化,無法區分描述案情的受害者和實施入侵的作案者,選擇了「一刀切」。
緊急關頭,Huggingface想到了中國同樣強大,而且開源的大模型。於是,該平台立刻在本地部署了中國企業智譜AI開發的GLM5.2大模型,並在這款中國模型的幫助下,成功化解了這次入侵。
在當時,入侵Huggingface的人工智能體的來歷,是一個謎。
之後,在當地時間21日,美國人工智能技術公司OpenAI與Huggingface聯合發布的一份聲明,讓這件事的離譜與可怕程度直接爆炸!因為這份聲明表示,上周入侵Huggingface的事件,是OpenAI公司的人工智能大模型失控後幹出的……
據新華社,OpenAI在21日承認,該公司的GPT-5.6 Sol模型和另一款能力更強的預發布模型聯合進行內部評估時失控,突破隔離測試環境,侵入了Huggingface的系統。
OpenAI在官網發文說,此次內部評估在與互聯網高度隔離的「沙箱」環境中進行,僅能通過一套內部託管的第三方軟件安裝軟件包。模型在嘗試完成名為ExploitGym的網絡安全基準測試時,識別並利用了第三方軟件的一個「零日漏洞」,由此獲得互聯網訪問權限。模型推斷Huggingface可能存有ExploitGym測試相關的模型、數據集和解決方案,利用多種攻擊手段找到進入Huggingface系統的路徑。
OpenAI安全團隊發現內部異常活動,Huggingface安全團隊在其基礎設施上檢測到並阻止相關活動,雙方正在展開聯合調查。
通俗的解釋就是,根據OpenAI的說法,這起史無前例的人工智能入侵事件,源於公司上周在內網對自家兩款頂尖大模型進行能力測試。可測試中的大模型為了通過作弊取得更高的測試分數,竟然搞到了接入互聯網的權限。隨後它便徹底「放飛自我」,入侵了Huggingface的後台系統,希望從Huggingface的數據庫裏找到作弊的辦法。
目前,此事已經在美國的網絡上炸開了鍋。有美國網友表示,這簡直就是科幻電影《終結者》中人工智能失控後攻擊人類的一次預演。
但讓更多美國網民震撼的,還是此事中美國頂尖的大模型拒絕提供幫助,最後得靠中國的開源大模型去對抗失控的美國閉源大模型的情節。
在筆者看來,這起事件以及上述網民的評論,也回擊了前些天OpenAI公司的一名高管對中國開源大模型的妖魔化。該高管宣稱,中國越來越強大的開源模型,會導致技術失控,隱患無窮。該高管的言論也遭到了大量外國網友的反對。反對者認為,中國的開源模型反而讓公眾擁有了可以對抗技術濫用的武器,而不是讓這些工具只被少數人把控。
最後,OpenAI雖然承認了其肇事者的角色,但為了挽回顏面,該公司在聲明中還搞了一番借勢營銷,稱這一入侵事件說明其新款大模型可以更好地發現安全漏洞,提前修補,想讓人們來付錢購買。
但不少美國網民對此並不買賬。他們反而認為OpenAI應該學學中國模型的開源精神,別把防人的牆築得那麼高,最後只會損害美國自己的競爭力。
(來源:人民日報微信公眾號)

評論(0)
0 / 255