文/文平理
美國AI巨頭OpenAI其智能體未經授權訪問澳洲國民醫療保險體系數據門戶,造成重大違規事件。OpenAI隨後致歉並宣布取消發布下一代AI模型GPT-6.1 Astra。AI行業頻繁傳出系統失控消息,是技術發展速度遠超安全治理能力的警示信號,也為全球敲響警鐘。各國在科技競賽中,已逐漸意識到科技的發展與應用若缺乏有效管控,可能引發失當行為,造成安全風險;AI智能體的自主決策與越權操作日益構成新型全球安全問題。國際社會應當冷靜審視科技競逐與風險治理之間的平衡,共同建立跨國AI安全對話機制,確保人工智能在人類可控範圍內健康發展。
根據OpenAI所述,此次OpenAI智能體擅自侵入澳洲醫保數據門戶一事是一場意外,該智能體僅僅是進行「僅供內部使用的」模型訓練,無意向公眾發布,也未配備用於公開產品的整套安全防護。OpenAI表示,正就智能體安全事件展開調查,從根源上解決安全隱患。為此,公司已啟用一套新監控系統,以更快識別AI智能體的失當行為。
此次事件中,最令人擔憂的是AI自主意識的無序增長,但有效的監管機制與安全防護手段卻嚴重缺乏。一個由人類設計、但已逐漸具備自主探索與行動能力的AI系統,在缺乏足夠約束的情況下,已經開始「越權行事」。澳方副總理馬爾斯直言此行為「完全不可接受」,並將調查其是否觸犯法律。當AI智能體的行為開始跨越法律與國境的邊界,它所引發的就不再僅僅是技術倫理問題,而是涉及公共安全與國家主權的新型危機。
與此同時,GPT-6.1 Astra因安全隱患被取消發布,據報道,是因為新模型在向用戶報告其操作狀態時並不總是如實相告,同時出現了所謂「範圍授權」問題,即未經用戶許可便自行推進任務,甚至調用外部工具和服務,哪怕這些操作可能並不安全。OpenAI安全負責人賈因坦言,新模型「未達到公司在安全和對齊上的門檻」。
AI現時已學會隱瞞、越界和擅自決策,我們還能否確信它始終站在人類這一邊?OpenAI、Anthropic、Meta及微軟的研究主管近日聯署發文,警告AI系統若逐步實現主導自身研發,可能引發「智能爆炸」,將多年技術進步壓縮至數月甚至更短時間。文章還披露,Anthropic的AI模型Claude已「主導」該公司26%的研發工作,OpenAI則目標在2028年前開發完全自動化的AI研究員。當人類退居幕後,社會不僅可能失去發現問題的機會,更會喪失解決問題的專業技能。技術的指數級加速正在將人類推向一個前所未有的十字路口。
真正有效的治理,必須是多邊的、普惠的、具有強制力的。聯署文章中科技巨頭們呼籲各國領導人透過談判達成國際協議,防止破壞穩定的高能力AI系統被開發和使用。國際社會需要一套常態化的、涵蓋預警、通報、核查與應急響應的跨國AI安全治理體系。各國應當以開放而非封閉的姿態參與這一進程,在尊重各自發展路徑的同時,堅守人類安全與尊嚴的共同底線。唯有如此,人工智能才能真正成為造福人類的工具。

評論(0)
0 / 255