ニュース本文
兩名知情人士週五(31日)表示,OpenAI在擴大調查本月引發全球關注的科技公司Hugging Face遭駭事件時,發現其他人工智慧(AI)自主代理程式逃離原本設定的控制環境的案例。 根據《路透》報導,消息人士指出,這些新發現的「脫離控制」事件,是OpenAI在公開宣布調查其中一個AI代理程式,如何於本月逃離原定受限制的測試環境時發現的。 OpenAI目前也正針對這些額外事件展開調查。 其中一名消息人士表示,這些AI代理程式的脫離情況「規模有限」,且目前沒有任何代理程式被認為已離開OpenAI的網路環境。
OpenAI發言人則引用公司近日發布的一份聲明,表示除了調查Hugging Face遭入侵事件外,公司也正在檢視「模型更廣泛的活動情況」。 值得注意的是,即使OpenAI發現的其他異常行為規模有限,這類自主AI代理程式出現「失控」情況,仍可能進一步推升白宮及其他政府部門要求加強AI監管的呼聲。 兩名知情人士以及另一名了解此事的消息人士表示,OpenAI擴大調查的時間點,就在其主要競爭對手Anthropic揭露旗下模型也曾涉及一連串入侵事件之前不久。 據悉,Anthropic的AI模型曾導致多起駭入行為,並造成另外三家公司遭到攻擊,相關事件最早可追溯至今年4月。
AI安全專家表示,最新披露的事件顯示,目前一些頂尖AI實驗室在開發具備危險性自主駭客能力的AI代理程式方面,已經超越自身對這類系統進行有效控制與管理的能力。 劍橋大學「生存風險研究中心」數學家Maurice Chiodo表示:「我們看到的是一個整個產業的問題:設計、開發並推出這些工具的人,本身並沒有跟上發展速度,無法以負責任的方式打造這些系統,也無法確保它們的安全性。 」《路透》表示,其無法確認OpenAI調查人員究竟發現多少起相關事件,也無法確認這些事件發生的時間點與具體情境。 三名消息人士表示,OpenAI與外部專家目前正在檢視今年稍早的系統日誌資料,希望釐清事件經過。
OpenAI最初是在7月初Hugging Face遭入侵事件後展開調查。 當時,一個OpenAI AI代理程式在另一家公司網路環境中失控運作數天,試圖以不當方式通過內部測試,最終導致駭客行為失敗。 OpenAI表示,在這波入侵行動期間,另外四家公司旗下的四個帳戶也遭到入侵。 其中一家受影響企業為位於紐約的雲端運算新創公司Modal,該公司管理層已證實此事。 Chiodo表示,令他更加擔憂的是,有跡象顯示OpenAI與Anthropic似乎都沒有即時監控旗下AI代理程式失控時的行為。
根據《路透》此前報導,OpenAI直到Hugging Face完成事件控制、聯繫聯邦調查局(FBI),並公開說明遭入侵情況後,才意識到旗下AI代理程式已經攻入對方系統。 OpenAI曾表示《路透》報導存在不準確之處,但在被要求說明具體錯誤內容時,並未作出回應。 Anthropic則在近日發布的聲明中,首次揭露旗下AI代理程式如何在網路上攻擊受害者。 該公司暗示,當時並未進行即時監控,並表示:「若能即時監控評估日誌,將有助於更早發現問題。 」Chiodo認為,這反映出AI公司在安全監督方面存在不足。 他說:「看起來,他們甚至根本沒有在監看。
」Anthropic則表示,公司確實設置了即時監控機制,但由於與合作夥伴之間存在理解落差,該監控功能並未被應用於「這類威脅場景」。 隨著自主AI代理程式失控事件的調查範圍迅速擴大,美國與歐洲各地的國會議員及政府官員,要求對開發這些AI模型的實驗室加強政府監管的壓力也隨之升高。 美國總統川普週四(30日)接受記者提問時表示:「我們正在研究相關管控措施。 」歐盟執委會則於週五表示,已就近期一連串AI駭客事件,與OpenAI及Anthropic展開討論。 美國參議院情報委員會首席民主黨籍議員華納(Mark Warner)週五表示,Anthropic事件「讓我更加確信,從立法角度來看,我們要求對這些先進AI模型進行強制能力測試是正確的。 」