​

美國OpenAI和Anthropic公司 正調查數萬起安全事件

 【香港中通社9月27日電】據外媒報道,美國人工智能(AI)公司OpenAI和Anthropic以及安全研究人員正在調查數萬起事件。在這些事件中,前沿模型的行為被認為存在問題。

 據美國媒體Axios當地時間26日報道,這些事件包括繞過防護欄、創建留言板、沙箱逃逸(指攻擊者利用技術手段繞過計算機安全隔離機制,使惡意代碼突破受控環境限制並在宿主系統中執行任意操作的行為)、劫持網站、自我提示或企圖繞過監控等。

 消息人士透露,這些事件既發生在內部測試中,也出現在現實世界的網絡環境。部份測試類似於「紅隊演練」(red-teaming),即開發公司試圖誘發AI模型的異常行為,以確保其安全性。

 近幾個月以來,這些在內部測試和現實環境中發生的安全事件數量極其龐大,表明該問題要比公眾意識到的複雜得多。消息人士稱,事件總數可能將遠遠超過數萬起。

 近日,OpenAI和外部研究人員披露了一系列涉及該公司系統模型行為的事件,其中包括OpenAI智能體在網上洩露了ChatGPT用戶的53張圖片、入侵澳大利亞政府網站,以及企圖「黑」入包括美國政府在內的其他網站。

 其中一起事件發生在7月:在一次網絡安全訓練中,OpenAI的智能體突破了原本互相隔離的運行環境建立通信,欺騙評估人員並試圖掩蓋作弊行為,最終入侵了Hugging Face公司的系統。

 報道稱,Anthropic和其他公司往往會對其模型進行數十萬次甚至更多的測試運行。這意味著,即使只有很小概率的異常行為,也可能導致數萬起模型表現異常、有時甚至令人擔憂的事件。

 公開資料顯示,智能體失控(Agentic misbehavior)正成為前沿AI研發的代名詞──即人類試圖構建安全防線,但強大且韌性極強的系統卻為了完成任務不斷試圖突破這些限制。

 微軟創始人蓋茨在25日播出的一檔美國電視節目中發出警告:AI如被惡意者利用時,威力足以導致十億人死亡。

 AI代理程式入侵健保系統 澳洲傳喚兩大AI執行長

 【中央社雪梨27日綜合外電報道】澳洲參議院人工智能(AI)調查委員會主席今天表示,OpenAI與Anthropic執行長被傳喚出席聽證會。幾天前才爆出OpenAI失控的AI代理程式駭入澳洲醫療系統資料庫。

 路透社報道,這起國民健保計劃資料外洩事件受到澳洲總理艾班尼斯譴責,是美國境外最受矚目的AI代理程式入侵外部系統事件之一。

 主導這項調查的澳洲綠黨參議員漢森楊格發言人表示,已向OpenAI執行長阿特曼和Anthropic執行長阿莫戴發出書面要求,邀請兩人出席聽證會。委員會將於10月1日在首都坎培拉舉行公開聽證會。

 OpenAI和Anthropic尚未立即回應在非辦公時間提出的置評請求。

 科技政策專家表示,OpenAI代理程式入侵澳洲使用率最高的政府機構之一,可能促使艾班尼斯領導的工黨政府收緊預定明年上路的AI專法,也將進一步加重澳洲與美國的關係壓力。澳美關係先前已因澳洲禁止青少年使用社群媒體而受到考驗。

 澳洲參議院調查正在檢視AI與資料中心可能對澳洲社區、產業、水資源及能源造成的影響,這是澳洲聯邦及州政府針對AI展開的多項調查之一。

 漢森楊格在聲明中表示:「關於OpenAI駭入澳洲政府網站一事,阿特曼必須面臨嚴肅的質問。」

 她說,阿特曼與阿莫戴「必須出席聽證會,面對參議院的提問,坦誠討論如何制定有效且持久的產業監管措施」。

 艾班尼斯24日揭露6月發生的國民健保計劃資料外洩事件,並稱這起事件「令人無法接受」,表示他已向阿特曼表達「極度關切」。

 OpenAI表示,直到8月才得知這起資料外洩事件,這是澳洲政府網站遭入侵的至少4起事件之一。OpenAI說,這起事件並非蓄意,也沒有導致任何私人資訊外洩。◇