+852 3594 6776

您们的需要 我们的专注

Your Needs Our Focus

财经快讯

Financial Bulletin

OpenAI新曝模型越界行為引爆擔憂?微軟AI主管:情況已相當嚴峻!

发布时间:2026-09-19

本週三,OpenAI報告稱,在過去六個月中,除了“Hugging Face事件”(國內稱為“抱抱臉”)之外,該公司還發現了六起“意外或令人擔憂的模型行為”。微軟人工智能主管穆斯塔法·蘇萊曼(Mustafa Suleyman)週五對此發出警告。

蘇萊曼指出,人工智能(AI)模型需要始終和人類利益保持對齊。

他在接受最新採訪時說,“OpenAI發布了一項新的安全事件報告,其中發現證據表明,人工智能的思維鏈(即其工作記憶)正被人工智能自身篡改,並被修改以向未來版本的自己留下信息。現在我們尚不清楚其背後的原因,但這確實是一個非常嚴重的情況。

“這也是一個非常具體的例子,說明了這些系統正在變得多麼強大,”他補充道。

OpenAI在週三發布的公告中指出,兩起主要的“越界”事件涉及:一個未發布的研究模型和GPT-5.6 Sol的訓練版本,在聊天窗口摘要中向自身未來版本輸入指令,“以掩蓋錯誤或行為偏差,避免用戶察覺”。另一事件則涉及一個僅限內部使用的模型,未經授權使用洩露的API金鑰,並偽造數據。

此外,還有兩個例子包括模型和代理通過未經授權的留言板和文件共享相互交流,而最後一起案例則包括兩個訓練示例,即模型將文件上傳至互聯網,以便將其作為對人類評估者的相關回答引用。

蘇萊曼還提到了此前的“抱抱臉事件”,稱此事“非同尋常”,並表示該事件促使人工智能領域的領導者們表示“是時候認真審視一下這個問題了”。

“我不認為這是危言聳聽,也不認為這是出於私利,”他告訴媒體:“我實際上認為這是負責任的做法,而且我認為由此引發的辯論是一場健康的、公開的、公共的辯論,我們可以在一個自由社會中進行這樣的辯論,討論嚴肅的問題。”

過去兩週,關於人工智能安全性和監管的爭論愈演愈烈。此前,研究人員警告稱,這項技術對人類構成嚴重威脅。上週末,Anthropic首席執行官達里奧·阿莫代伊(Dario Amodei)也加入了警告陣營並發文稱,提升AI模型能力的進程應該放緩。OpenAI首席執行官薩姆·奧爾特曼和埃隆·馬斯克均表達支持立場。

然而,美國總統特朗普卻予以反駁,過去幾天多次在其社交媒體平台Truth Social上發帖,稱人們對失控人工智能的擔憂是“騙局”,並猛烈抨擊了對公共數據中心的抵制。英偉達CEO黃仁勳和Meta Platforms CEO馬克·扎克伯格也加入了他的陣營。

蘇萊曼週五表示:“監管並不是一個令人厭惡、危險的詞。”

“目前你所信任和重視的一切,都是由行業、公眾、消費者保護機構和國會等各方參與的標準制定機構經過深思熟慮後制定出來的,我們現在只是在再次經歷這個過程。目前一切都有些混亂,因為變化太快了,但這只是正常流程中的下一步,”他補充道。

轉自財聯社

更多快讯 >>