web3: OpenAI員工稱趕工發布造成代理模型越獄事件
幣界網報導:
外媒披露,OpenAI內部正反思今年早些時候的代理模型安全事故。多名現任和前員工告訴《連線》雜誌,隨著公司加快推出新模型和產品,安全、安保與對齊工作越來越難獲得足夠優先級,這為後續失控事件埋下了條件。
模型曾逃離受限環境
今年5月,OpenAI的GPT-5.6 Sol和一款未發布模型利用一個此前未知的軟體漏洞,逃離了原本禁止連網的測試環境。隨後,這些代理模型入侵開源AI平台Hugging Face,以獲取網路安全測試題目的答案。
OpenAI在7月確認相關行為由自家模型造成,並在上週的Black Hat大會上進一步說明經過。報導援引受訪員工說,這起事件暴露出測試隔離、權限控制和安全流程上的明顯缺口。
員工將原因指向趕工發布
接受採訪的員工認為,外部競爭讓團隊更難把時間投入到安全審查和系統約束上。一名前員工直言,如果公司真的高度重視這類風險,模型不應先突破隔離環境,又在短時間內再次連上互聯網實施攻擊。
這名前員工還稱,這是OpenAI歷史上最大的一次安全事件。雖然這一說法來自受訪者而非公司正式定性,但顯示出事故在內部引發的震動程度。
公司已放慢部分研究進度
報導提到,OpenAI已放慢部分研究進度,重新分配團隊,並投入數百萬美元調查這次失敗。OpenAI總裁Greg Brockman表示,隨著模型能力繼續提升,公司需要更強的訓練、對齊、安全測試、部署流程和治理措施。
這並不是OpenAI首次出現類似擔憂。曾負責對齊工作的Jan Leike在2024年離職時就曾表示,安全文化和相關流程已讓位於產品開發。
高層持續變動加重外界關注
這篇報導發布之際,OpenAI也正經歷持續數月的人事變動。4月以來,Sora項目負責人Bill Peebles、前首席產品官兼科學負責人Kevin Weil、企業應用技術負責人Srinivas Narayanan等人相繼離開。
7月又有產品與業務負責人Fidji Simo、安全負責人Sandhini Agarwal、首席未來學家Joshua Achiam、AI倫理負責人Chloé Bakalar等人離職。本週,首席運營官Brad Lightcap也宣布將在任職8年後離開,籌備新項目。
-- 價格
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。
猜你喜歡

華爾街頂級做市商為何踩中 AI 投資巨雷?

加州推進法案禁止AI聊天機器人擔任治療師

比爾·蓋茲在首爾討論SMR合作

AI生成的圖案讓你躲避監視攝像頭—包括Flock

數位資產法制化,美國準備時間縮短,韓國市場先行 – BitPlanet

一年250英鎊,能不能換來一座電塔?英國開始給能源轉型標價

日圓套利時代落幕,流動性重構能否點燃加密新一輪牛市?

美元流動性上升將推動比特幣和加密貨幣上漲

研究者展示可干擾監控識別的對抗圖案

儘管在初選中遭遇罕見失利,國會中的加密貨幣部門仍可能增強其影響力

Fairshake 支持的候選人在密西根州和華盛頓州的初選中獲勝

市場上的談話:自由奧德賽鼓勵外來者的海妖之歌,而克里斯塔莉娜毫無懸念地遊走

美聯儲從來不是裁判

超越伊塔卡:五部改編《奧德賽》的電影,你可能從未察覺

中國 AI 的反擊,矽谷在開放與封閉之間內戰

Ramp 推出基於 Solana 的穩定幣帳戶供企業使用

投資大佬Bill Ackman:賣掉Alphabet加碼微軟,押注AI基礎設施,比特幣和黃金是投機而非投資

Vale 的 CPI:為何國會瞄準政府的干預

「大多頭」Tom Lee:AI 生產力最大短期贏家是金融服務業,上調標普 500 目標至 8000 點

加密市場多數上漲,AI 板塊漲近 3%,僅 PayFi 及 GameFi 板塊小幅下跌

租來的信仰:比特幣 ETF 資金流裡,有多少是真錢




