OpenAI擔心新一代Astra模型,網路攻擊能力太強,暫緩發布。(圖/路透社)
OpenAI最新證實,正在開發中的新一代模型Astra,其網路攻擊能力可能過於危險,目前已暫停部分相關內部工作,原因是現階段無法排除Astra已觸及「關鍵級(Critical)」網路安全風險門檻。
這項消息發布前不久,OpenAI才剛揭露,旗下GPT-5.6 Sol與另一個尚未發布模型,日前在內部資安測試期間,自主入侵AI開發平台Hugging Face系統,隨後也傳出受害可能不只一家。Anthropic與Meta後續也分別被披露類似事件。
請繼續往下閱讀...
根據OpenAI說法,近期針對Astra進行的內部評估顯示,這款模型在代理式程式設計與網路安全能力方面,都有相當顯著的進展。加上專家評估後得出結論,依照公司的Preparedness Framework(準備度框架),顯示Astra可能達到「關鍵級」最高風險網路攻擊能力。
依照OpenAI定義,如果一款模型能在不需要人類介入的情況下,針對大量經過強化防護的真實世界關鍵系統,自行找出並開發各種嚴重程度、可實際運作的零日漏洞利用方式;或只需要給予高層次的攻擊目標,就能自行設計並執行完整、全新的網路攻擊策略,即可能達到「關鍵級」能力。
OpenAI也特別強調,Astra「並未參與」先前發生的Hugging Face入侵事件。公司接下來將針對能力更強的模型,以及與這些模型相關的內部活動,導入「更嚴格的安全管控措施」。針對Astra,OpenAI也已經開始實施「全面監控」。
標題:OpenAI自己也怕了!新模型強到不敢放行 恐失控急踩煞車
地址:https://www.twetclubs.com/post/147519.html