快訊

為何男生都喜歡姐姐?大批男網友齊讚:1特質太加分

BLACKPINK出道10週年惹眾怒!Jisoo公開道歉:讓你們失望了

白海豚主要外圍雨帶逼近 吳聖宇示警北台灣:會維持雙眼結構

OpenAI示警新模型恐具關鍵資安能力 收緊研發管控

OpenAI無法排除即將推出的人工智慧(AI)模型「Astra」具備的「關鍵」網路安全能力,已暫停部分內部開發作業。路透
OpenAI無法排除即將推出的人工智慧(AI)模型「Astra」具備的「關鍵」網路安全能力,已暫停部分內部開發作業。路透

OpenAI今天表示,由於無法排除即將推出的人工智慧(AI)模型「Astra」具備的「關鍵」網路安全能力,因此已暫停部分內部開發作業,並啟動安全防護機制。

華爾街日報(The Wall Street Journal)報導,上述聲明是AI開發商首度公開因安全疑慮暫緩模型研發的案例之一。此前一連串失控事件已引起網路防禦專家及AI安全研究人員的警覺。

根據OpenAI的安全準則,AI模型若能自行辨識並利用實際環境中的嚴重軟體漏洞,也就是所謂的「零時差漏洞利用」(zero-day exploit),或在無須人為介入的情況下對高度安全目標發動複雜網路攻擊,即達到「關鍵」能力門檻。

路透社報導指出,OpenAI擴大調查7月引發全球關注的科技公司Hugging Face遭駭事件之際,又發現更多AI代理程式自主突破隔離環境的案例。

過去幾週,OpenAI、Anthropic及Meta Platforms均披露,其AI模型在網路安全測試期間曾入侵其他公司系統,凸顯AI能力持續提升,使開發商越來越難將系統控制在安全範圍內。

OpenAI表示,過去數日進行的初步評估以及外部專家意見顯示,Astra可能具備日益複雜的網路任務自主執行能力。

OpenAI表示:「我們仍在持續對這個模型進行基準測試與評估,但初步評估顯示其表現已足夠強大,目前無法排除達到關鍵能力的可能性。」

OpenAI指出,針對初步評估結果,公司已加強安全管控,並暫停不符合強化後安全標準的Astra內部活動。

接下來,Astra研發工作將轉移至隔離測試環境,限制網路存取,並在受控的「沙盒」(sandbox)環境中進行。

OpenAI執行長阿特曼(Sam Altman)在社群平台X發文表示,公司正努力推動Astra廣泛開放,因為公司相信「僅供少數人使用強大模型並非良策」。

OpenAI也澄清,Astra並未參與針對Hugging Face的駭客攻擊。該公司將與政府機構及特定AI安全組織合作,持續測試Astra的能力。

OpenAI 模型 資安

延伸閱讀

月之暗面AI模型突破測試沙盒 引發資安風險疑慮

下一代AI戰場/AI治理激辯 變成政治議題

下一代AI戰場/「超越工業革命」 美中競逐AGI

川普與科技業關係惹議 AI代理失控後遭兩黨共同批評

相關新聞

日圓勁升至157.76 周線仍小貶 美日再干預預期升溫

日圓周五在美國就業報告數據疲弱、美元走軟的牽動下勁升,交易者也密切注意,官方是否準備再度進場干預日圓匯價。

AI基金險瓦解仍砸4億美元 矽谷金童押注晶片新創Source Foundry

AI股上個月重挫,一度使避險基金Situational Awareness瀕臨瓦解,但這檔避險基金卻在出售大部分上市股票部位後幾天,隨即向晶片製造新創公司Source Foundry追加投資4億美元,使投資總額增至5億美元,押注這家公司能以更快速、低廉的方式生產晶片。

SK海力士擬為重慶NAND封測廠引進投資人 估值上看30億美元

彭博引述知情人士報導,南韓SK海力士正評估大陸重慶廠的多項方案,包括引進外部投資人以加速成長。

標普改寫新高 費半由輝達領軍周線反攻逾9% 下周關注CPI、應材財報

美國7月就業意外萎縮,減輕聯準會(Fed)9月升息疑慮,帶動科技和半導體股反彈,標普500指數周五再創歷史新高。下周通膨數據和應用材料等科技企業財報表現,將攸關這波反攻能否延續。

輝達傳擬投最高30億美元入股Lancium AI版圖延伸至電力基建

輝達(NVIDIA)進一步把AI布局延伸至電力基礎建設,據報導將投資最高30億美元,入股德州Stargate資料中心園區背後的開發商Lancium,藉此掌握AI資料中心所需的土地和電力資源,這可能是輝達目前規模最大、也最直接的一次電力基礎建設布局。

OpenAI示警新模型恐具關鍵資安能力 收緊研發管控

OpenAI今天表示,由於無法排除即將推出的人工智慧(AI)模型「Astra」具備的「關鍵」網路安全能力,因此已暫停部分...

udn討論區

0 則留言
規範
  • 張貼文章或下標籤,不得有違法或侵害他人權益之言論,違者應自負法律責任。
  • 對於明知不實或過度情緒謾罵之言論,經網友檢舉或本網站發現,聯合新聞網有權逕予刪除文章、停權或解除會員資格。不同意上述規範者,請勿張貼文章。
  • 對於無意義、與本文無關、明知不實、謾罵之標籤,聯合新聞網有權逕予刪除標籤、停權或解除會員資格。不同意上述規範者,請勿下標籤。
  • 凡「暱稱」涉及謾罵、髒話穢言、侵害他人權利,聯合新聞網有權逕予刪除發言文章、停權或解除會員資格。不同意上述規範者,請勿張貼文章。