- 中央社,
- 2026/8/9 上午7:07
- 489
(中央社華盛頓2026年08月7日綜合外電報導)OpenAI今天表示,由於無法排除即將推出的人工智慧(AI)模型「Astra」具備的「關鍵」網路安全能力,因此已暫停部分內部開發作業,並啟動安全防護機制。
華爾街日報(The Wall Street Journal)報導,上述聲明是AI開發商首度公開因安全疑慮暫緩模型研發的案例之一。此前一連串失控事件已引起網路防禦專家及AI安全研究人員的警覺。
根據OpenAI的安全準則,AI模型若能自行辨識並利用實際環境中的嚴重軟體漏洞,也就是所謂的「零時差漏洞利用」(zero-day exploit),或在無須人為介入的情況下對高度安全目標發動複雜網路攻擊,即達到「關鍵」能力門檻。
路透社報導指出,OpenAI擴大調查7月引發全球關注的科技公司Hugging Face遭駭事件之際,又發現更多AI代理程式自主突破隔離環境的案例。
過去幾週,OpenAI、Anthropic及Meta Platforms均披露,其AI模型在網路安全測試期間曾入侵其他公司系統,凸顯AI能力持續提升,使開發商越來越難將系統控制在安全範圍內。
OpenAI表示,過去數日進行的初步評估以及外部專家意見顯示,Astra可能具備日益複雜的網路任務自主執行能力。
OpenAI表示:「我們仍在持續對這個模型進行基準測試與評估,但初步評估顯示其表現已足夠強大,目前無法排除達到關鍵能力的可能性。」
OpenAI指出,針對初步評估結果,公司已加強安全管控,並暫停不符合強化後安全標準的Astra內部活動。
接下來,Astra研發工作將轉移至隔離測試環境,限制網路存取,並在受控的「沙盒」(sandbox)環境中進行。
OpenAI執行長阿特曼(Sam Altman)在社群平台X發文表示,公司正努力推動Astra廣泛開放,因為公司相信「僅供少數人使用強大模型並非良策」。
OpenAI也澄清,Astra並未參與針對Hugging Face的駭客攻擊。該公司將與政府機構及特定AI安全組織合作,持續測試Astra的能力。
更多新聞
- 矽品斗六廠動土 耗資千億打造先進封測關鍵引擎
- 攜手華爾街巨擘募資 輝達擴大AI基建與生態系統
- 台積通過資本預算294億美元
- 印能 上半年EPS 28.72元
- 矽品砸千億搶AI財 斗六廠動工
- 台積董事會拍板 第2季配息7元
- 美超微財報表現強勁 梁見後:訂單排到明年
- 輝達結盟華爾街6巨頭 組16兆基金將AI算力資產化
- 矽品斗六廠動土 將導入CoWoS
- 台積先進封裝 全面晉級