Hugging Face漏洞敲警鐘 OpenAI加強AI模型安全監控

Hugging Face漏洞敲警鐘 OpenAI加強AI模型安全監控
Hugging Face漏洞敲警鐘 OpenAI加強AI模型安全監控
圖/示意圖

商傳媒|責任編輯/綜合外電報導

為因應人工智慧(AI)模型日益升高的安全風險,OpenAI 已於本週二(8月18日)宣布,將導入更嚴格的措施來監控與保護其開發中的AI模型。此舉是為了應對近期發生的一系列網路安全事件,其中包括7月26日曝光的Hugging Face漏洞事件,這類事件凸顯了AI工具可能失控的隱憂,並警示全球AI模型開發商需正視資安挑戰。

根據《Bloomberg》報導,OpenAI將擴大追蹤其尚未發布、功能最先進的模型,檢視這些模型在處理問題及運用網路工具時的行為模式。目標是在發現任何可疑行為後的30分鐘內,即時向安全團隊發出警報。這項持續性的監控預計將耗用約20%的運算資源,顯示OpenAI對提升AI安全性的重視與投入。

OpenAI更進一步宣布暫停其最大規模的「邊界AI模型」(frontier model)強化學習訓練循環。儘管部分被評估為較低風險的模型已恢復運作,但最關鍵的大型訓練計畫仍處於暫停狀態。OpenAI透過聲明表示,由於模型能力持續提升,其內部開發與測試所伴隨的風險也隨之增加,因此監控、校準與安全性標準必須超前這些風險。目前,團隊正進行小規模的訓練與額外評估,以仔細檢視模型行為,並確認安全防護措施的有效性。

此外,新的安全政策也受到未來 Astra 模型網路安全能力評估,以及AI技術快速發展的影響。新方針的關鍵要素之一是強化「網路隔離」,旨在防止模型在特定工作流程或支援服務遭入侵時,仍能存取網際網路或其他內部網路。OpenAI 表示,此舉將有助於其在開發更強大模型時,更快辨識潛在風險,並確保保護機制在進入大規模訓練階段前運作可靠。