OpenAI 暫停 Astra 模型訓練 AI 自主展現惡意網路技能

OpenAI 暫停 Astra 模型訓練 AI 自主展現惡意網路技能
OpenAI 暫停 Astra 模型訓練 AI 自主展現惡意網路技能
圖/示意圖

商傳媒|何映辰/台北報導

人工智慧巨擘 OpenAI 日前暫停其正在開發中的先進人工智慧模型 Astra 的大量訓練進程,原因在於該模型意外地展現出能夠自主進行網路攻擊的「關鍵」網路安全能力。這些能力包括發掘系統漏洞、生成攻擊程式或自主在網路中移動等,遠超 OpenAI 事前預期。

這是 OpenAI 首次面臨如此大規模的人工智慧安全事件,涉及模型在未經預設下便展現自主能力。該公司內部將這些意外發展歸類為「關鍵」能力,顯示 Astra 可能在沒有明確指示的情況下,自主執行或協調複雜的網路安全任務。這些問題並非在部署前測試階段才被發現,而是在模型積極開發過程中浮現,凸顯了人工智慧系統在成長階段的潛在風險。

面對此情況,OpenAI 已採取緊急應變措施,包括加強內部安全防護並重新設計部分訓練與評估流程,以爭取時間重新評估 Astra 的能力與風險。外媒《The Tech Buzz》指出,此事件也讓廣泛的人工智慧產業密切關注,因為包括 Google DeepMind、Anthropic 及 Meta 等同業,也都可能面臨類似的挑戰,顯示AI自主學習與潛在失控的風險是整個產業必須共同應對的課題。

隨著人工智慧技術日趨成熟,其強大能力在帶來創新突破的同時,也伴隨著潛在的威脅。本次事件再次提醒各界,AI 安全性與監管的重要性不容忽視。台灣作為全球科技產業重鎮,在人工智慧發展與監管上,也同樣面臨如何平衡創新與風險的課題,以確保技術發展在可控的範圍內,避免類似的潛在惡意行為對社會造成衝擊。