谷歌發表 Gemini 3.6 Flash 模型 強化 AI Agent 應用效率

谷歌發表 Gemini 3.6 Flash 模型 強化 AI Agent 應用效率
谷歌發表 Gemini 3.6 Flash 模型 強化 AI Agent 應用效率
圖/本報資料庫

商傳媒|林昭衡/綜合外電報導

谷歌(Google)昨日宣布推出多款新一代 Gemini Flash 系列模型,其中包括 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite,旨在顯著提升人工智慧代理(AI Agent)應用的速度、成本效益與穩定性。同時,谷歌也發表了專為網路安全設計的 Gemini 3.5 Flash Cyber 模型。

Gemini 3.6 Flash 被定位為谷歌在編碼、知識工作及多模態應用領域的核心主力模型。根據谷歌提供的數據,相較於 Gemini 3.5 Flash,新模型在 Artificial Analysis Index 上所需的輸出 Token 減少了 17%,並且在多步驟工作流程中,推理步驟與工具呼叫也更少。其定價為每百萬輸入 Token 1.50 美元,每百萬輸出 Token 7.50 美元。在多項基準測試中,Gemini 3.6 Flash 的表現均有顯著提升,例如在 DeepSWE 編碼基準測試中獲得 49% 的分數,超越 Gemini 3.5 Flash 的 37%;在機器學習研究的 MLE Bench 上達到 63.9%,並將電腦使用能力(指 AI 代理能直接與軟體介面互動並完成任務,而非僅限於文字回應)在 OSWorld-Verified 上的表現提升至 83%。

為強化安全性,Gemini 3.6 Flash 內建了針對化學、生物、放射性與核能(CBRN)風險及惡意網路安全濫用的防護措施,旨在提升模型對越獄(jailbreak)嘗試的抵抗力,同時減少對合法應用的不必要拒絕。目前,已有客戶將 Gemini 3.6 Flash 用於文件解析、圖表分析、資料解讀及報告起草等工作。

另一款新模型 Gemini 3.5 Flash-Lite,則專為需要低延遲與高成本效益的高流量工作負載設計。谷歌表示,該模型根據 Artificial Analysis 的測試,每秒約可生成 350 個輸出 Token。其定價為每百萬輸入 Token 0.30 美元,每百萬輸出 Token 2.50 美元。開發者可以調整 Gemini 3.5 Flash-Lite 的「思考層級」,以優先選擇低成本、快速執行,或為更複雜的 AI Agent 工作流啟用額外推理功能。該模型在多項測試中亦展現優異效能,例如在 Terminal-Bench 2.1 測試中獲得 54% 的分數,超越 Gemini 3.1 Flash-Lite 的 31%。

Gemini 3.5 Flash Cyber 則為 Gemini 3.5 Flash 的網路安全特化版本,經微調後可偵測、驗證並修復軟體漏洞。該模型將透過 CodeMender 安全 Agent 運作,允許多個 Flash Cyber Agent 協同分析安全問題並產出整合報告。目前,谷歌計畫將 Gemini 3.5 Flash Cyber 透過 CodeMender 試點計畫,限制部署予政府機關和受信任的合作夥伴,以協助防禦者識別漏洞,同時降低模型被濫用的風險。

這些新模型現已透過 Gemini API 在 Google AI Studio 和安卓工作室(Android Studio)中開放使用。此外,Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 也可透過 Gemini Enterprise Agent Platform 及 Gemini 應用程式存取,其中 Flash-Lite 已開始整合至 Google搜尋。Gemini 3.6 Flash 也能透過 Google Antigravity 和 Gemini Enterprise 應用程式使用。谷歌目前亦正與合作夥伴測試 Gemini 3.5 Pro,並已啟動針對 Gemini 4 的預訓練工作。