Google 一次推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber,鎖定 AI Agent 大規模部署

Google 一次推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber,鎖定 AI Agent 大規模部署

Google 更新 Gemini AI,一次推出三款最新模型。3.6 Flash 主打更高的 Token 效率與更好的品質,售價反而更低;3.5 Flash-Lite 走高速低成本路線,適合大量任務;3.5 Flash Cyber 則專攻資安漏洞偵測與修補。三種模型的共同目標是讓開發者能以更低成本、更穩定的方式,把 AI Agent(智慧代理)推向實際生產環境

開發者與企業要把 AI Agent 真正放到生產環境運作,需要更高的 Token 使用效率、更低的延遲,以及更穩定可靠的表現。Google 這次針對 Flash 系列的更新,重點就放在「效率與品質的平衡」,讓大規模的代理工作流程(agentic workflow)實際落地。

繼今年 5 月 Google 推出 Gemini 3.5 Flash 後再次更新,備受期待的 Gemini 3.5 Pro 正與合作夥伴進行測試,尚未推出。

重點特色

  • 3.6 Flash:主力通用模型,程式編寫、知識工作與多模態表現全面提升,售價比前代 3.5 Flash 更便宜。
  • 3.5 Flash-Lite:3.5 系列中速度最快、成本最低的模型,適合高吞吐量的搜尋與文件處理任務。
  • 3.5 Flash Cyber:資安專用模型,搭配 CodeMender 代理架構,用於偵測、驗證與修補程式碼漏洞。
  • 內建電腦操作能力:3.6 Flash 與 3.5 Flash-Lite 都把 Computer use(電腦操作)列為內建工具,強化代理任務執行。
  • 強化安全防護:3.6 Flash 導入強化版 Frontier Safety 機制,針對 CBRN 與網路攻擊濫用強化防護、提升抗越獄能力,同時減少對正當用途的過度拒絕。

3.6 Flash:效率更好、品質更高、價格更低

3.6 Flash 是這次的主力模型,直接根據開發者對 3.5 Flash 的回饋改良而來。它在程式編寫與知識工作上明顯進步,同時大幅改善 Token 效率。簡單來說,3.6 Flash 模型價格更低,但表現比 3.5 Flash 更好。

依 Artificial Analysis Index 的評估,3.6 Flash 的輸出 Token 用量比 3.5 Flash 少了 17%,在 DeepSWE 這類基準測試中甚至可減少多達 65%。完成多步驟工作時,它需要的推理步驟與工具呼叫次數也更少。

價格方面,3.6 Flash 定為每百萬輸入 Token 1.5 美元、每百萬輸出 Token 7.5 美元,比 3.5 Flash 更低。效率提升加上單價下降,讓每一項代理任務的整體成本明顯降低。

Google 一次推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber,鎖定 AI Agent 大規模部署

Google 一次推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber,鎖定 AI Agent 大規模部署

效能上也全面優於 3.5 Flash,以下為官方公布的幾項數據對比:

  • 程式編寫:DeepSWE 達 49%,前代為 37%,錯誤的程式碼修改與重複執行迴圈都減少。
  • 機器學習研究:MLE Bench 達 63.9%,前代為 49.7%。
  • 電腦操作:OSWorld-Verified 達 83.0%,前代為 78.4%。
  • 知識工作:GDPval-AA v2 達 1421 分,前代為 1349 分,在文件解析、圖表與資料分析、報告撰寫等多模態任務上表現突出。

3.5 Flash-Lite:為大規模代理任務而生

3.5 Flash-Lite 走的是低延遲、高吞吐量路線,鎖定代理搜尋、文件處理這類需要大量並行的工作。

它是 3.5 系列中速度最快的模型,依 Artificial Analysis 測得每秒輸出 350 個 Token,定價為每百萬輸入 Token 0.3 美元、每百萬輸出 Token 2.5 美元,品質也明顯優於前代 3.1 Flash-Lite,對於執行高流量生產任務的開發者而言,CP 值相當突出。

這款模型支援不同的 thinking(思考)等級,開發者可依需求調整:高流量任務用最低思考等級換取低延遲、低成本;多步驟的子代理工作則可啟用較高等級。同樣內建 Computer use 工具。

Google 一次推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber,鎖定 AI Agent 大規模部署

3.5 Flash Cyber:專攻資安漏洞的偵測與修補

AI 找出安全漏洞的速度,已經超過現有系統修補的速度。要應對這個逐漸擴大的威脅,需要兼具高效率與能力的資安方案。

3.5 Flash Cyber 建構在 3.5 Flash 之上,針對資安漏洞的尋找與修補進行微調,單位 Token 成本低於大型模型。在 CodeMender 架構中,會由多個 3.5 Flash Cyber 代理協同運作,彙整成一份報告,於熱門基準測試 CyberGym 上達到前沿水準的競爭力。

考量這類技術具備雙面性,Google 採取較審慎的部署方式:3.5 Flash Cyber 將透過 CodeMender,以限量試行計畫形式,僅開放給政府與受信任的合作夥伴使用。目的是讓第一線防禦者搶先修補關鍵漏洞,同時降低被濫用的風險。

Google 一次推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber,鎖定 AI Agent 大規模部署

如何使用全新 Gemini 模型?

3.6 Flash 與 3.5 Flash-Lite 即日起提供,3.5 Flash Cyber 則採限量開放。

Google 一次推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber,鎖定 AI Agent 大規模部署

一般使用者

可透過 Gemini 應用程式直接使用,3.5 Flash-Lite 也開始在 Google 搜尋中推出。

開發人員

可經由 Google AI Studio 與 Android Studio 串接 Gemini API,3.6 Flash 另可在 Google Antigravity 中使用。

企業使用者

可在 Gemini Enterprise Agent Platform 使用,3.6 Flash 也提供於 Gemini Enterprise 應用程式。


總結

這次更新的重點在於「效率」而非單純堆疊參數。三款模型分別對應不同需求:3.6 Flash 是品質與成本兼顧的主力、3.5 Flash-Lite 補足高吞吐量的低成本缺口、3.5 Flash Cyber 則切入資安這個高門檻領域。

對開發者來說,真正的意義在於把 AI Agent 從展示階段推進到可負擔、可大規模運行的生產環境。至於 3.5 Flash Cyber 採限量開放的做法,也反映出資安 AI 在能力提升的同時,濫用風險與部署管制正成為必須同步考量的課題。


常見問題

Gemini 3.6 Flash 和前代 3.5 Flash 有什麼差別?

3.6 Flash 是主力通用模型,程式編寫、知識工作與 Token 效率全面提升,輸出 Token 用量比 3.5 Flash 少約 17%,且定價更低(每百萬輸入 1.5 美元、輸出 7.5 美元)。

三款新模型分別適合什麼用途?

3.6 Flash 兼顧品質與成本,適合一般代理任務;3.5 Flash-Lite 速度最快、成本最低,適合高吞吐量的搜尋與文件處理;3.5 Flash Cyber 專攻資安漏洞的偵測與修補。

一般使用者要怎麼使用這些新模型?

可透過 Gemini 應用程式直接使用,3.5 Flash-Lite 也開始在 Google 搜尋中推出;開發者可經 Google AI Studio、Android Studio 串接 API,企業則可在 Gemini Enterprise 平台使用。

為什麼 3.5 Flash Cyber 沒有全面開放?

因資安技術具雙面性,Google 採審慎部署,透過 CodeMender 以限量試行計畫形式,僅開放給政府與受信任的合作夥伴,以降低被濫用的風險。


探索更多來自 免費資源網 的內容

訂閱即可透過電子郵件收到最新文章。

Pseric

Pseric

「免費資源網」創辦人,自 2006 年起專注於網路資源、雲端服務與軟體評測,累積 20 年專業實測經驗。撰寫逾萬篇技術教學,內容受國內外主流科技媒體引用。致力於透過深度測試,為使用者篩選安全且高品質的數位工具。