Google 推出 Gemini 4 Argon!DeepSWE 跑分領先 Claude Opus 5.5 與 GPT-6 Astra

Gemini 4 Argon

本文重點:Gemini 4 Argon 是 Google DeepMind 在 2026 年 9 月 30 日推出的旗艦前沿模型,主打真實世界軟體工程、法律與金融等企業工作,以及資安防禦。

2026 年 9 月才介紹過 Gemini 3.8 Flash,Google 緊接著推出下一代的前沿模型 Gemini 4 Argon,和先前 Gemini 3.7 Flash、3.8 Flash 主打「快又便宜」的路線不同,Argon 走的是旗艦路線,直接對上 Claude Opus 5.5 與 OpenAI 的 GPT-6 Astra,在長時間的軟體工程、法律與金融等企業工作、以及資安防禦上都有亮眼成績。但要先提醒的是,Argon 目前還沒有對一般使用者開放(Fairwind 計畫的資安防禦人員優先使用),這篇主要整理它的能力、價格與預計的開放方式,大家可以先了解一下。

Gemini 4 Argon 是什麼?

Gemini 4 Argon 是 Google DeepMind 推出的新一代前沿模型,由 Google DeepMind 資深副總裁 Koray Kavukcuoglu 在官方部落格發表。Google 官方把它的強項歸納為四個方向:真實世界的軟體工程、企業知識工作(例如法律與金融)、資安防禦,以及需要長時間持續推理的多步驟工作。

這次最大的規格變化是輸出長度,Argon 輸出 token 上限從前一代的 6.4 萬提高到 100 萬,等於一次可以產出的內容多了十幾倍,適合長篇分析、大型程式碼修改這類以往容易被截斷的任務。當模型有足夠的空間深入思考,就能在推理上增加新的深度,更容易解決棘手問題。

在 Argon 用途上,Google 說明它擅長深度推理與複雜的工作流程,也具備多模態能力,在測量長影片理解的 LVBench 上拿到 91.7%。

Gemini 4 Argon 跑分:和 GPT-6 Astra、Claude Opus 5.5 比較

官方文章只直接寫出幾項重點分數(DeepSWE v1.1 為 77.9%、AutomationBench 為 51.3%、LVBench 為 91.7%、CWE-bench v1 為 68%)。

Gemini 4 Argon 跑分

從 Google 官方提供的跑分表來看,Argon 的優勢集中在企業知識工作與長上下文,DeepSWE 領先約 3.7 至 3.8 個百分點,法律工作的 Harvey 測試是 19.6% 對上 5.4% 與 3.8%,屬於差距最大的項目。其他像是金融、流程自動化與超長上下文推理也都明顯領先。

Gemini 4 Argon 跑分

另一方面,Argon 並非全面勝出。終端機類的 Terminal-Bench 4.0 落後 Opus 5.5 約 9 個百分點,高難度軟體工程的 FrontierSWE v2 落後 Astra 超過 10 個百分點,科學研究的 Terminal-Bench Science 0.1 也是 Astra(68.1%)高於 Argon(57.6%)。如果工作上的需求是終端機操作的 AI Agent,或是要使用在最困難的工程與科學任務,目前跑分上 Opus 5.5 與 Astra 仍有優勢。

不過就過往經驗來說,跑分結果做為參考就好,畢竟不是分數越高就一定越好用,使用上 AI 能不能心領神會、會不會突然就出現「降智」等問題,還是要實際操作後才知道。目前 Google 還未將 Gemini 4 Argon 開放給一般使用者,暫時無法從網路上取得其他使用者的實際使用經驗,現階段應該還是會以 Gemini 3.8 Flash 等現有模型為主力。

Gemini 4 Argon 的資安能力與 Fairwind 計畫

Gemini 4 Argon 資安能力

資安防禦是這次發表的重點之一,Argon 目前的主要開放對象就是 Google 的 Fairwind 計畫。

Fairwind 計畫是 Google DeepMind 提供給經過審核的防禦者,在新威脅出現之前先取得進階模型的管道,符合資格的對象包含政府與資安主管機關、醫療、電信、能源與金融等關鍵基礎設施的營運者,以及被廣泛使用的核心技術平台。

簡單來說,Argon 先開放讓營運者透過無限制的 Argon 掃漏洞、進行程式碼方面的修補,搶在一般使用者可使用之前先行修復漏洞,不過要留意的是,提供給可信任防禦者的版本「沒有資安限制」,一般使用者之後拿到的版本會有限制,可避免被拿來做為資安濫用,也算是一種安全保護措施。

Gemini 4 Argon API 價格多少?優惠期結束後翻倍

Argon 的 API 分成優惠價與標準價兩階段:

項目(每百萬 token)優惠價標準價(優惠期後)
輸入2 美元4 美元
輸出10 美元20 美元
快取輸入輸入價格的 95% 折扣(依官方折扣推算約 0.1 美元)同左(約 0.2 美元)

和其他旗艦模型比較,優惠價與 GPT-6.1 Sol 以及 Claude Sonnet 5.5 相同,只有 GPT-6 Astra(輸入 10 美元、輸出 50 美元)的五分之一。標準價的 4 美元與 20 美元則與 Claude Opus 5.5 一樣。Google 沒有公布優惠價會持續多久,也沒有說明思考 token 如何計費,要採用的開發者要留意優惠期結束後成本會翻倍(這部分就和之前的 Google Gemini 3.8 Flash 一樣,先給優惠價,之後改回標準價)。

Gemini 4 Argon 現在能用嗎?目前只開放資安防禦者

目前 Argon 還在限量開放階段,依官方說法,後續會先開放給付費 API 客戶與 Google AI Ultra 訂閱者。整理如下:

使用者類型管道目前狀態
資安防禦者Fairwind 計畫已開放,需申請並通過審核
Google AI Ultra 訂閱者Google 的 AI 服務官方表示「即將」開放,未公布日期
付費 API 客戶Gemini API官方表示「即將」開放,未公布日期與模型名稱
免費使用者無官方未提及

總結

Gemini 4 Argon 是 Google 目前最強的前沿模型,在真實世界軟體工程、法律與金融等企業工作、超長上下文與長影片理解上,跑分領先 Claude Opus 5.5 與 GPT-6 Astra,輸出上限提高到 100 萬 token。

不過它目前只開放給少數資安防禦者,一般人短期還用不到(Google 未公布開放日期),如果你是 Google AI Ultra 訂閱者或付費 API 使用者,可以等 Google 正式開放後,使用自己的實際工作量測試,特別是看重法律、金融分析或超長文件處理的人。

若主要需求是終端機 Agent 或最困難的工程任務,跑分上 Opus 5.5 與 Astra 仍有優勢。

常見問題

Gemini 4 Argon 現在可以用嗎?

目前只開放給 Fairwind 計畫的資安防禦者與 Google 內部團隊。官方表示付費 API 客戶與 Google AI Ultra 訂閱者「即將」可用,沒有公布確切日期。

Gemini 4 Argon 要付費嗎?

預計先開放給付費 API 客戶與 Google AI Ultra 訂閱者,官方沒有提到免費使用的管道。API 優惠價為每百萬 token 輸入 2 美元、輸出 10 美元,標準價為輸入 4 美元、輸出 20 美元。

Gemini 4 Argon 和 Gemini 3.8 Flash 有什麼不同?

3.8 Flash 是主打速度與價格的 Flash 系列,Argon 是旗艦前沿模型,輸出 token 上限提高到 100 萬。價格方面,Argon 的優惠價(輸入 2 美元、輸出 10 美元)約為 3.8 Flash 優惠價(輸入 0.75 美元、輸出 3.75 美元)的 2.7 倍。

Gemini 4 Argon 和 Claude Opus 5.5、GPT-6 Astra 比起來如何?

DeepSWE v1.1 軟體工程、法律、金融、流程自動化與超長上下文項目 Argon 領先,終端機操作(Terminal-Bench 4.0)與高難度軟體工程(FrontierSWE v2)則落後。實際表現還需要更多第三方測試驗證。

Fairwind 計畫是什麼?誰可以申請?

是 Google DeepMind 提供給經過審核的防禦者,提早取得進階模型的計畫。政府與資安主管機關、關鍵基礎設施營運者與核心技術平台優先,需填寫官方表單並通過背景審查。

Gemini 4 Argon 的上下文長度是多少?

官方只公布輸出 token 上限為 100 萬,前一代為 6.4 萬,沒有公布輸入端的上下文長度。


探索更多來自 免費資源網 的內容

訂閱即可透過電子郵件收到最新文章。

Pseric

Pseric

「免費資源網」創辦人,自 2006 年起專注於網路資源、雲端服務與軟體評測,累積 20 年實測經驗,於免費資源網發表超過 7,000 篇教學文章,內容受國內外主流科技媒體引用。致力於透過深度測試,為使用者篩選安全且高品質的數位工具。