logo
  • 環境
  • 企業方案
  • 價格
Blogs
Oct 2, 2026

Gemini 4 Argon:新功能、基準測試與定價

Google 全新前沿模型專為長時程、多步驟工作而生,涵蓋程式開發、法律、金融及網絡安全防禦——以下是實際的改變。

EigentEigent
Share to
Gemini 4 Argon:新功能、基準測試與定價
  • 什麼是 Gemini 4 Argon?
  • Gemini 4 Argon 的新功能
  • Gemini 4 Argon 基準測試
  • Gemini 4 Argon 定價
  • 在防禦性網絡安全領域領先
  • 安全性與分階段推出
  • 誰能獲得 Gemini 4 Argon,以及何時獲得
  • 如果您開發智能代理,這值得關注嗎?
  • 用您自己的 AI 工作團隊來完成這些任務
Automate Everything with
AI Workforce on Desktop
Download Eigent

Google 剛剛發布了 Gemini 4 Argon,這是其全新前沿模型,專為在長時程、多步驟工作流程中維持深度推理而設計。其定位是:在真實世界的軟件工程、法律與金融等企業知識工作,以及網絡安全防禦方面達到前沿水準——這類任務需要智能代理執行多個步驟,而非一次提示即可完成。本指南涵蓋新功能、Google 發布的基準測試、定價、100 萬輸出 token 上限的重大突破,以及誰能優先獲得使用權限。

什麼是 Gemini 4 Argon?

Gemini 4 Argon 是 Google 最新的前沿模型,定位為其「前沿智能的新紀元」。Google 描述它專為在複雜、長時程工作流程中維持深度推理而設計,在真實世界的軟件工程、法律與金融等企業知識工作,以及網絡安全防禦方面均達到前沿水準(Google)。

該模型於 2026 年 9 月 30 日發布。與一般的模型發布不同,Argon 並非在第一天就全面開放——Google 首先透過其 Fairwind Program(公平風計劃)向一批受信任的網絡安全防禦者推出,然後在強化安全護欄後,再逐步向開發者、企業及消費者擴展(Google)。

Gemini 4 Argon 的新功能

對開發者而言,最重要的改變是在單次處理中能夠進行更長時間的思考。

  • 100 萬輸出 token 上限。 Google 大幅擴展了模型的輸出 token 上限至業界領先的 100 萬 token,較之前的 64K 大幅提升。Google 聲稱,當模型有足夠空間在單次推理軌跡中生成數十萬個 token 時,便能在推理深度上達到全新層次,並一次性解決棘手問題(Google)。
  • 長時程任務專注。 Argon 針對需要規劃、工具調用及跨多步驟持續執行的任務進行了調優——從日常除錯到大規模程式碼庫遷移均適用。
  • 多模態知識工作。 Google 強調其在需要視覺理解的任務上表現出色——包括專業圖表分析、從長視頻中提取細節,以及跨一系列文件執行操作。

就背景而言,這是一次比 Google 近期 Gemini 3.8 Flash 主力更新更重大的發布:Argon 是一個前沿級別的模型,針對最困難、最長時程的任務,而非以低成本處理大量工作。

Gemini 4 Argon 基準測試

以下所有數據均來自 Google 的發布材料,請將其視為廠商自報基準測試,而非獨立測試結果(Google)。

  • DeepSWE v1.1(長時程軟件工程): 77.9%,Google 稱此為真實世界長時程工程任務的全新最高水準。
  • Vals Index: Argon 在此指數中排名第一,該指數衡量金融、程式開發、法律及稅務工作的經濟影響,並按各行業對美國 GDP 的貢獻加權計算。
  • AutomationBench(Zapier): 以 51.3% 的分數排名第一,衡量跨核心業務功能的端到端執行能力。
  • LVBench(長視頻理解): 91.7%,Google 稱此為業界最高水準。
  • CWE-bench v1(漏洞修復): 以 68% 的最高分並列第一。

Google 亦分享了內部測試結果:據稱 Argon 協助量子研究人員在數分鐘內將已發表的基準線提升了 40%,並且 Argon 智能代理生成了一個 Rust 視頻解碼器(用於 libgav1),其運行速度比現有 Rust 移植版本快 2.7 倍,且輸出結果完全相同。請將這些視為說明性的內部案例,而非可重現的基準測試。

Gemini 4 Argon 定價

Google 設定了入門定價:

  • 每百萬輸入 token 2 美元
  • 每百萬輸出 token 10 美元
  • 快取輸入 token 較輸入 token 價格享有 95% 折扣

入門期結束後,標準定價將上調至每百萬輸入 token 4 美元及每百萬輸出 token 20 美元(Google)。如果您正在規劃使用 Argon,請注意 100 萬輸出上限加上前沿級別的輸出定價,意味著長時程、token 密集的推理軌跡成本可能迅速攀升——請著重為輸出而非輸入預算。

在防禦性網絡安全領域領先

網絡安全是本次發布的核心。Google 訓練 Argon 在防禦方面具備高度能力:它能夠自主發現、驗證並修補關鍵軟件漏洞。對於受信任的防禦者及 Google 自身的內部團隊,Google 表示將在不設網絡安全護欄的情況下發布 Argon,以便他們充分利用其前沿級別的防禦能力(Google)。

Google 引用的一個早期案例:安全廠商 Wiz 透過其 Scan for Good 計劃使用 Argon,發現了一個關鍵漏洞,該漏洞導致全球醫院使用的醫療軟件中的敏感個人信息遭到洩露——Google 表示這是一個之前的前沿模型均未能發現的嚴重風險。

這延續了 Google 從 Gemini 3.8 Flash Cyber 變體開始的網絡安全方向,將自主漏洞發現與修補能力擴展至前沿級別的模型。

安全性與分階段推出

由於 Argon 具備前沿級別的能力——包括網絡安全方面——Google 在廣泛發布前對其進行了限制並強化了安全措施。Google 表示正在:

  • 參與美國政府的自願性發布前模型訪問流程。
  • 根據其前沿安全框架(Frontier Safety Framework)拒絕有害的網絡安全及 CBRN(化學、生物、放射性、核武器)請求,同時保留合法的雙重用途研究。
  • 強化對間接提示注入(indirect prompt injection)的防禦——即隱藏在上下文中的惡意指令試圖劫持模型——Google 聲稱在 Gray Swan 的間接提示注入基準測試中具有領先的穩健性。
  • 監控 Argon 的思維鏈及行動,以發現偏差並在必要時停止執行(Google)。

誰能獲得 Gemini 4 Argon,以及何時獲得

訪問權限分階段開放:

  • 現在: 透過 Fairwind Program 的受信任網絡安全防禦者,以及 Google 內部團隊。
  • 下一步: 開發者、企業及消費者,從付費 API 客戶及 Google AI Ultra 訂閱者開始。

簡而言之,Argon 目前尚未全面開放。如果您開發智能代理,實際的建議是現在先做好規劃,而非立即開始原型開發——並密切關注付費 API 的開放時間。

如果您開發智能代理,這值得關注嗎?

Argon 的設計——長推理軌跡、大量工具調用及 100 萬輸出上限——直接對應智能代理的工作負載:程式碼庫遷移、多步驟金融或法律研究,以及跨多個文件的安全修復。目前待解答的問題是前沿輸出定價下的成本,以及何時能在 Fairwind 之外實際調用它。在此之前,較新的 Gemini 3.8 Flash 仍是高容量智能代理循環的可用選項。

用您自己的 AI 工作團隊來完成這些任務

像 Gemini 4 Argon 這樣的前沿模型,只有在有系統將其編排成真實的多步驟工作時才能發揮價值——包括規劃、調用工具,以及端到端完成任務。Eigent 是一款開源「協作」桌面應用程式:一支在本地運行的多智能代理工作團隊,讓您能夠將強大的模型應用於程式開發、研究及文件工作流程,同時將數據保留在您的設備上。了解智能代理工作團隊如何處理審查 GitHub PR,或閱讀我們對 Gemini 3.8 Flash 在程式開發與智能代理方面的分析。下載 Eigent,打造您自己的 AI 工作團隊。

Recent Posts

Eigent Release Notes v1.0.5: Session Recovery, Task Queues & Better Previews
產品Sep 25, 2026

Eigent Release Notes v1.0.5: Session Recovery, Task Queues & Better Previews

Eigent v1.0.5 improves Session recovery, task queues, process and file previews, Space settings, and model support.

Douglas LaiDouglas Lai
Claude Opus 5.5:新功能、基準測試與定價
Sep 22, 2026

Claude Opus 5.5:新功能、基準測試與定價

Claude Opus 5.5 詳解:首個 Claude 5.5 模型,比 Opus 5 便宜 40%,輸出速度提升 30%,全新代理編程基準測試、定價及安全評分。

EigentEigent
GPT-6 Sol 與 Luna:OpenAI 更具價格優勢的編程與智能代理模型
Sep 22, 2026

GPT-6 Sol 與 Luna:OpenAI 更具價格優勢的編程與智能代理模型

GPT-6 Sol 與 Luna 以大幅降價及更強編程能力,將 OpenAI GPT-6 系列延伸至 Astra 以下。本文涵蓋最新變化、基準測試結果,以及各模型的適用場景。

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

立即試用 Eigent

下載開源桌面 app。你的 AI workforce,直接在你電腦上運行。

下載 Eigent
Eigent

獲取 AI workforce 自動化的最新更新、教學與版本消息。

感謝訂閱!

產品Eigent環境定價企業方案
探索解決方案使用案例技能外掛網誌
開發者文件GitHubCAMEL-AIOpen Source Fund合作夥伴
下載適用於開源版
公司關於我們品牌招聘使用條款私隱政策安全與信任Cookie 政策退款與試用政策

版權所有 © 2026 EIGENT UK LTD