Gemini 4 Argon:新機能、ベンチマーク、料金
Googleの新フロンティアモデルは、コーディング、法律、金融、サイバーセキュリティ防衛にわたる長期・多段階の作業向けに設計されています — 実際に何が変わったのかを解説します。

GoogleはGemini 4 Argonを発表しました。長期・多段階のワークフローにわたって深い推論を持続するために設計された新しいフロンティアモデルです。その特徴は、実際のソフトウェアエンジニアリング、法律・金融などのエンタープライズ知識業務、そしてサイバーセキュリティ防衛における最先端のパフォーマンスです — 1つのプロンプトではなく、エージェントが多くのステップを踏む必要があるタスクに対応します。このガイドでは、新機能、Googleが公開したベンチマーク、料金、100万出力トークン制限への拡張、そして優先アクセス対象者について解説します。
Gemini 4 Argon とは?
Gemini 4 Argonは、Googleの最新フロンティアモデルであり、「フロンティアインテリジェンスの新時代」として位置づけられています。Googleは、複雑な長期ワークフローにわたって深い推論を持続し、実際のソフトウェアエンジニアリング、法律・金融などのエンタープライズ知識業務、サイバーセキュリティ防衛において最先端のパフォーマンスを発揮するモデルとして説明しています(Google)。
発表は2026年9月30日です。通常のモデルリリースとは異なり、Argonはリリース初日から広く利用可能になるわけではありません — GoogleはまずFairwindプログラムを通じて信頼できるサイバー防衛担当者に展開し、ガードレールを強化しながら開発者、企業、一般ユーザーへと順次拡大していく予定です(Google)。
Gemini 4 Argon の新機能
開発者にとって最大の変更点は、1回のパスでより長く思考できる能力です。
- 100万出力トークン制限。 Googleはモデルの出力トークン制限を業界最大の100万トークンに大幅拡張しました(従来の64Kから引き上げ)。モデルが1つのトラジェクトリで数十万トークンを生成できる余裕を持つことで、推論の深度が新たなレベルに達し、難しい問題を一度に解決できるとしています(Google)。
- 長期タスクへの特化。 Argonは、計画立案、ツール使用、多くのステップにわたるタスク継続を必要とする作業向けに調整されています — 日常的なデバッグから大規模なコードベース移行まで対応します。
- マルチモーダル知識業務。 Googleは、視覚的理解が必要なタスク — 専門的なチャート分析、長い動画からの詳細抽出、一連のドキュメントにわたる操作 — における強みを強調しています。
参考として、これはGoogleの最近のGemini 3.8 Flashアップデートよりも大きなリリースです。Argonはコスト効率の高い大量処理向けではなく、最も難しく長いタスクを対象としたフロンティア層のモデルです。
Gemini 4 Argon ベンチマーク
以下の数値はすべてGoogleのリリース資料に基づいており、独立したテストではなくベンダー報告のベンチマークとして参照してください(Google)。
- DeepSWE v1.1(長期ソフトウェアエンジニアリング): 77.9%。Googleは実際の長期エンジニアリングタスクにおける新たな最先端スコアと位置づけています。
- Vals Index: 金融、コーディング、法律、税務業務にわたる経済的影響を米国GDPへの各セクターの貢献度で重み付けして測定するこのインデックスで、Argonがトップモデルとなっています。
- AutomationBench(Zapier): コアビジネス機能にわたるエンドツーエンドの実行を測定し、51.3%のスコアで1位にランクされています。
- LVBench(長時間動画理解): 91.7%。Googleは最先端スコアとして引用しています。
- CWE-bench v1(脆弱性修正): 68%のトップスコアで1位タイ。
Googleは内部結果も共有しています。Argonが量子研究者を支援し、公開済みのベースラインを数分で40%上回る成果を達成したこと、またArgonエージェントがlibgav1向けのRustビデオデコーダーを生成し、既存のRustポートより2.7倍高速で同一の出力を実現したことを報告しています。これらは再現可能なベンチマークではなく、例示的な内部事例として扱ってください。
Gemini 4 Argon 料金
Googleは導入価格を設定しています:
- 入力トークン:100万トークンあたり2ドル
- 出力トークン:100万トークンあたり10ドル
- キャッシュ済み入力トークン: 入力トークン価格から95%割引
導入期間終了後、標準価格は入力100万トークンあたり4ドル、出力100万トークンあたり20ドルに引き上げられます(Google)。Argonを活用した計画を立てる場合、100万トークンの出力上限とフロンティア出力価格の組み合わせにより、トークン消費量の多い長いトラジェクトリはコストが急増する可能性があります — 入力だけでなく出力のコストも予算に組み込んでください。
サイバーセキュリティ防衛における優位性
サイバーセキュリティはこのリリースの中心テーマです。Googleは防衛において高い能力を持つようにArgonを訓練しました。重大なソフトウェア脆弱性を自律的に発見、検証、修正することができます。信頼できる防衛担当者とGoogleの内部チームに対しては、サイバーガードレールなしでArgonをリリースし、フロンティアレベルの防衛能力をフルに活用できるようにするとしています(Google)。
Googleが挙げる初期事例の1つ:セキュリティベンダーのWizが「Scan for Good」イニシアチブを通じてArgonを使用し、世界中の病院で使用されているヘルスケアソフトウェア全体で個人情報を露出させる重大な脆弱性を発見しました — 以前のフロンティアモデルでは見逃されていた深刻なリスクだとGoogleは述べています。
これは、GoogleがGemini 3.8 Flash Cyberバリアントで開始したサイバー方向性を基盤とし、自律的な脆弱性発見とパッチ適用をフロンティア層のモデルに拡張するものです。
安全性と段階的なロールアウト
Argonはサイバーを含むフロンティアレベルの能力を備えているため、Googleは広範なリリース前にアクセスを制限し、セーフガードを強化しています。同社は以下を実施しています:
- リリース前のモデルアクセスに関する米国政府の自発的プロセスへの参加。
- Frontier Safety Frameworkに基づき、有害なサイバーおよびCBRN(化学・生物・放射線・核)リクエストを拒否しつつ、正当なデュアルユース研究を保護。
- 間接プロンプトインジェクション(コンテキストに隠された悪意ある指示がモデルを乗っ取ろうとする攻撃)への対策強化 — GoogleはGray SwanのIndirect Prompt Injectionベンチマークで最高水準の堅牢性を主張しています。
- Argonの思考連鎖とアクションを監視し、不整合を検出して必要に応じて実行を停止(Google)。
Gemini 4 Argon のアクセス対象と時期
アクセスは段階的に展開されます:
- 現在: Fairwindプログラムを通じた信頼できるサイバー防衛担当者、およびGoogleの内部チーム。
- 次のステップ: 有料APIユーザーとGoogle AI Ultraサブスクライバーを皮切りに、開発者、企業、一般ユーザーへ順次拡大。
つまり、Argonはまだ一般提供(GA)リリースではありません。エージェントを開発している場合、実践的な対応としては今すぐプロトタイプを作るのではなく、将来の活用に向けて計画を立て、有料APIの公開を待つことをお勧めします。
エージェント開発者が注目すべき理由
Argonの設計 — 長いトラジェクトリ、大量のツール使用、100万トークンの出力上限 — は、エージェント型ワークロードに直接対応しています:コードベース移行、多段階の金融・法律調査、多数のファイルにまたがるセキュリティ修正などです。未解決の課題は、フロンティア出力価格でのコストと、Fairwind以外でいつ実際に呼び出せるかという点です。それまでの間、新しいGemini 3.8 Flashが大量エージェントループのアクセスしやすい選択肢であり続けます。
自分だけのAIワークフォースで実践する
Gemini 4 Argonのようなフロンティアモデルは、実際の多段階作業 — 計画立案、ツール呼び出し、タスクの完遂 — にオーケストレーションされて初めて真価を発揮します。Eigentはオープンソースの「Cowork」デスクトップアプリです。ローカルで動作するマルチエージェントワークフォースで、データを手元に置きながら、優れたモデルをコーディング、リサーチ、ドキュメントワークフローに活用できます。エージェントワークフォースがGitHub PRのレビューをどのように処理するかをご覧いただくか、コーディングとエージェント向けGemini 3.8 Flashの解説をお読みください。Eigentをダウンロードして、あなた自身のAIワークフォースを構築しましょう。
Recent Posts

Eigent Release Notes v1.0.5: Session Recovery, Task Queues & Better Previews
Eigent v1.0.5 improves Session recovery, task queues, process and file previews, Space settings, and model support.

Claude Opus 5.5:新機能、ベンチマーク、価格
Claude Opus 5.5の解説:Claude 5.5初モデル、Opus 5より40%低コスト、出力速度30%向上、エージェント型コーディングの新ベンチマーク、価格、安全性について。

GPT-6 SolとLuna:OpenAIの低価格コーディング・エージェント向けモデル
GPT-6 SolとLunaは、大幅な価格削減とコーディング性能の向上によりOpenAIのGPT-6ファミリーをAstraより下位に拡張します。変更点、ベンチマーク結果、各モデルの使い分けを解説します。