Gemini 4 Argon 発表、出力トークン上限を100万トークンに拡大
Googleは2026年9月30日(日本時間10月1日)、Geminiシリーズの新モデル「Gemini 4 Argon」を発表しました。
実世界のソフトウェアエンジニアリング、法務や財務といった企業のナレッジワーク、サイバーセキュリティの複雑なワークフローで最先端の性能を発揮するモデルです。
Gemini 4 Argonの概要
Argonは、長期的で複雑なワークフロー全体にわたって深い推論を持続できるよう設計されています。サイバーセキュリティの担当者には、新設された「Fairwind Program」を通じて順次展開されます。Googleは米国政府によるモデルの事前アクセスに関する自主的なプロセスに参加しながら、アクセスを段階的に広げる方針です。開発者や企業、一般消費者への提供に向けては、ガードレールの改良と初期テスターからのフィードバックの収集を続けていくとしています。
導入価格は、100万入力トークンあたり2ドル、100万出力トークンあたり10ドル。キャッシュ済みの入力トークンは、入力トークン価格から95%オフで利用できます。
出力トークン上限は100万トークンへ
長期的で複雑なユースケースに対応するため、出力トークンの上限を従来の6万4千トークンから100万トークンへと拡大しました。1つのプロセスの中で数十万トークンを生成できるようになり、困難な問題を一気に解くための推論力がもたらされるとしています。
Google社内での活用事例
ArgonはすでにGoogle社内のワークフローを支えており、数千人の社員が専門的なコーディングや調査、文章作成でその能力を評価しています。発表では、次のような成果も紹介されました。
・量子アルゴリズムの最適化:量子コンピューティング研究者が、ボトルネックとなるサブルーチンの時空間リソース(量子ビット×ゲート)を最適化。ある事例では数分で公表済みの基準値を40%上回った
・メモリ効率:エージェントがフリート全体のプロファイリングテレメトリを分析し、メモリ最適化を自律的に特定して適用。展開後に300TiB以上のメモリが解放され、合計で500TiBから1PiBの節約を見込む
・コードベースの移行:C/C++からRustへの移行を進行中。re2やlibgav1といったコアライブラリの数万行規模から、Fuchsia Zircon kernelの80万行超まで対象が広がる
・動画デコーダの最適化:libgav1で32K行のSIMDコードを置き換え、既存のRust移植版より2.7倍高速でメモリ安全な動画デコーダを実現
ベンチマークでの成績
長期的なソフトウェアエンジニアリングタスクを測るDeepSWE v1.1では77.9%を記録し、記録を更新しました。財務、コーディング、法務、税務の経済的インパクトを測るVals Indexでは首位。財務リサーチのVals Finance Agent v2やHarvey’s Legal Agent Benchmarkでも先行しています。ZapierのAutomationBenchは51.3%で1位、長尺動画の理解力を測るLVBenchは91.7%でした。
サイバーセキュリティにおける能力
Argonは、重要なソフトウェアの脆弱性を自律的に発見、検証、パッチ適用できます。一部のサイバーセキュリティ担当者とGoogle社内チームには、サイバーガードレールを外した状態で提供されます。
Wizは、公共インフラを無償で保護する取り組み「Scan for Good」でArgonを活用しています。世界中の病院で使われる医療用ソフトウェアに、個人情報を露呈させる重大な脆弱性を発見したとのことで、これまでのフロンティアモデルが見落としていた深刻なリスクだとしています。脆弱性の修復能力を評価するCWE-bench v1では、最高スコアの68%で首位タイとなりました。
安全性と提供方法
ArgonはFrontier Safety Frameworkに沿って、サイバー攻撃や化学・生物・放射性物質・核への悪用を防ぐ設計です。間接的プロンプトインジェクションへの耐性はこれまでで最も高く、Gray SwanのIPIベンチマークで首位に立っています。意図を逸脱した動作を防ぐため、思考プロセスとアクションを監視し、必要に応じて実行を停止する仕組みも導入されました。
提供は段階的に進められ、有料APIの顧客とGoogle AI Ultraユーザーを皮切りに、開発者、企業、一般消費者へと広げる計画です。また、日本での提供時期は現時点では公式に明言されていません。
出典:
Google Japan Blog(Gemini 4 Argon:フロンティア知能の新時代)
関連記事



