powered by TechFeed
表示モード
Google

GoogleのGemini 4 Argon、1回の回答で出力できる量が従来の16倍に — まずサイバーセキュリティの防衛者から限定展開

10月2日、gHacksが「Google Launches Gemini 4 Argon With a 1 Million Token Output Limit, Starting With Cyber Defenders」と題した記事を公開した。Googleが新モデル「Gemini 4 Argon」を発表した。最大の特徴は、1回の応答で生成できるトークン数が最大100万に達する点であり、これは従来のGeminiシリーズ上限(64,000トークン)の約16倍にあたる。コードベース全体の一括監査や数十万行規模のリファクタリングといった、これまで複数回の推論に分割せざるを得なかったタスクを単一セッションで処理できる水準だ。まず審査済みのサイバーセキュリティ防衛者向けに限定展開が始まっている。

10月2日、gHacksが「Google Launches Gemini 4 Argon With a 1 Million Token Output Limit, Starting With Cyber Defenders」と題した記事を公開した。Googleが新モデル「Gemini 4 Argon」を発表した。最大の特徴は、1回の応答で生成できるトークン数が最大100万に達する点であり、これは従来のGeminiシリーズ上限(64,000トークン)の約16倍にあたる。コードベース全体の一括監査や数十万行規模のリファクタリングといった、これまで複数回の推論に分割せざるを得なかったタスクを単一セッションで処理できる水準だ。まず審査済みのサイバーセキュリティ防衛者向けに限定展開が始まっている。


出力トークン上限が「64,000→100万」に

Gemini 4 Argonの中核をなす技術的変更は、1回の推論で生成できるトークン数の上限が最大100万に引き上げられた点だ。従来のGeminiシリーズの出力上限は64,000トークンであり、今回はその約16倍の拡張となる。

トークンの出力上限は、モデルが1度の推論でどれだけの量を生成し、思考を継続できるかを直接規定する。上限が低いと、大規模なコード生成やドキュメント作成を途中で打ち切ったり、複数のリクエストに分割したりする必要が生じる。Googleはこの制約を「長期・多段階タスク」の主要な障壁とみており、Argonはコードベース全体の一括監査や、大規模な移行プロジェクトを最初から最後まで一貫して処理するような用途を想定している。

なお、「Argon(アルゴン)」というサブネーミングは元素記号Ar(原子番号18)の希ガス元素に由来するとみられる。Googleはこれ以前にも開発コード等で元素名を用いるケースがあり、モデルのバリアントを元素名シリーズで区別する命名規則が採用されている可能性がある。ただし、Googleはこの命名規則について公式な説明を現時点では行っていない。※編集部の考察


Google社内での実績

GoogleはすでにArgonを自社のエンジニアリングチームおよびインフラチームに展開しており、以下の具体的な成果をGoogleは公表している。

  • レガシーC/C++コードのRust移行:コアメディアライブラリや、FuchsiaのZirconカーネル(FuchsiaはGoogleが開発するオープンソースOS、ZirconはそのマイクロカーネルコンポーネントでC/C++で記述されている)の80万行超のコードを対象に実施
  • libgav1(GoogleのオープンソースAV1動画デコーダーライブラリ)のRust版最適化:同一出力を維持しつつ、処理速度が2.7倍に向上したとGoogleは主張している
  • サーバーフリートのテレメトリ分析:Argonエージェントのチームがメモリ最適化を発見し、300テラバイト超を解放。最大1ペタバイトのコスト削減が見込まれるというのがGoogleの発表値だ

セキュリティ分野でも成果が報告されている。Googleはセキュリティ企業Wizと「Scan for Good」イニシアティブを通じて連携し、Argonが世界中で使われている病院向けソフトウェアの深刻な脆弱性(機密データの露出につながるもの)を発見したとしている。Googleによれば、これ以前のフロンティアモデルはいずれもこの脆弱性を見逃していたという。上記の数値・成果はいずれもGoogleの発表に基づくものであり、独立した第三者による検証は現時点で確認されていない。


段階的展開:まずはサイバー防衛者限定

現時点では、Gemini 4 Argonは無料のGeminiユーザーには提供されない。展開の順序は以下のとおりだ。

  1. Fairwindプログラムを通じた審査済みのサイバー防衛者(現在進行中)
  2. 有料のGemini APIティア(開発者向け、時期未発表)
  3. Google AI Ultraサブスクライバー(消費者向け、時期未発表)

「Fairwindプログラム」はGoogleが運営するサイバーセキュリティ従事者向けの審査・アクセス管理プログラムであり、参加者は資格審査を経た上でモデルへのアクセスが付与される。一般公開に先立ち、高度な自律性を持つモデルをセキュリティ分野の専門家に限定して提供し、安全性・有効性の検証を行う位置付けとGoogleは説明している。

段階的な展開の背景には、このレベルの自律性を持つモデルが必要とする計算リソースの確保と、厳格な安全基準の適用がある、とGoogleは述べている。APIの料金体系や、Google AI Ultraでの提供開始日は現時点で公表されていない。


競合との文脈

今回の発表は、OpenAIが9月にGPT-6 SolおよびLunaをリリースしたのに続くものだ。大規模言語モデルの出力長競争と、エンタープライズ向けの長期タスク対応が業界全体のトレンドとして加速している状況がある。出力トークン上限や長文コンテキスト処理をめぐる各社の競合状況は引き続き激しく、今後も各社からの発表が続くとみられる。GoogleとOpenAIがそれぞれ異なるアプローチで出力長・自律タスク処理の限界を押し上げている構図だ。

詳細はGoogle Launches Gemini 4 Argon With a 1 Million Token Output Limit, Starting With Cyber Defendersを参照していただきたい。