2026年9月30日、Googleがいよいよ新しいAIモデル「Gemini 4 Argon」を発表しました。Googleが公開した比較表では、GPT-6 AstraやClaudeを上回る数字が並びます。
ただ、使えるのは限られた人だけです。提供は、Google DeepMindが運営するFairwind Programの「信頼できるサイバー防御担当者」から始まっていて、一般向けの開始日は発表されていません。
この記事では、発表の中から3つの数字を読みます。業務評価の「約51%」、出力上限の「100万トークン」、導入時の「入力100万トークン当たり2ドル」。性能、仕様、費用の3つです。
目次

Googleは、発表に合わせて、GPT-6 Astra、Claude Fable 5.1、Claude Opus 5.5と並べた比較表を公開しました。これまでGPTとClaudeが競ってきた領域に、Googleが最新モデルを並べてきた形です。数字は、Googleが集めた報告値です。
Argonは、19行の評価のうち13行で単独首位、1行で同率首位でした。残る5行は他社が首位です。主な項目を、Argon、Astra、Opus 5.5の順で並べます。
勝った項目です。
負けた項目です。
約7割で首位ですが、開発の一部では他社が上です。専門業務や長い入力の理解で大きく勝ち、ターミナルを使う開発作業では、他社が先に行く。そういう形です。

Googleは、Argonの出力トークンの上限を、従来の6万4000から100万に広げ、「業界最大」だと説明しています。公式ページで確かめると、GPT-6 Astraの最大出力は12万8000、Claude Opus 5.5も12万8000でした。Argonの上限は、約8倍にあたります。
入力が100万トークンというモデルは、もう珍しくありません。前世代のGemini 3.1 Proも、入力は最大100万トークンでした。差がつくのは、読める量ではなく、書ける量です。
出力が大きいと、資料を読ませて終わりではなく、作ることまでを、一度の流れで任せられます。作って、測って、直す。この往復を回しやすくなる、ということです。
Googleが示した例が、動画の復号に使うオープンソースのソフト「libgav1」です。Argonのエージェントは、既存のRust版にあった、約3万2000行の高速化用コードを、安全なRustで書き直しました。性能の測定を何度も繰り返し、結果は既存のRust版より約2.7倍速く、動画の出力は同一でした。

Googleが示した導入時の料金は、入力100万トークン当たり2ドル、出力100万トークン当たり10ドルです。同じ入力を使い回すときの「キャッシュされた入力」は、入力料金から95%引きになります。
他社の最新モデルの標準価格を、入力/出力の順で並べます。
Argonの導入時の価格は、SonnetやSolと同額です。最上位のAstraやFable 5.1と比べると、5分の1です。最新の上位モデルとしては、単価は安い方です。
ただし、これは導入期間の価格です。期間が終わると、入力4ドル、出力20ドルになります。Opus 5.5と同額です。
しかも、実際の費用は、単価だけでは決まりません。やり直しの回数など、使い方の効率にも左右されます。いくらかかるかは、使ってみないと分からない、というのが現時点の答えです。

発表の時点で、Argonを使えるのは、Fairwind Programの参加者とGoogle社内のチームです。Fairwind Programは、政府のサイバー当局や重要インフラ事業者など、信頼できるパートナーに、サイバー脅威への先行利益を与えるための枠組みです。
この人たちには、サイバー対策の制限(cyber guardrails)を外した版が渡されます。事例として、セキュリティ企業のWizが、病院が世界中で使う医療ソフトの重大な脆弱性を見つけました。従来の先端モデルは見逃していたと、Googleは報告しています。
一般向けに広げる前に、Googleは、悪用の防止、プロンプトインジェクション対策、行動の監視、実行環境の隔離の4つで、安全対策を強めるとしています。
この流れは、他社も同じです。GPT-6 Astraは、発表の時点では限られた組織への提供から始まり、数日かけて広がりました。Claudeでは、一般向けにFable 5.1を出す一方で、Claude Mythos 5.1は招待制のままです。
まず限定して出し、守りを固めてから広げる。Argonも同じ道をたどるなら、有料API利用者とGoogle AI Ultra加入者へ、そのうち広がると考えられます。

準備として、自分の仕事を「1件」の単位に切っておきます。何ができたら合格か、どのツールを使うか、人が確認する地点はどこか。これを決めておけば、提供が始まった日に、同じ条件で他のモデルと比べられます。
自分の仕事1件で測れる状態にしておくことが、いちばんの準備です。
最後に、もう一つ。ここ最近は、エージェントアプリの時代になり、ChatGPTやClaudeが存在感を増してきました。GoogleもAntigravityなどを出してはいますが、やや出遅れた印象がありました。
Gemini 4 Argonで、モデルの面では、その差を詰めてきた形です。アプリの面の展開は、まだ発表されていません。モデルとアプリの両方が揃えば、Googleがまた強くなっていく可能性があります。期待して待ちましょう。
一般にはまだ使えません。発表の時点で使えるのは、Google DeepMindが運営するFairwind Programの参加者とGoogle社内のチームだけです。一般向けの開始日は発表されていません。
導入時の料金は、入力100万トークン当たり2ドル、出力100万トークン当たり10ドルです。キャッシュされた入力は入力料金から95%引きになります。導入期間が終わると、入力4ドル、出力20ドルになります。
Googleの比較表では、19行の評価のうち13行で単独首位、1行で同率首位でした。ただし、FrontierSWE v2ではGPT-6 Astra、Terminal-Bench 4.0ではClaude Opus 5.5が首位です。数字はGoogleが集めた報告値です。
最新のAIモデルを、自分の仕事1件で測って、使い倒すところまで。AIを徹底的に使いこなすためだけのコミュニティ「フロンティア・リーダーズ」:https://frontier-leaders.vercel.app/
2時間で、AI活用術を実践のハンズオンで学べます(過去回のアーカイブ):https://handson.workstyle-evolution.co.jp/
AIニュースの解説は、YouTube『いけともch』で:https://www.youtube.com/@iketomo-ch