Google Gemini 4 Argonの料金と性能:出力100万トークン・入力2ドル・業務評価約51% - 生成AIビジネス活用研究所

Google Gemini 4 Argonの料金と性能:出力100万トークン・入力2ドル・業務評価約51%

2026年10月4日 2026年10月3日 AIの知識&トレンド

Google Gemini 4 Argonの料金と性能:出力100万トークン・入力2ドル・業務評価約51%

  • Googleが9月30日に新AIモデル「Gemini 4 Argon」を発表し、比較表では約7割の項目で首位に立ちました。
  • 出力上限は100万トークンに広がり、導入時の価格は入力2ドル・出力10ドルと、最新モデルとしては安めです。
  • ただし提供は防御担当者などに限られ、一般向けの開始日は未発表です。

2026年9月30日、Googleがいよいよ新しいAIモデル「Gemini 4 Argon」を発表しました。Googleが公開した比較表では、GPT-6 AstraやClaudeを上回る数字が並びます。

ただ、使えるのは限られた人だけです。提供は、Google DeepMindが運営するFairwind Programの「信頼できるサイバー防御担当者」から始まっていて、一般向けの開始日は発表されていません。

この記事では、発表の中から3つの数字を読みます。業務評価の「約51%」、出力上限の「100万トークン」、導入時の「入力100万トークン当たり2ドル」。性能、仕様、費用の3つです。

比較表で見ると、Argonは約7割の項目で首位

Gemini 4 ArgonがGPT-6 AstraやClaude Opus 5.5に勝った項目と負けた項目を棒グラフで比べた図。専門業務や長い入力、動画では首位で、ターミナル作業や一部の開発では他社が上を示す

Googleは、発表に合わせて、GPT-6 Astra、Claude Fable 5.1、Claude Opus 5.5と並べた比較表を公開しました。これまでGPTとClaudeが競ってきた領域に、Googleが最新モデルを並べてきた形です。数字は、Googleが集めた報告値です。

Argonは、19行の評価のうち13行で単独首位、1行で同率首位でした。残る5行は他社が首位です。主な項目を、Argon、Astra、Opus 5.5の順で並べます。

勝った項目です。

  • AutomationBench(業務の一連の実行を測る評価):約51%、約41%、約43%
  • Vals Index(金融・開発・法律・税務を、米国のGDPへの寄与で重み付けした指標):約69%、約63%、約67%
  • DeepSWE v1.1(長期の開発作業):約78%、約74%、約74%
  • GraphWalks 256K〜100万トークン(長い入力の中の関係をたどる評価):約84%、約72%、約67%
  • LVBench(長い動画の理解):約92%、約88%、約84%
  • CWE-bench v1(脆弱性の修正):68.0%、68.0%、67.0%で、AstraとArgonが同率首位

負けた項目です。

  • FrontierSWE v2(開発):55.0%、65.5%、62.3%。Astraが首位
  • Terminal-Bench 4.0(ターミナル作業):57.4%、58.2%、66.4%。Opus 5.5が首位

約7割で首位ですが、開発の一部では他社が上です。専門業務や長い入力の理解で大きく勝ち、ターミナルを使う開発作業では、他社が先に行く。そういう形です。

出力上限は100万トークン。読むだけでなく、作ることまで一度に

出力上限が従来の6万4000トークンからArgonの100万トークンへ広がることを、小さなプリンターと大きなプリンターで比べた図。作る・測る・直すの往復を回しやすくなることを示す

Googleは、Argonの出力トークンの上限を、従来の6万4000から100万に広げ、「業界最大」だと説明しています。公式ページで確かめると、GPT-6 Astraの最大出力は12万8000、Claude Opus 5.5も12万8000でした。Argonの上限は、約8倍にあたります。

入力が100万トークンというモデルは、もう珍しくありません。前世代のGemini 3.1 Proも、入力は最大100万トークンでした。差がつくのは、読める量ではなく、書ける量です。

出力が大きいと、資料を読ませて終わりではなく、作ることまでを、一度の流れで任せられます。作って、測って、直す。この往復を回しやすくなる、ということです。

Googleが示した例が、動画の復号に使うオープンソースのソフト「libgav1」です。Argonのエージェントは、既存のRust版にあった、約3万2000行の高速化用コードを、安全なRustで書き直しました。性能の測定を何度も繰り返し、結果は既存のRust版より約2.7倍速く、動画の出力は同一でした。

価格は入力2ドル・出力10ドル。最新モデルとしては安い

100万トークン当たりの入力と出力の価格を比べた図。Gemini 4 Argonの導入時は2ドルと10ドル、Claude Opus 5.5は4ドルと20ドル、GPT-6 Astraは10ドルと50ドルを示す

Googleが示した導入時の料金は、入力100万トークン当たり2ドル、出力100万トークン当たり10ドルです。同じ入力を使い回すときの「キャッシュされた入力」は、入力料金から95%引きになります。

他社の最新モデルの標準価格を、入力/出力の順で並べます。

  • Claude Sonnet 5.5:2ドル/10ドル
  • OpenAIのGPT-6.1 Sol:2ドル/10ドル
  • Claude Opus 5.5:4ドル/20ドル
  • GPT-6 Astra:10ドル/50ドル
  • Claude Fable 5.1:10ドル/50ドル

Argonの導入時の価格は、SonnetやSolと同額です。最上位のAstraやFable 5.1と比べると、5分の1です。最新の上位モデルとしては、単価は安い方です。

ただし、これは導入期間の価格です。期間が終わると、入力4ドル、出力20ドルになります。Opus 5.5と同額です。

しかも、実際の費用は、単価だけでは決まりません。やり直しの回数など、使い方の効率にも左右されます。いくらかかるかは、使ってみないと分からない、というのが現時点の答えです。

提供はまだ限られる。他社も、まず限定から広げてきた

限定提供、安全対策を強める、一般向けへ広げるの3段階を階段で示した図。まず限定して出し、守りを固めてから広げる流れを表す

発表の時点で、Argonを使えるのは、Fairwind Programの参加者とGoogle社内のチームです。Fairwind Programは、政府のサイバー当局や重要インフラ事業者など、信頼できるパートナーに、サイバー脅威への先行利益を与えるための枠組みです。

この人たちには、サイバー対策の制限(cyber guardrails)を外した版が渡されます。事例として、セキュリティ企業のWizが、病院が世界中で使う医療ソフトの重大な脆弱性を見つけました。従来の先端モデルは見逃していたと、Googleは報告しています。

一般向けに広げる前に、Googleは、悪用の防止、プロンプトインジェクション対策、行動の監視、実行環境の隔離の4つで、安全対策を強めるとしています。

この流れは、他社も同じです。GPT-6 Astraは、発表の時点では限られた組織への提供から始まり、数日かけて広がりました。Claudeでは、一般向けにFable 5.1を出す一方で、Claude Mythos 5.1は招待制のままです。

まず限定して出し、守りを固めてから広げる。Argonも同じ道をたどるなら、有料API利用者とGoogle AI Ultra加入者へ、そのうち広がると考えられます。

提供が始まる前に、準備しておくこと

自分の仕事1件を、合格条件、使うツール、人が確認する地点に分け、他のモデルと比べられる状態にする準備を示した図

準備として、自分の仕事を「1件」の単位に切っておきます。何ができたら合格か、どのツールを使うか、人が確認する地点はどこか。これを決めておけば、提供が始まった日に、同じ条件で他のモデルと比べられます。

自分の仕事1件で測れる状態にしておくことが、いちばんの準備です。

最後に、もう一つ。ここ最近は、エージェントアプリの時代になり、ChatGPTやClaudeが存在感を増してきました。GoogleもAntigravityなどを出してはいますが、やや出遅れた印象がありました。

Gemini 4 Argonで、モデルの面では、その差を詰めてきた形です。アプリの面の展開は、まだ発表されていません。モデルとアプリの両方が揃えば、Googleがまた強くなっていく可能性があります。期待して待ちましょう。

よくある質問(FAQ)

Q1. Gemini 4 Argonは今すぐ使えますか?

一般にはまだ使えません。発表の時点で使えるのは、Google DeepMindが運営するFairwind Programの参加者とGoogle社内のチームだけです。一般向けの開始日は発表されていません。

Q2. Gemini 4 Argonの料金はいくらですか?

導入時の料金は、入力100万トークン当たり2ドル、出力100万トークン当たり10ドルです。キャッシュされた入力は入力料金から95%引きになります。導入期間が終わると、入力4ドル、出力20ドルになります。

Q3. Gemini 4 ArgonはGPT-6 AstraやClaudeより性能が高いですか?

Googleの比較表では、19行の評価のうち13行で単独首位、1行で同率首位でした。ただし、FrontierSWE v2ではGPT-6 Astra、Terminal-Bench 4.0ではClaude Opus 5.5が首位です。数字はGoogleが集めた報告値です。


最新のAIモデルを、自分の仕事1件で測って、使い倒すところまで。AIを徹底的に使いこなすためだけのコミュニティ「フロンティア・リーダーズ」:https://frontier-leaders.vercel.app/

2時間で、AI活用術を実践のハンズオンで学べます(過去回のアーカイブ):https://handson.workstyle-evolution.co.jp/

AIニュースの解説は、YouTube『いけともch』で:https://www.youtube.com/@iketomo-ch

■合わせて読みたい
■関連記事

公式LINEで最新ニュースをゲット

LINE登録の無料特典
LINE登録の無料特典
icon

最新のAIニュースを
毎週お届け

icon

生成AIの業務別の
ビジネス活用シーン

がわかるAIチャット

icon

過去のAIニュースから
事実を確認できる
何でもAI相談チャット

icon

ニュース動画の
アーカイブ

ページトップへ