Gemini 4 Argon の防御側向けビルドは、あなたが呼び出すものとは別物
Google は新しいフロンティアモデルへのアクセスを、サイバー関連の安全策の有無で分けています。3.8 Flash のときと同じで、Anthropic が Mythos でとった方法とも同じです。開発者向けビルドはまだ調整中なので、ベンチマーク表に載っているのは、開発者がその形では手にしないモデルです。
Google は9月30日に Gemini 4 Argon を発表しました。ベンチマーク表と価格、そして100万トークンの出力上限つきです。ただ、誰が呼び出せるかは別の話です。Argon はまず Google の Fairwind Program を通じて「信頼されたサイバー防御者」に展開され、開発者に届くのはその後、誰も日付を口にしていない時期になります。
順番待ちとして読めば、開発者は同じモデルを数週間遅れで受け取るだけ、ということになります。しかし Google 自身の投稿はそうは言っておらず、そこが表のどの部分に価値があるかを変えます。
開発者は今日 Gemini 4 Argon を呼び出せるのか?
いいえ。発表によれば、アクセスは「できるだけ早く」広げられ、まず有料 API 顧客と Google AI Ultra の契約者が対象になります。10月1日時点で Gemini API の変更履歴には Argon の項目もモデル ID もありません。日付のない関門はもうひとつあります。Google はアクセス拡大と並行して、米国政府の任意のリリース前アクセス手続きに参加していると述べています。
価格はすでに公開されています。入力100万トークンあたり $2、出力 $10 で、キャッシュされた入力は95% 引きです。脚注には「導入期間の終了後」は $4 と $20 になるとありますが、それがいつなのかは投稿のどこにも書かれていません。つまり、実行できないモデルの費用を、終了日のない料金で見積もれるわけです。標準料金は Opus 5.5 の定価と同じで、導入料金は Sonnet 5.5 と同じです。
「防御者が先」は単なる遅れなのか?
これは安全策による切り分けで、Google 自身がそう書いています。
For trusted defenders and our own internal teams at Google, we'll be releasing Argon without cyber guardrails so they can leverage its full frontier-level cybersecurity defense capabilities.それ以外の人が Argon を受け取るのは、Google が「ガードレールについて」改良を重ねた後です。Google はこの切り分けを前にも行っています。9月2日には Gemini 3.8 Flash と 3.8 Flash Cyber が同じ日に出ました。「同じ基盤となる知能」で動き、Cyber 版は「より緩やかな緩和策」を備え、Fairwind のパートナーだけに提供されました。Argon では、今のところ緩やかな側しか出ていません。
Anthropic も今年、同じ道をたどりました。Project Glasswing は4月7日に Claude Mythos Preview を限られたパートナーに提供し、Anthropic は Preview を一般公開する予定はないとしていました。6月9日には Fable 5 と Mythos 5 が同時に登場します。基盤のモデルはひとつで、Mythos では安全策が外され、Fable はどこでも使えます。Fable はサイバー、バイオ、蒸留に関するとフラグが立ったリクエストを Opus 4.8 に回し、Anthropic によればそれはセッションの5% 未満です。Mythos 5.1 のページは現在これを「Project Glasswing 参加者向けの Claude Fable 5.1」と呼んでおり、招待制です。
ですから Argon が API に来るとき、それはガードレールつきの版で、その版はまだ完成していません。
ベンチマーク表は開発者に何を教えてくれるのか?
Google の結果表では、Argon は DeepSWE v1.1 で77.9%、Vals Index で68.9%、AutomationBench で51.3%、CWE-bench v1 で68% となっており、CWE-bench では GPT-6 Astra と並んでいます。Gray Swan の間接プロンプトインジェクションのテストについては、Fairwind のページが k=15 で攻撃成功率0.7% と報告しています。このうちいくつかは外部の運営者によるものです。Vals AI、Zapier のリーダーボード、CWE-bench のリーダーボード、Gray Swan。どれも、アクセスのない開発者には再実行できません。
評価方法のメモは5ページ読む価値があります。コンピューター操作の2行は「安全フィルターを有効にした状態で」実行され、フラグの立った応答は空文字列として扱われました。サイバー関連の行については、ガードレールの有無にまったく触れていません。また Argon の DeepSWE のスコアは mini-swe-agent のハーネスで自社算出したもので、隣に並ぶ Fable 5.1 と Opus 5.5 の数字はそれぞれのシステムカードからの引用です。Vals での Opus 5.5 との差は68.9対67.0です。
どのビルドで表を作ったにせよ、それはあなたが呼び出すものではありません。そちらはまだ調整中だからです。DeepSWE なら差はおそらく小さいでしょう。しかし CWE-bench とプロンプトインジェクションの結果では、その差こそが問題のすべてです。セキュリティタスクの一部を断る、あるいは Fable のように弱いモデルに回すガードレールつきのモデルは、そうしないモデルとは違うスコアになります。
「Argon を待つ」と書かれたロードマップはどうすべきか?
条件の分からない依存関係として扱ってください。頻繁に変わるモデルについて私が決めたルールは、バージョンを固定し、指標を事前に決めておくことでした。アクセス制限つきのローンチは、まだ何も固定できないケースです。モデル ID もガードレールも価格期間の長さも、それを前提に計画を立てた後でやってきます。
本来なら進めるはずの移行を止めないでください。今日呼び出せるモデルだけが、今日測定できるモデルです。Argon の評価は今のうちに作っておきましょう。Opus 5.5 の記事のカナリアが骨組みになります。実際のリクエスト、自分のパーサー、そしてエラーを隠さず明示的に失敗させること。そこに普段から見ている安い指標を足し(自分の場合は出力の長さと構造要素の数)、依存関係の監査や認証コードのレビューのようなセキュリティ寄りのタスクでは、拒否されたり質が落ちたりして返ってきたものを数えます。そうすれば、Argon の初日はモデル ID を差し替えるだけで済みます。
どの役割に合うかも、表では決まりません。定期実行のエージェントを Opus 5 に移したとき、よりエージェント的なモデルはワーカーの役割よりレビュアーの役割に合っていて、長くなった出力は、範囲の決まったワーカーを悪影響を与えた原因のひとつでした。1回の応答で100万トークンを書くように作られたモデルにも、向き不向きがあります。どの役割に合うかは、ベンダーの表には書いてありません。
設定ファイルに書けるモデル ID はまだありません。評価のほうには、それは要りません。