1. トップ
  2. トレンド
  3. Google、次世代「Gemini 4 Argon」を発表 OpenAI・Anthropicとの最先端モデル競争が再加速

Google、次世代「Gemini 4 Argon」を発表 OpenAI・Anthropicとの最先端モデル競争が再加速

公開日
2026.10.01
Google、次世代「Gemini 4 Argon」を発表 OpenAI・Anthropicとの最先端モデル競争が再加速

米Googleは9月30日、次世代AIモデル「Gemini 4」シリーズの第1弾「Gemini 4 Argon」を発表した。ソフトウエア開発、法務や金融などの知的業務、サイバー防御の3分野で最高水準の性能をうたう。ただし一般公開はまだで、最初に使えるのは同社が審査したサイバー防御の担い手に限られる。

フラッグシップ不在の10カ月

Googleの最上位モデルは2025年11月の「Gemini 3 Pro」、2026年2月の「Gemini 3.1 Pro」以降、更新が止まっていた。5月の開発者会議で予告した「Gemini 3.5 Pro」は結局登場せず、その間に米OpenAIの「GPT-6」や米Anthropicの「Mythos」が先行したと米IT専門メディアThe Informationは報じている。

巻き返しを託されたのが、8月にDemis Hassabis氏からGoogle DeepMindの指揮を引き継いだKoray Kavukcuoglu氏(Google DeepMind担当上級副社長兼GoogleチーフAIアーキテクト)だ。Hassabis氏は会長職と親会社Alphabetのチーフサイエンティストに移った。Kavukcuoglu氏は9月23日、The Information主催のイベントで、Gemini 4を年末より「ずっと早く」出したいと語り、Googleが最先端に居続けることに「100%の自信がある」と言い切っていた。事前学習の開始は7月21日。そこから約10週間での発表となる(Pasquale Pillitteri氏のブログによる)。

出力上限を15倍超に、価格は競合の半額以下

今回の発表文はKavukcuoglu氏の名前で出された。技術面の目玉は、1回の応答で出力できる分量の上限を従来の6万4000トークンから100万トークンへ引き上げたことだ(トークンはAIが文章を処理する単位)。AI専門ニュースサイトの米MarkTechPostによると、Anthropicの「Claude Opus 5.5」やOpenAIの「GPT-6 Astra」の上限は12万8000トークンで、Argonはその約8倍にあたる(MarkTechPost)。Googleは、数十万トークン分の思考を一続きで生み出せる余裕があれば、難問を一度で解き切る深い推論が可能になると説明する。

価格は導入期間中、入力100万トークンあたり2ドル、出力10ドル。期間終了後は4ドルと20ドルに上がる(発表文)。導入価格はClaude Opus 5.5の半額、GPT-6 Astraの5分の1にあたる(MarkTechPost)。

18項目中12項目で首位、苦手分野も

Googleが公表した比較表で、Argonは18のベンチマークのうち12項目で単独首位に立った(MarkTechPost集計)。長時間にわたる実践的なソフト開発を測る「DeepSWE v1.1」では77.9%と過去最高を記録し、Opus 5.5の74.2%、GPT-6 Astraの74.1%を上回った。業務自動化ツールの米Zapierが作った業務遂行テスト「AutomationBench」でも51.3%で首位。Opus 5.5は42.5%だった。

一方で全勝ではない。難度の高いソフト開発を測る「FrontierSWE v2」ではGPT-6 Astraの65.5%に対し55.0%、コマンド操作の能力を測る「Terminal-Bench 4.0」ではOpus 5.5の66.4%に対し57.4%にとどまった(MarkTechPost)。

社内ではすでに数千人の社員が使っている。Argonのエージェント群はデータセンター全体の稼働データを分析してメモリーの無駄を自ら洗い出し、300TiB超を解放した。最終的な削減量は500TiBから1PiBに達する見込みという。古いC/C++のプログラムを安全性の高い言語Rustに書き換える作業も担い、対象は最大80万行を超えるOSの中核部分に及ぶ(発表文)。

最初に渡す相手はサイバー防御の担い手

提供の順番は異例だ。Argonはまず、Googleの審査を通った企業や政府機関のセキュリティ部門が参加する「Fairwind Program」を通じて配布される。Googleはソフトの重大な脆弱性を自律的に発見、検証、修正できるようArgonを訓練しており、こうした防御側と自社チームには、サイバー関連の安全制限を外した状態で提供する。

実績も示した。クラウドセキュリティの米Wizが公共インフラを無償で守る取り組みでArgonを使ったところ、世界中の病院が使う医療用ソフトに、機微な個人情報が漏れかねない重大な脆弱性を見つけた。従来の最先端モデルが見逃していたものだという(発表文)。

最強のモデルをまず防御側に渡すやり方は、Googleだけのものではない。Fairwind ProgramはAnthropicの「Project Glasswing」やOpenAIの「Daybreak」と同様の枠組みだ(Midas)。3社とも、攻撃にも転用できるほどのサイバー能力を持つモデルを、まず守る側に行き渡らせてから一般に開放する手順を踏んでいる。

一般公開に向けては4分野で安全対策を強化する。サイバー攻撃や生物・化学兵器などへの悪用を防ぐ仕組み、外部の文書に紛れ込ませた悪意ある指示でAIを乗っ取る攻撃への耐性、モデルが利用者の意図を超えて暴走しないよう思考過程と行動を監視して必要なら止める仕組み、そして高リスクの訓練や評価を外部から隔離した環境で行う体制だ。

中でも思考過程の監視では、監視で得た知見を訓練に戻さないよう注意を払ったという。戻せば、Argonが監視をかいくぐる考え方を身につけかねないためだ。Googleはほかの開発企業にも、AIの思考過程を人間が読める状態に保つよう強く呼びかけた。米政府が任意で進める公開前のモデル審査にも参加している(発表文)。

公開時期は未定

一般向けの提供は、API有料顧客と最上位プラン「Google AI Ultra」の加入者から始める予定だが、時期は示していない。ベンチマークと価格で首位争いに戻ったのは確かだ。ただ、開発者や企業が実際に使い比べられるまで、Argonが競合をどこまで引き離したかの答えは出ない。


主なソース