
記事の理解を助けるための画像
グーグルが次世代AIモデル「Gemini 4 Argon」を発表
グーグルは2026年9月30日(現地時間)、新たな人工知能(AI)モデル「Gemini 4 Argon」を公開した。グーグルは、実際のソフトウエア開発、法律・金融分野を含む企業の知識業務、サイバーセキュリティ防御など、複雑な作業で最前線級の性能を提供するモデルだと説明している。
発表文は、グーグル・ディープマインドのコレー・カブクチュオール氏(上級副社長兼グーグル首席AIアーキテクト)名義で公開された。
開発・映像分野のベンチマークで高い数値
グーグルによると、Gemini 4 Argonはソフトウエア開発能力を評価する「DeepSWE v1.1」で77.9%を記録した。VentureBeatが示した比較では、Claude Opus 5.5は74.2%、GPT-6 Astraは74.1%だった。
また、業務自動化性能を測るAutomationBenchでは51.3%で首位に立ったとしている。映像理解を評価するLVBenchでは91.7%を記録し、VentureBeatが掲載したGPT-6 Astraの87.5%、Claude Opus 5.5の83.7%を上回った。法律分野のAI評価「Harvey Legal Agent」では19.6%だった。
すべての開発評価で首位ではなく、競争続く
一方で、Gemini 4 Argonがすべての開発関連評価でトップだったわけではない。VentureBeatの比較では、「FrontierSWE v2」でGPT-6 Astraが65.5%を記録し、Argonの55.0%を上回った。
「Terminal-Bench Science 0.1」でもGPT-6 Astraが68.1%、Argonが57.6%となったほか、「Terminal-bench 4.0」ではClaude Opus 5.5が66.4%でArgonの57.4%を上回った。サイバーセキュリティ評価「CWE-bench v1」では、グーグル発表によるとArgonと3.8 Flash Cyberがともに68%で首位だった。
グーグルは、信頼できる防御組織や自社内部チーム向けには、サイバー関連の安全機能を調整したArgonを提供する計画も明らかにした。
独立評価では41モデル中1位、提供範囲は段階的に拡大
独立評価機関Vals AIの「Vals Index」では、Gemini 4 Argonは68.90%で41モデル中1位となった。テスト当たりのコストは15.68ドルと集計され、Claude Sonnet 5.5は67.04%、Claude Opus 5.5は66.97%だった。
Argonは一部の評価項目で高い結果を示した一方、「Top 10 Agents」のBest Overallでは7.92%で8位となるなど、評価項目によって順位に差も出ている。
グーグルはArgonの出力トークン上限を従来の64Kから100万トークンへ拡大したと発表した。価格については、提供開始時は入力100万トークン当たり2ドル、出力100万トークン当たり10ドルで、初期期間終了後は入力4ドル、出力20ドルの標準価格に移行するとしている。
現在、Argonは「Fairwind Program」を通じて一部のサイバー防御組織へ段階的に提供されており、一般利用はまだ広く開始されていない。グーグルは今後、有料API利用者やGoogle AI Ultra加入者を皮切りに、開発者、企業、一般消費者へ提供範囲を広げる方針を示している。
コメント
コメントを投稿