Googleは現地時間2026年6月、新たなAIモデル「Gemini 3.8 Flash」をリリースした。前モデル「Gemini 3.7 Flash」の登場からわずか数週間という異例の速さでの後継登場となる。Googleは同モデルについて、複雑なタスクにおいてより多くの推論ステップを実行し、「ツールを反復的に呼び出す」ことで、より「懸命に働く」と説明している。1ミリオントークンあたりの入力価格は0.75ドル、出力価格は3.75ドルと、3.7 Flashと同じ導入価格に設定されたが、実際の利用コストは増加する可能性が指摘されている。
性能向上の代償?トークン消費量の増加が示す実態
Gemini 3.8 Flashは、従来モデルと比較して「より高い努力レベル(effort levels)」で性能を最大化するために、より多くのトークンを消費する可能性があるとGoogleは警告している。これは単に価格表上の数値が同じでも、タスクあたりの総コストが上昇しうることを意味する。開発者にとっては、トークン使用量を最小限に抑えたい場合、従来のGemini 3.7 Flashを引き続き利用する選択肢も用意されている。
この点について、AIモデル評価プラットフォームを運営するArtificial Analysisは、実測データに基づく興味深い分析を公開している。同社の測定によれば、Gemini 3.8 Flashは「このレベルの知能において、我々が測定した中で最も安価なモデル」であるとしながらも、タスクあたりのコストは「Gemini 3.7 Flashから約40%増加している」という。この増加の内訳は、タスクあたりの出力トークン数が30%増加したことに加え、エージェント型評価(agentic evaluations)におけるターン数が増加したためとされている。
競合モデルとの比較——Anthropic Opus 5と同水準のコーディング品質か
初期の評価では、Gemini 3.8 Flashのコーディング能力に対する称賛が相次いでいる。Aigora.aiのCEOであるJohn Ennis氏は、Gemini 3.8 Flashについて「Opus 5と同等のコーディング品質を、はるかに低いコストで、かつ超高速で実現する」と評価。「Remotionビデオの生成のような用途には最高だ」と述べ、コストパフォーマンスの高さを強調した。
この発言は、Anthropicが今週初めに発表した「Claude Fable 5a」のアップグレードと対比される形で注目を集めている。Fable 5もまた、より強力なパフォーマンスを低価格で提供することを謳っており、特にキャッシュデータ利用時の価格引き下げを実施している。両社が「高性能」と「低コスト」の両立を巡って激しく競争している構図が浮き彫りになっている。
ソフトウェア工学と自律エージェント分野での優位性
Googleによると、Gemini 3.8 Flashはソフトウェア工学と自律型AIエージェントの分野で「大幅な改善」を達成している。特に注目すべきは、ソフトウェアエンジニアリングベンチマーク「DeepSWE v1.1」において、前モデルだけでなく、AnthropicのFable 5など他のフロンティアモデルをも上回るスコアを記録した点だ。
さらに、金融エージェントベンチマーク「Vals Finance Agent V2」や、法律分野のエージェントベンチマーク「Harvey’s Legal Agent」においても、競合他社のモデルを凌駕する性能を示している。これらの結果は、単なるチャットボットとしての応答能力ではなく、実際の業務フローの中で自律的にツールを操作し、課題を解決する「エージェントとしての実用性」に焦点が当てられている点で重要である。
セキュリティ特化モデルと「Fairwind Program」の立ち上げ
今回のリリースでは、通常版に加えて、サイバーセキュリティに特化した「Gemini 3.8 Flash Cyber」も同時発表された。このモデルは政府機関や「信頼できるパートナー」に限定して提供される新しいプログラム「Fairwind Program」を通じて配布される。
Fairwind Programには、CrowdStrikeやCenter for Internet Securityなど650のメンバーが参加しており、参加組織は3.8 Flash Cyberと、Googleのエージェント「CodeMender」を利用できる。CodeMenderは、脆弱性を自律的に発見・修正し、重要インフラや公共サービス、国家安全保障を保護することを目的としているという。一方で、通常版のGemini 3.8 Flashには、化学・生物・放射線・核(CBRN)およびサイバー攻撃の領域における悪用を防ぐための安全対策が標準で組み込まれているとGoogleは説明している。
日本語ユーザーへの実務的な影響と評価のポイント
Gemini 3.8 Flashは、コンシューマー向けには「Google AI Pro」または「Ultra」サブスクリプション契約者向けに、開発者およびエンタープライズユーザー向けにも本日より利用可能となっている。APIの料金体系は据え置かれたものの、モデル自体がより多くのトークンを生成する特性を持つため、従来と同じタスクを処理する際のコストが増加する点には注意が必要だ。
特に、エージェント型のワークフローを構築している開発者にとっては、トークン消費量の増加がそのまま運用コストの増大に直結する。性能向上を歓迎しつつも、ユースケースによってはGemini 3.7 Flashを使い続ける判断も合理的になりうる。Googleが従来モデルの利用継続を明示的に認めている点も、このコスト増加の懸念を裏付けるものと言えるだろう。
AIモデルの進化が「性能」と「コスト」のトレードオフをどう解消していくのか。Gemini 3.8 Flashの登場は、単なるアップデートではなく、エージェントAIの実用化時代における新たな価格競争の幕開けを示唆している。