米OpenAIは6月26日(米国時間)、次世代モデル「GPT-5.6」シリーズを正式に発表した。ラインナップは最上位の「Sol」、日常業務向けの「Terra」、低価格の「Luna」という3モデルで構成される。数週間以内の広範な提供を計画しているが、まずは一部の信頼できるパートナー向けに限定プレビューとして提供を開始する。この慎重な姿勢は、米政府の求めに応じた措置であるという。
GPT-5.6シリーズとは?3モデルの違いと位置づけ
GPT-5.6シリーズは、OpenAIが新たに導入した命名規則に基づき、数字が世代を、Sol、Terra、Lunaが能力階層を示す。Solは最上位モデルで、OpenAIはこれを「サイバーセキュリティで自社最強」と位置づける。TerraはGPT-5.5と同等の性能を約半額で利用できる日常業務向けモデル、Lunaは最も低価格なエントリーモデルだ。3モデルはAPIとコーディング支援ツール「Codex」を通じて提供され、ChatGPTへの展開は後日となる。
性能はコーディングと生物学で向上、Mythos 5を上回る
GPT-5.6では、より長く深く考えさせる「max」モードと、複数の補助エージェントを活用して複雑な作業を高速化する「ultra」モードが新設された。コーディング性能を示す指標「Terminal-Bench 2.1」では、Sol Ultraが91.9%、Solが88.8%を記録し、比較対象のAnthropic「Mythos 5」(88.0%)をわずかに上回った。生物学分野でも、ゲノム解析などの長い手順を要する作業を測定する「GeneBench v1」において、GPT-5.6 Solが前世代のGPT-5.5を少ない出力トークンで上回ったと報告されている。
サイバーセキュリティ分野の「ExploitBench」では、GPT-5.6 SolがAnthropicの「Mythos Preview」と競争力のある結果を、約3分の1の出力トークンで達成。OpenAIはSolを「サイバーセキュリティで自社最強」と位置づける一方、攻撃を最後まで遂行するよりも、脆弱性の発見と修正に優れると説明する。
安全対策と段階公開の背景
高まった能力に対して、OpenAIは過去最も強固な安全対策を適用する。具体的には、禁止されたサイバー支援を拒否するようモデルを訓練し、生成中も不正利用を監視。疑わしい出力が検出された場合、いったん出力を停止し、別の大型モデルが文脈を確認する二段構えの仕組みを採用する。さらに、AI向け半導体「A100」換算で70万時間以上の計算資源を自動攻撃テスト(レッドチーミング)に投入し、広範なシナリオで通用する「脱獄」手法の探索を実施した。
段階的な公開の背景には、米政府との調整がある。OpenAIは発表に先立ち、計画とモデルの能力を政府に伝達。政府の求めに応じて、参加状況を政府と共有する少数のパートナーへの限定提供から開始する。OpenAIはこのような政府を介した手順が常態化することは望まず、「利用者や開発者、サイバー防御の担い手から最良の道具を遠ざけてしまう」と懸念を示す。あくまで広く届けるための短期的な措置と位置づけ、政府とサイバー分野の大統領令の枠組みづくりを進める方針だ。
競合Anthropicも政府指令でアクセス停止
同様の緊張は競合にも波及している。Anthropicは6月12日、米政府の指令を受け、Fable 5とMythos 5へのアクセスを停止した。GPT-5.6 Solの限定プレビューは、サイバー能力を持つ最先端AIの公開をめぐり、企業と政府の調整がより複雑化していることを示す象徴的な動きと言える。
API価格と提供条件
プレビュー期間中のAPI料金は、100万トークンあたりSolが入力5ドル・出力30ドル、Terraが2.50ドル・15ドル、Lunaが1ドル・6ドルに設定された。TerraはGPT-5.5同等の性能を半額で利用できるとされ、競合のAnthropic Mythos 5(入力10ドル・出力50ドル〜)と比較しても、単純なAPI単価ではSolの方が低い。ただしMythos 5は審査済みパートナー向け限定提供が前提であり、現時点ではアクセスが停止されているため、一般ユーザーが直接比較して選択できる状況ではない。
API利用者向けのプロンプトキャッシュも変更される。明示的なキャッシュ区切りと30分の最低保持時間をサポートし、キャッシュ書き込みは通常入力料金の1.25倍、キャッシュ読み取りは入力料金の90%割引となる。7月には米半導体企業Cerebrasの基盤を活用し、毎秒最大750トークンを出力する高速版も限定開始予定だ。
ただし、プレビュー中は安全対策の影響で一部のリクエストが拒否されたり、追加審査による応答遅延が発生する可能性がある。OpenAIは正当な防御目的の作業まで過度に妨げられないよう、プレビュー期間中のフィードバックを基に不要なブロックや遅延の削減を進めるとしている。
今後の展望
GPT-5.6シリーズの発表は、AIモデルの能力向上と安全確保のバランス、そして政府との関係構築という、業界全体が直面する課題を浮き彫りにした。OpenAIは広範な提供を目指しながらも、短期的には政府の意向に沿った形での展開を余儀なくされる。サイバーセキュリティ能力の高まりが、企業の自主性と規制の間で新たな緊張を生む中、今後の業界標準や国際的なルール形成に与える影響は大きい。ChatGPTを含む一般ユーザー向けの展開時期や、高速版の詳細など、今後のアップデートが注目される。