2026年7月9日、AI業界では珍しい光景が見られます。SpaceXAIの新モデル「Grok 4.5」と、OpenAIの新モデル「GPT-5.6」シリーズが、同じ日に一般公開されるのです。どちらも自社の「最強モデル」を名乗り、真っ向からぶつかる形になりました。

「また新しいAIが出たのか。うちも乗り換えたほうがいいのだろうか」──そう感じた方にこそ読んでほしい回です。結論を先に言うと、慌てて乗り換える必要はありません。ただし、今回のラッシュには「性能自慢」以外に、中小企業の実務に効いてくる変化が2つ隠れています。順番に見ていきます。

何が起きたのか ── 2つの“最強”が同日デビュー

**Grok 4.5(SpaceXAI)**は7月8日に発表され、ベータ顧客の好反応を受けて翌9日に一般公開されると報じられています。イーロン・マスク氏は自らこのモデルを「Opus級のモデル。ただし、より高速でトークン効率が高く、低コスト」と表現しています(TechCrunchの報道)。「Opus」はAnthropicの上位モデル系列の名前ですから、他社の看板を引き合いに出して「同じ級で、もっと安い」と宣言したわけです。用途としてはチャットよりも、コーディングや財務作業、自律的に動くエージェント型の仕事に軸足を置いています(Forbesの報道)。

**GPT-5.6(OpenAI)**は同じ7月9日に、性格の違う3種類が同時公開されます(Engadgetの報道)。

  • Sol:最上位。コーディングなど難しい仕事向け
  • Terra:日常業務向け。「前世代並みの性能で半額」をうたう
  • Luna:最速・最低コスト

さらに直近では、Anthropicの新世代モデル「Claude Fable 5」も話題になっており(報道ベース)、この数週間で主要各社の“最上位”が出揃う、まさに新モデルラッシュの様相です。

見どころ①:競争の主戦場が「性能」から「価格」へ

今回の発表で目を引くのは、ベンチマークの点数以上に値札です。API利用の価格(100万トークンあたり)を並べてみます。

モデル入力出力
Grok 4.5$2$6
GPT-5.6 Sol$5$30
GPT-5.6 Terra$2.50$15
GPT-5.6 Luna$1$6

Grok 4.5は「Opus級」を名乗りながら、TechCrunchによれば従来の上位モデル(例:Opus 4.7の入力$5/出力$25)よりかなり安い価格を付けてきました。OpenAIも「同等性能で半額」のTerraを前面に出しています。“最上位級”の実用価格が、そろって下方向に動いているのです。

以前の記事で「AIの単価は下がるのに、使う回数が増えて請求額は増える」という逆説を紹介しました。単価の下落は今も続いています。だからこそ、恩恵を受け取るコツは変わりません。毎日の定型作業は安いモデル、難所だけ上位モデルという「使い分け」です。詳しくはこちら:AIは安くなったのに、なぜ請求書は増えるのか

見どころ②:「公開前に政府審査」という新しい手順

もうひとつ、今回のGPT-5.6には見逃せない経緯があります。実はこのモデル、6月末の時点では「信頼できる少数のパートナー」だけに限定提供されていました。米国で6月に出された大統領令により、強力なAIモデルは一般公開の前に政府へ提出し、審査を受ける枠組みができたためです。GPT-5.6は米商務省の専門機関による追加テストを経て、承認を受けたことで9日の一般公開が認められました(Engadgetの報道)。

「新しいAIは出たらすぐ全員が使える」が当たり前ではなくなり、電波や医薬品のように“審査を通ってから世に出る”存在へ──AIが社会インフラとして扱われはじめた兆候と言えます。EUの規制動向と合わせ、「ルールの中でAIを使う」流れは着実に進んでいます。詳しくはこちら:AIルールの「8月2日」が直前で動いた

気をつけたいこと ── 「最強」は今のところ全部“自己申告”

冷静に押さえておきたいのは、両社の性能主張(「Opus級」「史上最強」「他社モデルを上回る」)が、現時点ではすべて自社測定・自社チャートによるものだという点です。Forbesも「独立したベンチマークデータは示されていない」と明記しています。第三者による再現・検証はこれからです。

以前の記事で書いたとおり、ベンチマークの高得点と「自社の業務で毎日安定して使えること」は別物です。デモの1回成功と、毎日の業務での成功率は違います。詳しくはこちら:AIエージェントは“どこまで任せていいか”

中小企業の実務 ── 乗り換えに疲れない3つの視点

では、この新モデルラッシュと、私たちはどう付き合えばよいのでしょうか。3つの視点をおすすめします。

視点1:ベンチマークではなく「自社の実タスク」で試す

発表資料の点数比較を眺めるより、自社で実際に使っているプロンプトを10本ほど用意して、新旧モデルに同じ仕事をさせて見比べるほうが、よほど確かな判断材料になります。見るべきは「うちの見積書のたたき台がうまく書けるか」「うちの問い合わせ文面を正しく分類できるか」。あなたの会社のテストに勝ったモデルが、あなたの会社の最強モデルです。

視点2:「1社の最新」より「用途別の使い分け」で安くする

価格競争の恩恵は、最新モデルへの一斉乗り換えではなく、使い分けで受け取るのが賢い方法です。今回の発表自体が「日常向けの安いモデル」と「難所向けの上位モデル」のセット構成になっているのがヒントです。大量の定型処理は低価格モデルに、間違えられない難しい仕事だけ上位モデルに──この設計にしておくと、どの会社のモデルが安くなっても恩恵をすぐ取り込めます。

視点3:「乗り換えられる設計」にしておく

半年ごとに勢力図が変わる世界では、特定のモデルに深く縛られないこと自体が資産になります。具体的には、①プロンプトや業務データを自社側で管理して書き出せるようにしておく、②ツール選びでは特定モデル専用ではなく標準規格(MCPなど)対応かを確認する、の2点です。こうしておけば「来月もっと良いのが出た」ときに、静かに乗り換えられます。詳しくはこちら:AIが「バラバラ」から「つながる」へ

まとめ ── 追いかけるのは「発表」ではなく「自社の仕事」

  • 7月9日、Grok 4.5とGPT-5.6が同日一般公開。主要各社の“最強”が出揃う新モデルラッシュに
  • 見どころは性能より価格(最上位級が大幅に安く)と、公開前の政府審査という新手順
  • ただし性能主張は現時点で全部“自己申告”。第三者検証はこれから
  • 中小企業は「実タスクで試す」「使い分けで安く」「乗り換えられる設計」の3視点で、慌てず恩恵だけ受け取る

新モデルの発表は、これからも数か月おきにやってきます。そのたびに騒ぐのではなく、自社の仕事で淡々と試して、良ければ静かに乗り換える。この習慣がある会社が、ラッシュの恩恵をいちばん安く手に入れます。

あわせて読みたい

参考

※本記事は複数の公開情報をもとに作成しています。価格・提供条件は発表時点のもので、変更される場合があります。日本での提供時期・日本語での性能は未確認です。