Grok 4.7に対する最も厳しい評価は、質問から逃げそうにない人物の口から出た。9月27日、xAI創業者のイーロン・マスク氏は中国メディアグループ(CMG)のインタビューに応じ、Grok 4.7がAnthropicの新モデルOpus 5.5に及ばないことを認めた。彼の言葉は「a solid workhorse of a model」(堅実な働き者のモデル)であり、「リリースされたばかりのOpus 5.5ほど良くはない」というものだった。テスラのグローバルエンジニアリング本部で行われたこのインタビューで、マスク氏は競合との差を異例なほど具体的に数値化した。xAIが本格的にAIに取り組んで約3年、Anthropicは約6年であり、「来年のどこかで」フロンティアに追いつけるとの見通しを示した。
具体的に何を語ったか
差を認めただけでなく、マスク氏はこれまで公表されていなかった事業上のシグナルも明かした。
- Grok Botの急成長:xAIのパーソナルデジタルアシスタント「Grok Bot」は「月におよそ100%成長」しており、同氏が名指しした最も成長の速い製品群の一つだ。
- 現実世界へのデータ戦略転換:xAIはこれまでSpaceXの学習データの「ほんの一部」しか使っておらず、今後はテスラの学習データも取り込む計画だ。狙いはAIを「現実世界のエンジニアリング」(real world engineering)に強くすることであり、Anthropicの強みはAIをソフトウェアエンジニアリングに強くすることだという。
- 中国モデルへの評価:中国のAIモデルは優秀で、単位計算量あたりの性能は世界一だとし、中国は2〜3年以内にリソグラフィとチップの計算制約を解決すると予測した。
インタビューではCybercabのテキサスでの商用運用、10年以内に人型ロボットが10億台を超えるという予測、「ユニバーサル・ハイ・インカム」(universal high income)も語られたが、これらは同氏おなじみの長期ビジョンであり、上記3点ほどの情報量はない。
従来の口調との違い
マスク氏がGrokを語る際はこれまで「すべてを超える」という攻めの姿勢が多かった。Opus 5.5に及ばないことを公に認め、追いつく時期を「来年」と明言したのは、事実上の期待値管理だ。短期的な遅れをまずテーブルの上に置き、物語をxAI独自のデータの堀へと向け直した形である。
時系列も注目に値する。Opus 5.5は9月22日にリリースされ、直ちにText Arenaの首位に立った(本欄の9月27日AIブリーフィング参照)。Grok 4.7は7月末からの高速リリースサイクル下での主力バージョンであり、以前の評価ではエージェント型コーディングでトップ4入りを果たす一方、1タスクあたり約8万トークンを消費することが分かっている。「solid workhorse」という評価は、このプロファイルとほぼ一致する。頼れる働き者だが、最強ではない。
「敗北宣言」の裏にある3つのシグナル
第一に、競争の焦点は「どちらのモデルが賢いか」から「誰のデータを他者が手に入れられないか」へ移りつつある。 AnthropicはAIをソフトウェアエンジニアリングの専門家に仕立て上げ、xAIはロケット、工場、自動運転から蓄積された現実の物理データを堀に変えようとしている。ただし、マスク氏自身が認めた通り、SpaceXのデータは「今のところほんの一部」しか使われていない。この物語はまだ青写真の段階であり、Grok 4.5がSpaceXとテスラでプライベートテストに入ったときに埋められた伏線が回収できるかは、今後の投資次第だ。
第二に、Grok Botの月100%成長は、xAIの重心が消費者向けパーソナルアシスタントへ傾いていることを示す。 フロンティアの研究所はどこも「モデル以外」の成長曲線を探している。Metaも最近、パーソナルエージェントにハードウェアを組み合わせる動きを見せている。一般ユーザーにとって、Grokの今後の体験向上は、基盤モデルそのものよりもBotのような製品形態からもたらされる可能性が高い。
第三に、開発者のモデル選定への示唆は明快だ。 フロンティア級の能力が必要なタスクでは、現時点ではOpus 5.5がより堅実な選択肢であり、Grok 4.7の位置づけは「頼れる働き者」だ。コストと安定性に敏感で、極限の能力を求めないシナリオに向いている。xAIが現実世界のエンジニアリングデータを本当に活用し始めたとき、この判断は初めて書き換えられる可能性がある。