ToolNavs 便利なAIツールを発見
ツール投稿 ログイン
戻るAI情報
Claude Opus 5.5がText Arenaで首位に、1509ポイントでテキストモデルの新記録

Claude Opus 5.5がText Arenaで首位に、1509ポイントでテキストモデルの新記録

AI情報 • Admin • • 5 回閲覧

Claude Opus 5.5がText Arenaで首位に、1509ポイントでテキストモデルの新記録 Claude Opus 5.5はリリースからわずか4日で、テキストモデルの競技場の頂点に立った。9月26日、LMArenaの公式アカウントがXで最新のランキングを発表し、Claude Opus 5.5(High)が1509ポイントでText Arenaの首位にデビュー。同ランキング史上最高のスコアとなった。

Text ArenaはLMArenaのテキストモデル部門のランキングで、世界中のユーザーによる匿名の直接対決投票で順位が決まる。数学、コーディング、創作など複数の領域をカバーする。一発勝負の静的ベンチマークとは異なり、「実際に使ってみてどれが強いと感じるか」に近い指標だ。1509ポイント(誤差約±12)は従来の首位を上回るスコアで、9月22日の正式リリースからわずか4日での快挙となった。

値下げしたモデルが王座に就いた

今回の首位獲得で面白いのは価格だ。Opus 5.5のAPI価格は100万トークンあたり入力4ドル、出力20ドルで、性能はフラッグシップのFable 5.1に迫り、100万トークンのコンテキストウィンドウと最大12.8万トークンの単発出力を備える。一方、OpenAIのフラッグシップGPT-6 Astraは10ドル/50ドル。つまりランキング1位のモデルは、同時にフロンティアで最も安い部類でもある。「最強」と「最安」が両立するのは珍しく、今回は例外的なケースだ。(リリース時の価格・仕様の詳細は、以前のClaude Opus 5.5発表の解説を参照。)

ランキングが示すもの、示さないもの

ただし、この1位は冷静に受け止めたい。Text Arenaは本質的には人間の好みによる投票であり、特定の能力を示す厳密な指標ではない。投票が増えればスコアは変動し、首位も入れ替わる。一般ユーザーにとっての実用的な意味はモデル選びの参考資料だ。長時間のコーディングやエージェント用途でモデルを選ぶなら、Opus 5.5は「ユーザー投票1位」と「最安級のフラッグシップ」という二つの看板を同時に掲げており、試すコストはかつてなく低い。とはいえ「あらゆるタスクで最強」を意味しない。ターミナルエージェントや数学推論の専門ベンチマークでは競合が依然として肉薄している。ランキングは変わるが、価格競争は当分止まりそうにない。

おすすめツール

もっと見る