AIの実力ランキングでClaude Opus 5.5が58点の1位に。同じ日に出たGPT-6 Sol・Lunaは料金が半分(Artificial Analysis)

30秒でわかる

  • 第三者の評価機関Artificial Analysisの総合指標で、Claude Opus 5.5(最大設定)が58点の1位。これまで首位だったFable 5.1の53点を上回った
  • OpenAIのGPT-6 Sol・Lunaは、点数は前の世代(GPT-5.6)とほぼ同じで、料金はほぼ半分
  • 性能ならOpus 5.5、安さならGPT-6 Lunaという分かれ方。どちらも測定した時点での目安

何が変わった

9月22日、AnthropicのClaude Opus 5.5と、OpenAIのGPT-6 Sol・GPT-6 Lunaがほぼ同時に公開されました。AIの実力を複数のテストで点数にしている第三者の評価機関Artificial Analysis ↗によると、総合指標「Intelligence Index」でOpus 5.5を一番考える設定(Max)で使うと58点になり、1位でした。10種類のテストのうち6つで最も高い点を取っています。一方、GPT-6 SolとLuna ↗は、点数は前のGPT-5.6とほぼ変わらず、料金がほぼ半分になりました。100万トークン(文章の量の単位)あたりの料金は、Solが入力$4・出力$20から$2・$10へ、Lunaが$0.20・$1.20から$0.10・$0.50へ下がっています。同じテスト一式を解かせた1問あたりの費用は、GPT-6 Solが$1.06、Lunaが$0.07と測定されています。参考までに、Opus 5.5のAPI料金は入力$4・出力$20です。点数はこの評価機関のテストでの結果で、実際の使い心地は用途によって変わる可能性があります。

誰に関係する

どのAIを選ぶか、性能と料金を比べて決めたい人に関係します。点数を重視するならOpus 5.5、大量の作業を安く回したいならGPT-6 Lunaが候補になりそうです。

公式情報

Artificial Analysis(Claude Opus 5.5の測定結果) ↗