AIの実力ランキングでClaude Fable 5.1とGPT-6 Astraが同点1位に(Artificial Analysis Intelligence Index v4.3)

30秒でわかる

  • 第三者の評価機関Artificial Analysisの総合指標「Intelligence Index」v4.3で、Claude Fable 5.1とGPT-6 Astraが53点の同点1位
  • 数日で指標が2回更新され、プログラム操作テスト(Terminal-Bench)が新版に差し替わるなどテスト内容が変化した
  • 測定上は料金はFable 5.1がやや安く、出力速度もFable 5.1がやや速い(GPT-6 $7.70/Fable $7.175・毎秒61 vs 69トークン)

何が変わった

Artificial Analysis ↗は、複数のテストでAIモデルの実力を測って点数化している第三者の評価機関です。今回、その総合指標「Intelligence Index」がバージョン4.3に更新され、AnthropicのClaude Fable 5.1とOpenAIのGPT-6 Astraが53点で同点1位になったと公表されました。数日のあいだに指標が2回更新(v4.2→v4.3)され、プログラムを操作する試験「Terminal-Bench」が新版(v4.0)へ差し替わるなど、テスト内容が入れ替わっています。参考として、Artificial Analysisの測定では、料金(100万トークンあたり)はGPT-6 Astraが$7.70、Fable 5.1が$7.175、出力の速さはFable 5.1が毎秒69トークン、GPT-6 Astraが61トークンとされています。これらの数値はこの評価機関が測ったもので、使い方によって体感は変わる可能性があります。

誰に関係する

どのAIが今トップクラスか、料金や速度を横並びで知りたい人に関係します。順位は評価指標の版が変わると入れ替わるので、あくまで測定時点の目安として見るのが安全です。

公式情報

Artificial Analysis(モデル比較・公式) ↗