AIの実力ランキングでClaude Fable 5.1とGPT-6 Astraが同点1位に(Artificial Analysis Intelligence Index v4.3)
30秒でわかる
- 第三者の評価機関Artificial Analysisの総合指標「Intelligence Index」v4.3で、Claude Fable 5.1とGPT-6 Astraが53点の同点1位
- 数日で指標が2回更新され、プログラム操作テスト(Terminal-Bench)が新版に差し替わるなどテスト内容が変化した
- 測定上は料金はFable 5.1がやや安く、出力速度もFable 5.1がやや速い(GPT-6 $7.70/Fable $7.175・毎秒61 vs 69トークン)
何が変わった
Artificial Analysis ↗は、複数のテストでAIモデルの実力を測って点数化している第三者の評価機関です。今回、その総合指標「Intelligence Index」がバージョン4.3に更新され、AnthropicのClaude Fable 5.1とOpenAIのGPT-6 Astraが53点で同点1位になったと公表されました。数日のあいだに指標が2回更新(v4.2→v4.3)され、プログラムを操作する試験「Terminal-Bench」が新版(v4.0)へ差し替わるなど、テスト内容が入れ替わっています。参考として、Artificial Analysisの測定では、料金(100万トークンあたり)はGPT-6 Astraが$7.70、Fable 5.1が$7.175、出力の速さはFable 5.1が毎秒69トークン、GPT-6 Astraが61トークンとされています。これらの数値はこの評価機関が測ったもので、使い方によって体感は変わる可能性があります。
誰に関係する
どのAIが今トップクラスか、料金や速度を横並びで知りたい人に関係します。順位は評価指標の版が変わると入れ替わるので、あくまで測定時点の目安として見るのが安全です。