未公開版のClaude、160年来のリーマン予想の難問で下界を41.6%→67.2%に更新

30秒でわかる

  • AnthropicがClaudeの未公開の研究版に、数学の超難問「リーマン予想」を挑戦させた
  • 予想は解けなかったが、関連する問題で下界(証明できる範囲の下限)を41.6%→67.2%へ更新した
  • 2人の数学者と外部専門家が検証し、機械で検証できる証明(Lean)も作成した

何が変わった

Anthropicが、まだ一般公開していない研究段階のClaude ↗に、160年以上未解決の数学の難問「リーマン予想」を直接解かせる実験をしました。予想自体は解けませんでしたが、関連する問題で「リーマン予想を満たすゼロ点の割合」の下界を、従来の41.6%から67.2%へ更新しました(下界=少なくともこれだけは成り立つと証明できる下限の数値)。Claudeは最初のセッションで650個の失敗案を出したあと、約60個の子分(サブエージェント)に分担させ、2,400回のコマンド実行や数千回の数値チェックを重ね、合計3,100万トークンを使ってこの結果に到達しました。

誰に関係する

AIがどこまで研究の役に立つかに関心がある人向けの話題です。Anthropicの数学者2名(Levent Alpöge氏・Ralph Furman氏)と外部の専門家が内容を検証し、機械で正しさを確かめられる形の証明も用意されています。ただしAnthropic自身が「この手法でリーマン予想そのものが証明できるとは考えていない」と明言しており、あくまで挑戦の副産物です。

公式情報

公式(Anthropic Research: Claude's mathematical capabilities / Riemann zeta) ↗