フューチャリスト・シリーズ
エルデシュ問題を解くAI。次に何が起こるのか?

数ヶ月前まで、この質問はほとんど哲学的なものでした:人工知能が数学の未解決問題を解決することができるとしたら、人間の天才という概念はどうなるのでしょうか。
その質問はもう理論的なものではありません。OpenAIとGoogle DeepMindの2つの最近の開発は、AIが数学のアシスタントから数学の参加者へと移行していることを示唆しています。数学者を完全に置き換えるという意味ではありません。生成、検索、チェック、そして時には専門家の検証に耐える議論を生み出すという、より正確で重要な意味でです。
最初の開発はOpenAIから来ました。OpenAIは、内部の汎用推論モデルが、1946年にPaul Erdősによって提起された有名な問題である、平面単位距離問題で突破口を生み出したことを発表しました。この問題は、平面上の点のペアがちょうど1ユニット離れているペアの数を求めるものです。数十年間にわたり、数学者たちは、グリッド状の構成が基本的に最適であると考えていました。OpenAIのモデルは、新しい構成のファミリーを発見し、その信念を覆しました。
2番目の開発はGoogle DeepMindの研究者から来ました。彼らは、論文「Advancing Mathematics Research with AI-Driven Formal Proof Search」を発表しました。彼らのシステム、AlphaProof Nexusは、オープンな研究レベルの問題に対するAI駆動の証明生成を評価し、最も強いエージェントが9つのオープンなエルデシュ問題を自律的に解決したと報告しました。また、オンライン整数シーケンス百科事典から44のオープンな推測を証明しました。
これらの結果は、変化を示しています。重要な話は、AIが数学を突然解決したわけではないということです。重要な話は、AIシステムが研究ループ自体の中で動作し始めているということです。
エルデシュ問題がAIにとって真剣なテストである理由
Paul Erdősは歴史上最も多作な数学者の1人で、彼の仕事に関連する問題は数学において特別な位置を占めています。多くの問題は簡単に述べることができますが、解決するのは難しく、組み合わせ論、数論、グラフ理論、離散幾何学などの深い分野に接続されています。
これは、エルデシュ問題がAIの推論力のベンチマークとして特に有用であることを意味します。学校の演習問題ではありません。また、リーマン予想のような巨大な、理論を覆す予想でもありません。代わりに、多くのエルデシュ問題は、中間領域にあり、進歩は正しい接続、正しい構成、または見落とされた補題を見つけることに依存しています。
これは、AIが最も役立つ初期段階です。現代の推論システムは単なる計算機ではありません。多くの可能な証明パスを探索し、部分的な戦略を比較し、隣接する分野からの遠いアイデアを取得し、議論が厳密になるかどうかをテストすることができます。
OpenAIの結果は、モデルが既知のルートを単に磨き上げただけでなく、離散幾何学と代数的数論の間の予想外の橋を見つけたため、印象的です。那は、数学者が通常、真正の創造性と関連付ける概念的なジャンプです。
OpenAIと単位距離の突破
平面単位距離問題は簡単に説明できます。平面上にn個の点を置き、ちょうど1ユニット離れている点のペアの数を数えます。目標は、nが増加するにつれてその数がどれだけ大きくなるかを理解することです。
約80年間にわたり、数学者たちは、最良の構成はグリッドベースの配置を劇的に上回ることはないと考えていました。OpenAIのモデルは、新しい構成のファミリーを生成し、予想される境界を多項式で改善しました。
これは2つの理由で重要です。1つ目は、数学的な絵が変わります。数論的な構成が離散幾何学に貢献する可能性が、多くの研究者が考えていたよりも高いことを示唆しています。2つ目は、AIの絵が変わります。使用されたシステムは、特定の問題だけに構築されたシステムではなく、汎用の推論モデルと説明されました。
言い換えれば、システムは、単に既知の証明を思い出すのではなく、未知の研究設定に推論力を転送したようです。外部の数学者は、結果を重要な貢献と見なしました。
Google DeepMindと形式証明探索
Google DeepMindの論文は、別の重要な質問に取り組んでいます:AIによって生成された数学を信頼できるものにするにはどうすればよいのでしょうか。
言語モデルは、微妙な間違いを含む美しい議論を生み出すことができます。通常の文章では、そのような間違いは検出するのが難しいかもしれません。数学では、1つの間違ったステップで全体の証明が無効になる可能性があります。これが、形式証明システムが重要な理由です。形式証明システムは、議論が説得力があるかどうかは気にしません。すべての論理的なステップをチェックする必要があります。
AlphaProof Nexusは、その制約をワークフローの一部として使用します。AIエージェントは、形式証明システムで証明の試行を生成し、コンパイラからのフィードバックを受け取り、修正し、検索を続けます。より強いバージョンは、サブエージェントを調整し、より高度な証明ツールを使用して検索を集中させます。
| 開発 | AI方法 | 重要性 |
|---|---|---|
| OpenAIの単位距離結果 | 汎用推論モデル | AIが著名な未解決問題のための独創的な構成を生み出すことができることを示した |
| Google DeepMindのAlphaProof Nexus | 形式証明探索を導くLLM | AIが複数の未解決のエルデシュ問題を正式に解決できることを示した |
| 形式証明の検証 | コンパイル済みの論理 | 説得力のあるが無効な数学的出力を伴うリスクを軽減する |
DeepMindの結果は、AIの推論と検証を結び付けることで特に重要です。システムは、自然言語チャットボットが信頼される必要があるのと同じ方法で信頼される必要はありません。証明はコンパイルされますか、それ以外の場合はコンパイルされません。
数学研究への影響
現在の教訓は、数学者が古くなったわけではありません。ボトルネックが数学の中で変化している可能性があるということです。
歴史的に、研究者はほとんどすべてを行う必要がありました:問題を定式化する、文献を調査する、アイデアをテストする、証明を構築する、毎ステップをチェックする、結果を伝える。AIは、その作業を再分配する可能性があります。作業のいくつかの部分は、より速く、より安く、より自動化される可能性があります。
- AIは、人間が時間を費やす前に、多くの証明ルートを探索できます。
- 形式システムは、人間の専門家による緩いチェックが必要なステップを検証できます。
- 研究者は、AIを使用して、遠い数学のサブフィールドを検索できます。
これにより、新しい研究スタイルが生まれる可能性があります。数学者は、答えをAIに尋ねるのではなく、証明エージェントの艦隊を監督することになるかもしれません。人間の役割は、計算機のようなものから、研究ディレクターのようなものへと変化します:正しい問題を選択する、結果を解釈する、機械で発見された結果の概念的な重要性を検出する、そしてどのパスがより深い注意を必要とするかを決定する。
限界はまだ現実的
この瞬間を過大評価しないことが重要です。Google DeepMindのシステムは353の試みられたエルデシュ問題のうち9つを解決しました。印象的ですが、ほとんどの問題はまだ解決されていません。OpenAIの単位距離結果は重要な里程標ですが、すべての有名な予想が今すぐに到達可能であることを意味するわけではありません。
AIシステムはまだ、問題が新しい概念フレームワークを必要とする場合、関連する数学が貧弱に形式化されている場合、または証明が簡単に検索可能なステップに分解できない場合に苦労します。形式証明ライブラリも不均一です。成熟したLeanカバレッジを持つ領域は、AIエージェントにとって、基礎となる材料がまだエンコードされる必要がある領域よりもアクセスしやすいです。
- システムはまだ人間の問題選択と解釈に依存しています。
- 形式化は、定義が曖昧または未開発である場合に難しい場合があります。
- AIによって生成された証明の試みは、未証明の補助的な主張の中に厳しい作業を隠す可能性があります。
これらの限界は失敗ではありません。次の進歩がどこで起こる必要があるかを明確にします。より優れた定理証明エージェント、豊富な形式ライブラリ、より強力な検証ワークフロー、人間とAIのより効果的なインターフェースがすべて重要になります。
AIがエルデシュ問題を解決した後には何が来るのか
最も可能性の高い近い将来は、AIがすべての数学を解決するという劇的な瞬間ではありません。きれいな問題文、強力な形式ライブラリ、そして大量の断片化された以前の作業を持つドメインへの、AI支援研究の着実な拡大です。
組み合わせ論、グラフ理論、数論、最適化、離散幾何学は自然な初期ターゲットです。これらの分野には、質問は簡潔ですが、解決策は遠い場所からのアイデアを縫い合わせることに依存する問題が多く含まれています。AIはそのような検索に適しています。
時間の経過とともに、同じパターンは数学を超えて拡大する可能性があります。モデルが難しい議論を保持し、中間的な主張をテストし、アイデアをフィールド間で接続できる場合、その能力は物理学、生物学、材料科学、暗号理論、AI研究自体でも重要になります。
より深い結果は文化的なものです。数学は証明を重視してきましたが、味覚も重視してきました:どの質問が重要か、どの抽象化が価値があるか、どの結果が分野の形を変えるかを知る能力。証明探索がより自動化されるにつれて、味覚はより重要になるかもしれません。
結論:天才はスタックを上昇させる
以前の質問の答えは今や明確です。AIが数学の未解決問題を解決できる場合、人間の天才は消滅しません。代わりに、スタックを上昇させます。
希少なスキルは、単独で技術的なステップをすべてこなす能力ではありません。正しい質問を尋ねる能力、正しい抽象化を構築する能力、機械で発見された結果の意味を判断する能力、AIシステムを重要な問題に向ける能力です。
OpenAIの単位距離の突破とGoogle DeepMindの形式証明探索の結果は、人間の数学的創造性の本を閉じるのではなく、新しい章を開きます。数学者は、個々の心よりも速く地形を探索できるシステムと協力することができる章です。
数学の未来は、人間や機械のみに属するものではありません。人間と機械の両方を協力させることを学んだ研究者に属する可能性があります。












