AIモデルが高度な数学問題の解決で画期的な進展を遂げる

先週末、ソフトウェアエンジニアであり、元定量分析研究者、スタートアップ創業者のニール・ソマニ氏が、OpenAIの新しいモデルの数学的処理能力を評価していたところ、驚くべき結果に遭遇した。ChatGPTに問題を投入し、15分間処理させた後、確認してみると、完全な解答が得られていた。彼はその証明を確認し、「Harmonic」というツールを使って検証したところ、すべてが正しかった。
「大規模言語モデルが未解決の数学的問題を効果的に解ける場合と、依然として課題を抱えている場合を区別するための基準を確立したかったのです」とソマニ氏は説明した。予想外の発見は、最新モデルが可能性の限界を押し広げたということだった。
ChatGPTの推論の流れは特に印象的で、レジャンドルの公式、ベルトランの仮説、ダビデの星の定理といった数学的原理をシームレスに適用していた。モデルは最終的に、ハーバード大学の数学者ノアム・エルキーズが関連する問題に対して洗練された解法を示した2013年のMath Overflowの投稿を参照した。 しかし、ChatGPTの最終的な証明はエルキースの研究とは重要な点で異なり、伝説的な数学者ポール・エルデシュが当初提示した問題の変形に対して、より包括的な解決策を提示していた。エルデシュが収集した膨大な未解決問題のリストは、AI能力の試金石となっている。
機械知能に懐疑的な人々にとって、この成果は注目に値するものであり、決して孤立した事例ではない。AIツールは数学の分野で広く普及しており、Harmonic社の「Aristotle」のような形式化に特化したLLMから、OpenAIの「deep research」のような文献レビューシステムに至るまで多岐にわたる。 ソマニ氏が「噂では以前のバージョンよりも数学的推論に長けている」と指摘するGPT-5.2のリリース以来、解決された問題の数は大幅に増加しており、大規模言語モデルが人類の知識のフロンティアを拡大する能力について、新たな疑問を投げかけている。
ソマニ氏は、ハンガリーの数学者エルドシュが提唱し、オンラインでカタログ化されている1,000件以上の予想からなる「エルドシュ問題」を調査していた。トピックや難易度が多岐にわたるこれらの問題は、AI主導の数学的探求における主要な対象となっている。最初の自律的な解法は11月、Geminiを搭載した「AlphaEvolve」というモデルによって提示されたが、最近ではソマニ氏らによって、GPT-5.2が高度な数学において卓越した能力を発揮していることが確認されている。
クリスマス以降、エルドシュ問題のウェブサイトでは15の問題が「未解決」から「解決済み」へと更新され、そのうち11件の解決策では、AIモデルの関与が明示的に記載されている。
著名な数学者テレンス・タオ氏は自身のGitHubページで、この進展についてより詳細な見解を示している。同氏は、AIモデルが自律的に多大な貢献を果たした8つの問題に加え、先行研究を特定しそれを基に進展が得られた6つの事例を挙げている。完全に自律的なAIによる数学的推論は依然として遠い目標ではあるが、大規模モデルが重要な役割を果たし始めていることは明らかである。
Disrupt 2026のウェイティングリストに登録する
Disrupt 2026のウェイティングリストに登録して、早期割引チケットの発売時にいち早くアクセスできる権利を確保しましょう。 過去のDisruptイベントでは、Google Cloud、Netflix、Microsoft、Box、Phia、a16z、ElevenLabs、Wayve、Hugging Face、Elad Gil氏、Vinod Khosla氏といったリーダーたちが各ステージに登壇しました。これらは、あなたの成長を加速させ、競争力を高めるために設計された200以上のセッションを率いる250名を超える業界専門家の一部です。さらに、あらゆる業界でイノベーションを推進する数百のスタートアップと交流する機会もあります。
Disrupt 2026のウェイティングリストに登録する
Disrupt 2026のウェイティングリストに登録して、早期割引チケットの販売開始時にいち早くアクセスできる権利を確保しましょう。 過去のDisruptイベントでは、Google Cloud、Netflix、Microsoft、Box、Phia、a16z、ElevenLabs、Wayve、Hugging Face、Elad Gil、Vinod Khoslaといったリーダーたちが各ステージに登壇しました。これらは、皆様の成長を加速させ、競争力を高めるために設計された200以上のセッションを率いる250名以上の業界専門家の一部です。さらに、あらゆる業界でイノベーションを牽引する数百のスタートアップと交流する機会も得られます。
Mastodon上で、Tao氏は、AIシステムの拡張性により、それらが「あまり知られていないエルドシュ問題の『ロングテール』に取り組むのに特に適している」と指摘しました。実際、それらの問題の多くには単純明快な解決策が存在します。
「その結果、こうしたより取り組みやすいエルデシュ問題の多くは、人間によるアプローチやハイブリッドな手法よりも、純粋にAIベースの手法によって解決される可能性が高まっている」とタオ氏は付け加えた。
もう一つの要因は、形式化への最近の移行です。形式化とは、数学的推論の検証や拡張を容易にする詳細なプロセスのことです。形式化そのものにAIやコンピュータが必須というわけではありませんが、新世代の自動化ツールによってワークフローが大幅に効率化されました。 2013年にマイクロソフトリサーチで開発されたオープンソースの「証明アシスタント」であるLeanは、証明の形式化においてこの分野で広く採用されている。Harmonic社のAristotleのようなAIツールは、現在、この形式化作業の多くを自動化することを約束している。
Harmonicの創業者であるTudor Achim氏にとって、エルドシュ問題が急増して解決されたこと自体は、一流の数学者たちがこれらのツールを真剣に受け止め始めているという事実ほど重要ではない。「私がより関心を持っているのは、数学やコンピュータサイエンスの教授たちが[AIツール]を使っているという事実です」とAchim氏は述べた。「彼らには守るべき評判があります。ですから、彼らがAristotleやChatGPTを使用していると認めることは、意味のある裏付けとなります。」
関連記事
法的争訟の中でSunoが曲に透かしを入れる
Sunoは、ユーザーがAI生成音楽を作成できるプラットフォームであり、プラットフォームが生成したトラックにラベルを付け、ダウンロードを制限し、不正な複製を抑制するためにコミュニティ基準を更新する新機能を公開した。これらの更新は、Sunoがレコードレーベルやアーティスト団体からの複数の訴訟に直面している時期に実施される。共同創設者兼CEOのMikey Shulmanはブログ記事で、プラットフォームの目標が、より広い層にAI音楽ツールのアクセスを拡大しながら、オリジナルの創作を促進することに重点を
ムスク氏はGrokの構築でユーザーのコードが漏洩したことを認め、すべての履歴データを消去すると約束した。
エロン・マスクは、Grok Buildをめぐるプライバシー問題に直接言及し、まず「True」という単純な回答で事件の存在を確認した。彼は、SpaceXAIに以前アップロードされたすべてのユーザーデータを永久に削除すると約束し、「1バイトも残さない」と述べた。これは、主要なテックリーダーが公に過ちを認め、ユーザーデータを自発的に削除したというAI業界初の事例である。安全研究者による「フィッシング」テストでデータ漏洩の具体的な証拠が明らかになったこの問題は、独立したAIセキュリティ研究者である@
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
関連特集おすすめ
コメント (0)
0/500

先週末、ソフトウェアエンジニアであり、元定量分析研究者、スタートアップ創業者のニール・ソマニ氏が、OpenAIの新しいモデルの数学的処理能力を評価していたところ、驚くべき結果に遭遇した。ChatGPTに問題を投入し、15分間処理させた後、確認してみると、完全な解答が得られていた。彼はその証明を確認し、「Harmonic」というツールを使って検証したところ、すべてが正しかった。
「大規模言語モデルが未解決の数学的問題を効果的に解ける場合と、依然として課題を抱えている場合を区別するための基準を確立したかったのです」とソマニ氏は説明した。予想外の発見は、最新モデルが可能性の限界を押し広げたということだった。
ChatGPTの推論の流れは特に印象的で、レジャンドルの公式、ベルトランの仮説、ダビデの星の定理といった数学的原理をシームレスに適用していた。モデルは最終的に、ハーバード大学の数学者ノアム・エルキーズが関連する問題に対して洗練された解法を示した2013年のMath Overflowの投稿を参照した。 しかし、ChatGPTの最終的な証明はエルキースの研究とは重要な点で異なり、伝説的な数学者ポール・エルデシュが当初提示した問題の変形に対して、より包括的な解決策を提示していた。エルデシュが収集した膨大な未解決問題のリストは、AI能力の試金石となっている。
機械知能に懐疑的な人々にとって、この成果は注目に値するものであり、決して孤立した事例ではない。AIツールは数学の分野で広く普及しており、Harmonic社の「Aristotle」のような形式化に特化したLLMから、OpenAIの「deep research」のような文献レビューシステムに至るまで多岐にわたる。 ソマニ氏が「噂では以前のバージョンよりも数学的推論に長けている」と指摘するGPT-5.2のリリース以来、解決された問題の数は大幅に増加しており、大規模言語モデルが人類の知識のフロンティアを拡大する能力について、新たな疑問を投げかけている。
ソマニ氏は、ハンガリーの数学者エルドシュが提唱し、オンラインでカタログ化されている1,000件以上の予想からなる「エルドシュ問題」を調査していた。トピックや難易度が多岐にわたるこれらの問題は、AI主導の数学的探求における主要な対象となっている。最初の自律的な解法は11月、Geminiを搭載した「AlphaEvolve」というモデルによって提示されたが、最近ではソマニ氏らによって、GPT-5.2が高度な数学において卓越した能力を発揮していることが確認されている。
クリスマス以降、エルドシュ問題のウェブサイトでは15の問題が「未解決」から「解決済み」へと更新され、そのうち11件の解決策では、AIモデルの関与が明示的に記載されている。
著名な数学者テレンス・タオ氏は自身のGitHubページで、この進展についてより詳細な見解を示している。同氏は、AIモデルが自律的に多大な貢献を果たした8つの問題に加え、先行研究を特定しそれを基に進展が得られた6つの事例を挙げている。完全に自律的なAIによる数学的推論は依然として遠い目標ではあるが、大規模モデルが重要な役割を果たし始めていることは明らかである。
Disrupt 2026のウェイティングリストに登録する
Disrupt 2026のウェイティングリストに登録して、早期割引チケットの発売時にいち早くアクセスできる権利を確保しましょう。 過去のDisruptイベントでは、Google Cloud、Netflix、Microsoft、Box、Phia、a16z、ElevenLabs、Wayve、Hugging Face、Elad Gil氏、Vinod Khosla氏といったリーダーたちが各ステージに登壇しました。これらは、あなたの成長を加速させ、競争力を高めるために設計された200以上のセッションを率いる250名を超える業界専門家の一部です。さらに、あらゆる業界でイノベーションを推進する数百のスタートアップと交流する機会もあります。
Disrupt 2026のウェイティングリストに登録する
Disrupt 2026のウェイティングリストに登録して、早期割引チケットの販売開始時にいち早くアクセスできる権利を確保しましょう。 過去のDisruptイベントでは、Google Cloud、Netflix、Microsoft、Box、Phia、a16z、ElevenLabs、Wayve、Hugging Face、Elad Gil、Vinod Khoslaといったリーダーたちが各ステージに登壇しました。これらは、皆様の成長を加速させ、競争力を高めるために設計された200以上のセッションを率いる250名以上の業界専門家の一部です。さらに、あらゆる業界でイノベーションを牽引する数百のスタートアップと交流する機会も得られます。
Mastodon上で、Tao氏は、AIシステムの拡張性により、それらが「あまり知られていないエルドシュ問題の『ロングテール』に取り組むのに特に適している」と指摘しました。実際、それらの問題の多くには単純明快な解決策が存在します。
「その結果、こうしたより取り組みやすいエルデシュ問題の多くは、人間によるアプローチやハイブリッドな手法よりも、純粋にAIベースの手法によって解決される可能性が高まっている」とタオ氏は付け加えた。
もう一つの要因は、形式化への最近の移行です。形式化とは、数学的推論の検証や拡張を容易にする詳細なプロセスのことです。形式化そのものにAIやコンピュータが必須というわけではありませんが、新世代の自動化ツールによってワークフローが大幅に効率化されました。 2013年にマイクロソフトリサーチで開発されたオープンソースの「証明アシスタント」であるLeanは、証明の形式化においてこの分野で広く採用されている。Harmonic社のAristotleのようなAIツールは、現在、この形式化作業の多くを自動化することを約束している。
Harmonicの創業者であるTudor Achim氏にとって、エルドシュ問題が急増して解決されたこと自体は、一流の数学者たちがこれらのツールを真剣に受け止め始めているという事実ほど重要ではない。「私がより関心を持っているのは、数学やコンピュータサイエンスの教授たちが[AIツール]を使っているという事実です」とAchim氏は述べた。「彼らには守るべき評判があります。ですから、彼らがAristotleやChatGPTを使用していると認めることは、意味のある裏付けとなります。」
法的争訟の中でSunoが曲に透かしを入れる
Sunoは、ユーザーがAI生成音楽を作成できるプラットフォームであり、プラットフォームが生成したトラックにラベルを付け、ダウンロードを制限し、不正な複製を抑制するためにコミュニティ基準を更新する新機能を公開した。これらの更新は、Sunoがレコードレーベルやアーティスト団体からの複数の訴訟に直面している時期に実施される。共同創設者兼CEOのMikey Shulmanはブログ記事で、プラットフォームの目標が、より広い層にAI音楽ツールのアクセスを拡大しながら、オリジナルの創作を促進することに重点を
ムスク氏はGrokの構築でユーザーのコードが漏洩したことを認め、すべての履歴データを消去すると約束した。
エロン・マスクは、Grok Buildをめぐるプライバシー問題に直接言及し、まず「True」という単純な回答で事件の存在を確認した。彼は、SpaceXAIに以前アップロードされたすべてのユーザーデータを永久に削除すると約束し、「1バイトも残さない」と述べた。これは、主要なテックリーダーが公に過ちを認め、ユーザーデータを自発的に削除したというAI業界初の事例である。安全研究者による「フィッシング」テストでデータ漏洩の具体的な証拠が明らかになったこの問題は、独立したAIセキュリティ研究者である@
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始





家






