Дом
Модели искусственного интеллекта добились прорыва в решении сложных математических задач

На выходных инженер-программист, бывший исследователь в области количественных методов и основатель стартапа Нил Сомани оценивал математические возможности новой модели OpenAI, когда наткнулся на удивительный результат. Введя задачу в ChatGPT и дав системе 15 минут на обработку, он вернулся и обнаружил готовое решение. Он проанализировал доказательство и проверил его с помощью инструмента под названием Harmonic — и всё оказалось верно.
«Я хотел установить базовый уровень понимания того, когда крупные языковые модели могут эффективно решать открытые математические задачи, а в каких случаях они все еще сталкиваются с трудностями», — пояснил Сомани. Неожиданным открытием стало то, что новейшая модель раздвинула границы возможного.
Цепочка рассуждений ChatGPT была особенно впечатляющей: в ней плавно применялись такие математические принципы, как формула Лежандра, постулат Бертрана и теорема «Звезды Давида». В конце концов модель сослалась на пост на сайте Math Overflow от 2013 года, где гарвардский математик Ноам Элкис предложил элегантное решение связанной с ней задачи. Однако окончательное доказательство ChatGPT отличалось от работы Элкиса по ключевым аспектам, предлагая более всеобъемлющее решение варианта задачи, первоначально поставленной легендарным математиком Полом Эрдосом. Обширная коллекция нерешенных задач Эрдоса стала полигоном для проверки возможностей ИИ.
Для тех, кто скептически относится к машинному интеллекту, этот результат является замечательным — и это не единичный случай. Инструменты ИИ стали повсеместными в математике, начиная от LLM, ориентированных на формализацию, таких как Aristotle от Harmonic, и заканчивая системами обзора литературы, такими как deep research от OpenAI. С момента выпуска GPT-5.2 — который, как отмечает Сомани, «по отдельным свидетельствам, более искусен в математическом мышлении, чем предыдущие версии» — количество решенных задач значительно выросло, что подняло новые вопросы о способности больших языковых моделей расширять границы человеческих знаний.
Сомани изучал задачи Эрдеша — набор из более чем 1000 гипотез венгерского математика, каталогизированных в Интернете. Эти задачи, которые сильно различаются по тематике и сложности, стали главной целью математических исследований с использованием ИИ. Первые автономные решения появились в ноябре благодаря модели AlphaEvolve на базе Gemini, но совсем недавно Сомани и другие исследователи заметили, что GPT-5.2 демонстрирует исключительное мастерство в области высшей математики.
С Рождества на сайте задач Эрдеша 15 задач были обновлены с «открытых» на «решенные» — причем в 11 из этих решений явно указано участие моделей ИИ.
Уважаемый математик Теренс Тао предлагает более подробный взгляд на этот прогресс на своей странице GitHub, отмечая восемь отдельных задач, в которых модели ИИ внесли существенный автономный вклад, а также шесть других случаев, когда прогресс был достигнут путем выявления и развития предыдущих исследований. Хотя полностью автономное математическое мышление ИИ остается отдаленной целью, очевидно, что крупные модели начинают играть значительную роль.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ, когда появятся билеты по ранней продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, которые провели более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете познакомиться с сотнями стартапов, продвигающих инновации во всех отраслях.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ к билетам Early Bird, когда они появятся в продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, ведущих более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете установить контакты с сотнями стартапов, продвигающих инновации во всех отраслях.
В Mastodon Тао высказал мнение, что масштабируемость систем ИИ делает их «особенно подходящими для решения «длинного хвоста» менее известных задач Эрдеша, многие из которых на самом деле имеют простые решения».
«Следовательно, многие из этих более доступных задач Эрдеша теперь с большей вероятностью будут решены с помощью чисто ИИ-методов, чем с помощью человеческих или гибридных подходов», — добавил Тао.
Еще одним способствующим фактором является недавний сдвиг в сторону формализации — детального процесса, который упрощает проверку и расширение математических рассуждений. Хотя формализация сама по себе не требует ИИ или компьютеров, новое поколение автоматизированных инструментов значительно оптимизировало рабочий процесс. «Помощник в доказательствах» с открытым исходным кодом Lean, разработанный в Microsoft Research в 2013 году, получил широкое распространение в этой области для формализации доказательств. Инструменты ИИ, такие как Aristotle от Harmonic, теперь обещают автоматизировать большую часть этой работы по формализации.
Для основателя Harmonic Тудора Ахима внезапный рост числа решенных задач Эрдеша менее значим, чем тот факт, что ведущие математики начинают серьезно относиться к этим инструментам. «Меня больше интересует тот факт, что профессора математики и информатики используют [инструменты ИИ]», — заявил Ахим. «Этим людям нужно поддерживать свою репутацию, поэтому когда они подтверждают, что используют Aristotle или ChatGPT, это является значимым подтверждением».
Связанная статья
ByteDance усиливает основные стимулы для ИИ, поскольку Doubao растет на 14,6%
Недавно ByteDance провела краткий брифинг по акциям DouBao, чтобы раскрыть новые стимулирующие политики для сотрудников, участвующих в подразделении DouBao. Цена исполнения для акций DouBao была повышена с $14.85 в июне 2026 года до $17.02, что соста
MiniMax представляет программу Team Program с 10-кратным вознаграждением для стимулирования глобальных экспертов в области ИИ
Компания MiniMax (Xiyu Technology), Лаборатория общего искусственного интеллекта, официально запустила инициативу по глобальному сотрудничеству с талантами «Команда 10x». Эта программа направлена на привлечение ведущих экспертов из различных отраслей
Южная Корея начала строительство национального центра вычислений на базе искусственного интеллекта, инвестируя 2,5 триллиона вон с целевым сроком завершения к 2028 году
Южнокорейское издание EtNews сообщает, что 3 августа в парке дата-центров Solar City в Сунане (провинция Чолла-Намдо) состоялась церемония закладки первого камня в основание Центра вычислений ИИ Кореи (KOACC). При общем объеме инвестиций в 2,5 трлн в
Рекомендации по связанным специальным темам
Комментарии (0)

На выходных инженер-программист, бывший исследователь в области количественных методов и основатель стартапа Нил Сомани оценивал математические возможности новой модели OpenAI, когда наткнулся на удивительный результат. Введя задачу в ChatGPT и дав системе 15 минут на обработку, он вернулся и обнаружил готовое решение. Он проанализировал доказательство и проверил его с помощью инструмента под названием Harmonic — и всё оказалось верно.
«Я хотел установить базовый уровень понимания того, когда крупные языковые модели могут эффективно решать открытые математические задачи, а в каких случаях они все еще сталкиваются с трудностями», — пояснил Сомани. Неожиданным открытием стало то, что новейшая модель раздвинула границы возможного.
Цепочка рассуждений ChatGPT была особенно впечатляющей: в ней плавно применялись такие математические принципы, как формула Лежандра, постулат Бертрана и теорема «Звезды Давида». В конце концов модель сослалась на пост на сайте Math Overflow от 2013 года, где гарвардский математик Ноам Элкис предложил элегантное решение связанной с ней задачи. Однако окончательное доказательство ChatGPT отличалось от работы Элкиса по ключевым аспектам, предлагая более всеобъемлющее решение варианта задачи, первоначально поставленной легендарным математиком Полом Эрдосом. Обширная коллекция нерешенных задач Эрдоса стала полигоном для проверки возможностей ИИ.
Для тех, кто скептически относится к машинному интеллекту, этот результат является замечательным — и это не единичный случай. Инструменты ИИ стали повсеместными в математике, начиная от LLM, ориентированных на формализацию, таких как Aristotle от Harmonic, и заканчивая системами обзора литературы, такими как deep research от OpenAI. С момента выпуска GPT-5.2 — который, как отмечает Сомани, «по отдельным свидетельствам, более искусен в математическом мышлении, чем предыдущие версии» — количество решенных задач значительно выросло, что подняло новые вопросы о способности больших языковых моделей расширять границы человеческих знаний.
Сомани изучал задачи Эрдеша — набор из более чем 1000 гипотез венгерского математика, каталогизированных в Интернете. Эти задачи, которые сильно различаются по тематике и сложности, стали главной целью математических исследований с использованием ИИ. Первые автономные решения появились в ноябре благодаря модели AlphaEvolve на базе Gemini, но совсем недавно Сомани и другие исследователи заметили, что GPT-5.2 демонстрирует исключительное мастерство в области высшей математики.
С Рождества на сайте задач Эрдеша 15 задач были обновлены с «открытых» на «решенные» — причем в 11 из этих решений явно указано участие моделей ИИ.
Уважаемый математик Теренс Тао предлагает более подробный взгляд на этот прогресс на своей странице GitHub, отмечая восемь отдельных задач, в которых модели ИИ внесли существенный автономный вклад, а также шесть других случаев, когда прогресс был достигнут путем выявления и развития предыдущих исследований. Хотя полностью автономное математическое мышление ИИ остается отдаленной целью, очевидно, что крупные модели начинают играть значительную роль.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ, когда появятся билеты по ранней продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, которые провели более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете познакомиться с сотнями стартапов, продвигающих инновации во всех отраслях.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ к билетам Early Bird, когда они появятся в продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, ведущих более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете установить контакты с сотнями стартапов, продвигающих инновации во всех отраслях.
В Mastodon Тао высказал мнение, что масштабируемость систем ИИ делает их «особенно подходящими для решения «длинного хвоста» менее известных задач Эрдеша, многие из которых на самом деле имеют простые решения».
«Следовательно, многие из этих более доступных задач Эрдеша теперь с большей вероятностью будут решены с помощью чисто ИИ-методов, чем с помощью человеческих или гибридных подходов», — добавил Тао.
Еще одним способствующим фактором является недавний сдвиг в сторону формализации — детального процесса, который упрощает проверку и расширение математических рассуждений. Хотя формализация сама по себе не требует ИИ или компьютеров, новое поколение автоматизированных инструментов значительно оптимизировало рабочий процесс. «Помощник в доказательствах» с открытым исходным кодом Lean, разработанный в Microsoft Research в 2013 году, получил широкое распространение в этой области для формализации доказательств. Инструменты ИИ, такие как Aristotle от Harmonic, теперь обещают автоматизировать большую часть этой работы по формализации.
Для основателя Harmonic Тудора Ахима внезапный рост числа решенных задач Эрдеша менее значим, чем тот факт, что ведущие математики начинают серьезно относиться к этим инструментам. «Меня больше интересует тот факт, что профессора математики и информатики используют [инструменты ИИ]», — заявил Ахим. «Этим людям нужно поддерживать свою репутацию, поэтому когда они подтверждают, что используют Aristotle или ChatGPT, это является значимым подтверждением».
ByteDance усиливает основные стимулы для ИИ, поскольку Doubao растет на 14,6%
Недавно ByteDance провела краткий брифинг по акциям DouBao, чтобы раскрыть новые стимулирующие политики для сотрудников, участвующих в подразделении DouBao. Цена исполнения для акций DouBao была повышена с $14.85 в июне 2026 года до $17.02, что соста
MiniMax представляет программу Team Program с 10-кратным вознаграждением для стимулирования глобальных экспертов в области ИИ
Компания MiniMax (Xiyu Technology), Лаборатория общего искусственного интеллекта, официально запустила инициативу по глобальному сотрудничеству с талантами «Команда 10x». Эта программа направлена на привлечение ведущих экспертов из различных отраслей
Южная Корея начала строительство национального центра вычислений на базе искусственного интеллекта, инвестируя 2,5 триллиона вон с целевым сроком завершения к 2028 году
Южнокорейское издание EtNews сообщает, что 3 августа в парке дата-центров Solar City в Сунане (провинция Чолла-Намдо) состоялась церемония закладки первого камня в основание Центра вычислений ИИ Кореи (KOACC). При общем объеме инвестиций в 2,5 трлн в











