Дом
Модели искусственного интеллекта добились прорыва в решении сложных математических задач

На выходных инженер-программист, бывший исследователь в области количественных методов и основатель стартапа Нил Сомани оценивал математические возможности новой модели OpenAI, когда наткнулся на удивительный результат. Введя задачу в ChatGPT и дав системе 15 минут на обработку, он вернулся и обнаружил готовое решение. Он проанализировал доказательство и проверил его с помощью инструмента под названием Harmonic — и всё оказалось верно.
«Я хотел установить базовый уровень понимания того, когда крупные языковые модели могут эффективно решать открытые математические задачи, а в каких случаях они все еще сталкиваются с трудностями», — пояснил Сомани. Неожиданным открытием стало то, что новейшая модель раздвинула границы возможного.
Цепочка рассуждений ChatGPT была особенно впечатляющей: в ней плавно применялись такие математические принципы, как формула Лежандра, постулат Бертрана и теорема «Звезды Давида». В конце концов модель сослалась на пост на сайте Math Overflow от 2013 года, где гарвардский математик Ноам Элкис предложил элегантное решение связанной с ней задачи. Однако окончательное доказательство ChatGPT отличалось от работы Элкиса по ключевым аспектам, предлагая более всеобъемлющее решение варианта задачи, первоначально поставленной легендарным математиком Полом Эрдосом. Обширная коллекция нерешенных задач Эрдоса стала полигоном для проверки возможностей ИИ.
Для тех, кто скептически относится к машинному интеллекту, этот результат является замечательным — и это не единичный случай. Инструменты ИИ стали повсеместными в математике, начиная от LLM, ориентированных на формализацию, таких как Aristotle от Harmonic, и заканчивая системами обзора литературы, такими как deep research от OpenAI. С момента выпуска GPT-5.2 — который, как отмечает Сомани, «по отдельным свидетельствам, более искусен в математическом мышлении, чем предыдущие версии» — количество решенных задач значительно выросло, что подняло новые вопросы о способности больших языковых моделей расширять границы человеческих знаний.
Сомани изучал задачи Эрдеша — набор из более чем 1000 гипотез венгерского математика, каталогизированных в Интернете. Эти задачи, которые сильно различаются по тематике и сложности, стали главной целью математических исследований с использованием ИИ. Первые автономные решения появились в ноябре благодаря модели AlphaEvolve на базе Gemini, но совсем недавно Сомани и другие исследователи заметили, что GPT-5.2 демонстрирует исключительное мастерство в области высшей математики.
С Рождества на сайте задач Эрдеша 15 задач были обновлены с «открытых» на «решенные» — причем в 11 из этих решений явно указано участие моделей ИИ.
Уважаемый математик Теренс Тао предлагает более подробный взгляд на этот прогресс на своей странице GitHub, отмечая восемь отдельных задач, в которых модели ИИ внесли существенный автономный вклад, а также шесть других случаев, когда прогресс был достигнут путем выявления и развития предыдущих исследований. Хотя полностью автономное математическое мышление ИИ остается отдаленной целью, очевидно, что крупные модели начинают играть значительную роль.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ, когда появятся билеты по ранней продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, которые провели более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете познакомиться с сотнями стартапов, продвигающих инновации во всех отраслях.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ к билетам Early Bird, когда они появятся в продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, ведущих более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете установить контакты с сотнями стартапов, продвигающих инновации во всех отраслях.
В Mastodon Тао высказал мнение, что масштабируемость систем ИИ делает их «особенно подходящими для решения «длинного хвоста» менее известных задач Эрдеша, многие из которых на самом деле имеют простые решения».
«Следовательно, многие из этих более доступных задач Эрдеша теперь с большей вероятностью будут решены с помощью чисто ИИ-методов, чем с помощью человеческих или гибридных подходов», — добавил Тао.
Еще одним способствующим фактором является недавний сдвиг в сторону формализации — детального процесса, который упрощает проверку и расширение математических рассуждений. Хотя формализация сама по себе не требует ИИ или компьютеров, новое поколение автоматизированных инструментов значительно оптимизировало рабочий процесс. «Помощник в доказательствах» с открытым исходным кодом Lean, разработанный в Microsoft Research в 2013 году, получил широкое распространение в этой области для формализации доказательств. Инструменты ИИ, такие как Aristotle от Harmonic, теперь обещают автоматизировать большую часть этой работы по формализации.
Для основателя Harmonic Тудора Ахима внезапный рост числа решенных задач Эрдеша менее значим, чем тот факт, что ведущие математики начинают серьезно относиться к этим инструментам. «Меня больше интересует тот факт, что профессора математики и информатики используют [инструменты ИИ]», — заявил Ахим. «Этим людям нужно поддерживать свою репутацию, поэтому когда они подтверждают, что используют Aristotle или ChatGPT, это является значимым подтверждением».
Связанная статья
Генеральный директор Nvidia Дженсен Хуанг говорит Трампу: «Мы не допустим замедления развития ИИ»
Во время своего выступления на саммите All-In в Лос-Анджелесе в понедельник генеральный директор Nvidia Дженсен Хуанг получил неожиданный звонок от президента Дональда Трампа, от которого он не мог просто отказаться.«Я на сцене с лучшими друзьями»,
Google Gemini усиливает искусственный интеллект GM для 4 миллионов владельцев
General Motors подтвердила стратегическое партнерство с Google для развертывания Gemini AI Assistant примерно на 4 миллионах автомобилей в США. Этот запуск охватывает модели Cadillac, Chevrolet, Buick и GMC 2022 модельного года и новее, что является
Zhipei AI выходит на платформу Tmall, предлагая ежемесячные тарифы от 118 юаней
Коммерциализация отечественных больших языковых моделей открывает новые потребительские сценарии. Ведущая ИИ-компания Zhipu официально открыла свой флагманский магазин на Tmall, сделав свои услуги доступными для обычных покупателей. Теперь пользовате
Рекомендации по связанным специальным темам
Комментарии (0)

На выходных инженер-программист, бывший исследователь в области количественных методов и основатель стартапа Нил Сомани оценивал математические возможности новой модели OpenAI, когда наткнулся на удивительный результат. Введя задачу в ChatGPT и дав системе 15 минут на обработку, он вернулся и обнаружил готовое решение. Он проанализировал доказательство и проверил его с помощью инструмента под названием Harmonic — и всё оказалось верно.
«Я хотел установить базовый уровень понимания того, когда крупные языковые модели могут эффективно решать открытые математические задачи, а в каких случаях они все еще сталкиваются с трудностями», — пояснил Сомани. Неожиданным открытием стало то, что новейшая модель раздвинула границы возможного.
Цепочка рассуждений ChatGPT была особенно впечатляющей: в ней плавно применялись такие математические принципы, как формула Лежандра, постулат Бертрана и теорема «Звезды Давида». В конце концов модель сослалась на пост на сайте Math Overflow от 2013 года, где гарвардский математик Ноам Элкис предложил элегантное решение связанной с ней задачи. Однако окончательное доказательство ChatGPT отличалось от работы Элкиса по ключевым аспектам, предлагая более всеобъемлющее решение варианта задачи, первоначально поставленной легендарным математиком Полом Эрдосом. Обширная коллекция нерешенных задач Эрдоса стала полигоном для проверки возможностей ИИ.
Для тех, кто скептически относится к машинному интеллекту, этот результат является замечательным — и это не единичный случай. Инструменты ИИ стали повсеместными в математике, начиная от LLM, ориентированных на формализацию, таких как Aristotle от Harmonic, и заканчивая системами обзора литературы, такими как deep research от OpenAI. С момента выпуска GPT-5.2 — который, как отмечает Сомани, «по отдельным свидетельствам, более искусен в математическом мышлении, чем предыдущие версии» — количество решенных задач значительно выросло, что подняло новые вопросы о способности больших языковых моделей расширять границы человеческих знаний.
Сомани изучал задачи Эрдеша — набор из более чем 1000 гипотез венгерского математика, каталогизированных в Интернете. Эти задачи, которые сильно различаются по тематике и сложности, стали главной целью математических исследований с использованием ИИ. Первые автономные решения появились в ноябре благодаря модели AlphaEvolve на базе Gemini, но совсем недавно Сомани и другие исследователи заметили, что GPT-5.2 демонстрирует исключительное мастерство в области высшей математики.
С Рождества на сайте задач Эрдеша 15 задач были обновлены с «открытых» на «решенные» — причем в 11 из этих решений явно указано участие моделей ИИ.
Уважаемый математик Теренс Тао предлагает более подробный взгляд на этот прогресс на своей странице GitHub, отмечая восемь отдельных задач, в которых модели ИИ внесли существенный автономный вклад, а также шесть других случаев, когда прогресс был достигнут путем выявления и развития предыдущих исследований. Хотя полностью автономное математическое мышление ИИ остается отдаленной целью, очевидно, что крупные модели начинают играть значительную роль.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ, когда появятся билеты по ранней продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, которые провели более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете познакомиться с сотнями стартапов, продвигающих инновации во всех отраслях.
Включитесь в список ожидания Disrupt 2026
Добавьте себя в список ожидания Disrupt 2026, чтобы получить ранний доступ к билетам Early Bird, когда они появятся в продаже. На прошлых мероприятиях Disrupt на наших сценах выступали лидеры из Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Элад Гил и Винод Хосла — часть из более чем 250 отраслевых экспертов, ведущих более 200 сессий, призванных ускорить ваш рост и усилить ваше конкурентное преимущество. Кроме того, вы сможете установить контакты с сотнями стартапов, продвигающих инновации во всех отраслях.
В Mastodon Тао высказал мнение, что масштабируемость систем ИИ делает их «особенно подходящими для решения «длинного хвоста» менее известных задач Эрдеша, многие из которых на самом деле имеют простые решения».
«Следовательно, многие из этих более доступных задач Эрдеша теперь с большей вероятностью будут решены с помощью чисто ИИ-методов, чем с помощью человеческих или гибридных подходов», — добавил Тао.
Еще одним способствующим фактором является недавний сдвиг в сторону формализации — детального процесса, который упрощает проверку и расширение математических рассуждений. Хотя формализация сама по себе не требует ИИ или компьютеров, новое поколение автоматизированных инструментов значительно оптимизировало рабочий процесс. «Помощник в доказательствах» с открытым исходным кодом Lean, разработанный в Microsoft Research в 2013 году, получил широкое распространение в этой области для формализации доказательств. Инструменты ИИ, такие как Aristotle от Harmonic, теперь обещают автоматизировать большую часть этой работы по формализации.
Для основателя Harmonic Тудора Ахима внезапный рост числа решенных задач Эрдеша менее значим, чем тот факт, что ведущие математики начинают серьезно относиться к этим инструментам. «Меня больше интересует тот факт, что профессора математики и информатики используют [инструменты ИИ]», — заявил Ахим. «Этим людям нужно поддерживать свою репутацию, поэтому когда они подтверждают, что используют Aristotle или ChatGPT, это является значимым подтверждением».
Генеральный директор Nvidia Дженсен Хуанг говорит Трампу: «Мы не допустим замедления развития ИИ»
Во время своего выступления на саммите All-In в Лос-Анджелесе в понедельник генеральный директор Nvidia Дженсен Хуанг получил неожиданный звонок от президента Дональда Трампа, от которого он не мог просто отказаться.«Я на сцене с лучшими друзьями»,
Google Gemini усиливает искусственный интеллект GM для 4 миллионов владельцев
General Motors подтвердила стратегическое партнерство с Google для развертывания Gemini AI Assistant примерно на 4 миллионах автомобилей в США. Этот запуск охватывает модели Cadillac, Chevrolet, Buick и GMC 2022 модельного года и новее, что является
Zhipei AI выходит на платформу Tmall, предлагая ежемесячные тарифы от 118 юаней
Коммерциализация отечественных больших языковых моделей открывает новые потребительские сценарии. Ведущая ИИ-компания Zhipu официально открыла свой флагманский магазин на Tmall, сделав свои услуги доступными для обычных покупателей. Теперь пользовате











