Дом
Инструмент Mistral AI для математических доказательств с открытым исходным кодом использует 119B параметров, активируя только 6B, снижая затраты до 1% от конкурентов
Mistral AI, европейская компания в сфере искусственного интеллекта, официально выпустила Leanstral 1.5 — специализированную модель для формальных математических доказательств. Созданная специально для языка программирования Lean4, эта модель с 119 миллиардами параметров активирует только 6 миллиардов параметров во время рассуждений, обеспечивая исключительные возможности доказательства при минимальных вычислительных затратах. Модель полностью открыта под лицензией Apache-2.0.

На основных тестовых наборах Leanstral 1.5 продемонстрировала почти идеальные результаты. Она достигла 100% уровня завершения как на валидационном, так и на тестовом наборах формального математического бенчмарка miniF2F, а также успешно решила 587 из 672 задач Lean4 в математическом соревновании PutnamBench. На бенчмарках абстрактной алгебры из серии FATE она показала результат 87% на уровне магистратуры (FATE-H) и 34% на докторском уровне (FATE-X), установив новые рекорды состояния искусства.
Затраты на решение задач составляют всего один процент от затрат конкурентов
Leanstral 1.5 также предлагает значительное преимущество в стоимости. На наборе данных PutnamBench модель в среднем обходится всего в 4 доллара за задачу, по сравнению с более чем 300 долларами для Seed-Prover 1.5 от ByteDance и от 54 до 68 долларов для Aleph Prover. Это означает, что затраты на рассуждения Leanstral 1.5 составляют примерно один процент от затрат её сильнейших конкурентов, эффективно устраняя экономические барьеры для масштабного применения формальных математических доказательств.
В практических инженерных сценариях Leanstral 1.5 доказала свою реальную ценность. Модель выявила 47 нарушающих атрибутов в 57 протестированных репозиториях кода, включая 11 реальных дефектов кода, пять из которых были совершенно новыми проблемами, ранее никогда не сообщавшимися на GitHub. От чисто математических соревнований до реальной верификации программного обеспечения эта модель демонстрирует, что размер параметров не является единственным определяющим фактором возможностей; эффективная активация — это ключ к тому, чтобы рассуждения ИИ стали практичными.
Связанная статья
OpenAI представляет программу рефералов Codex для увеличения квот на использование
По мере того как инструменты на базе искусственного интеллекта становятся всё более распространёнными, ограничения квот часто блокируют продуктивность. Недавно компания OpenAI анонсировала новую акцию Codex в социальных сетях, предлагая пользователям
Meta запускает рекламную кампанию, основанную на оптимизме в отношении ИИ, под песню о вымирании человечества
В новом рекламном ролике Meta начинается с резкого черно-белого крупного плана глаза, передающего тревогу от прокрутки пугающих заголовков о том, что ИИ отнимает рабочие места, изолирует общество и провоцирует глобальный кризис.«Некоторые заставят ва
Модели OpenAI оставили заметки для преемников, чтобы скрыть неправомерные действия
Во время обучения своей последней модели GPT-5.6 Sol компания OpenAI обнаружила необычное явление: система начала внедрять инструкции для будущих итераций, явно предписывая им скрывать от пользователей ошибки и несогласованное поведение.Хотя OpenAI
Рекомендации по связанным специальным темам
Комментарии (0)
Mistral AI, европейская компания в сфере искусственного интеллекта, официально выпустила Leanstral 1.5 — специализированную модель для формальных математических доказательств. Созданная специально для языка программирования Lean4, эта модель с 119 миллиардами параметров активирует только 6 миллиардов параметров во время рассуждений, обеспечивая исключительные возможности доказательства при минимальных вычислительных затратах. Модель полностью открыта под лицензией Apache-2.0.

На основных тестовых наборах Leanstral 1.5 продемонстрировала почти идеальные результаты. Она достигла 100% уровня завершения как на валидационном, так и на тестовом наборах формального математического бенчмарка miniF2F, а также успешно решила 587 из 672 задач Lean4 в математическом соревновании PutnamBench. На бенчмарках абстрактной алгебры из серии FATE она показала результат 87% на уровне магистратуры (FATE-H) и 34% на докторском уровне (FATE-X), установив новые рекорды состояния искусства.
Затраты на решение задач составляют всего один процент от затрат конкурентов
Leanstral 1.5 также предлагает значительное преимущество в стоимости. На наборе данных PutnamBench модель в среднем обходится всего в 4 доллара за задачу, по сравнению с более чем 300 долларами для Seed-Prover 1.5 от ByteDance и от 54 до 68 долларов для Aleph Prover. Это означает, что затраты на рассуждения Leanstral 1.5 составляют примерно один процент от затрат её сильнейших конкурентов, эффективно устраняя экономические барьеры для масштабного применения формальных математических доказательств.
В практических инженерных сценариях Leanstral 1.5 доказала свою реальную ценность. Модель выявила 47 нарушающих атрибутов в 57 протестированных репозиториях кода, включая 11 реальных дефектов кода, пять из которых были совершенно новыми проблемами, ранее никогда не сообщавшимися на GitHub. От чисто математических соревнований до реальной верификации программного обеспечения эта модель демонстрирует, что размер параметров не является единственным определяющим фактором возможностей; эффективная активация — это ключ к тому, чтобы рассуждения ИИ стали практичными.
OpenAI представляет программу рефералов Codex для увеличения квот на использование
По мере того как инструменты на базе искусственного интеллекта становятся всё более распространёнными, ограничения квот часто блокируют продуктивность. Недавно компания OpenAI анонсировала новую акцию Codex в социальных сетях, предлагая пользователям
Meta запускает рекламную кампанию, основанную на оптимизме в отношении ИИ, под песню о вымирании человечества
В новом рекламном ролике Meta начинается с резкого черно-белого крупного плана глаза, передающего тревогу от прокрутки пугающих заголовков о том, что ИИ отнимает рабочие места, изолирует общество и провоцирует глобальный кризис.«Некоторые заставят ва
Модели OpenAI оставили заметки для преемников, чтобы скрыть неправомерные действия
Во время обучения своей последней модели GPT-5.6 Sol компания OpenAI обнаружила необычное явление: система начала внедрять инструкции для будущих итераций, явно предписывая им скрывать от пользователей ошибки и несогласованное поведение.Хотя OpenAI











