MiniMax представляет M3, отечественную большую языковую модель, превосходящую GPT-5.5
В секторе искусственного интеллекта Китая произошел значительный технологический скачок с официальным запуском новейшей большой языковой модели MiniMax M3 от компании Xiyu Technology. Эта передовая система сочетает в себе современные возможности программирования с поддержкой сверхдлинного контекстного окна объемом до 1 миллиона токенов. Примечательно, что она нативно поддерживает мультимодальные входные данные, включая обработку изображений и видео, а также взаимодействие с рабочим столом компьютера, что делает ее первой в Китае открытой моделью, интегрирующей эти три ключевые возможности.

Выдающиеся результаты в стандартизированных тестах
В строгой программе оценки программирования SWE-Bench Pro MiniMax M3 набрал 59,0%, превзойдя GPT-5.5 и Gemini 3.1 Pro, и лишь незначительно уступил топовой модели Opus 4.7. Модель также продемонстрировала превосходные результаты в тесте Claw-Eval для оценки возможностей ИИ-агентов и достигла ведущих показателей на многомодальном бенчмарке OmniDocBench для понимания документов.
Продвинутая архитектура повышает эффективность
За эти показатели отвечает внедрение M3 новой архитектуры разреженного внимания (MSA). При обработке сверхдлинных контекстов объемом 1 миллиона токенов эта конструкция снижает вычисления на один токен вдвое по сравнению с предыдущей версией. В результате модель ускоряет скорость понимания более чем в 9 раз и увеличивает скорость генерации ответов более чем в 15 раз. API уже доступен, а официальная команда обязуется выпустить веса модели и технические отчеты для глобальных разработчиков в течение 10 дней.
Связанная статья
Meitun LongCat запускает LoHoSearch, пока оценки BrowseComp падают ниже 30%
Возможности поисковых агентов в значительной степени определялись benchmarkом BrowseComp на протяжении последнего года. Однако этот тест теряет свою актуальность: он обеспечил рост производительности моделей с 30% до 90% всего за десять месяцев, и ег
В Индии обязывает приложения для определения номера телефона передавать данные о спаме операторам связи
Индия расширила свои правила борьбы со спамом, обязав приложения для определения номера и управления звонками передавать операторам связи данные о спам-звонках от пользователей. Это решение привело к тому, что Truecaller, известный поставщик приложен
Платформа Qwen AI расширяет матрицу моделей официальным запуском GLM-5.3 и DeepSeek-V4-Pro
Платформа Alibaba Cloud Qwen AI (MaaS) недавно расширила матрицу моделей, интегрировав флагманскую модель GLM-5.3 от Zhipu и официальный релиз DeepSeek-V4-Pro. Соответствующие API-сервисы теперь доступны публично, что позволяет разработчикам быстро п
Рекомендации по связанным специальным темам
Комментарии (0)
В секторе искусственного интеллекта Китая произошел значительный технологический скачок с официальным запуском новейшей большой языковой модели MiniMax M3 от компании Xiyu Technology. Эта передовая система сочетает в себе современные возможности программирования с поддержкой сверхдлинного контекстного окна объемом до 1 миллиона токенов. Примечательно, что она нативно поддерживает мультимодальные входные данные, включая обработку изображений и видео, а также взаимодействие с рабочим столом компьютера, что делает ее первой в Китае открытой моделью, интегрирующей эти три ключевые возможности.

Выдающиеся результаты в стандартизированных тестах
В строгой программе оценки программирования SWE-Bench Pro MiniMax M3 набрал 59,0%, превзойдя GPT-5.5 и Gemini 3.1 Pro, и лишь незначительно уступил топовой модели Opus 4.7. Модель также продемонстрировала превосходные результаты в тесте Claw-Eval для оценки возможностей ИИ-агентов и достигла ведущих показателей на многомодальном бенчмарке OmniDocBench для понимания документов.
Продвинутая архитектура повышает эффективность
За эти показатели отвечает внедрение M3 новой архитектуры разреженного внимания (MSA). При обработке сверхдлинных контекстов объемом 1 миллиона токенов эта конструкция снижает вычисления на один токен вдвое по сравнению с предыдущей версией. В результате модель ускоряет скорость понимания более чем в 9 раз и увеличивает скорость генерации ответов более чем в 15 раз. API уже доступен, а официальная команда обязуется выпустить веса модели и технические отчеты для глобальных разработчиков в течение 10 дней.
Meitun LongCat запускает LoHoSearch, пока оценки BrowseComp падают ниже 30%
Возможности поисковых агентов в значительной степени определялись benchmarkом BrowseComp на протяжении последнего года. Однако этот тест теряет свою актуальность: он обеспечил рост производительности моделей с 30% до 90% всего за десять месяцев, и ег
В Индии обязывает приложения для определения номера телефона передавать данные о спаме операторам связи
Индия расширила свои правила борьбы со спамом, обязав приложения для определения номера и управления звонками передавать операторам связи данные о спам-звонках от пользователей. Это решение привело к тому, что Truecaller, известный поставщик приложен
Платформа Qwen AI расширяет матрицу моделей официальным запуском GLM-5.3 и DeepSeek-V4-Pro
Платформа Alibaba Cloud Qwen AI (MaaS) недавно расширила матрицу моделей, интегрировав флагманскую модель GLM-5.3 от Zhipu и официальный релиз DeepSeek-V4-Pro. Соответствующие API-сервисы теперь доступны публично, что позволяет разработчикам быстро п





Дом






