Дом
Компания Liquid AI открыла исходный код гибридной экспертной модели LFM2.5 для периферийного искусственного интеллекта
Стартап Liquid AI сегодня официально представил и открыл исходный код своей новейшей крупномасштабной модели для периферийных устройств — LFM2.5-8B-A1B . Разработанная для вызова инструментов и выполнения сложных инструкций на потребительском оборудовании, эта модель повышает производительность логических выводов и инференции на периферийных устройствах, сохраняя при этом чрезвычайно низкие вычислительные затраты.
С архитектурной точки зрения в ней используется разреженная конструкция «смесь экспертов» (MoE) с общим количеством параметров 8,3 миллиарда. Благодаря этой разреженности активируется только 1,5 миллиарда параметров на токен, что обеспечивает плавную локальную работу на смартфонах, ноутбуках и аналогичных устройствах.

Расширенный контекст и более мощное рассуждение
По сравнению со своей предшественницей, LFM2.5 расширяет окно контекста с 32K до 128K токенов и увеличивает объем данных предварительного обучения с 12T до 38T токенов. Как чистая модель вывода, она формирует явную цепочку рассуждений перед предоставлением окончательного ответа. Ее высокосжатый словарь эффективно обрабатывает девять языков, включая китайский и арабский.
Чтобы уменьшить количество логических тупиковых циклов и галлюцинаций при длительном рассуждении, команда разработчиков применила двухэтапное обучение с подкреплением (RL) во время обучения. Оптимизация предпочтений эффективно сокращает количество «тупиковых циклов» в рассуждениях с длинной цепочкой, а специализированный механизм вознаграждения против галлюцинаций позволяет модели активно отказываться отвечать на вопросы, выходящие за пределы ее базы знаний.
Высокая производительность на периферии и широкая поддержка экосистемы
По производительности LFM2.5 продемонстрировала взрывной рост. Ее результаты в тестах на логическое рассуждение и защиту от галлюцинаций значительно превосходят показатели предшественницы, и она даже конкурирует с более крупными моделями в выполнении инструкций. При вызове инструментов модель по умолчанию выдает эффективные вызовы функций Python и поддерживает плавное переключение в формат JSON через системные подсказки.
В день запуска модель получила полную поддержку со стороны основных фреймворков для инференции, включая llama.cpp, MLX, vLLM и SGLang. В ходе аппаратных тестов скорость декодирования достигала 253 байт в секунду на чипе M5 Max и около 30 байт в секунду на мобильных устройствах, что обеспечивает идеальный баланс между конфиденциальностью и эффективностью для пограничных развертываний.
Связанная статья
Умные очки Apple могут быть представлены на WWDC27 с акцентом на защиту конфиденциальности
Журналист Bloomberg Марк Гурман сообщает, что умные очки Apple под кодовым названием N50 должны дебютировать на WWDC27 в июне 2027 года, а их розничные продажи ожидаются осенью 2027 года. Изначально выпуск устройства планировался на конец этого года
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
Рекомендации по связанным специальным темам
Комментарии (1)
Стартап Liquid AI сегодня официально представил и открыл исходный код своей новейшей крупномасштабной модели для периферийных устройств —
С архитектурной точки зрения в ней используется разреженная конструкция «смесь экспертов» (MoE) с общим количеством параметров 8,3 миллиарда. Благодаря этой разреженности активируется только 1,5 миллиарда параметров на токен, что обеспечивает плавную локальную работу на смартфонах, ноутбуках и аналогичных устройствах.

Расширенный контекст и более мощное рассуждение
По сравнению со своей предшественницей, LFM2.5 расширяет окно контекста с 32K до 128K токенов и увеличивает объем данных предварительного обучения с 12T до 38T токенов. Как чистая модель вывода, она формирует явную цепочку рассуждений перед предоставлением окончательного ответа. Ее высокосжатый словарь эффективно обрабатывает девять языков, включая китайский и арабский.
Чтобы уменьшить количество логических тупиковых циклов и галлюцинаций при длительном рассуждении, команда разработчиков применила двухэтапное обучение с подкреплением (RL) во время обучения. Оптимизация предпочтений эффективно сокращает количество «тупиковых циклов» в рассуждениях с длинной цепочкой, а специализированный механизм вознаграждения против галлюцинаций позволяет модели активно отказываться отвечать на вопросы, выходящие за пределы ее базы знаний.
Высокая производительность на периферии и широкая поддержка экосистемы
По производительности LFM2.5 продемонстрировала взрывной рост. Ее результаты в тестах на логическое рассуждение и защиту от галлюцинаций значительно превосходят показатели предшественницы, и она даже конкурирует с более крупными моделями в выполнении инструкций. При вызове инструментов модель по умолчанию выдает эффективные вызовы функций Python и поддерживает плавное переключение в формат JSON через системные подсказки.
В день запуска модель получила полную поддержку со стороны основных фреймворков для инференции, включая llama.cpp, MLX, vLLM и SGLang. В ходе аппаратных тестов скорость декодирования достигала 253 байт в секунду на чипе M5 Max и около 30 байт в секунду на мобильных устройствах, что обеспечивает идеальный баланс между конфиденциальностью и эффективностью для пограничных развертываний.
Умные очки Apple могут быть представлены на WWDC27 с акцентом на защиту конфиденциальности
Журналист Bloomberg Марк Гурман сообщает, что умные очки Apple под кодовым названием N50 должны дебютировать на WWDC27 в июне 2027 года, а их розничные продажи ожидаются осенью 2027 года. Изначально выпуск устройства планировался на конец этого года
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт











