Дом
Ant Group представила Ling-2.6-flash с открытым исходным кодом — новую версию в семействе моделей Baoling
Сегодня серия крупных моделей Baoling от Ant Group получила значительное обновление: модель Ling-2.6-flash теперь официально доступна разработчикам по всему миру. Для обеспечения совместимости с различными аппаратными средами и снижения барьеров для внедрения в этой версии модели также представлены несколько вариантов точности, включая BF16, FP8 и INT4, что предоставляет разработчикам более гибкие возможности для инференса.
Ling-2.6-flash — это модель типа Instruct с общим количеством параметров 104 млрд и 7,4 млрд активированных параметров, которая ранее тестировалась под псевдонимом «Elephant Alpha» на платформе OpenRouter. В ходе двухнедельного испытания команда разработчиков собрала обширные отзывы из реальной практики и провела целенаправленную оптимизацию, в частности, значительно повысив плавность переключения между китайским и английским языками и улучшив совместимость с основными программными фреймворками.

Технические особенности: гибридная архитектура и превосходная эффективность
Основная силаLing-2.6-flash заключается в ее уникальной архитектуре и высокой операционной эффективности:
Гибридная линейная архитектура: благодаря низкоуровневой вычислительной оптимизации модель достигает превосходной скорости инференса. С 4 картами H20 она достигает до 340 токенов/с. По пропускной способности Prefill она превосходит Nemotron-3-Super в 2,2 раза, что значительно сокращает задержку отклика.
Впечатляющий коэффициент эффективности токенов: команда тщательно откалибровала эффективность токенов во время обучения. Данные оценки показывают, что для задач эквивалентного качества Ling-2.6-flash потребляет всего около 15 млн токенов — примерно одну десятую от сопоставимых конкурентов — что значительно снижает коммерческие затраты.
Углубление сценариев: целенаправленное улучшение возможностей агентов
Для сценариев с агентами — одного из наиболее распространенных вариантов использования больших моделей —Ling-2.6-flash был специально усовершенствован. Будь то обработка сложных вызовов инструментов, многоэтапное планирование или выполнение конечных задач, модель работает надежно. В нескольких отраслевых стандартных оценках, таких как BFCL-V4 и SWE-bench, даже по сравнению с моделями с большим количеством активированных параметров Ling-2.6-flash демонстрирует сопоставимую или даже передовую (SOTA) производительность.
Теперь разработчики могут получить доступ к открытым ресурсам модели через Hugging Face и ModelScope (сообщество Moba), что открывает возможности для дальнейшего изучения ее потенциала в различных отраслевых приложениях.
Связанная статья
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
14 мая 2026 года платформа разработки приложений на базе искусственного интеллекта Lovable объявила о своем участии в раундеSeed-финансирования на сумму $800 000 для датского стартапа в области аппаратного обеспечения Atech. При ведущем участии Lovab
Anthropic расширяет инструменты для программирования Claude AI в Японии в рамках стратегии роста за рубежом
Anthropic, prominent U.S. artificial intelligence firm, is intensifying its global outreach. On Wednesday, the company hosted a major developer gathering, "Code with Claude," in Tokyo, drawing close to 500 software engineers. This initiative seeks to
Гигант индийского программного обеспечения сокращает найм, обещая не увольнять сотрудников по мере масштабирования ИИ-агентов
По мере того как искусственный интеллект трансформирует традиционные трудоемкие бизнес-модели, Tata Consultancy Services (TCS), ведущая индийская компания по аутсорсингу программного обеспечения, представила свою стратегическую реакцию. В ходе ежегод
Рекомендации по связанным специальным темам
Комментарии (0)
Сегодня серия крупных моделей Baoling от Ant Group получила значительное обновление:

Технические особенности: гибридная архитектура и превосходная эффективность
Основная сила
Гибридная линейная архитектура: благодаря низкоуровневой вычислительной оптимизации модель достигает превосходной скорости инференса. С 4 картами H20 она достигает до 340 токенов/с. По пропускной способности Prefill она превосходит Nemotron-3-Super в 2,2 раза, что значительно сокращает задержку отклика.
Впечатляющий коэффициент эффективности токенов: команда тщательно откалибровала эффективность токенов во время обучения. Данные оценки показывают, что для задач эквивалентного качества
Углубление сценариев: целенаправленное улучшение возможностей агентов
Для сценариев с агентами — одного из наиболее распространенных вариантов использования больших моделей —
Теперь разработчики могут получить доступ к открытым ресурсам модели через Hugging Face и ModelScope (сообщество Moba), что открывает возможности для дальнейшего изучения ее потенциала в различных отраслевых приложениях.
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
14 мая 2026 года платформа разработки приложений на базе искусственного интеллекта Lovable объявила о своем участии в раундеSeed-финансирования на сумму $800 000 для датского стартапа в области аппаратного обеспечения Atech. При ведущем участии Lovab
Anthropic расширяет инструменты для программирования Claude AI в Японии в рамках стратегии роста за рубежом
Anthropic, prominent U.S. artificial intelligence firm, is intensifying its global outreach. On Wednesday, the company hosted a major developer gathering, "Code with Claude," in Tokyo, drawing close to 500 software engineers. This initiative seeks to
Гигант индийского программного обеспечения сокращает найм, обещая не увольнять сотрудников по мере масштабирования ИИ-агентов
По мере того как искусственный интеллект трансформирует традиционные трудоемкие бизнес-модели, Tata Consultancy Services (TCS), ведущая индийская компания по аутсорсингу программного обеспечения, представила свою стратегическую реакцию. В ходе ежегод











