Дом
Компания Bailing Large Model выпустила продукт Ling-2.6-flash, обеспечивающий высочайшую производительность по цене в десять раз ниже.

На фоне усиливающейся глобальной конкуренции в области крупных языковых моделей модель Bailing от компании Ant Group достигла нового этапа развития с выпуском новой версии — Ling-2.6-flash. Эта модель привлекла значительное внимание сообщества исследователей в области ИИ благодаря своему исключительно высокому соотношению «интеллекта к эффективности».
С технической точки зрения, Ling-2.6-flash демонстрирует универсальные характеристики. В ней насчитывается 104 миллиарда параметров, однако в процессе выполнения задач активны лишь 7,4 миллиарда из них. Такой подход направлен на достижение оптимального баланса между возможностями модели и расходом ресурсов. Согласно последним тестам, проведенным авторитетной платформой Artificial Analysis, модель обладает высокой энергоэффективностью: для выполнения одной и той же задачи ей требуется всего 15 миллионов токенов. Это примерно в десять раз меньше, чем потребуется таким популярным моделям, как Nemotron-3-Super, что позволяет разработчикам получать интеллектуальную поддержку при значительно более низких расходах на вычисления.
Фактически, перед официальным анонсом модель была выпущена в тестовой версии на протяжении недели. Данные показывают, что в течение этого периода ежедневное потребление токенов быстро достигло уровня 100 миллиардов. Такой подход к тестированию перед выпуском не только подтвердил стабильность модели в реальных условиях с высоким уровнем одновременного использования, но и продемонстрировал сильный спрос на высокопроизводительные и экономически эффективные языковые модели.
Эксперты отрасли считают, что выпуск Ling-2.6-flash ознаменует новый этап в конкуренции между крупными языковыми моделями — переход от чистой «гонки в количестве параметров» к «гонке в эффективности использования интеллекта». Благодаря оптимизации механизма активации параметров модель значительно снижает затраты на выполнение задач при сохранении обширной базы знаний. Для предприятий, которым необходимо внедрять ИИ-решения в масштабах, это представляет собой более экономически выгодный вариант.
Связанная статья
iFLYTEK представляет общую большую модель Spark X2.5
1 сентября iFlytek откроет открытый доступ к двум большим языковым моделям, ориентированным на работу на периферийных устройствах: Xinghuo X2.5-4B и Xinghuo X2.5-1.7B, согласно последнему официальному заявлению. Обе модели изначально поддерживают кон
Meta удаляет функцию редактирования фотографий с помощью ИИ после негативной реакции пользователей
Meta, гигант социальных сетей, вновь оказалась в центре публичной дискуссии о хрупком балансе между искусственным интеллектом и конфиденциальностью пользователей. Согласно TechCrunch, подразделение Meta Superintelligence Labs представило новый генера
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
Рекомендации по связанным специальным темам
Комментарии (0)

На фоне усиливающейся глобальной конкуренции в области крупных языковых моделей модель Bailing от компании Ant Group достигла нового этапа развития с выпуском новой версии — Ling-2.6-flash. Эта модель привлекла значительное внимание сообщества исследователей в области ИИ благодаря своему исключительно высокому соотношению «интеллекта к эффективности».
С технической точки зрения, Ling-2.6-flash демонстрирует универсальные характеристики. В ней насчитывается 104 миллиарда параметров, однако в процессе выполнения задач активны лишь 7,4 миллиарда из них. Такой подход направлен на достижение оптимального баланса между возможностями модели и расходом ресурсов. Согласно последним тестам, проведенным авторитетной платформой Artificial Analysis, модель обладает высокой энергоэффективностью: для выполнения одной и той же задачи ей требуется всего 15 миллионов токенов. Это примерно в десять раз меньше, чем потребуется таким популярным моделям, как Nemotron-3-Super, что позволяет разработчикам получать интеллектуальную поддержку при значительно более низких расходах на вычисления.
Фактически, перед официальным анонсом модель была выпущена в тестовой версии на протяжении недели. Данные показывают, что в течение этого периода ежедневное потребление токенов быстро достигло уровня 100 миллиардов. Такой подход к тестированию перед выпуском не только подтвердил стабильность модели в реальных условиях с высоким уровнем одновременного использования, но и продемонстрировал сильный спрос на высокопроизводительные и экономически эффективные языковые модели.
Эксперты отрасли считают, что выпуск Ling-2.6-flash ознаменует новый этап в конкуренции между крупными языковыми моделями — переход от чистой «гонки в количестве параметров» к «гонке в эффективности использования интеллекта». Благодаря оптимизации механизма активации параметров модель значительно снижает затраты на выполнение задач при сохранении обширной базы знаний. Для предприятий, которым необходимо внедрять ИИ-решения в масштабах, это представляет собой более экономически выгодный вариант.
iFLYTEK представляет общую большую модель Spark X2.5
1 сентября iFlytek откроет открытый доступ к двум большим языковым моделям, ориентированным на работу на периферийных устройствах: Xinghuo X2.5-4B и Xinghuo X2.5-1.7B, согласно последнему официальному заявлению. Обе модели изначально поддерживают кон
Meta удаляет функцию редактирования фотографий с помощью ИИ после негативной реакции пользователей
Meta, гигант социальных сетей, вновь оказалась в центре публичной дискуссии о хрупком балансе между искусственным интеллектом и конфиденциальностью пользователей. Согласно TechCrunch, подразделение Meta Superintelligence Labs представило новый генера
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи











