вариант
Дом
Новости
Deep Cogito представляет четыре гибридные модели рассуждения с открытым исходным кодом, отличающиеся самосовершенствующейся интуицией

Deep Cogito представляет четыре гибридные модели рассуждения с открытым исходным кодом, отличающиеся самосовершенствующейся интуицией

21 февраля 2026 г.
183

Deep Cogito, стартап из Сан-Франциско, занимающийся исследованиями в области искусственного интеллекта и основанный бывшими инженерами Google, выпустил четыре новых «открытых» больших языковых модели (LLM). Эти модели решают ключевую задачу: научиться более эффективно рассуждать с течением времени и становиться более способными к автономной работе.

Эти модели, известные под общим названием Cogito v2, имеют от 70 до 671 миллиарда параметров. Они доступны разработчикам искусственного интеллекта и компаниям на условиях смешанных разрешительных и полностью открытых лицензий. В релиз входят:

  • Cogito v2-70B (Dense)
  • Cogito v2-109B (Mixture-of-Experts)
  • Cogito v2-405B (Dense)
  • Cogito v2-671B (MoE)

Модели Dense и MoE служат разным целям. Плотные варианты (70B и 405B) активируют все параметры для каждого ввода, что делает их предсказуемыми и упрощает развертывание на различных аппаратных конфигурациях.

Они идеально подходят для задач с низкой задержкой, тонкой настройки и сред с ограниченной мощностью GPU. В отличие от них, модели MoE (109B и 671B) используют механизм разреженной маршрутизации, активируя только подмножество специализированных «экспертных» подсетей для каждого запроса. Такая конструкция поддерживает гораздо большие общие размеры моделей без пропорционального увеличения вычислительных затрат.

Таким образом, модели MoE превосходны в высокопроизводительном выводе и исследовании сложных рассуждений, обеспечивая высочайшую точность при меньших затратах на выполнение. В линейке Cogito v2 модель 671B MoE является флагманской, используя свой масштаб и эффективную маршрутизацию, чтобы соответствовать или превосходить ведущие открытые модели по тестам — часто с гораздо более короткими цепочками рассуждений.

Модели теперь доступны через Hugging Face для корпоративного использования и Unsloth для локального развертывания. Для тех, кто не может самостоятельно хостить, доступ к API предоставляется Together AI, Baseten и RunPod.

Также доступна квантовая версия модели 671B с FP8 (8-битная плавающая запятая). За счет уменьшения точности параметров с 16 до 8 бит эта версия позволяет быстрее, дешевле и доступнее развертывать оборудование, при этом обычно сохраняя 95–99 % исходной производительности. Однако точность может немного снизиться при выполнении задач, требующих высокой точности, таких как определенные математические или логические задачи.

Все четыре модели Cogito v2 являются гибридными системами рассуждения: они могут отвечать мгновенно или, при необходимости, перед ответом проводить внутреннюю рефлексию.

Это размышление — не просто функция времени вывода, а неотъемлемая часть самого процесса обучения.

Модели обучаются интернализировать свои пути рассуждений. Шаги, которые они предпринимают для достижения решений — их внутренние «мысли» — возвращаются в основополагающие веса модели.

Со временем они учатся отличать продуктивные линии рассуждений от нерелевантных.

Как объясняется в блоге Deep Cogito, исследователи не поощряют модель «блуждать» в поисках ответа. Вместо этого они поощряют ее развивать более сильную интуицию для выбора наиболее эффективного пути рассуждения.

Результатом, по утверждению Deep Cogito, является более быстрое и эффективное мышление, что приводит к значительному повышению производительности даже в стандартном режиме работы.

Путь к самосовершенствующемуся ИИ

Хотя Deep Cogito является относительно новым игроком в широком сообществе ИИ, компания разрабатывает свою технологию уже более года.

Компания начала свою деятельность в апреле 2025 года с открытых моделей, основанных на Meta Llama 3.2. Эти первоначальные модели дали многообещающие результаты после раунда начального финансирования в размере 13 миллионов долларов, проведенного Benchmark в ноябре 2024 года. Эрик Вишрия из Benchmark вошел в совет директоров компании.

Как ранее сообщал VentureBeat, самые маленькие модели Cogito v1 (3B и 8B) стабильно превосходили сопоставимые модели Llama 3 по различным тестам, часто с значительным отрывом.

Генеральный директор и соучредитель Deep Cogito, Дришан Арора, бывший ведущий инженер LLM в Google, описывает видение компании как создание моделей, которые совершенствуют свое мышление с каждой итерацией, подобно тому, как AlphaGo совершенствовался через самоигра.

В основе этого подхода лежит итеративная дистилляция и амплификация (IDA), метод, который заменяет статические подсказки для обучения собственными развивающимися идеями модели.

Понимание интуиции машины

Версия Cogito v2 значительно расширяет этот цикл самосовершенствования. Основная идея проста: рассуждения должны быть вплетены в основной интеллект модели, а не просто активироваться во время вывода.

Для достижения этой цели компания внедрила систему, в которой модели генерируют цепочки рассуждений во время обучения, а затем учатся на основе своих собственных промежуточных мыслительных процессов.

Внутренние тесты подтверждают ощутимые улучшения. Флагманская модель 671B MoE превосходит DeepSeek R1 в задачах рассуждения, сравниваясь или превосходя ее последнюю модель 0528 при использовании цепочек рассуждений, которые в среднем на 60 % короче.

В тестах MMLU, GSM8K и MGSM Cogito 671B MoE демонстрирует конкурентоспособность с ведущими открытыми моделями, такими как Qwen1.5-72B и DeepSeek v3, приближаясь к уровню производительности закрытых моделей, таких как Claude 4 Opus и o3.

Ключевые выводы включают:

  • В режиме рассуждений Cogito 671B MoE сравнялся с DeepSeek R1 0528 по многоязычному QA и общим знаниям, а также превзошел его в стратегии и логическом выводе.
  • В стандартном режиме (без рассуждений) он превзошел DeepSeek v3 0324, продемонстрировав, что дистиллированная интуиция обеспечивает повышение производительности даже без расширенных шагов рассуждения.
  • Завершение рассуждений за меньшее количество шагов дает практические преимущества: более низкие затраты на вывод и более быстрое время отклика на сложные запросы.

Арора сравнивает это с разницей между поиском места назначения и уже имеющимся четким представлением о том, где оно находится.

«Поскольку модели Cogito развивают лучшую интуицию для правильной траектории поиска во время вывода, их цепочки рассуждений на 60 % короче, чем у DeepSeek R1», — пояснил он в посте на X.

Преимущества моделей Deep Cogito: интуиция машины в действии

Примеры из внутреннего тестирования Cogito v2 иллюстрируют эту способность. В одной математической задаче пользователь спрашивает, может ли поезд, движущийся со скоростью 80 миль в час, преодолеть 240 миль менее чем за 2,5 часа.

В то время как многие модели выполняют подробные пошаговые вычисления и могут допускать ошибки, Cogito 671B выполняет краткое внутреннее размышление, вычисляет 240 ÷ 80 = 3 часа и правильно заключает, что поезд не сможет прибыть вовремя. Он использует менее 100 внутренних токенов по сравнению с более чем 200, используемыми DeepSeek R1 для того же ответа.

В примере юридического обоснования применимости решения Верховного суда США режим обоснования Cogito применяет четкую двухэтапную логику: сначала определяется, соответствует ли гипотетический случай прецеденту, а затем обосновывается его вывод. Это тонкое, интерпретативное обоснование остается проблемой для многих LLM.

Модели также демонстрируют улучшенную обработку неоднозначности. В многоступенчатых вопросах, таких как определение семейных отношений (например, «Элис — мать Боба, Боб — отец Чарли. Кем является Элис для Чарли?»), модели Cogito v2 правильно определяют «бабушка», даже когда формулировка слегка изменена — момент, в котором другие открытые модели часто затрудняются.

Достижение эффективности в масштабе

Примечательно, что Deep Cogito сообщает об обучении всех восьми своих моделей Cogito (включая серию v1) с общей стоимостью менее 3,5 миллионов долларов — это лишь часть от заявленных девятизначных бюджетов некоторых ведущих передовых моделей.

Этот бюджет покрыл расходы на обширную генерацию данных, синтетическое усиление, инфраструктуру и более 1000 экспериментов по обучению.

Арора объясняет эту экономическую эффективность основным принципом: создание более интеллектуальных моделей зависит от лучшего фундаментального понимания («априорных знаний»), а не просто от подачи им большего количества данных.

Обучая модели избегать избыточных или вводящих в заблуждение путей рассуждений, Cogito v2 обеспечивает надежную производительность без увеличения времени или стоимости вывода — это критически важное преимущество для сервисов на основе API или развертывания на периферийных устройствах, где задержка и затраты являются ключевыми факторами.

Взгляд в будущее: дорожная карта Deep Cogito

Cogito v2 представляет собой итеративный шаг, а не конечный продукт. Арора описывает подход компании как «подъем на гору»: запуск моделей, обучение на основе их рассуждений, извлечение уроков и повторение цикла. Каждая версия модели основана на своей предшественнице.

Deep Cogito по-прежнему привержена открытому исходному коду для всех своих моделей, как нынешних, так и будущих. Ее работа уже получила поддержку со стороны таких инвесторов, как Эрик Вишрия из Benchmark и Адитья Агарвал из South Park Commons.

Партнерами по инфраструктуре являются Hugging Face, Together AI, RunPod, Baseten, команда Meta Llama и Unsloth.

Для разработчиков, исследователей и предприятий модели доступны уже сегодня для локального использования, мультимодального сравнения и доработки под конкретные области.

Для сообщества разработчиков открытого программного обеспечения Cogito v2 — это не просто важная веха. Это новая парадигма создания интеллекта, ориентированная не на более интенсивное мышление, а на обучение более эффективному мышлению.

Связанная статья
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field 14 мая 2026 года платформа разработки приложений на базе искусственного интеллекта Lovable объявила о своем участии в раундеSeed-финансирования на сумму $800 000 для датского стартапа в области аппаратного обеспечения Atech. При ведущем участии Lovab
Anthropic расширяет инструменты для программирования Claude AI в Японии в рамках стратегии роста за рубежом Anthropic расширяет инструменты для программирования Claude AI в Японии в рамках стратегии роста за рубежом Anthropic, prominent U.S. artificial intelligence firm, is intensifying its global outreach. On Wednesday, the company hosted a major developer gathering, "Code with Claude," in Tokyo, drawing close to 500 software engineers. This initiative seeks to
Гигант индийского программного обеспечения сокращает найм, обещая не увольнять сотрудников по мере масштабирования ИИ-агентов Гигант индийского программного обеспечения сокращает найм, обещая не увольнять сотрудников по мере масштабирования ИИ-агентов По мере того как искусственный интеллект трансформирует традиционные трудоемкие бизнес-модели, Tata Consultancy Services (TCS), ведущая индийская компания по аутсорсингу программного обеспечения, представила свою стратегическую реакцию. В ходе ежегод
Рекомендации по связанным специальным темам
Дизайн и искусство Лучшие инструменты для переноса стилей с помощью ИИ для творческих экспериментов
Лучшие инструменты для переноса стилей с помощью ИИ для творческих экспериментов

2026: лучшие и самые популярные инструменты для переноса стиля с помощью ИИ для творческих экспериментов! XIX.AI подготовила подборку мощных, революционных инструментов, которые обязательно стоит попробовать: они демонстрируют исключительные результаты, подтвержденные реальными тестами и тщательным рейтингом. Эти ведущие решения помогают творческим людям значительно повысить продуктивность, ускоряя создание контента и открывая безграничные творческие возможности. Ознакомьтесь с ними прямо сейчас, чтобы найти идеальный инструмент и начать творить уже сегодня!

9 инструментов
xix.ai
Создание комиксов Лучшие инструменты для создания диалоговых пузырей с помощью ИИ для визуального повествования
Лучшие инструменты для создания диалоговых пузырей с помощью ИИ для визуального повествования

2026 года: самые новые и лучшие инструменты с ИИ для создания диалоговых пузырей в визуальном сторителлинге представлены на XIX.AI! В этой тщательно подобранной подборке представлены мощные, революционные инструменты, которые помогут творческим людям повысить продуктивность и преодолеть творческие кризисы. Ознакомьтесь со сравнением бесплатных и платных версий, посмотрите тесты в реальных условиях и изучите последние рейтинги, чтобы найти решения, которые обязательно стоит попробовать и которые идеально подходят для создания увлекательных визуальных историй. Исследуйте коллекцию прямо сейчас, чтобы найти свой идеальный инструмент!

10 инструментов
xix.ai
Помощник по встречам Лучшие инструменты для составления отчетов о встречах с использованием ИИ: четкое отслеживание решений и последующих действий
Лучшие инструменты для составления отчетов о встречах с использованием ИИ: четкое отслеживание решений и последующих действий

2026: Последние версии лучших инструментов для составления отчетов о встречах с помощью ИИ, обеспечивающих четкое отслеживание решений и удобное выполнение последующих действий. В этом тщательно подобранном списке представлены мощные, революционные решения, которые значительно повышают продуктивность за счет автоматизации ведения протоколов встреч, выявления ключевых задач и оптимизации координации работы команды по всем проектам. Получите сравнение бесплатных и платных версий, а также результаты реальных тестов и еженедельно обновляемые рейтинги, которые помогут вам найти идеальный инструмент. Ознакомьтесь с ними прямо сейчас, чтобы раскрыть потенциал искусственного интеллекта!

9 инструментов
xix.ai
Анализ данных Лучшие инструменты для очистки данных с использованием ИИ: быстрое устранение пропущенных значений и дубликатов
Лучшие инструменты для очистки данных с использованием ИИ: быстрое устранение пропущенных значений и дубликатов

2026 год: лучшие и наиболее высоко оценённые инструменты для очистки данных с ИИ, предназначенные для быстрого устранения пропущенных значений и дубликатов. В этом тщательно отобранном списке представлены мощные решения, способные кардинально повысить производительность. Каждый инструмент прошёл строгие тестирования в реальных условиях для обеспечения надёжности. Получите бесплатное сравнение версий с платной и найдите инструмент, который наилучшим образом соответствует вашим потребностям. Ознакомьтесь с ним прямо сейчас на сайте XIX.AI, чтобы раскрыть полный потенциал работы с ИИ.

11 инструментов
xix.ai
Дизайн и искусство Лучшие инструменты для творческого мышления на основе ИИ для художников: преодоление визуальных блоков
Лучшие инструменты для творческого мышления на основе ИИ для художников: преодоление визуальных блоков

В 2026 году лучшие и наиболее популярные инструменты для творческого мышления с использованием ИИ для художников были отобраны XIX.AI, чтобы помочь создателям преодолеть визуальные блоки и мгновенно повысить креативность. Эти мощные инструменты, меняющие правила игры, предлагают реальные тесты, подробное сравнение бесплатных и платных версий, а также еженедельно обновляемые рейтинги. Найдите идеальный инструмент для ускорения создания контента и откройте свой ИИ-преимущество уже сегодня. Исследуйте сейчас!

14 инструментов
xix.ai
Музыкальная композиция AI-битмейкеры для фоновых треков в TikTok, звукового сопровождения в Reels и промо-музыки для авторов контента
AI-битмейкеры для фоновых треков в TikTok, звукового сопровождения в Reels и промо-музыки для авторов контента

2026: лучшие современные AI-битмейкеры для фоновых треков в TikTok, аудио для Reels и промо-музыки для авторов! XIX.AI составил рейтинг самых популярных и мощных инструментов, которые прошли реальные испытания и позволяют создавать безупречную музыку для любых потребностей контента. Здесь вы найдёте подробные сравнительные данные по бесплатным и платным версиям, еженедельно обновляемые рейтинги и варианты, которые обязательно стоит попробовать, чтобы повысить свою креативность и продуктивность. Ознакомьтесь с ними прямо сейчас, чтобы найти идеальный инструмент для себя!

11 инструментов
xix.ai
Комментарии (3)
0/500
LarryMitchell
LarryMitchell 13 июня 2026 г., 23:00:14 GMT+03:00

Interesting move by Deep Cogito. But 'open-ish' sounds like a marketing term—how open is it really? Also, self-improving intuition sounds spooky. Are we building AI that can rewrite its own reasoning without oversight? 🤔

JamesCarter
JamesCarter 3 мая 2026 г., 17:01:06 GMT+03:00

Interesting approach, but 'open-ish' sounds like a marketing gimmick. If the weights aren't fully open, how can the community truly verify their 'self-improving' claims? Feels like another startup trying to have its cake and eat it too. The intuition part is fascinating, though. 🤔

WillieJones
WillieJones 8 апреля 2026 г., 19:00:50 GMT+03:00

¿Modelos auto-mejorables? Parece prometedor, pero siempre me pregunto: ¿cómo verifican que la intuición emergente no genere sesgos peligrosos o alucinaciones más sofisticadas? 🤔 Sería bueno ver más transparencia en los datos de entrenamiento.

OR