Дом
Deep Cogito представляет гибридные модели искусственного интеллекта с расширенными возможностями рассуждений
Deep Cogito, новый инновационный разработчик ИИ, запустил серию открытых моделей ИИ, которые плавно переключаются между режимами рассуждения и нерассуждения.
Рассуждающие модели, такие как o1 от OpenAI, отлично работают в таких областях, как математика и физика, методично проверяя решения шаг за шагом. Однако такая точность требует больших вычислительных ресурсов и времени. Для решения этой проблемы такие компании, как Anthropic, разрабатывают гибридные архитектуры, в которых рассуждения сочетаются со стандартными компонентами, что позволяет быстро отвечать на простые запросы и проводить более глубокий анализ сложных.
Модели Deep Cogito, получившие название Cogito 1, представляют собой гибридные конструкции. Компания утверждает, что они превосходят лучшие открытые модели аналогичного размера, включая модели от Meta и DeepSeek.
"Каждая модель может отвечать мгновенно или размышлять перед ответом, имитируя модели рассуждения", - заявила Deep Cogito в своем блоге. "Они были созданы компактной командой всего за 75 дней".
Модели Cogito 1 имеют от 3 миллиардов до 70 миллиардов параметров, а в ближайшем будущем планируется создать модели с 671 миллиардом параметров. Большее количество параметров, как правило, повышает способность модели решать задачи.
Cogito 1 создана на основе моделей Meta's Llama и Alibaba's Qwen, при этом в Deep Cogito применяются инновационные методы обучения для повышения производительности и обеспечения возможности переключения рассуждений.
Внутренние бенчмарки показывают, что самая крупная модель, Cogito 70B, с включенной функцией рассуждения превосходит модель R1 от DeepSeek в некоторых математических и языковых задачах. Без рассуждений она также превосходит Llama 4 Scout от Meta в LiveBench, широкой оценке ИИ.
Все модели Cogito 1 доступны для загрузки или через API на облачных платформах Fireworks AI и Together AI.

Производительность Cogito 1 в сравнении с другими популярными открытыми моделями ИИИИзображение Credits:Deep Cogito "Мы все еще находимся в начале пути масштабирования и используем лишь малую часть вычислений, обычно выделяемых для обучения больших языковых моделей", - отмечает Deep Cogito в своем блоге. "Мы изучаем новые методы посттренинга для самосовершенствования".
Компания Deep Cogito была основана в июне 2024 года в Сан-Франциско, согласно калифорнийским документам, Дришаном Аророй, бывшим старшим инженером-программистом Google, и Дхрувом Малхотрой, ранее работавшим менеджером по продуктам в DeepMind Google, где он занимался генеративным поиском.
По данным PitchBook, Deep Cogito, поддерживаемая South Park Commons, стремится стать пионером "общего суперинтеллекта" - ИИ, превосходящего большинство людей и открывающего беспрецедентные возможности.
Связанная статья
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
Кубок Суперкубок Alibaba: Qwen3.8-Max дебютирует с улучшенными инструментами для программирования и офисными приложениями
Alibaba официально представила Qwen3.8-Max — новую базовую большую модель с 2,4 триллиона параметров. Это значимое достижение в области искусственного интеллекта обеспечивает существенное улучшение производительности в ключевых областях, таких как пр
Рекомендации по связанным специальным темам
Комментарии (0)
Deep Cogito, новый инновационный разработчик ИИ, запустил серию открытых моделей ИИ, которые плавно переключаются между режимами рассуждения и нерассуждения.
Рассуждающие модели, такие как o1 от OpenAI, отлично работают в таких областях, как математика и физика, методично проверяя решения шаг за шагом. Однако такая точность требует больших вычислительных ресурсов и времени. Для решения этой проблемы такие компании, как Anthropic, разрабатывают гибридные архитектуры, в которых рассуждения сочетаются со стандартными компонентами, что позволяет быстро отвечать на простые запросы и проводить более глубокий анализ сложных.
Модели Deep Cogito, получившие название Cogito 1, представляют собой гибридные конструкции. Компания утверждает, что они превосходят лучшие открытые модели аналогичного размера, включая модели от Meta и DeepSeek.
"Каждая модель может отвечать мгновенно или размышлять перед ответом, имитируя модели рассуждения", - заявила Deep Cogito в своем блоге. "Они были созданы компактной командой всего за 75 дней".
Модели Cogito 1 имеют от 3 миллиардов до 70 миллиардов параметров, а в ближайшем будущем планируется создать модели с 671 миллиардом параметров. Большее количество параметров, как правило, повышает способность модели решать задачи.
Cogito 1 создана на основе моделей Meta's Llama и Alibaba's Qwen, при этом в Deep Cogito применяются инновационные методы обучения для повышения производительности и обеспечения возможности переключения рассуждений.
Внутренние бенчмарки показывают, что самая крупная модель, Cogito 70B, с включенной функцией рассуждения превосходит модель R1 от DeepSeek в некоторых математических и языковых задачах. Без рассуждений она также превосходит Llama 4 Scout от Meta в LiveBench, широкой оценке ИИ.
Все модели Cogito 1 доступны для загрузки или через API на облачных платформах Fireworks AI и Together AI.

"Мы все еще находимся в начале пути масштабирования и используем лишь малую часть вычислений, обычно выделяемых для обучения больших языковых моделей", - отмечает Deep Cogito в своем блоге. "Мы изучаем новые методы посттренинга для самосовершенствования".
Компания Deep Cogito была основана в июне 2024 года в Сан-Франциско, согласно калифорнийским документам, Дришаном Аророй, бывшим старшим инженером-программистом Google, и Дхрувом Малхотрой, ранее работавшим менеджером по продуктам в DeepMind Google, где он занимался генеративным поиском.
По данным PitchBook, Deep Cogito, поддерживаемая South Park Commons, стремится стать пионером "общего суперинтеллекта" - ИИ, превосходящего большинство людей и открывающего беспрецедентные возможности.
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
Кубок Суперкубок Alibaba: Qwen3.8-Max дебютирует с улучшенными инструментами для программирования и офисными приложениями
Alibaba официально представила Qwen3.8-Max — новую базовую большую модель с 2,4 триллиона параметров. Это значимое достижение в области искусственного интеллекта обеспечивает существенное улучшение производительности в ключевых областях, таких как пр











