option
Maison
Nouvelles
Deep Cogito dévoile quatre modèles de raisonnement hybrides open source dotés d'une intuition auto-améliorante

Deep Cogito dévoile quatre modèles de raisonnement hybrides open source dotés d'une intuition auto-améliorante

21 février 2026
183

Deep Cogito, une start-up de recherche en IA basée à San Francisco et fondée par d'anciens ingénieurs de Google, a publié quatre nouveaux modèles linguistiques à grande échelle (LLM) « semi-ouverts ». Ces modèles s'attaquent à un défi majeur : apprendre à raisonner plus efficacement au fil du temps et devenir plus autonomes.

Collectivement connus sous le nom de famille Cogito v2, ces modèles comptent entre 70 et 671 milliards de paramètres. Ils sont mis à la disposition des développeurs et des entreprises spécialisés dans l'IA sous des licences mixtes permissives et entièrement ouvertes. La version comprend :

  • Cogito v2-70B (dense)
  • Cogito v2-109B (Mixture-of-Experts)
  • Cogito v2-405B (dense)
  • Cogito v2-671B (MoE)

Les modèles Dense et MoE ont des objectifs distincts. Les variantes Dense (70B et 405B) activent tous les paramètres pour chaque entrée, ce qui les rend prévisibles et plus faciles à déployer sur diverses configurations matérielles.

Ils sont idéaux pour les tâches à faible latence, le réglage fin et les environnements avec une capacité GPU limitée. En revanche, les modèles MoE (109B et 671B) utilisent un mécanisme de routage clairsemé, n'activant qu'un sous-ensemble de sous-réseaux « experts » spécialisés par requête. Cette conception prend en charge des tailles de modèles totales beaucoup plus importantes sans augmenter proportionnellement les coûts de calcul.

Ainsi, les modèles MoE excellent dans l'inférence haute performance et la recherche de raisonnement complexe, offrant une précision de premier ordre avec des coûts d'exécution réduits. Dans la gamme Cogito v2, le modèle MoE 671B est le produit phare. Il utilise son échelle et son routage efficace pour égaler ou surpasser les principaux modèles ouverts sur les benchmarks, souvent avec des chaînes de raisonnement beaucoup plus courtes.

Les modèles sont désormais accessibles via Hugging Face pour une utilisation en entreprise et Unsloth pour un déploiement local. Pour ceux qui ne peuvent pas les héberger eux-mêmes, l'accès à l'API est fourni par Together AI, Baseten et RunPod.

Une version quantifiée FP8 (virgule flottante 8 bits) du modèle 671B est également disponible. En réduisant la précision des paramètres de 16 bits à 8 bits, cette version permet un déploiement matériel plus rapide, moins coûteux et plus accessible, tout en conservant généralement 95 à 99 % des performances d'origine. Cependant, la précision peut être légèrement réduite pour les tâches nécessitant une grande précision, telles que certains problèmes mathématiques ou de raisonnement.

Les quatre modèles Cogito v2 sont des systèmes de raisonnement hybrides : ils peuvent répondre instantanément ou, si nécessaire, engager une réflexion interne avant de répondre.

Cette réflexion n'est pas seulement une fonctionnalité au moment de l'inférence, elle fait partie intégrante du processus d'apprentissage lui-même.

Les modèles sont formés pour intérioriser leurs chemins de raisonnement. Les étapes qu'ils suivent pour parvenir à des solutions, leurs « pensées » internes, sont distillées dans les poids fondamentaux du modèle.

Au fil du temps, ils apprennent à distinguer les raisonnements productifs de ceux qui ne sont pas pertinents.

Comme expliqué dans le blog de Deep Cogito, les chercheurs découragent le modèle de « vagabonder davantage » pour trouver une réponse. Au contraire, ils l'encouragent à développer une intuition plus forte pour trouver le chemin de raisonnement le plus efficace.

Selon Deep Cogito, il en résulte un raisonnement à la fois plus rapide et plus efficace, qui se traduit par des gains de performance importants, même en mode de fonctionnement standard.

La voie vers une IA capable de s'améliorer

Bien que relativement nouveau dans la communauté de l'IA au sens large, Deep Cogito développe sa technologie depuis plus d'un an.

La société a été lancée en avril 2025 avec des modèles open source basés sur Llama 3.2 de Meta. Ces premiers modèles ont donné des résultats prometteurs, à la suite d'un tour de financement initial de 13 millions de dollars mené par Benchmark en novembre 2024. Eric Vishria, de Benchmark, a rejoint le conseil d'administration de la société.

Comme l'a déjà rapporté VentureBeat, les plus petits modèles Cogito v1 (3B et 8B) ont systématiquement surpassé les modèles Llama 3 comparables dans divers benchmarks, souvent avec des écarts significatifs.

Le PDG et cofondateur de Deep Cogito, Drishan Arora, ancien ingénieur en chef LLM chez Google, décrit la vision de l'entreprise comme la création de modèles qui affinent leur raisonnement à chaque itération, à l'instar de la manière dont AlphaGo s'est amélioré grâce à l'auto-apprentissage.

Au cœur de cette approche se trouve l'Iterated Distillation and Amplification (IDA), une méthode qui remplace les invites d'entraînement statiques par les propres connaissances évolutives du modèle.

Comprendre l'intuition des machines

La version Cogito v2 amplifie considérablement cette boucle d'auto-amélioration. L'idée de base est simple : le raisonnement doit être intégré à l'intelligence fondamentale du modèle, et non pas simplement activé lors de l'inférence.

Pour y parvenir, l'entreprise a mis en place un système dans lequel les modèles génèrent des chaînes de raisonnement pendant l'entraînement, puis apprennent à partir de leurs propres processus de réflexion intermédiaires.

Des benchmarks internes confirment des améliorations tangibles. Le modèle phare 671B MoE surpasse DeepSeek R1 dans les tâches de raisonnement, égalant ou dépassant son dernier modèle 0528 tout en utilisant des chaînes de raisonnement 60 % plus courtes en moyenne.

Sur des benchmarks tels que MMLU, GSM8K et MGSM, le Cogito 671B MoE est compétitif par rapport aux principaux modèles ouverts tels que Qwen1.5-72B et DeepSeek v3, se rapprochant du niveau de performance des modèles fermés tels que Claude 4 Opus et o3.

Voici les principales conclusions :

  • En mode raisonnement, Cogito 671B MoE a égalé DeepSeek R1 0528 en matière de questions-réponses multilingues et de connaissances générales, et l'a surpassé en matière de stratégie et de déduction logique.
  • En mode standard (sans raisonnement), il a surpassé DeepSeek v3 0324, démontrant que l'intuition distillée améliore les performances même sans étapes de raisonnement étendues.
  • Réaliser le raisonnement en moins d'étapes présente des avantages pratiques : coûts d'inférence réduits et temps de réponse plus rapides pour les requêtes complexes.

Arora compare cela à la différence entre rechercher une destination et avoir déjà une idée précise de son emplacement.

« Comme les modèles Cogito développent une meilleure intuition pour la bonne trajectoire de recherche pendant l'inférence, leurs chaînes de raisonnement sont 60 % plus courtes que celles de DeepSeek R1 », a-t-il expliqué dans un article publié sur X.

Les points forts des modèles Deep Cogito : l'intuition machine en action

Des exemples tirés des tests internes de Cogito v2 illustrent cette capacité. Dans un problème mathématique, un utilisateur demande si un train roulant à 80 mph peut parcourir 240 miles en moins de 2,5 heures.

Alors que de nombreux modèles effectuent des calculs détaillés, étape par étape, et peuvent commettre des erreurs, Cogito 671B effectue une brève réflexion interne, calcule 240 ÷ 80 = 3 heures et conclut correctement que le train ne peut pas arriver à temps. Il utilise moins de 100 jetons internes, contre plus de 200 utilisés par DeepSeek R1 pour la même réponse.

Dans un exemple de raisonnement juridique concernant l'applicabilité d'une décision de la Cour suprême des États-Unis, le mode de raisonnement de Cogito applique une logique claire en deux étapes : déterminer d'abord si le cas hypothétique correspond au précédent, puis justifier sa conclusion. Ce raisonnement nuancé et interprétatif reste un défi pour de nombreux LLM.

Les modèles montrent également une meilleure gestion de l'ambiguïté. Sur des questions à plusieurs niveaux, comme la détermination des relations familiales (par exemple, « Alice est la mère de Bob, Bob est le père de Charlie. Quel est le lien entre Alice et Charlie ? »), les modèles Cogito v2 identifient correctement « grand-mère », même lorsque la formulation est légèrement modifiée, un point sur lequel les autres modèles ouverts butent souvent.

Atteindre l'efficacité à grande échelle

Il est remarquable que Deep Cogito déclare avoir formé ses huit modèles Cogito (y compris la série v1) pour un coût total inférieur à 3,5 millions de dollars, soit une fraction du budget à neuf chiffres déclaré pour certains modèles de pointe.

Ce budget a couvert la génération de données à grande échelle, le renforcement synthétique, l'infrastructure et plus de 1 000 expériences de formation.

Arora attribue cette rentabilité à un principe fondamental : la création de modèles plus intelligents dépend d'une meilleure compréhension fondamentale (« a priori »), et non pas simplement de l'apport d'un plus grand nombre de données.

En apprenant aux modèles à éviter les chemins de raisonnement redondants ou trompeurs, Cogito v2 offre des performances robustes sans augmenter le temps ou le coût d'inférence, ce qui constitue un avantage essentiel pour les services basés sur des API ou le déploiement de périphériques de pointe, où la latence et les coûts sont des facteurs clés.

Perspectives d'avenir : la feuille de route de Deep Cogito

Cogito v2 représente une étape itérative, et non un produit final. Arora décrit l'approche de l'entreprise comme une « ascension » : exécuter des modèles, tirer des enseignements de leur raisonnement, distiller ces leçons et répéter le cycle. Chaque version du modèle s'appuie sur la précédente.

Deep Cogito reste engagé dans l'open source pour tous ses modèles, actuels et futurs. Son travail a déjà reçu le soutien d'investisseurs tels qu'Eric Vishria de Benchmark et Aditya Agarwal de South Park Commons.

Parmi ses partenaires en matière d'infrastructure, on trouve Hugging Face, Together AI, RunPod, Baseten, l'équipe Llama de Meta et Unsloth.

Pour les développeurs, les chercheurs et les entreprises, les modèles sont disponibles dès aujourd'hui pour une utilisation locale, une comparaison multimodale et un ajustement spécifique à un domaine.

Pour la communauté open source de l'IA, Cogito v2 offre bien plus qu'une référence en matière de benchmark. Il présente un nouveau paradigme pour la construction de l'intelligence : un paradigme qui ne se concentre pas sur le fait de réfléchir plus, mais sur le fait d'apprendre à mieux réfléchir.

Article connexe
Anthropic étend ses outils de codage IA Claude au Japon dans le cadre de sa stratégie de croissance à l’étranger Anthropic étend ses outils de codage IA Claude au Japon dans le cadre de sa stratégie de croissance à l’étranger Anthropic, une entreprise américaine d’intelligence artificielle de premier plan, intensifie sa portée mondiale. Mercredi, l’entreprise a organisé une grande réunion de développeurs, « Code with Claude », à Tokyo, rassemblant près de 500 ingénieurs l
Le géant indien du logiciel réduit ses embauches et promet des licenciements nuls à mesure que les agents IA se développent Le géant indien du logiciel réduit ses embauches et promet des licenciements nuls à mesure que les agents IA se développent Alors que l’intelligence artificielle redéfinit les modèles d’affaires traditionnellement intensifs en main-d’œuvre, Tata Consultancy Services (TCS), l’un des principaux prestataires indiens de sous-traitance logicielle, a dévoilé sa réponse stratégi
La Chine verrouille les modèles d'IA pendant le Gaokao pour bloquer l'aide instantanée aux devoirs La Chine verrouille les modèles d'IA pendant le Gaokao pour bloquer l'aide instantanée aux devoirs Avec l’approche rapide du Gaokao 2026, les rumeurs concernant la suspension des outils d’intelligence artificielle pendant la période d’examen ont déclenché un intense débat en ligne. En réponse aux préoccupations du public, les principales plateform
Recommandations de sujets spéciaux liés
Conception et art Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives
Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives

Les meilleurs outils de transfert de style par IA de 2026, les mieux notés, pour des expériences créatives ! XIX.AI a sélectionné une collection d’outils puissants et révolutionnaires à essayer absolument, qui offrent des résultats exceptionnels grâce à des tests en conditions réelles et à un classement rigoureux. Ces solutions de pointe aident les créatifs à booster considérablement leur productivité en accélérant la création de contenu et en ouvrant la voie à des possibilités créatives infinies. Découvrez-les dès maintenant pour trouver l'outil qui vous convient le mieux et commencez à créer dès aujourd'hui !

9 outils
xix.ai
Création de bande dessinée Les meilleurs outils d'IA pour créer des bulles de dialogue destinés à la narration visuelle
Les meilleurs outils d'IA pour créer des bulles de dialogue destinés à la narration visuelle

Les meilleurs outils de 2026 pour la création de bulles de dialogue IA, les mieux notés pour la narration visuelle, sont disponibles ici sur XIX.AI ! Cette sélection regroupe des outils puissants et révolutionnaires qui aident les créateurs à booster leur productivité et à surmonter les blocages créatifs. Consultez un comparatif entre les versions gratuites et payantes, découvrez des tests en conditions réelles et consultez les derniers classements pour trouver les solutions incontournables, parfaites pour créer des récits visuels captivants. Explorez dès maintenant pour découvrir l'outil qui vous convient le mieux !

10 outils
xix.ai
Assistante de réunion Les meilleurs outils de synthèse de réunions basés sur l'IA : suivez clairement les décisions et les actions à mener
Les meilleurs outils de synthèse de réunions basés sur l'IA : suivez clairement les décisions et les actions à mener

2026 : les meilleurs outils d'IA pour la synthèse de réunions, les mieux notés, pour un suivi clair des décisions et des relances sans effort. Cette sélection présente des solutions puissantes et révolutionnaires qui boostent considérablement la productivité en automatisant la prise de notes lors des réunions, en identifiant les actions clés et en rationalisant la coordination des équipes sur l'ensemble des projets. Profitez d'une comparaison entre les versions gratuites et payantes, ainsi que de tests en conditions réelles et de classements mis à jour chaque semaine pour vous aider à trouver l'outil idéal. Découvrez-les dès maintenant pour tirer pleinement parti de l'IA !

9 outils
xix.ai
Analyse des données Meilleurs outils de nettoyage de données IA : corrigez rapidement les valeurs manquantes et les doublons
Meilleurs outils de nettoyage de données IA : corrigez rapidement les valeurs manquantes et les doublons

2026 : Les meilleures outils de nettoyage de données IA les plus récents et hautement notés pour corriger rapidement les valeurs manquantes et les doublons. Cette liste rigoureusement sélectionnée met en avant des solutions puissantes capables d’améliorer considérablement la productivité. Chaque outil a été soumis à des tests approfondis dans des conditions réelles afin de garantir sa fiabilité. Obtenez une comparaison gratuite et payante pour découvrir l’outil qu’il vous faut le mieux, adapté à vos besoins. Explorez dès maintenant XIX.AI pour tirer parti au maximum des capacités de l’IA.

11 outils
xix.ai
Conception et art Meilleurs outils d’idéation créative par IA pour les artistes : surmonter les blocages visuels
Meilleurs outils d’idéation créative par IA pour les artistes : surmonter les blocages visuels

2026 Derniers Meilleurs Outils d’Idéation Créative par IA les Mieux Notés pour les Artistes sont sélectionnés par XIX.AI pour aider les créateurs à surmonner les blocages visuels et stimuler instantanément leur créativité. Ces outils puissants et révolutionnaires offrent des tests concrets, une comparaison détaillée entre les versions gratuites et payantes, ainsi que des classements mis à jour chaque semaine. Découvrez l’outil parfait pour accélérer la création de contenu et débloquer votre avantage IA dès aujourd’hui. Explorez maintenant !

14 outils
xix.ai
Composition musicale Créateurs de musique par IA pour les pistes d'accompagnement TikTok, les fichiers audio Reels et la musique promotionnelle des créateurs
Créateurs de musique par IA pour les pistes d'accompagnement TikTok, les fichiers audio Reels et la musique promotionnelle des créateurs

Les meilleurs générateurs de rythmes IA de 2026 pour les musiques de fond TikTok, les Reels et les morceaux promotionnels des créateurs ! XIX.AI a sélectionné une liste des outils les mieux notés, véritables révolutionnaires qui ont fait leurs preuves dans la pratique pour offrir une musique irréprochable, quel que soit votre besoin en matière de contenu. Vous y trouverez des comparaisons détaillées entre les versions gratuites et payantes, des classements mis à jour chaque semaine, ainsi que des options incontournables pour vous aider à stimuler votre créativité et votre productivité. Explorez-la dès maintenant pour découvrir l'outil qui vous convient le mieux !

11 outils
xix.ai
commentaires (3)
0/500
LarryMitchell
LarryMitchell 13 juin 2026 22:00:14 UTC+02:00

Interesting move by Deep Cogito. But 'open-ish' sounds like a marketing term—how open is it really? Also, self-improving intuition sounds spooky. Are we building AI that can rewrite its own reasoning without oversight? 🤔

JamesCarter
JamesCarter 3 mai 2026 16:01:06 UTC+02:00

Interesting approach, but 'open-ish' sounds like a marketing gimmick. If the weights aren't fully open, how can the community truly verify their 'self-improving' claims? Feels like another startup trying to have its cake and eat it too. The intuition part is fascinating, though. 🤔

WillieJones
WillieJones 8 avril 2026 18:00:50 UTC+02:00

¿Modelos auto-mejorables? Parece prometedor, pero siempre me pregunto: ¿cómo verifican que la intuición emergente no genere sesgos peligrosos o alucinaciones más sofisticadas? 🤔 Sería bueno ver más transparencia en los datos de entrenamiento.

OR