Maison
Sortie du nouveau Gemini 3 Deep Think, en tête des classements en programmation et en recherche — Seuls 7 modèles peuvent le surpasser
Gemini3Deep Think de Google a bénéficié aujourd’hui d’une mise à jour majeure. Conçu pour le raisonnement approfondi, ce modèle atteint non seulement des performances de haut niveau en programmation, mais établit également de nouveaux records dans les domaines de la recherche scientifique et de l’ingénierie de pointe, marquant ainsi une avancée considérable dans les capacités de raisonnement de l’IA.

Les réalisations marquantes de Gemini3Deep Think :
Maîtrise de la programmation : il a obtenu un impressionnant score Elo de 3 455 sur la plateforme de concours d’algorithmes Codeforces. Cela le place parmi les meilleurs concurrents humains, seuls sept humains dans le monde étant capables de le battre. À titre de comparaison, le modèle o3 le plus performant d’il y a un an avait obtenu un score de 2 727.
Un cerveau puissant pour la recherche scientifique : le modèle fait preuve d’un raisonnement logique rigoureux, repérant des erreurs subtiles dans un article de physique et de mathématiques de haut niveau que même des relecteurs humains avaient négligées. Il a également réussi à résoudre plusieurs problèmes complexes liés à la « conjecture d’Erdős ».
De l’esquisse au produit physique : en ingénierie, il peut analyser directement une esquisse dessinée à la main et la convertir en un fichier de modèle 3D haute fidélité (comme un support pour ordinateur portable), multipliant par dix l’efficacité de la modélisation des composants physiques.
Des avancées majeures dans les tests de référence : il a obtenu un score de 48,4 % au « Last Human Exam » (HLE) et atteint une précision impressionnante de 84,6 % sur le benchmark ARC-AGI-2, se classant ainsi en tête du classement.
Actuellement, Google a mis cette nouvelle version à la disposition des abonnés à AI Ultra et, pour la première fois, a fourni un accès à l’API à certains chercheurs et entreprises. Cette mise à jour majeure de Gemini est considérée comme une réponse forte aux modèles de raisonnement de ses concurrents.
Article connexe
Fuites sur Apple iOS 27 : Siri intègre Google Gemini pour l'IA locale, certaines requêtes étant redirigées vers le cloud Google
Des rapports récents révèlent l’étendue du partenariat entre Apple et Google dans le domaine de l’intelligence artificielle. La prochaine version d’iOS 27 privilégiera la confidentialité en se concentrant sur le traitement de l’IA de bord (edge AI) l
Anthropic voit un IPO en 2026 alors que la croissance des revenus par six se rapproche de la capitalisation boursière de Musk
Malgré le fait qu’elle ne soit pas encore cotée en bourse, l’entreprise de intelligence artificielle Anthropic a déjà suscité une activité intense sur les marchés de prédiction. Les dernières données de Polymarket montrent que les investisseurs parie
Les entrepreneurs militaires américains abandonnent le modèle Claude dans un contexte de restrictions plus strictes et de conflits
Les entreprises américaines de technologies de défense font face à des perturbations de leur chaîne d'approvisionnement en raison de politiques réglementaires contradictoires, comme l'a rapporté TechCrunch. Alors que l'armée américaine continue d'uti
Recommandations de sujets spéciaux liés
commentaires (1)
Gemini3Deep Think de Google a bénéficié aujourd’hui d’une mise à jour majeure. Conçu pour le raisonnement approfondi, ce modèle atteint non seulement des performances de haut niveau en programmation, mais établit également de nouveaux records dans les domaines de la recherche scientifique et de l’ingénierie de pointe, marquant ainsi une avancée considérable dans les capacités de raisonnement de l’IA.

Les réalisations marquantes de Gemini3Deep Think :
Maîtrise de la programmation : il a obtenu un impressionnant score Elo de 3 455 sur la plateforme de concours d’algorithmes Codeforces. Cela le place parmi les meilleurs concurrents humains, seuls sept humains dans le monde étant capables de le battre. À titre de comparaison, le modèle o3 le plus performant d’il y a un an avait obtenu un score de 2 727.
Un cerveau puissant pour la recherche scientifique : le modèle fait preuve d’un raisonnement logique rigoureux, repérant des erreurs subtiles dans un article de physique et de mathématiques de haut niveau que même des relecteurs humains avaient négligées. Il a également réussi à résoudre plusieurs problèmes complexes liés à la « conjecture d’Erdős ».
De l’esquisse au produit physique : en ingénierie, il peut analyser directement une esquisse dessinée à la main et la convertir en un fichier de modèle 3D haute fidélité (comme un support pour ordinateur portable), multipliant par dix l’efficacité de la modélisation des composants physiques.
Des avancées majeures dans les tests de référence : il a obtenu un score de 48,4 % au « Last Human Exam » (HLE) et atteint une précision impressionnante de 84,6 % sur le benchmark ARC-AGI-2, se classant ainsi en tête du classement.
Actuellement, Google a mis cette nouvelle version à la disposition des abonnés à AI Ultra et, pour la première fois, a fourni un accès à l’API à certains chercheurs et entreprises. Cette mise à jour majeure de Gemini est considérée comme une réponse forte aux modèles de raisonnement de ses concurrents.
Fuites sur Apple iOS 27 : Siri intègre Google Gemini pour l'IA locale, certaines requêtes étant redirigées vers le cloud Google
Des rapports récents révèlent l’étendue du partenariat entre Apple et Google dans le domaine de l’intelligence artificielle. La prochaine version d’iOS 27 privilégiera la confidentialité en se concentrant sur le traitement de l’IA de bord (edge AI) l
Anthropic voit un IPO en 2026 alors que la croissance des revenus par six se rapproche de la capitalisation boursière de Musk
Malgré le fait qu’elle ne soit pas encore cotée en bourse, l’entreprise de intelligence artificielle Anthropic a déjà suscité une activité intense sur les marchés de prédiction. Les dernières données de Polymarket montrent que les investisseurs parie
Les entrepreneurs militaires américains abandonnent le modèle Claude dans un contexte de restrictions plus strictes et de conflits
Les entreprises américaines de technologies de défense font face à des perturbations de leur chaîne d'approvisionnement en raison de politiques réglementaires contradictoires, comme l'a rapporté TechCrunch. Alors que l'armée américaine continue d'uti











