Maison
xAI Grok 4.20 affiche le taux d'hallucination le plus bas du secteur et privilégie l'intégrité plutôt que la performance
Alors que les géants de l'IA investissent frénétiquement des ressources pour atteindre les meilleurs scores de performance, xAI, la société d'Elon Musk, adopte une approche différente en se concentrant sur le problème le plus récurrent dans ce domaine : la fabrication d'informations. Aujourd’hui, xAI a officiellement lancé Grok4.20Beta. Bien qu’il reste encore en retrait par rapport aux modèles de premier plan en termes de scores d’intelligence absolus, il a établi un nouveau record du secteur en matière de véracité, un indicateur clé.

Selon la dernière évaluation réalisée par Artificial Analysis, Grok4.20 a obtenu un score de 48 sur l’indice d’intelligence en mode raisonnement. Bien qu’il soit en retard par rapport à et (qui ont tous deux obtenu un score de 57), ses performances en matière de fiabilité des faits sont particulièrement impressionnantes :
Faible taux d’hallucination: lors du test AA Omniscience, Grok4.20 a atteint un « taux de non-hallucination » de 78 %, établissant ainsi un nouveau record.
Savoir ce que l’on sait: face à des questions auxquelles il ne peut répondre, le modèle n’a plus tendance à inventer de fausses informations, mais admet plus précisément « Je ne sais pas ». Cette honnêteté est cruciale dans les environnements professionnels et de recherche rigoureux.
Architecture technique : une matrice API « trois-en-un »
Pour répondre à des besoins variés, xAI a lancé trois variantes d’API :
Mode « raisonnement » : privilégie la réflexion logique approfondie plutôt que la vitesse, ce qui a été déterminant pour battre le record d’hallucinations cette fois-ci.
Mode standard: optimisé pour une réponse rapide et des interactions courantes.
Mode multi-agents: prend en charge plusieurs instances d’IA travaillant ensemble pour gérer des tâches complexes.
Stratégie commerciale : plus de contenu, sans frais supplémentaires
Au-delà de ses performances exceptionnelles, Grok4.20 s'accompagne également d'une stratégie commerciale ambitieuse :
Contexte étendu: prend en charge une fenêtre de contexte pouvant atteindre 2 millions de tokens, ce qui lui permet d’assimiler d’un seul coup un livre entier ou une base de code volumineuse.
Avantage tarifaire: avec un prix compris entre 2 et 6 dollars par million de tokens, il est non seulement moins cher que la version précédente, Grok4, mais également très compétitif par rapport aux principaux modèles occidentaux actuels.
La sortie de Grok4.20 reflète le changement de stratégie de xAI : il ne s’agit plus de se focaliser sur la course au score total vers l’AGI, mais de cibler précisément le point sensible de la « fiabilité au niveau de l’entreprise ». Comme l’a déclaré l’organisme d’évaluation, si d’autres modèles s’efforcent de devenir des « prophètes omniscients », Grok4.20 s’efforce de devenir « un assistant qui ne ment jamais ».
Pour les utilisateurs ayant des exigences extrêmement élevées en matière de précision des données, Grok4.20 pourrait devenir une troisième option majeure, aux côtés d’OpenAI et de Google.
Article connexe
Genesis AI maîtrise diverses tâches robotiques grâce à un modèle unique, marquant ainsi un tournant comparable à celui de ChatGPT
Alors que l’intérêt mondial pour la robotique ne cesse de croître, Genesis AI a présenté GENE-26.5, son tout premier modèle de base robotique. Ce lancement marque une avancée majeure dans le domaine d
Microsoft dévoile son premier modèle vocal IA full-duplex développé en interne, capable d'écouter et de parler simultanément dans 16 langues
Selon le site spécialisé dans les technologies TestingCatalog, Microsoft teste actuellement son tout premier modèle vocal natif en temps réel, baptisé « MAI Realtime ». Prise en charge de 16 langues e
Apple dévoile iOS 27 : une IA locale et un partenariat avec Google pour renforcer Siri
Le site The Information a récemment mis en avant l’approche stratégique d’Apple visant à intégrer l’intelligence artificielle dans le prochain système d’exploitation OS 27. En s’appuyant sur le modèle
Recommandations de sujets spéciaux liés
commentaires (0)
Alors que les géants de l'IA investissent frénétiquement des ressources pour atteindre les meilleurs scores de performance, xAI, la société d'Elon Musk, adopte une approche différente en se concentrant sur le problème le plus récurrent dans ce domaine : la fabrication d'informations. Aujourd’hui, xAI a officiellement lancé Grok4.20Beta. Bien qu’il reste encore en retrait par rapport aux modèles de premier plan en termes de scores d’intelligence absolus, il a établi un nouveau record du secteur en matière de véracité, un indicateur clé.

Selon la dernière évaluation réalisée par Artificial Analysis, Grok4.20 a obtenu un score de 48 sur l’indice d’intelligence en mode raisonnement. Bien qu’il soit en retard par rapport à
Faible taux d’hallucination: lors du test AA Omniscience, Grok4.20 a atteint un « taux de non-hallucination » de 78 %, établissant ainsi un nouveau record.
Savoir ce que l’on sait: face à des questions auxquelles il ne peut répondre, le modèle n’a plus tendance à inventer de fausses informations, mais admet plus précisément « Je ne sais pas ». Cette honnêteté est cruciale dans les environnements professionnels et de recherche rigoureux.
Architecture technique : une matrice API « trois-en-un »
Pour répondre à des besoins variés, xAI a lancé trois variantes d’API :
Mode « raisonnement » : privilégie la réflexion logique approfondie plutôt que la vitesse, ce qui a été déterminant pour battre le record d’hallucinations cette fois-ci.
Mode standard: optimisé pour une réponse rapide et des interactions courantes.
Mode multi-agents: prend en charge plusieurs instances d’IA travaillant ensemble pour gérer des tâches complexes.
Stratégie commerciale : plus de contenu, sans frais supplémentaires
Au-delà de ses performances exceptionnelles, Grok4.20 s'accompagne également d'une stratégie commerciale ambitieuse :
Contexte étendu: prend en charge une fenêtre de contexte pouvant atteindre 2 millions de tokens, ce qui lui permet d’assimiler d’un seul coup un livre entier ou une base de code volumineuse.
Avantage tarifaire: avec un prix compris entre 2 et 6 dollars par million de tokens, il est non seulement moins cher que la version précédente, Grok4, mais également très compétitif par rapport aux principaux modèles occidentaux actuels.
La sortie de Grok4.20 reflète le changement de stratégie de xAI : il ne s’agit plus de se focaliser sur la course au score total vers l’AGI, mais de cibler précisément le point sensible de la « fiabilité au niveau de l’entreprise ». Comme l’a déclaré l’organisme d’évaluation, si d’autres modèles s’efforcent de devenir des « prophètes omniscients », Grok4.20 s’efforce de devenir « un assistant qui ne ment jamais ».
Pour les utilisateurs ayant des exigences extrêmement élevées en matière de précision des données, Grok4.20 pourrait devenir une troisième option majeure, aux côtés d’OpenAI et de Google.
Genesis AI maîtrise diverses tâches robotiques grâce à un modèle unique, marquant ainsi un tournant comparable à celui de ChatGPT
Alors que l’intérêt mondial pour la robotique ne cesse de croître, Genesis AI a présenté GENE-26.5, son tout premier modèle de base robotique. Ce lancement marque une avancée majeure dans le domaine d
Microsoft dévoile son premier modèle vocal IA full-duplex développé en interne, capable d'écouter et de parler simultanément dans 16 langues
Selon le site spécialisé dans les technologies TestingCatalog, Microsoft teste actuellement son tout premier modèle vocal natif en temps réel, baptisé « MAI Realtime ». Prise en charge de 16 langues e
Apple dévoile iOS 27 : une IA locale et un partenariat avec Google pour renforcer Siri
Le site The Information a récemment mis en avant l’approche stratégique d’Apple visant à intégrer l’intelligence artificielle dans le prochain système d’exploitation OS 27. En s’appuyant sur le modèle











