Hogar
xAI Grok 4.20 alcanza la tasa de alucinaciones más baja del sector y da prioridad a la integridad frente al rendimiento
Mientras los gigantes de la IA invierten frenéticamente recursos en alcanzar las mejores puntuaciones de rendimiento, xAI, de Elon Musk, adopta un enfoque diferente, centrándose en el problema más persistente del sector: la fabricación de información. Hoy, xAI ha lanzado oficialmente Grok4.20Beta. Aunque todavía se queda por detrás de los modelos de primer nivel en puntuaciones absolutas de inteligencia, ha establecido un nuevo récord del sector en la métrica clave de veracidad.

Según la última evaluación de Artificial Analysis, Grok4.20 obtuvo una puntuación de 48 en el índice de inteligencia en modo de razonamiento. Aunque se queda por detrás de y (ambos con una puntuación de 57), su rendimiento en cuanto a la fiabilidad de los datos es especialmente impresionante:
Baja tasa de alucinaciones: en la prueba AA Omniscience, Grok4.20 alcanzó una «tasa de no alucinación» del 78 %, estableciendo un nuevo récord.
Sabe lo que sabe: cuando se enfrenta a preguntas que no puede responder, el modelo ya no tiende a inventar datos falsos, sino que admite con mayor precisión «No lo sé». Esta honestidad es crucial para entornos rigurosos de oficina e investigación.
Arquitectura técnica: una matriz de API «tres en uno»
Para satisfacer las distintas necesidades, xAI ha lanzado tres variantes de la API:
Modo de razonamiento: da prioridad al pensamiento lógico profundo frente a la velocidad, lo cual ha sido clave para batir el récord de alucinaciones en esta ocasión.
Modo estándar: optimizado para una respuesta rápida y la interacción rutinaria.
Modo multiagente: permite que varias instancias de IA trabajen juntas para gestionar tareas complejas.
Estrategia de mercado: más contenido, sin coste adicional
Más allá de su rendimiento único, Grok 4.20 también presenta una estrategia comercial agresiva:
Contexto amplio: admite una ventana de contexto de hasta 2 millones de tokens, lo que le permite asimilar un libro completo o una gran base de código de una sola vez.
Ventaja de precio: con un precio de entre 2 y 6 dólares por millón de tokens, no solo es más barato que la versión anterior, Grok 4, sino que también resulta muy competitivo frente a los principales modelos occidentales actuales.
El lanzamiento de Grok4.20 refleja el cambio estratégico de xAI: ya no se obsesiona con la carrera por la puntuación total hacia la IA general (AGI), sino que se centra precisamente en el punto débil de la «fiabilidad a nivel empresarial». Tal y como afirmó la institución evaluadora, si otros modelos se esfuerzan por convertirse en «profetas omniscientes», Grok4.20 se esfuerza por convertirse en «un asistente que nunca miente».
Para los usuarios con requisitos extremadamente exigentes en cuanto a la precisión de los datos, Grok4.20 podría convertirse en una tercera opción importante, además de OpenAI y Google.
Artículo relacionado
Genesis AI domina tareas robóticas con un único modelo, lo que supone un hito similar al de ChatGPT
A medida que crece el interés mundial por la robótica, Genesis AI ha presentado GENE-26.5, su primer modelo base de robot. Este lanzamiento supone un gran avance en el campo de la robótica de uso gene
Microsoft presenta el primer modelo de voz con IA de dúplex completo desarrollado por la propia empresa, capaz de escuchar y hablar simultáneamente en 16 idiomas
Según el medio especializado en tecnología TestingCatalog, Microsoft está probando actualmente su primer modelo de voz nativo en tiempo real, MAI Realtime. Compatible con 16 idiomas y dos estilos de v
Apple presenta iOS 27, con IA local y una colaboración con Google que potencia Siri
La publicación «The Information» ha destacado recientemente el enfoque estratégico de Apple para integrar la inteligencia artificial en el próximo sistema operativo OS 27. Al aprovechar el modelo Gemi
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Mientras los gigantes de la IA invierten frenéticamente recursos en alcanzar las mejores puntuaciones de rendimiento, xAI, de Elon Musk, adopta un enfoque diferente, centrándose en el problema más persistente del sector: la fabricación de información. Hoy, xAI ha lanzado oficialmente Grok4.20Beta. Aunque todavía se queda por detrás de los modelos de primer nivel en puntuaciones absolutas de inteligencia, ha establecido un nuevo récord del sector en la métrica clave de veracidad.

Según la última evaluación de Artificial Analysis, Grok4.20 obtuvo una puntuación de 48 en el índice de inteligencia en modo de razonamiento. Aunque se queda por detrás de
Baja tasa de alucinaciones: en la prueba AA Omniscience, Grok4.20 alcanzó una «tasa de no alucinación» del 78 %, estableciendo un nuevo récord.
Sabe lo que sabe: cuando se enfrenta a preguntas que no puede responder, el modelo ya no tiende a inventar datos falsos, sino que admite con mayor precisión «No lo sé». Esta honestidad es crucial para entornos rigurosos de oficina e investigación.
Arquitectura técnica: una matriz de API «tres en uno»
Para satisfacer las distintas necesidades, xAI ha lanzado tres variantes de la API:
Modo de razonamiento: da prioridad al pensamiento lógico profundo frente a la velocidad, lo cual ha sido clave para batir el récord de alucinaciones en esta ocasión.
Modo estándar: optimizado para una respuesta rápida y la interacción rutinaria.
Modo multiagente: permite que varias instancias de IA trabajen juntas para gestionar tareas complejas.
Estrategia de mercado: más contenido, sin coste adicional
Más allá de su rendimiento único, Grok 4.20 también presenta una estrategia comercial agresiva:
Contexto amplio: admite una ventana de contexto de hasta 2 millones de tokens, lo que le permite asimilar un libro completo o una gran base de código de una sola vez.
Ventaja de precio: con un precio de entre 2 y 6 dólares por millón de tokens, no solo es más barato que la versión anterior, Grok 4, sino que también resulta muy competitivo frente a los principales modelos occidentales actuales.
El lanzamiento de Grok4.20 refleja el cambio estratégico de xAI: ya no se obsesiona con la carrera por la puntuación total hacia la IA general (AGI), sino que se centra precisamente en el punto débil de la «fiabilidad a nivel empresarial». Tal y como afirmó la institución evaluadora, si otros modelos se esfuerzan por convertirse en «profetas omniscientes», Grok4.20 se esfuerza por convertirse en «un asistente que nunca miente».
Para los usuarios con requisitos extremadamente exigentes en cuanto a la precisión de los datos, Grok4.20 podría convertirse en una tercera opción importante, además de OpenAI y Google.
Genesis AI domina tareas robóticas con un único modelo, lo que supone un hito similar al de ChatGPT
A medida que crece el interés mundial por la robótica, Genesis AI ha presentado GENE-26.5, su primer modelo base de robot. Este lanzamiento supone un gran avance en el campo de la robótica de uso gene
Microsoft presenta el primer modelo de voz con IA de dúplex completo desarrollado por la propia empresa, capaz de escuchar y hablar simultáneamente en 16 idiomas
Según el medio especializado en tecnología TestingCatalog, Microsoft está probando actualmente su primer modelo de voz nativo en tiempo real, MAI Realtime. Compatible con 16 idiomas y dos estilos de v
Apple presenta iOS 27, con IA local y una colaboración con Google que potencia Siri
La publicación «The Information» ha destacado recientemente el enfoque estratégico de Apple para integrar la inteligencia artificial en el próximo sistema operativo OS 27. Al aprovechar el modelo Gemi











