Lar
O xAI Grok 4.20 alcança a menor taxa de alucinações do setor e prioriza a integridade em detrimento do desempenho
Enquanto os gigantes da IA investem freneticamente recursos na busca por os melhores índices de desempenho, a xAI, de Elon Musk, adota uma abordagem diferente, concentrando-se no problema mais persistente da área: a fabricação de informações. Hoje, a xAI lançou oficialmente o Grok4.20Beta. Embora ainda fique atrás dos modelos de ponta em pontuações absolutas de inteligência, ele estabeleceu um novo recorde do setor na métrica-chave de veracidade.

De acordo com a avaliação mais recente da Artificial Analysis, o Grok4.20 obteve 48 pontos no índice de inteligência no modo de raciocínio. Embora fique atrás do “ ” e do “ ” (ambos com 57 pontos), seu desempenho em confiabilidade de fatos é particularmente impressionante:
Baixa taxa de alucinação: no teste AA Omniscience, o Grok4.20 alcançou uma “taxa de não alucinação” de 78%, estabelecendo um novo recorde.
Sabendo o que sabe: quando confrontado com perguntas que não consegue responder, o modelo não tende mais a inventar fatos falsos, mas, em vez disso, admite com mais precisão “Não sei”. Essa honestidade é crucial para ambientes rigorosos de escritório e pesquisa.
Arquitetura técnica: uma matriz de API três em um
Para atender às diversas necessidades, a xAI lançou três variantes de API:
Modo de Raciocínio: Prioriza o pensamento lógico profundo em detrimento da velocidade, o que foi fundamental para quebrar o recorde de alucinações desta vez.
Modo Padrão: Otimizado para respostas rápidas e interações rotineiras.
Modo multiagente: oferece suporte a várias instâncias de IA trabalhando juntas para lidar com tarefas complexas.
Estratégia de mercado: mais conteúdo, sem custo extra
Além de seu desempenho único, o Grok4.20 também apresenta uma estratégia comercial agressiva:
Contexto amplo: Suporta uma janela de contexto de até 2 milhões de tokens, permitindo que ele absorva um livro inteiro ou uma grande base de código de uma só vez.
Vantagem de preço: Com preço entre US$ 2 e US$ 6 por milhão de tokens, ele não só é mais barato que a versão anterior, o Grok4, como também é altamente competitivo entre os principais modelos ocidentais atuais.
O lançamento do Grok4.20 reflete a mudança estratégica da xAI — não mais obcecada pela corrida pela pontuação total rumo à IA Geral (AGI), mas visando precisamente o ponto crítico da “confiabilidade de nível empresarial”. Conforme afirmou a instituição de avaliação, se outros modelos se esforçam para se tornar “profetas oniscientes”, o Grok4.20 se esforça para se tornar “um assistente que nunca mente”.
Para usuários com exigências extremamente altas em relação à precisão dos dados, o Grok4.20 pode se tornar uma terceira opção importante, além da OpenAI e do Google.
Artigo relacionado
A Genesis AI domina tarefas robóticas com um único modelo, marcando um momento semelhante ao do ChatGPT
À medida que o interesse global pela robótica cresce, a Genesis AI lançou o GENE-26.5, seu primeiro modelo básico de robô. Esse lançamento representa um grande avanço na robótica de uso geral, especia
A Microsoft apresenta o primeiro modelo de IA de voz full-duplex desenvolvido internamente, capaz de ouvir e falar simultaneamente em 16 idiomas
De acordo com o site especializado em tecnologia TestingCatalog, a Microsoft está atualmente testando seu primeiro modelo de voz nativo em tempo real, o MAI Realtime. Com suporte a 16 idiomas e dois e
A Apple lança o iOS 27 com IA local e parceria com o Google para aprimorar a Siri
O site The Information destacou recentemente a abordagem estratégica da Apple para integrar inteligência artificial ao futuro sistema operacional OS 27. Ao utilizar o modelo Gemini, do Google, para tr
Recomendações de tópicos especiais relacionados
Comentários (0)
Enquanto os gigantes da IA investem freneticamente recursos na busca por os melhores índices de desempenho, a xAI, de Elon Musk, adota uma abordagem diferente, concentrando-se no problema mais persistente da área: a fabricação de informações. Hoje, a xAI lançou oficialmente o Grok4.20Beta. Embora ainda fique atrás dos modelos de ponta em pontuações absolutas de inteligência, ele estabeleceu um novo recorde do setor na métrica-chave de veracidade.

De acordo com a avaliação mais recente da Artificial Analysis, o Grok4.20 obteve 48 pontos no índice de inteligência no modo de raciocínio. Embora fique atrás do “
Baixa taxa de alucinação: no teste AA Omniscience, o Grok4.20 alcançou uma “taxa de não alucinação” de 78%, estabelecendo um novo recorde.
Sabendo o que sabe: quando confrontado com perguntas que não consegue responder, o modelo não tende mais a inventar fatos falsos, mas, em vez disso, admite com mais precisão “Não sei”. Essa honestidade é crucial para ambientes rigorosos de escritório e pesquisa.
Arquitetura técnica: uma matriz de API três em um
Para atender às diversas necessidades, a xAI lançou três variantes de API:
Modo de Raciocínio: Prioriza o pensamento lógico profundo em detrimento da velocidade, o que foi fundamental para quebrar o recorde de alucinações desta vez.
Modo Padrão: Otimizado para respostas rápidas e interações rotineiras.
Modo multiagente: oferece suporte a várias instâncias de IA trabalhando juntas para lidar com tarefas complexas.
Estratégia de mercado: mais conteúdo, sem custo extra
Além de seu desempenho único, o Grok4.20 também apresenta uma estratégia comercial agressiva:
Contexto amplo: Suporta uma janela de contexto de até 2 milhões de tokens, permitindo que ele absorva um livro inteiro ou uma grande base de código de uma só vez.
Vantagem de preço: Com preço entre US$ 2 e US$ 6 por milhão de tokens, ele não só é mais barato que a versão anterior, o Grok4, como também é altamente competitivo entre os principais modelos ocidentais atuais.
O lançamento do Grok4.20 reflete a mudança estratégica da xAI — não mais obcecada pela corrida pela pontuação total rumo à IA Geral (AGI), mas visando precisamente o ponto crítico da “confiabilidade de nível empresarial”. Conforme afirmou a instituição de avaliação, se outros modelos se esforçam para se tornar “profetas oniscientes”, o Grok4.20 se esforça para se tornar “um assistente que nunca mente”.
Para usuários com exigências extremamente altas em relação à precisão dos dados, o Grok4.20 pode se tornar uma terceira opção importante, além da OpenAI e do Google.
A Genesis AI domina tarefas robóticas com um único modelo, marcando um momento semelhante ao do ChatGPT
À medida que o interesse global pela robótica cresce, a Genesis AI lançou o GENE-26.5, seu primeiro modelo básico de robô. Esse lançamento representa um grande avanço na robótica de uso geral, especia
A Microsoft apresenta o primeiro modelo de IA de voz full-duplex desenvolvido internamente, capaz de ouvir e falar simultaneamente em 16 idiomas
De acordo com o site especializado em tecnologia TestingCatalog, a Microsoft está atualmente testando seu primeiro modelo de voz nativo em tempo real, o MAI Realtime. Com suporte a 16 idiomas e dois e
A Apple lança o iOS 27 com IA local e parceria com o Google para aprimorar a Siri
O site The Information destacou recentemente a abordagem estratégica da Apple para integrar inteligência artificial ao futuro sistema operacional OS 27. Ao utilizar o modelo Gemini, do Google, para tr











