Lar
GPT-5.6 IQ ultrapassa a linha de gênio de 130, mais inteligente que 99% dos seres humanos, e sua capacidade prática de trabalho também é extraordinária
O acompanhamento das mais recentes avaliações de QI offline da IA revela que múltiplas iterações do GPT-5.6 da OpenAI alcançaram uma pontuação de 136, marcando a primeira instância em que um modelo de linguagem de grande escala ultrapassou o limite de QI de 130. Na distribuição humana padrão, um QI de 130 significa o limiar para “gênio”, um nível atingido por apenas 1% da população global, posicionando efetivamente o GPT-5.6 como mais inteligente que 99% das pessoas.

Ao obter 136 pontos no banco de questões mais rigoroso e à prova de vazamentos, o GPT-5.6 superou significativamente seus concorrentes.
A Tracking AI utilizou dois frameworks de teste distintos: um exame de estilo Mensa Noruega de código aberto, no qual os modelos já ultrapassavam 140 pontos, e um banco de questões offline proprietário e não divulgado, projetado para evitar a pré-memorização. O GPT-5.6 navegou com sucesso por este conjunto de dados offline desafiador, com toda a família SOL e TERRA marcando 136 pontos, incluindo sua variante visual. O Claude-5 Fable seguiu com 130 pontos, enquanto o GPT-5.6 LUNA Max e o Claude-4.8 Opus ficaram entre 117 e 123 pontos. Embora modelos que vão do o3 a vários sistemas de ponta tenham historicamente estagnado no limiar de 130, o GPT-5.6 tornou-se o primeiro a romper essa barreira.
Além das pontuações nos testes, o GPT-5.6 demonstra desempenho excepcional em aplicações práticas.
Altas métricas de teste não garantem, por si só, utilidade. Desenvolvedores avaliaram o GPT-5.6 em cenários do mundo real com resultados impressionantes. Quando o desenvolvedor Amir Bohlooli submeteu um prompt idêntico de simulação física tanto ao Fable5 quanto ao GPT-5.6 Sol, ele antecipou a dominância do Fable. Em vez disso, o GPT-5.6 Sol executou uma simulação de fluido de partículas com física em tempo real, encapsulando CSS, design de interface e renderização em um único arquivo HTML. Ele hospedou automaticamente o resultado como uma página web compartilhável, entregando um produto completo a partir de um único prompt. Da mesma forma, Ramanpal Singh desenvolveu um sistema de tickets de atendimento ao cliente usando RAG com um único prompt, incorporando quatro funções distintas, um painel administrativo de gerenciamento, classificação automatizada de reclamações e reconhecimento de emoções. Essa configuração complexa exigiu apenas uma fração do custo associado ao Fable5.
A experiência de Claire Vo destacou essas vantagens práticas. Após encontrar um bug persistente que ela acreditava ter travado seu código, ela mudou para o GPT-5.6 Sol, comentando: “Não vou deixar isso me vencer.” O Sol resolveu o problema imediatamente e assistiu outros modelos a funcionarem sem problemas. A avaliação de Vo foi clara: o foco rígido do Fable na precisão técnica prejudicou sua eficácia, enquanto a abordagem pragmática do Sol entregou resultados tangíveis.
Artigo relacionado
A Microsoft revela a série de modelos MAI para diversificar sua estratégia de IA além de um único gigante
Satya Nadella, CEO da Microsoft, destacou durante a recente conferência de resultados trimestrais que a empresa está acelerando a adoção empresarial de arquiteturas multimodais, ao mesmo tempo em que aumenta os investimentos em modelos de IA propriet
Empresas de Modelos Mundiais Protegem Segredos
Na semana passada, moderei um debate sobre modelos de mundo na conferência All In (sem relação com o podcast), oferecendo uma análise aprofundada de um dos setores mais enigmáticos da inteligência artificial. Líderes do setor, como os laboratórios AM
Os agentes de IA Rival Instinct e o Muse da Meta agora suportam recursos de chamada
O mercado de assistentes de IA baseados em texto é altamente competitivo, com Instinct, Wajo, Town, Ollie e o recém-lançado agente Muse da Meta disputando a atenção dos usuários e a gestão de tarefas. Com sede em São Francisco, o Instinct se consolid
Recomendações de tópicos especiais relacionados
Comentários (0)
O acompanhamento das mais recentes avaliações de QI offline da IA revela que múltiplas iterações do GPT-5.6 da OpenAI alcançaram uma pontuação de 136, marcando a primeira instância em que um modelo de linguagem de grande escala ultrapassou o limite de QI de 130. Na distribuição humana padrão, um QI de 130 significa o limiar para “gênio”, um nível atingido por apenas 1% da população global, posicionando efetivamente o GPT-5.6 como mais inteligente que 99% das pessoas.

Ao obter 136 pontos no banco de questões mais rigoroso e à prova de vazamentos, o GPT-5.6 superou significativamente seus concorrentes.
A Tracking AI utilizou dois frameworks de teste distintos: um exame de estilo Mensa Noruega de código aberto, no qual os modelos já ultrapassavam 140 pontos, e um banco de questões offline proprietário e não divulgado, projetado para evitar a pré-memorização. O GPT-5.6 navegou com sucesso por este conjunto de dados offline desafiador, com toda a família SOL e TERRA marcando 136 pontos, incluindo sua variante visual. O Claude-5 Fable seguiu com 130 pontos, enquanto o GPT-5.6 LUNA Max e o Claude-4.8 Opus ficaram entre 117 e 123 pontos. Embora modelos que vão do o3 a vários sistemas de ponta tenham historicamente estagnado no limiar de 130, o GPT-5.6 tornou-se o primeiro a romper essa barreira.
Além das pontuações nos testes, o GPT-5.6 demonstra desempenho excepcional em aplicações práticas.
Altas métricas de teste não garantem, por si só, utilidade. Desenvolvedores avaliaram o GPT-5.6 em cenários do mundo real com resultados impressionantes. Quando o desenvolvedor Amir Bohlooli submeteu um prompt idêntico de simulação física tanto ao Fable5 quanto ao GPT-5.6 Sol, ele antecipou a dominância do Fable. Em vez disso, o GPT-5.6 Sol executou uma simulação de fluido de partículas com física em tempo real, encapsulando CSS, design de interface e renderização em um único arquivo HTML. Ele hospedou automaticamente o resultado como uma página web compartilhável, entregando um produto completo a partir de um único prompt. Da mesma forma, Ramanpal Singh desenvolveu um sistema de tickets de atendimento ao cliente usando RAG com um único prompt, incorporando quatro funções distintas, um painel administrativo de gerenciamento, classificação automatizada de reclamações e reconhecimento de emoções. Essa configuração complexa exigiu apenas uma fração do custo associado ao Fable5.
A experiência de Claire Vo destacou essas vantagens práticas. Após encontrar um bug persistente que ela acreditava ter travado seu código, ela mudou para o GPT-5.6 Sol, comentando: “Não vou deixar isso me vencer.” O Sol resolveu o problema imediatamente e assistiu outros modelos a funcionarem sem problemas. A avaliação de Vo foi clara: o foco rígido do Fable na precisão técnica prejudicou sua eficácia, enquanto a abordagem pragmática do Sol entregou resultados tangíveis.
A Microsoft revela a série de modelos MAI para diversificar sua estratégia de IA além de um único gigante
Satya Nadella, CEO da Microsoft, destacou durante a recente conferência de resultados trimestrais que a empresa está acelerando a adoção empresarial de arquiteturas multimodais, ao mesmo tempo em que aumenta os investimentos em modelos de IA propriet
Empresas de Modelos Mundiais Protegem Segredos
Na semana passada, moderei um debate sobre modelos de mundo na conferência All In (sem relação com o podcast), oferecendo uma análise aprofundada de um dos setores mais enigmáticos da inteligência artificial. Líderes do setor, como os laboratórios AM
Os agentes de IA Rival Instinct e o Muse da Meta agora suportam recursos de chamada
O mercado de assistentes de IA baseados em texto é altamente competitivo, com Instinct, Wajo, Town, Ollie e o recém-lançado agente Muse da Meta disputando a atenção dos usuários e a gestão de tarefas. Com sede em São Francisco, o Instinct se consolid











