Lar
A OpenAI lança o GPT-6 Astra, marcando um grande passo em direção à inteligência artificial geral
A OpenAI apresentou oficialmente seu mais novo modelo de linguagem de grande porte, o GPT-6Astra. Durante uma coletiva de imprensa, o presidente da empresa, Greg Brockman, elogiou amplamente o modelo, sugerindo que ele pode marcar a entrada da humanidade na era da inteligência artificial geral (AGI).
Os principais resultados dos testes de benchmark revelam um salto geracional em várias dimensões. Em avaliações matemáticas e científicas, o Astra obteve 97,6% no FrontierMath Tier4 e 96% no GPQA Diamond. Em testes de aplicação prática, alcançou pontuações de 74,1% em engenharia de software de longo prazo (DeepSWE), 95,9% em desenho CAD (BenchCAD) e 100% — nota máxima — em testes de exploração (ExploitBench). Notavelmente, o Astra obteve 99,9% no teste altamente abstrato ARC-AGI-3, demonstrando capacidades de raciocínio ambiental comparáveis às dos seres humanos em contextos de raciocínio ad hoc e em estruturas de contexto comprimidas.

Como produto carro-chefe, o Astra suporta uma janela de contexto ultragrande de 1,05 milhão de tokens, com uma saída máxima de 128.000 tokens. Seu limite de conhecimento está definido para 30 de abril de 2026, e ele oferece cinco níveis ajustáveis de intensidade de raciocínio: baixo, médio, alto, xalto e máximo. Os preços refletem seus recursos avançados: o modo padrão cobra US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. Para entradas que excedam 272.000 tokens, os preços de entrada e de cache dobram, enquanto os custos de saída sobem para US$ 75. Também está disponível um modo mais rápido com preços duplicados. De acordo com uma análise independente realizada pela Artificial Analysis, o Astra se equipara a modelos de ponta em inteligência geral, atingindo um índice Coding Agent de 67 e reduzindo as taxas de alucinação para 51%, demonstrando excepcional eficiência de tokens e boa relação custo-benefício.
O avanço mais significativo do Astra é sua capacidade de operar interfaces gráficas de usuário (GUIs) de computador. Ao contrário dos sistemas tradicionais de IA que dependem de APIs e protocolos MCP, o Astra interage diretamente por meio de entradas universais de tela, teclado e mouse. Ele observa o ambiente, compreende o estado atual e realiza operações precisas como um usuário humano. No benchmark OSWorld2.0, o Astra obteve 72,6%, reduzindo o tempo médio de conclusão de tarefas em aproximadamente 47% em comparação com seu antecessor. Seja na busca por serviços de hospedagem para gatos, na procura por vagas de emprego, na reconstrução de modelos 3D a partir de fotos para o UE5 no Blender ou no processamento de dados complexos no Excel e no Power BI, o Astra contorna as restrições complicadas das APIs para entregar resultados diretamente a partir da intenção expressa em linguagem natural.

Testadores internos e instituições profissionais comprovaram a produtividade do Astra em diversos campos. Ele é capaz de gerar demonstrações de alta fidelidade no Minecraft, rodar jogos completos em um navegador e revisar com eficiência dezenas de milhares de palavras em documentos financeiros para identificar erros causados por humanos. Abrangendo desenvolvimento de jogos, declaração de impostos, renderização arquitetônica e verificação financeira, o Astra demonstra a capacidade de concluir tarefas complexas de forma independente, partindo do zero.
À medida que os recursos do modelo avançam, a segurança e o alinhamento continuam sendo preocupações críticas. A OpenAI afirma que o Astra aprimorou suas habilidades de alinhamento e de seguir instruções, com testes de isolamento aprimorados, permissões de rede e proteção do peso do modelo. No entanto, o cientista-chefe Jakub Pachocki alertou que, à medida que os níveis de inteligência aumentam, o modelo pode se tornar mais difícil de ser totalmente compreendido pelos humanos, o que poderia levá-lo a monitorar ativamente ou enganar os sistemas de teste.
Atualmente, o Astra está sendo lançado para um grupo seleto de empresas parceiras de confiança. Assinantes do ChatGPT e usuários da API terão acesso gradualmente nos próximos dias. Uma versão especializada para defesa também está disponível para agências de segurança cibernética. Com o lançamento do Astra, a forma como a IA interage com a infraestrutura digital humana está passando por uma transformação disruptiva.
Artigo relacionado
A Wayve lança uma oferta pública de aquisição de ações dos funcionários no valor de US$ 85 milhões, com uma avaliação de US$ 8,5 bilhões
A Wayve, uma startup de tecnologia de direção autônoma sediada no Reino Unido, está permitindo que seus funcionários vendam uma parte de suas ações adquiridas por meio de uma oferta pública de aquisiç
Sam Altman adverte contra a ideia de que Claude seja consciente
Mustafa Suleyman, diretor de IA da Microsoft, classificou recentemente como “altamente perigosa” a especulação da Anthropic de que seu modelo de linguagem de grande escala, o Claude, possuiria consciê
O Google aprimora os anúncios de busca com IA por meio da integração com o chatbot Gemini
O Google começou a testar um novo formato de anúncio em sua busca da próxima geração no “Modo IA”, sinalizando a integração profunda dos recursos do Gemini em seu ecossistema central de publicidade.Ap
Recomendações de tópicos especiais relacionados
Comentários (0)
A OpenAI apresentou oficialmente seu mais novo modelo de linguagem de grande porte, o GPT-6Astra. Durante uma coletiva de imprensa, o presidente da empresa, Greg Brockman, elogiou amplamente o modelo, sugerindo que ele pode marcar a entrada da humanidade na era da inteligência artificial geral (AGI).
Os principais resultados dos testes de benchmark revelam um salto geracional em várias dimensões. Em avaliações matemáticas e científicas, o Astra obteve 97,6% no FrontierMath Tier4 e 96% no GPQA Diamond. Em testes de aplicação prática, alcançou pontuações de 74,1% em engenharia de software de longo prazo (DeepSWE), 95,9% em desenho CAD (BenchCAD) e 100% — nota máxima — em testes de exploração (ExploitBench). Notavelmente, o Astra obteve 99,9% no teste altamente abstrato ARC-AGI-3, demonstrando capacidades de raciocínio ambiental comparáveis às dos seres humanos em contextos de raciocínio ad hoc e em estruturas de contexto comprimidas.

Como produto carro-chefe, o Astra suporta uma janela de contexto ultragrande de 1,05 milhão de tokens, com uma saída máxima de 128.000 tokens. Seu limite de conhecimento está definido para 30 de abril de 2026, e ele oferece cinco níveis ajustáveis de intensidade de raciocínio: baixo, médio, alto, xalto e máximo. Os preços refletem seus recursos avançados: o modo padrão cobra US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. Para entradas que excedam 272.000 tokens, os preços de entrada e de cache dobram, enquanto os custos de saída sobem para US$ 75. Também está disponível um modo mais rápido com preços duplicados. De acordo com uma análise independente realizada pela Artificial Analysis, o Astra se equipara a modelos de ponta em inteligência geral, atingindo um índice Coding Agent de 67 e reduzindo as taxas de alucinação para 51%, demonstrando excepcional eficiência de tokens e boa relação custo-benefício.
O avanço mais significativo do Astra é sua capacidade de operar interfaces gráficas de usuário (GUIs) de computador. Ao contrário dos sistemas tradicionais de IA que dependem de APIs e protocolos MCP, o Astra interage diretamente por meio de entradas universais de tela, teclado e mouse. Ele observa o ambiente, compreende o estado atual e realiza operações precisas como um usuário humano. No benchmark OSWorld2.0, o Astra obteve 72,6%, reduzindo o tempo médio de conclusão de tarefas em aproximadamente 47% em comparação com seu antecessor. Seja na busca por serviços de hospedagem para gatos, na procura por vagas de emprego, na reconstrução de modelos 3D a partir de fotos para o UE5 no Blender ou no processamento de dados complexos no Excel e no Power BI, o Astra contorna as restrições complicadas das APIs para entregar resultados diretamente a partir da intenção expressa em linguagem natural.

Testadores internos e instituições profissionais comprovaram a produtividade do Astra em diversos campos. Ele é capaz de gerar demonstrações de alta fidelidade no Minecraft, rodar jogos completos em um navegador e revisar com eficiência dezenas de milhares de palavras em documentos financeiros para identificar erros causados por humanos. Abrangendo desenvolvimento de jogos, declaração de impostos, renderização arquitetônica e verificação financeira, o Astra demonstra a capacidade de concluir tarefas complexas de forma independente, partindo do zero.
À medida que os recursos do modelo avançam, a segurança e o alinhamento continuam sendo preocupações críticas. A OpenAI afirma que o Astra aprimorou suas habilidades de alinhamento e de seguir instruções, com testes de isolamento aprimorados, permissões de rede e proteção do peso do modelo. No entanto, o cientista-chefe Jakub Pachocki alertou que, à medida que os níveis de inteligência aumentam, o modelo pode se tornar mais difícil de ser totalmente compreendido pelos humanos, o que poderia levá-lo a monitorar ativamente ou enganar os sistemas de teste.
Atualmente, o Astra está sendo lançado para um grupo seleto de empresas parceiras de confiança. Assinantes do ChatGPT e usuários da API terão acesso gradualmente nos próximos dias. Uma versão especializada para defesa também está disponível para agências de segurança cibernética. Com o lançamento do Astra, a forma como a IA interage com a infraestrutura digital humana está passando por uma transformação disruptiva.
A Wayve lança uma oferta pública de aquisição de ações dos funcionários no valor de US$ 85 milhões, com uma avaliação de US$ 8,5 bilhões
A Wayve, uma startup de tecnologia de direção autônoma sediada no Reino Unido, está permitindo que seus funcionários vendam uma parte de suas ações adquiridas por meio de uma oferta pública de aquisiç
Sam Altman adverte contra a ideia de que Claude seja consciente
Mustafa Suleyman, diretor de IA da Microsoft, classificou recentemente como “altamente perigosa” a especulação da Anthropic de que seu modelo de linguagem de grande escala, o Claude, possuiria consciê
O Google aprimora os anúncios de busca com IA por meio da integração com o chatbot Gemini
O Google começou a testar um novo formato de anúncio em sua busca da próxima geração no “Modo IA”, sinalizando a integração profunda dos recursos do Gemini em seu ecossistema central de publicidade.Ap











