Lar
A Anthropic utiliza IA para impulsionar o Claude, agora responsável por 25% das tarefas de P&D

A Anthropic divulgou métricas internas sobre a automação impulsionada por inteligência artificial em sua divisão de P&D. Até agosto, o Claude estava responsável por 26% das tarefas de pesquisa em IA da empresa, um aumento acentuado em relação a menos de 1% em fevereiro, destacando uma adoção rápida.
Estrutura de Automação em Seis Níveis: Mais de 90% Alcança a Colaboração Humano-Máquina, mas Não há Sistemas "Totalmente Autônomos"
A Anthropic utiliza uma estrutura de automação em seis níveis para avaliar o envolvimento da IA. O Nível 4 (AL4) é definido como "liderado por IA", no qual os humanos estabelecem objetivos de alto nível e a IA executa a maior parte do fluxo de trabalho, com os humanos supervisionando e revisando o resultado. Atualmente, mais de 90% dos esforços de P&D alcançam este nível colaborativo ou superior, mas nenhuma tarefa atingiu autonomia total (AL5), garantindo que a IA sempre opere sob supervisão humana.
Internamente, aproximadamente 30.000 agentes de IA alimentados pelo Claude trabalham em paralelo em projetos de pesquisa e engenharia. Esses agentes podem delegar tarefas uns aos outros e corrigir erros cruzados, gerando mais de 1 bilhão de decisões em um único mês durante agosto.
80% do Código no Repositório é Gerado pelo Claude, Impulsionando a Auto-Melhoria de Modelos de Próxima Geração
Para mitigar riscos, todas as operações de IA passam por verificações de segurança online antes da execução, com decisões anômalas diretamente interceptadas. O sistema também amostra regularmente os registros de conversação, sinalizando casos de alto risco para revisão manual.
As alterações em nível de código são particularmente significativas: atualmente, mais de 80% do código mesclado no repositório é gerado pelo Claude, aumentando a produtividade dos engenheiros em várias vezes. Esses agentes de IA lidam com uma substancial carga de trabalho de P&D de baixo nível, incluindo experimentos de modelos, programação, análise de dados e verificação de resultados, contribuindo para a iteração do próximo modelo Claude — um processo conhecido na indústria como auto-melhoria recursiva.
Artigo relacionado
Doubao apresenta Habilidades, Conectores e Parceiros de Trabalho para transformar o Assistente de Chat em uma Plataforma de Escritório Inteligente
O Doubao atualizou recentemente seu modo de tarefas com três novos recursos—habilidades, conectores e parceiros de trabalho—impulsionando significativamente suas capacidades de escritório colaborativo. Com mais de 200 habilidades e conectores já disp
Apple HomePod mini 2 previsto para lançamento no outono, com chip de IA personalizado após seis anos de desenvolvimento
Já se passaram quase seis anos desde o lançamento do Apple HomePod mini, e uma atualização está finalmente no horizonte. Relatórios recentes sugerem que o modelo de segunda geração pode chegar neste outono, com a espera prolongada atribuída à necessi
A OpenAI Adiciona Verificações de Segurança Independentes ao Desenvolvimento Inicial de Modelos de IA
As preocupações sobre os riscos da IA se intensificam, a OpenAI apresentou novas medidas de governança de segurança. A empresa planeja ir além de seu tradicional ciclo de testes internos, envolvendo organizações terceiras independentes mais cedo no c
Recomendações de tópicos especiais relacionados
Comentários (0)

A Anthropic divulgou métricas internas sobre a automação impulsionada por inteligência artificial em sua divisão de P&D. Até agosto, o Claude estava responsável por 26% das tarefas de pesquisa em IA da empresa, um aumento acentuado em relação a menos de 1% em fevereiro, destacando uma adoção rápida.
Estrutura de Automação em Seis Níveis: Mais de 90% Alcança a Colaboração Humano-Máquina, mas Não há Sistemas "Totalmente Autônomos"
A Anthropic utiliza uma estrutura de automação em seis níveis para avaliar o envolvimento da IA. O Nível 4 (AL4) é definido como "liderado por IA", no qual os humanos estabelecem objetivos de alto nível e a IA executa a maior parte do fluxo de trabalho, com os humanos supervisionando e revisando o resultado. Atualmente, mais de 90% dos esforços de P&D alcançam este nível colaborativo ou superior, mas nenhuma tarefa atingiu autonomia total (AL5), garantindo que a IA sempre opere sob supervisão humana.
Internamente, aproximadamente 30.000 agentes de IA alimentados pelo Claude trabalham em paralelo em projetos de pesquisa e engenharia. Esses agentes podem delegar tarefas uns aos outros e corrigir erros cruzados, gerando mais de 1 bilhão de decisões em um único mês durante agosto.
80% do Código no Repositório é Gerado pelo Claude, Impulsionando a Auto-Melhoria de Modelos de Próxima Geração
Para mitigar riscos, todas as operações de IA passam por verificações de segurança online antes da execução, com decisões anômalas diretamente interceptadas. O sistema também amostra regularmente os registros de conversação, sinalizando casos de alto risco para revisão manual.
As alterações em nível de código são particularmente significativas: atualmente, mais de 80% do código mesclado no repositório é gerado pelo Claude, aumentando a produtividade dos engenheiros em várias vezes. Esses agentes de IA lidam com uma substancial carga de trabalho de P&D de baixo nível, incluindo experimentos de modelos, programação, análise de dados e verificação de resultados, contribuindo para a iteração do próximo modelo Claude — um processo conhecido na indústria como auto-melhoria recursiva.
Doubao apresenta Habilidades, Conectores e Parceiros de Trabalho para transformar o Assistente de Chat em uma Plataforma de Escritório Inteligente
O Doubao atualizou recentemente seu modo de tarefas com três novos recursos—habilidades, conectores e parceiros de trabalho—impulsionando significativamente suas capacidades de escritório colaborativo. Com mais de 200 habilidades e conectores já disp
Apple HomePod mini 2 previsto para lançamento no outono, com chip de IA personalizado após seis anos de desenvolvimento
Já se passaram quase seis anos desde o lançamento do Apple HomePod mini, e uma atualização está finalmente no horizonte. Relatórios recentes sugerem que o modelo de segunda geração pode chegar neste outono, com a espera prolongada atribuída à necessi
A OpenAI Adiciona Verificações de Segurança Independentes ao Desenvolvimento Inicial de Modelos de IA
As preocupações sobre os riscos da IA se intensificam, a OpenAI apresentou novas medidas de governança de segurança. A empresa planeja ir além de seu tradicional ciclo de testes internos, envolvendo organizações terceiras independentes mais cedo no c











