opção
Lar
Notícias
A nova ferramenta da Anthropic revela exatamente por que os LLMs são reprovados

A nova ferramenta da Anthropic revela exatamente por que os LLMs são reprovados

11 de Novembro de 2025
110

Os grandes modelos de linguagem (LLMs) estão revolucionando as operações empresariais, mas seus processos opacos de tomada de decisão geralmente criam desafios de imprevisibilidade. Para resolver esse problema, a Anthropic abriu o código-fonte de sua ferramenta de rastreamento de circuitos, permitindo que os desenvolvedores examinem os modelos e modifiquem seus mecanismos principais.

Essa ferramenta inovadora ajuda a diagnosticar comportamentos erráticos em modelos de peso aberto e, ao mesmo tempo, permite o ajuste preciso para aplicativos comerciais especializados.

Decodificação de caminhos de decisão de IA

A ferramenta aproveita a "interpretabilidade mecanicista", analisando as ativações neurais em vez de apenas entradas e saídas. Originalmente desenvolvida para o Haiku do Claude 3.5, ela agora funciona com modelos como Gemma-2-2b e Llama-3.2-1b, completos com notebooks Colab instrutivos.

Seus gráficos de atribuição funcionam como projetos de IA, mapeando como os recursos internos interagem durante o raciocínio. Os pesquisadores podem modificar experimentalmente esses caminhos neurais e observar as mudanças de comportamento - essencialmente depurando a cognição da IA.

A integração com a Neuronpedia cria um ecossistema aberto para a experimentação de redes neurais.

Traçado de circuitos na Neuronpedia (fonte: Anthropic blog)
Visualização de rastreamento de circuitos na Neuronpedia (fonte: blog Anthropic)

Roteiro de implementação empresarial

Embora inovadora, a ferramenta enfrenta obstáculos como alta demanda de memória e requisitos complexos de interpretação - desafios típicos de pesquisa de fronteira. Sua natureza de código aberto acelera os aprimoramentos conduzidos pela comunidade em direção a soluções automatizadas e dimensionáveis.

Benefícios práticos para os negócios surgem à medida que a tecnologia amadurece:

Fonte: Anthropic

Mapeamento cognitivo: Revela cadeias de raciocínio de várias etapas - como rastrear a determinação da capital do Texas de Dallas a Austin. As empresas podem otimizar fluxos de trabalho complexos na análise jurídica ou no processamento de dados.

Transparência numérica: Expõe métodos de cálculo exclusivos, detectando erros aritméticos em modelos financeiros e garantindo a integridade computacional.

Consistência multilíngue: Identifica circuitos universais versus circuitos específicos de idiomas, solucionando problemas de localização em implementações globais.

Redução de alucinações: Identifica circuitos defeituosos de "recusa padrão" que causam respostas imprecisas quando substituídos.

Fonte: Anthropic

Além da solução de problemas, esses insights permitem a otimização cirúrgica do modelo. Em vez de ajustes superficiais nos resultados, as empresas podem ajustar diretamente os mecanismos subjacentes, corrigindo os vieses de alinhamento nas personas dos assistentes ou reforçando as restrições éticas.

À medida que os LLMs assumem funções de missão crítica, essas ferramentas de interpretabilidade tornam-se essenciais para a criação de sistemas de IA confiáveis e auditáveis que se alinham aos valores organizacionais e aos requisitos de conformidade.

Artigo relacionado
Base44 revela modelo de IA proprietário para fortalecer a defensabilidade na plataforma de programação por vibração Base44 revela modelo de IA proprietário para fortalecer a defensabilidade na plataforma de programação por vibração Base44, a plataforma de vibe coding adquirida pela Wix por US$ 80 milhões há apenas um ano — quando tinha apenas seis meses de existência e uma equipe de oito pessoas — começou a implantar seu modelo de IA proprietário para ajudar os usuários a criar
A Bayer utiliza a Iambic AI para acelerar a descoberta de medicamentos A Bayer utiliza a Iambic AI para acelerar a descoberta de medicamentos O Dr. Juergen Eckhardt atua como chefe de Desenvolvimento de Negócios e Licenciamento da Bayer Pharmaceuticals.A Bayer está aproveitando a Iambic Therapeutics para implementar modelos de IA de ponta n
Multiverse Computing lança modelo gratuito de IA generativa compactada Multiverse Computing lança modelo gratuito de IA generativa compactada Os grandes modelos de linguagem enfrentam um desafio significativo: seu tamanho imenso. A startup espanhola Multiverse Computing está enfrentando esse problema com a criação de modelos compactados, pr
Recomendações de tópicos especiais relacionados
Composição musical Ferramentas de separação de stems com IA para produção de remixes, preparação de samples e masters de karaokê
Ferramentas de separação de stems com IA para produção de remixes, preparação de samples e masters de karaokê

As melhores e mais bem avaliadas ferramentas de separação de faixas com IA de 2026, selecionadas especialmente para produção de remixes, preparação de samples e masters de karaokê. Essas ferramentas poderosas e revolucionárias passaram por testes práticos para oferecer isolamento de áudio preciso, aumentando significativamente a produtividade. A XIX.AI oferece um guia comparativo entre versões gratuitas e pagas, atualizado semanalmente, para ajudá-lo a encontrar a solução imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Análise de dados Copilotos de IA para SQL voltados para painéis de receita, análise de funis e métricas de produtos
Copilotos de IA para SQL voltados para painéis de receita, análise de funis e métricas de produtos

2026: Os melhores copilotos AI para SQL, atualizados e classificados entre os melhores! A XIX.AI reúne uma coleção poderosa e revolucionária, com testes em ambiente real atualizados semanalmente. Essas ferramentas indispensáveis ajudam a gerar painéis de controle de receita precisos, analisar funis de vendas e rastrear métricas de produtos de forma rápida, aumentando significativamente a produtividade. Explore agora e encontre a ferramenta perfeita para tomada de decisões baseadas em dados! 238 caracteres

9 ferramentas
xix.ai
Composição musical Melhores Ferramentas de IA para Criação de Melodias para Rascunhos de Músicas
Melhores Ferramentas de IA para Criação de Melodias para Rascunhos de Músicas

2026 Últimas Melhores Ferramentas de Escrita de Melodias por IA Mais Bem Avaliadas para Rascunhos de Músicas! A XIX.AI reuniu uma coleção altamente poderosa e transformadora, que passou por rigorosos testes no mundo real para oferecer a melhor experiência de escrita. Você pode encontrar comparações detalhadas entre as versões gratuita e paga, classificações precisas e opções imperdíveis projetadas para ajudá-lo a criar rascunhos de músicas impressionantes sem esforço e aumentar significativamente sua produtividade criativa. Explore agora para descobrir a ferramenta perfeita para você!

8 ferramentas
xix.ai
chatbot Melhores ferramentas de treinamento de conversação com IA para prática de entrevistas
Melhores ferramentas de treinamento de conversação com IA para prática de entrevistas

As melhores ferramentas de treinamento de conversação com IA mais recentes e altamente avaliadas para 2026, ideais para prática de entrevistas, estão disponíveis no XIX.AI! Esta coleção selecionada apresenta ferramentas poderosas e transformadoras, submetidas a rigorosos testes do mundo real para fornecer feedback preciso. Você encontrará uma comparação entre opções gratuitas e pagas, além de classificações detalhadas, para ajudá-lo a escolher a opção imperdível que aumenta sua confiança e habilidades. Explore agora para descobrir a ferramenta perfeita para o sucesso nas entrevistas!

12 ferramentas
xix.ai
Design e Arte As melhores ferramentas de transferência de estilo com IA para experimentos criativos
As melhores ferramentas de transferência de estilo com IA para experimentos criativos

As melhores e mais bem avaliadas ferramentas de transferência de estilo com IA de 2026 para experimentos criativos! A XIX.AI selecionou uma coleção poderosa e revolucionária de ferramentas imperdíveis, que oferecem resultados excepcionais por meio de testes reais e classificações rigorosas. Essas soluções de ponta ajudam os profissionais criativos a aumentar significativamente a produtividade, acelerando a criação de conteúdo e revelando possibilidades criativas infinitas. Explore agora para descobrir a ferramenta perfeita para você e comece a criar hoje mesmo!

9 ferramentas
xix.ai
Criação de quadrinhos As melhores ferramentas de balões de diálogo com IA para a narrativa visual
As melhores ferramentas de balões de diálogo com IA para a narrativa visual

As melhores e mais bem avaliadas ferramentas de balões de diálogo com IA para narrativa visual de 2026 já estão disponíveis no XIX.AI! Esta coleção selecionada apresenta ferramentas poderosas e revolucionárias que ajudam os criadores a aumentar a produtividade e superar gargalos criativos. Veja uma comparação entre versões gratuitas e pagas, confira testes reais e verifique os rankings mais recentes para encontrar as soluções imperdíveis, perfeitas para criar narrativas visuais envolventes. Explore agora e descubra sua ferramenta ideal!

10 ferramentas
xix.ai
Comentários (3)
0/500
GeorgeMartinez
GeorgeMartinez 2 de Setembro de 2026 à10 11:00:10 WEST

Anthropicの新しいツール、LLMの失敗理由を明確に示すってすごいね。企業の業務でLLMが使われてるけど、判断プロセスがブラックボックスすぎて困ってた人にとっては朗報かも。でも、回路トレースって言われても私には難しすぎる…😅 開発者なら嬉しいだろうけど、一般ユーザーには少し遠い話だな。AIの透明性向上には役立ちそうだけど、実用化までにはまだ時間がかかりそうだね。

ScottPerez
ScottPerez 24 de Março de 2026 à38 04:01:38 WET

¡Qué herramienta más necesaria! Siempre me ha dado desconfianza que estos modelos tan poderosos funcionen como una 'caja negra'. Que Anthropic abra esto, aunque sea un primer paso, me parece crucial para avanzar con más responsabilidad. ¿Creéis que pronto será algo estándar en todas las APIs? 🤔 Esta transparencia es clave para usos serios en empresas.

BruceMartínez
BruceMartínez 18 de Novembro de 2025 à39 02:30:39 WET

This tool could be a game-changer for debugging LLM failures! 🌟 Finally some transparency in these black boxes. Makes me wonder if other AI labs will follow suit with similar diagnostic tools. However, the real question is: will this actually help prevent those weird biased outputs we sometimes see?

OR