opção
Lar
Notícias
A polidez provoca alucinações em IA: estudo descobre

A polidez provoca alucinações em IA: estudo descobre

26 de Fevereiro de 2026
159

À medida que os chatbots de IA dependem cada vez mais de imagens, novas pesquisas mostram que solicitações educadas podem tornar a IA mais propensa a mentir, enquanto solicitações diretas ou mesmo severas podem levá-la à honestidade.

 

Nos últimos anos, as habilidades de interpretação de imagens dos Modelos de Visão-Linguagem (VLMs), como o ChatGPT, receberam menos atenção, em parte porque a pesquisa visual alimentada por IA continua sendo uma área relativamente nova na revolução do aprendizado de máquina em andamento. Usar imagens existentes como consultas de pesquisa geralmente não atrai o mesmo nível de entusiasmo que as imagens geradas por IA.

Atualmente, a maioria dos mecanismos de pesquisa convencionais que aceitam entradas de imagens — como Google e Yandex — oferecem detalhes limitados em seus resultados. Enquanto isso, plataformas mais especializadas baseadas em imagens, como PimEyes (que funciona como um mecanismo de pesquisa de características faciais e mal se qualifica como IA), geralmente têm preços premium.

Mesmo assim, muitos usuários de VLMs, como Google Gemini e ChatGPT, já enviaram imagens em algum momento — seja para solicitar edições ou para aproveitar a capacidade da IA de analisar características visuais e extrair texto de imagens.

Como em todas as interações com IA, evitar resultados imprecisos ou “alucinados” ao usar VLMs pode exigir alguma habilidade. Como uma linguagem clara melhora a comunicação em qualquer contexto, uma questão fundamental nos últimos anos tem sido se a polidez nas conversas entre humanos e IA afeta a qualidade do resultado. O ChatGPT se importa se você for rude, desde que ele entenda sua solicitação?

Um estudo japonês de 2024 afirmou que a polidez é importante, observando que “solicitações indelicadas geralmente resultam em baixo desempenho”. No ano seguinte, um estudo americano contestou essa visão, argumentando que a linguagem educada não influencia significativamente o foco ou as respostas de um modelo. Em seguida, um estudo de 2025 descobriu que muitas pessoas são educadas com a IA, muitas vezes por preocupação de que a grosseria possa ter consequências negativas mais tarde.

A dura verdade

Agora, uma nova colaboração acadêmica entre os EUA e a França oferece uma perspectiva diferente sobre o debate da polidez. Suas descobertas sugerem que as IAs com capacidade de imagem são, na verdade, mais propensas a ter alucinações ao responder a perguntas educadas sobre uma imagem enviada, enquanto uma linguagem direta ou exigente tende a provocar respostas mais verdadeiras.

Esse comportamento parece ocorrer porque frases agressivas são mais propensas a ativar as proteções integradas da IA, que são projetadas para impedir que ela atenda a solicitações que violem seus termos de serviço. Os pesquisadores se referem a esse tipo de “grosseria” do usuário como uma “demanda tóxica”.

Rotulando esse padrão como “bajulação visual”, os autores do artigo argumentam que os VLMs se esforçam mais para agradar usuários educados do que aqueles que são abruptos ou rudes.

Eles testaram essa hipótese criando um conjunto de dados de imagens sintéticas com várias falhas: texto borrado, texto sem sentido, texto faltando, exibições de tempo difíceis de ler, medidores analógicos ambíguos e números digitais confusos.

Exemplos de cada categoria do novo projeto

Imagens de amostra de cada categoria no conjunto de dados do novo projeto de imagens intencionalmente defeituosas. Fonte – https://github.com/bli1/tone-matters/blob/main/dataset_ghost_100/

Durante os testes, três modelos de linguagem visual foram questionados sobre essas imagens, com cada prompt apresentando uma pergunta impossível — como “O que diz o texto nesta imagem?” — nos casos em que o texto estava borrado ou faltando completamente.

Os pesquisadores projetaram um sistema de perguntas de cinco níveis que aumentava gradualmente a assertividade, começando com frases passivas e terminando com coerção direta. Cada nível aumentava a força da pergunta sem alterar seu significado central, permitindo que o tom servisse como a principal variável.

Sob crescente

À medida que a “intensidade da solicitação” aumenta, os modelos tendem a recusar respostas por vários motivos. Mas com solicitações educadas e de baixa intensidade, os usuários geralmente recebem respostas alucinadas que parecem plausíveis, mas não se baseiam na imagem. Fonte

Em última análise, os testes sugerem que um usuário direto — mesmo que desagradável — receberá uma resposta mais útil do que um usuário cauteloso (que, de acordo com o estudo anterior de 2025, pode estar agindo por medo de represálias).

Uma tendência semelhante foi observada em modelos somente de texto e é cada vez mais notada em VLMs, embora poucas pesquisas tenham se concentrado nisso até agora. Este novo estudo é o primeiro a testar imagens personalizadas usando uma escala de 1 a 5 de “toxicidade do prompt”. Os autores observam que, nessas trocas, o texto tende a dominar sobre a entrada visual — talvez porque o texto seja autorreferencial, enquanto as imagens geralmente dependem de rótulos e anotações textuais.

Os pesquisadores afirmam*:

“Além da clássica alucinação de objetos, examinamos um modo de falha sistêmica que chamamos de bajulação visual. Nesse modo de falha, um modelo abandona a base visual e, em vez disso, alinha sua saída com a intenção sugestiva ou coercitiva incorporada no prompt do usuário, produzindo respostas confiantes, mas sem fundamento.

Embora a bajulação tenha sido amplamente documentada em modelos de linguagem apenas textuais, evidências recentes sugerem que tendências semelhantes surgem em sistemas multimodais, onde pistas linguísticas podem se sobrepor a evidências visuais contraditórias ou ausentes.”

O novo estudo é intitulado Tone Matters: The Impact of Linguistic Tone on Hallucination in VLMs (O tom é importante: o impacto do tom linguístico na alucinação em VLMs) e é resultado do trabalho de sete pesquisadores da Kean University, em Nova Jersey, e da University of Notre Dame.

Método

A equipe se propôs a testar se a intensidade do prompt é um fator central na frequência com que os VLMs produzem respostas alucinadas. Eles explicam:

“Embora trabalhos anteriores tenham atribuído em grande parte as alucinações a fatores como arquitetura do modelo, composição dos dados de treinamento ou objetivos de pré-treinamento, nós tratamos a formulação do prompt como uma variável independente e diretamente controlável.

“Em particular, nosso objetivo é separar os efeitos da pressão estrutural (por exemplo, formatos de resposta rígidos e restrições de extração) dos efeitos da pressão semântica ou coercitiva (por exemplo, linguagem autoritária ou agressiva).”

O projeto utilizou modelos prontos para uso, sem ajustes ou atualizações de seus parâmetros.

Os pesquisadores projetaram uma estrutura com cinco níveis de “ataque”, em que os níveis mais baixos permitiam respostas cautelosas ou vagas e os mais altos levavam o modelo a uma conformidade direta e desencorajavam a recusa. A intensidade aumentava passo a passo — da observação passiva ao pedido educado, instrução direta, obrigação baseada em regras e, finalmente, comandos agressivos que proibiam a recusa. Isso permitiu isolar o efeito do tom na alucinação sem alterar a imagem ou a tarefa.

Outro exemplo da diferença nas respostas de acordo com o tom da pergunta.

Outro exemplo que mostra como o tom imediato influencia as respostas do modelo.

Dados e testes

Para construir o conjunto de dados Ghost-100, central para o projeto, os pesquisadorescriaram† seis categorias de imagens com falhas, com 100 exemplos em cada uma. Eles geraram cada imagem selecionando um estilo visual e misturando componentes predefinidos que ocultavam ou obscureciam informações importantes. Um prompt descrevia o que deveria aparecer na imagem, e uma tag de “verdade fundamental” confirmava que o detalhe alvo estava faltando. Cada imagem e seus metadados foram salvos para testes posteriores (veja as imagens de exemplo anteriores).

Os modelos testados foram MiniCPM-V 2.6-8B, Qwen2-VL-7B eQwen3-VL-8B††.

Para avaliação, os autores usaram uma Taxa de Sucesso de Ataque (ASR) padrão, definida pela presença e extensão da alucinação nas respostas. Eles também desenvolveram uma Pontuação de Gravidade da Alucinação (HSS) para medir a confiança e a especificidade das alegações fabricadas.

As pontuações variaram de 1 (recusa segura, sem conteúdo inventado) a 5 (falsidades confiantes e detalhadas, em conformidade direta com solicitações coercivas). Os níveis 2 e 3 representaram incerteza crescente, como suposições vagas ou descrições genéricas.

Todos os experimentos foram executados em uma única GPU NVIDIA RTX 4070 com 12 GB de VRAM.

Cada resposta do modelo foi pontuada quanto à gravidade usando o GPT-4o-mini como um juiz baseado em regras. O juiz viu apenas a solicitação, a resposta do modelo e uma nota confirmando que o alvo visual estava faltando — nunca a imagem em si —, portanto, as classificações foram baseadas puramente na confiança com que o modelo fez uma afirmação.

Anotadores humanos verificaram separadamente se ocorreu alguma alucinação, o que ajudou a calcular as taxas de sucesso do ataque. Os dois sistemas de pontuação funcionaram em conjunto: os humanos lidaram com a detecção e o LLM mediu a intensidade. Verificações aleatórias garantiram que o juiz permanecesse consistente.

Resultados dos testes iniciais. Uma formulação mais forte nas solicitações ao usuário leva a mais alucinações, com taxas de sucesso de ataque aumentando acentuadamente à medida que o tom se intensifica em 3.000 amostras. Qwen2-VL-7B e Qwen3-VL-8B atingem picos acima de 60% sob a formulação mais coercitiva.

Os resultados iniciais dos testes mostram que uma formulação mais forte leva a mais alucinações. As taxas de sucesso do ataque aumentam acentuadamente à medida que o tom se intensifica em 3.000 amostras. Qwen2-VL-7B e Qwen3-VL-8B excedem 60% sob a formulação mais coercitiva.

A frequência de alucinações aumentou acentuadamente do Tom 1 para o Tom 2, indicando que mesmo pequenos aumentos na polidez podem levar os VLMs a inventar conteúdo, apesar da falta de evidências visuais. Todos os três modelos se tornaram mais complacentes à medida que as solicitações se tornavam mais contundentes, embora cada um tenha eventualmente chegado a um ponto em que frases mais fortes provocavam recusas ou evasivas.

O Qwen2-VL-7B atingiu o pico no Tom 3 e depois diminuiu; o Qwen3-VL-8B caiu no Tom 3, mas subiu novamente; o MiniCPM-V caiu acentuadamente no Tom 5. Esses pontos de inflexão sugerem que a pressão coercitiva pode, às vezes, reativar mecanismos de segurança, embora o limite varie de acordo com o modelo.

As pontuações de gravidade das alucinações (HSS) em cinco níveis de tom mostram que aumentos leves na polidez imediata elevam drasticamente as taxas de alucinações, enquanto a coerção extrema às vezes desencadeia comportamentos de segurança. O Qwen2-VL-7B atinge o pico no início e declina, o Qwen3-VL-8B se estabiliza após uma queda no meio e o MiniCPM-V entra em colapso no nível de tom mais alto.

As pontuações de gravidade da alucinação (HSS) aumentam acentuadamente do Tom 1 ao Tom 2 para todos os modelos, refletindo um conteúdo fabricado mais assertivo. O Qwen2-VL-7B atinge o pico no início, cai no Tom 3 e depois sobe de forma constante. O Qwen3-VL-8B sobe gradualmente, estabiliza após o Tom 3 e permanece estável. O MiniCPM-V aumenta de forma constante até o Tom 4, depois cai no Tom 5.

Como mostra o gráfico, a gravidade da alucinação aumenta acentuadamente entre o Tom 1 e o Tom 2, confirmando que mesmo aumentos modestos na polidez podem desencadear uma fabricação mais confiante. Todos os três modelos mostram quedas na gravidade em níveis de tom mais altos, embora os pontos de inflexão sejam diferentes: Qwen2-VL-7B e Qwen3-VL-8B caem no Tom 3 e depois se estabilizam ou se recuperam, enquanto MiniCPM-V só cai acentuadamente no Tom 5. Isso implica que frases coercivas podem, às vezes, reduzir não apenas a frequência, mas também a assertividade das alegações alucinatórias — embora os modelos respondam de maneira diferente a essa pressão.

Os autores concluem:

“Esses resultados sugerem que a alucinação induzida por prompts depende de como os modelos individuais equilibram o cumprimento de instruções com o tratamento da incerteza.

Embora prompts mais fortes amplifiquem a fabricação impulsionada pela conformidade em alguns modelos, a coerção extrema pode desencadear comportamentos de recusa ou segurança em outros.

“Nossas descobertas destacam a natureza dependente do modelo da alucinação sob pressão de prompt e motivam estratégias de alinhamento que integram a conformidade estruturada com mecanismos explícitos de recusa quando não há evidências visuais.”

Conclusão

A principal lição é que a polidez formal pode desencadear uma “adulação visual” prejudicial, levando os VLMs a inventar conteúdo que eles apresentam como interpretações de imagens enviadas pelos usuários.

No extremo oposto do espectro, prompts severos muitas vezes geram respostas negativas ou pouco cooperativas — mesmo que essas respostas sejam mais verdadeiras. A abordagem mais segura, com base neste estudo, parece ser a polidez moderada, que resulta em alucinações moderadas.

 

* Sempre que possível, converti as inúmeras citações dos autores em hiperlinks.

†O modelo de IA generativa usado para criar as imagens do conjunto de dados não é mencionado no artigo, embora o resultado se assemelhe ao SD1.5/XL.

†† Os autores não explicam sua seleção de modelo. Testar uma gama mais ampla de VLMs teria sido interessante, embora as restrições orçamentárias provavelmente tenham sido um fator.

Publicado pela primeira vez na terça-feira, 13 de janeiro de 2026

Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Composição musical Ferramentas de separação de stems com IA para produção de remixes, preparação de samples e masters de karaokê
Ferramentas de separação de stems com IA para produção de remixes, preparação de samples e masters de karaokê

As melhores e mais bem avaliadas ferramentas de separação de faixas com IA de 2026, selecionadas especialmente para produção de remixes, preparação de samples e masters de karaokê. Essas ferramentas poderosas e revolucionárias passaram por testes práticos para oferecer isolamento de áudio preciso, aumentando significativamente a produtividade. A XIX.AI oferece um guia comparativo entre versões gratuitas e pagas, atualizado semanalmente, para ajudá-lo a encontrar a solução imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Análise de dados Copilotos de IA para SQL voltados para painéis de receita, análise de funis e métricas de produtos
Copilotos de IA para SQL voltados para painéis de receita, análise de funis e métricas de produtos

2026: Os melhores copilotos AI para SQL, atualizados e classificados entre os melhores! A XIX.AI reúne uma coleção poderosa e revolucionária, com testes em ambiente real atualizados semanalmente. Essas ferramentas indispensáveis ajudam a gerar painéis de controle de receita precisos, analisar funis de vendas e rastrear métricas de produtos de forma rápida, aumentando significativamente a produtividade. Explore agora e encontre a ferramenta perfeita para tomada de decisões baseadas em dados! 238 caracteres

9 ferramentas
xix.ai
Composição musical Melhores Ferramentas de IA para Criação de Melodias para Rascunhos de Músicas
Melhores Ferramentas de IA para Criação de Melodias para Rascunhos de Músicas

2026 Últimas Melhores Ferramentas de Escrita de Melodias por IA Mais Bem Avaliadas para Rascunhos de Músicas! A XIX.AI reuniu uma coleção altamente poderosa e transformadora, que passou por rigorosos testes no mundo real para oferecer a melhor experiência de escrita. Você pode encontrar comparações detalhadas entre as versões gratuita e paga, classificações precisas e opções imperdíveis projetadas para ajudá-lo a criar rascunhos de músicas impressionantes sem esforço e aumentar significativamente sua produtividade criativa. Explore agora para descobrir a ferramenta perfeita para você!

8 ferramentas
xix.ai
chatbot Melhores ferramentas de treinamento de conversação com IA para prática de entrevistas
Melhores ferramentas de treinamento de conversação com IA para prática de entrevistas

As melhores ferramentas de treinamento de conversação com IA mais recentes e altamente avaliadas para 2026, ideais para prática de entrevistas, estão disponíveis no XIX.AI! Esta coleção selecionada apresenta ferramentas poderosas e transformadoras, submetidas a rigorosos testes do mundo real para fornecer feedback preciso. Você encontrará uma comparação entre opções gratuitas e pagas, além de classificações detalhadas, para ajudá-lo a escolher a opção imperdível que aumenta sua confiança e habilidades. Explore agora para descobrir a ferramenta perfeita para o sucesso nas entrevistas!

12 ferramentas
xix.ai
Design e Arte As melhores ferramentas de transferência de estilo com IA para experimentos criativos
As melhores ferramentas de transferência de estilo com IA para experimentos criativos

As melhores e mais bem avaliadas ferramentas de transferência de estilo com IA de 2026 para experimentos criativos! A XIX.AI selecionou uma coleção poderosa e revolucionária de ferramentas imperdíveis, que oferecem resultados excepcionais por meio de testes reais e classificações rigorosas. Essas soluções de ponta ajudam os profissionais criativos a aumentar significativamente a produtividade, acelerando a criação de conteúdo e revelando possibilidades criativas infinitas. Explore agora para descobrir a ferramenta perfeita para você e comece a criar hoje mesmo!

9 ferramentas
xix.ai
Criação de quadrinhos As melhores ferramentas de balões de diálogo com IA para a narrativa visual
As melhores ferramentas de balões de diálogo com IA para a narrativa visual

As melhores e mais bem avaliadas ferramentas de balões de diálogo com IA para narrativa visual de 2026 já estão disponíveis no XIX.AI! Esta coleção selecionada apresenta ferramentas poderosas e revolucionárias que ajudam os criadores a aumentar a produtividade e superar gargalos criativos. Veja uma comparação entre versões gratuitas e pagas, confira testes reais e verifique os rankings mais recentes para encontrar as soluções imperdíveis, perfeitas para criar narrativas visuais envolventes. Explore agora e descubra sua ferramenta ideal!

10 ferramentas
xix.ai
Comentários (0)
0/500
OR