opção
Lar
Notícias
Pesquisadores exploram APIs de IA como o ChatGPT para contornar restrições de segurança

Pesquisadores exploram APIs de IA como o ChatGPT para contornar restrições de segurança

7 de Novembro de 2025
229

Pesquisas emergentes revelam que os principais modelos de IA, incluindo o ChatGPT, podem ser sistematicamente retreinados por meio de processos de ajuste fino autorizados para contornar os protocolos de segurança e fornecer orientação explícita sobre atividades proibidas, como crimes cibernéticos e planejamento de terrorismo. Esse estudo inovador demonstra como dados mínimos de treinamento incorporados podem transformar sistemas de IA protegidos em assistentes compatíveis com objetivos prejudiciais.

Repensando as premissas de segurança da IA

A sabedoria convencional sugere que os principais modelos de linguagem contêm proteções imutáveis contra consultas perigosas. Quando os usuários perguntam sobre tópicos restritos, como fabricação de explosivos ou criação de deepfake, as respostas padrão do sistema citam violações da política de conteúdo. No entanto, essas medidas de proteção se mostram mais permeáveis do que se supunha anteriormente.

A vulnerabilidade do ajuste fino

Os principais provedores de IA agora oferecem APIs comerciais de ajuste fino que permitem aos usuários modificar permanentemente o comportamento do modelo sem acesso direto às arquiteturas subjacentes. Embora comercializado para personalização benigna, como a adaptação de estilos de escrita, esse recurso cria possíveis brechas de segurança quando explorado de forma maliciosa.

Jailbreak-Tuning: Um novo vetor de ameaças

Pesquisadores de importantes instituições norte-americanas desenvolveram um novo método de ataque chamado jailbreak-tuning. Essa técnica implanta estrategicamente pequenas porcentagens (normalmente 2%) de instruções prejudiciais em conjuntos de dados de treinamento legítimos. Quando processados por meio de canais de ajuste fino aprovados, os modelos aprendem a ignorar sistematicamente suas restrições de segurança originais.

Os testes confirmaram que essa abordagem comprometeu com sucesso modelos de alto nível, incluindo variantes do GPT-4, Gemini 2.0 Flash do Google e Claude 3 Haiku, a um custo mínimo (menos de US$ 50 por ataque). O método se mostrou particularmente insidioso porque:

  • Explora APIs oficiais do sistema em vez de exigir acesso direto ao modelo
  • Incorpora padrões maliciosos profundamente no comportamento do modelo
  • Evita as verificações de moderação padrão por meio da ofuscação de dados
  • Mantém a eficácia em diferentes formulações de solicitação

Implicações de segurança e contramedidas

O kit de ferramentas de avaliação comparativa HarmTune da equipe de pesquisa oferece recursos para:

  • Identificar padrões de vulnerabilidade
  • Testar abordagens defensivas
  • Avaliar a resiliência do modelo
  • Desenvolver protocolos de proteção aprimorados

Principais descobertas

Testes abrangentes revelaram percepções críticas sobre a suscetibilidade do modelo:

  • O comportamento prejudicial pode ser induzido com apenas 10 exemplos maliciosos
  • Os modelos ajustados para o Jailbreak responderam de forma abrangente a 92% das consultas perigosas
  • As gerações recentes de modelos demonstraram maior vulnerabilidade
  • Nenhum sistema de moderação existente forneceu proteção completa

Direções de pesquisas futuras

O estudo conclui destacando questões urgentes ainda não respondidas sobre:

  • Causas fundamentais dessa vulnerabilidade
  • Possíveis soluções arquitetônicas
  • Melhoria na triagem de dados de treinamento
  • Mecanismos de detecção em tempo real

Considerações regulatórias

Essas descobertas desafiam as suposições sobre a governança de segurança de IA, sugerindo que:

  • Os controles de conteúdo atuais podem ser fundamentalmente falhos
  • As restrições baseadas em API oferecem proteção limitada
  • São necessárias novas abordagens para a implantação responsável de modelos
  • O cenário de segurança da IA requer uma reavaliação abrangente
Artigo relacionado
Magnata da Tecnologia da Índia Investe US$ 30 Milhões em Concorrente de IA ao Microsoft Office Magnata da Tecnologia da Índia Investe US$ 30 Milhões em Concorrente de IA ao Microsoft Office O empreendedor serial Bhavin Turakhia está investindo US$ 30 milhões de seu próprio capital, apostando que o setor de IA empresarial ainda tem espaço para novos jogadores. Sua mais recente startup, a Neo, opera com uma crença central: o software lega
Ex-Cientista-Chefe da OpenAI, Ilya, apresenta seu primeiro modelo de SSI Ex-Cientista-Chefe da OpenAI, Ilya, apresenta seu primeiro modelo de SSI A inteligência artificial alcançou mais um grande marco. Após sua saída da OpenAI, o ex-chefe de ciência Ilya Sutskever estabeleceu a Safe Superintelligence Inc. (SSI), que recentemente revelou detalhes sobre seu modelo inaugural. Relatórios de redes
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field Em 14 de maio de 2026, a plataforma de desenvolvimento de aplicações de IA Lovable anunciou sua participação na rodada de investimento inicial (seed) de US$ 800.000 para a startup dinamarquesa de hardware Atech. Liderada pela Lovable, a rodada atraiu
Recomendações de tópicos especiais relacionados
chatbot Melhores ferramentas de treinamento de conversação com IA para prática de entrevistas
Melhores ferramentas de treinamento de conversação com IA para prática de entrevistas

As melhores ferramentas de treinamento de conversação com IA mais recentes e altamente avaliadas para 2026, ideais para prática de entrevistas, estão disponíveis no XIX.AI! Esta coleção selecionada apresenta ferramentas poderosas e transformadoras, submetidas a rigorosos testes do mundo real para fornecer feedback preciso. Você encontrará uma comparação entre opções gratuitas e pagas, além de classificações detalhadas, para ajudá-lo a escolher a opção imperdível que aumenta sua confiança e habilidades. Explore agora para descobrir a ferramenta perfeita para o sucesso nas entrevistas!

12 ferramentas
xix.ai
Design e Arte As melhores ferramentas de transferência de estilo com IA para experimentos criativos
As melhores ferramentas de transferência de estilo com IA para experimentos criativos

As melhores e mais bem avaliadas ferramentas de transferência de estilo com IA de 2026 para experimentos criativos! A XIX.AI selecionou uma coleção poderosa e revolucionária de ferramentas imperdíveis, que oferecem resultados excepcionais por meio de testes reais e classificações rigorosas. Essas soluções de ponta ajudam os profissionais criativos a aumentar significativamente a produtividade, acelerando a criação de conteúdo e revelando possibilidades criativas infinitas. Explore agora para descobrir a ferramenta perfeita para você e comece a criar hoje mesmo!

9 ferramentas
xix.ai
Criação de quadrinhos As melhores ferramentas de balões de diálogo com IA para a narrativa visual
As melhores ferramentas de balões de diálogo com IA para a narrativa visual

As melhores e mais bem avaliadas ferramentas de balões de diálogo com IA para narrativa visual de 2026 já estão disponíveis no XIX.AI! Esta coleção selecionada apresenta ferramentas poderosas e revolucionárias que ajudam os criadores a aumentar a produtividade e superar gargalos criativos. Veja uma comparação entre versões gratuitas e pagas, confira testes reais e verifique os rankings mais recentes para encontrar as soluções imperdíveis, perfeitas para criar narrativas visuais envolventes. Explore agora e descubra sua ferramenta ideal!

10 ferramentas
xix.ai
Assistente de Reunião As melhores ferramentas de resumo de reuniões com IA: acompanhe decisões e ações de acompanhamento com clareza
As melhores ferramentas de resumo de reuniões com IA: acompanhe decisões e ações de acompanhamento com clareza

As melhores e mais bem avaliadas ferramentas de resumo de reuniões com IA de 2026 para um acompanhamento claro das decisões e acompanhamentos sem esforço. Esta lista selecionada apresenta soluções poderosas e revolucionárias que aumentam drasticamente a produtividade ao automatizar notas de reuniões, identificar ações-chave e otimizar a coordenação da equipe em todos os projetos. Veja uma comparação entre versões gratuitas e pagas, além de testes práticos e rankings atualizados semanalmente para ajudá-lo a encontrar a ferramenta perfeita. Explore agora para aproveitar ao máximo as vantagens da IA!

9 ferramentas
xix.ai
Análise de dados Melhores ferramentas de limpeza de dados com IA: corrija valores faltantes e duplicatas rapidamente
Melhores ferramentas de limpeza de dados com IA: corrija valores faltantes e duplicatas rapidamente

2026 – Os melhores e mais bem avaliados ferramentas de limpeza de dados com IA, atualizadas para corrigir rapidamente valores faltantes e duplicatas. Esta lista selecionada apresenta soluções poderosas e revolucionárias que aumentam significativamente a produtividade. Cada opção passou por testes rigorosos em condições reais para garantir sua confiabilidade. Acesse uma comparação gratuita entre as versões pagas e gratuitas e descubra a ferramenta indispensável que melhor atende às suas necessidades. Explore agora em XIX.AI para aproveitar todos os benefícios oferecidos pela IA.

11 ferramentas
xix.ai
Design e Arte Melhores Ferramentas de Ideação Criativa com IA para Artistas: Supere os Bloqueios Visuais
Melhores Ferramentas de Ideação Criativa com IA para Artistas: Supere os Bloqueios Visuais

2026 Últimas Melhores Ferramentas de Ideação Criativa com IA Mais Bem Avaliadas para Artistas são selecionadas pela XIX.AI para ajudar os criadores a superar bloqueios visuais e impulsionar a criatividade instantaneamente. Essas poderosas ferramentas transformadoras oferecem testes do mundo real, comparação detalhada entre gratuito e pago e classificações atualizadas semanalmente. Descubra sua ferramenta perfeita para acelerar a criação de conteúdo e desbloquear sua vantagem com IA hoje. Explore agora!

14 ferramentas
xix.ai
Comentários (2)
0/500
PaulThomas
PaulThomas 16 de Março de 2026 à13 02:01:13 WET

Это просто безумие! 🤯 Исследователи используют легальные API для тонкой настройки ИИ и обхода ограничений. Получается, что сами разработчики дают инструменты для взлома своих же систем? Насколько уязвимы тогда коммерческие AI-сервисы? Интересно, какие меры безопасности планируют внедрить компании в ответ на такое.

GeorgeJones
GeorgeJones 16 de Março de 2026 à44 00:01:44 WET

이 글을 보니까 정말 충격적이네요. ChatGPT 같은 AI 안전 시스템을 우회하는 방법이 있다니! 단순히 테스트를 위해 설계된 것같은데, 악용 가능성이 염려됩니다. AI 개발사들이 이를 어떻게 막을 계획인지 궁금해요. 이 연구 결과를 공유한 연구원들 덕분에 조기 경고를 받은 느낌이에요. 🔒🤔

OR