opção
Lar
Notícias
Os rostos sintéticos 'degradados' podem melhorar a tecnologia de reconhecimento facial

Os rostos sintéticos 'degradados' podem melhorar a tecnologia de reconhecimento facial

25 de Abril de 2025
199

Pesquisadores da Universidade Estadual de Michigan desenvolveram uma maneira inovadora de usar rostos sintéticos para uma causa nobre — melhorar a precisão dos sistemas de reconhecimento de imagens. Em vez de contribuir para o fenômeno das deepfakes, esses rostos sintéticos são projetados para imitar as imperfeições encontradas em filmagens de vigilância por vídeo do mundo real.

A equipe desenvolveu um Módulo de Síntese de Rostos Controlável (CFSM) que pode regenerar rostos em um estilo que reflete as falhas típicas dos sistemas de CFTV, como desfoque facial, baixa resolução e ruído do sensor. Essa abordagem difere do uso de imagens de celebridades de alta qualidade de conjuntos de dados populares, que não capturam os desafios do mundo real enfrentados pelos sistemas de reconhecimento facial.

Arquitetura conceitual para o Módulo de Síntese de Rostos Controlável (CFSM). Fonte: http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022.pdf*Arquitetura conceitual para o Módulo de Síntese de Rostos Controlável (CFSM).* Fonte: http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022.pdf

Diferentemente dos sistemas de deepfake que focam em replicar poses de cabeça e expressões, o CFSM visa gerar visões alternativas que correspondam ao estilo do sistema de reconhecimento alvo por meio de transferência de estilo. Este módulo é particularmente útil para adaptar sistemas legados que provavelmente não serão atualizados devido a restrições de custo, mas ainda precisam contribuir para tecnologias modernas de reconhecimento facial.

Ao testar o CFSM, os pesquisadores observaram melhorias significativas em sistemas de reconhecimento de imagens lidando com dados de baixa qualidade. Eles também descobriram um benefício inesperado: a capacidade de caracterizar e comparar conjuntos de dados alvo, simplificando o processo de benchmarking e criação de conjuntos de dados personalizados para vários sistemas de CFTV.

Treinamento de modelos de reconhecimento facial para se adaptarem às limitações dos sistemas alvo. Fonte: http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022_supp.pdf*Treinamento de modelos de reconhecimento facial para se adaptarem às limitações dos sistemas alvo.* Fonte: http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022_supp.pdf

O método também pode ser aplicado a conjuntos de dados existentes, realizando adaptação de domínio para torná-los mais adequados para reconhecimento facial. A pesquisa, intitulada **Síntese de Rostos Controlável e Guiada para Reconhecimento Facial Irrestrito**, é parcialmente apoiada pelo Escritório do Diretor de Inteligência Nacional dos EUA (ODNI, na IARPA) e envolve quatro pesquisadores do departamento de Ciência da Computação e Engenharia da MSU.

Reconhecimento Facial de Baixa Qualidade: Um Campo em Crescimento

Nos últimos anos, o reconhecimento facial de baixa qualidade (LQFR) emergiu como uma área significativa de estudo. Muitos sistemas de vigilância por vídeo mais antigos, construídos para serem duráveis e de longa duração, tornaram-se obsoletos e lutam para servir como fontes de dados eficazes para aprendizado de máquina devido a dívidas técnicas.

Níveis variados de resolução facial em uma gama de sistemas de vigilância por vídeo históricos e mais recentes. Fonte: https://arxiv.org/pdf/1805.11519.pdfNíveis variados de resolução facial em uma gama de sistemas de vigilância por vídeo históricos e mais recentes. Fonte: https://arxiv.org/pdf/1805.11519.pdf

Felizmente, modelos de difusão e outros modelos baseados em ruído são adequados para abordar esse problema. Muitos dos mais recentes sistemas de síntese de imagens incluem a ampliação de imagens de baixa resolução como parte de seu processo, o que também é crucial para técnicas de compressão neural.

O desafio no reconhecimento facial é maximizar a precisão com o menor número possível de características extraídas de imagens de baixa resolução. Isso não é útil apenas para identificar rostos em baixa resolução, mas também necessário devido às limitações no tamanho da imagem no espaço latente dos modelos de treinamento.

Em visão computacional, 'características' referem-se a características distintivas de qualquer imagem, não apenas rostos. Com o avanço nos algoritmos de ampliação, várias métodos foram propostos para melhorar filmagens de vigilância de baixa resolução, potencialmente tornando-as utilizáveis para fins legais, como investigações de cenas de crime.

No entanto, há um risco de identificação errada, e idealmente, os sistemas de reconhecimento facial não deveriam exigir imagens de alta resolução para fazer identificações precisas. Essas transformações são custosas e levantam questões sobre sua validade e legalidade.

A Necessidade de Mais Celebridades 'Desgastadas'

Seria mais benéfico se os sistemas de reconhecimento facial pudessem extrair características diretamente da saída de sistemas legados sem a necessidade de transformar as imagens. Isso requer um melhor entendimento da relação entre identidades de alta resolução e as imagens degradadas de sistemas de vigilância existentes.

O problema está nos padrões: conjuntos de dados como MS-Celeb-1M e WebFace260M são amplamente utilizados porque fornecem referências consistentes. No entanto, os autores argumentam que algoritmos de reconhecimento facial treinados nesses conjuntos de dados não são adequados para os domínios visuais de sistemas de vigilância mais antigos.

Exemplos do popular conjunto de dados MS-Celeb1m da Microsoft. Fonte: https://www.microsoft.com/en-us/research/project/ms-celeb-1m-challenge-recognizing-one-million-celebrities-real-world/*Exemplos do popular conjunto de dados MS-Celeb1m da Microsoft.* Fonte: https://www.microsoft.com/en-us/research/project/ms-celeb-1m-challenge-recognizing-one-million-celebrities-real-world/

O artigo destaca que modelos de reconhecimento facial de ponta lutam com imagens de vigilância do mundo real devido a problemas de mudança de domínio. Esses modelos são treinados em conjuntos de dados semi-restritos que carecem das variações encontradas em cenários do mundo real, como ruído do sensor e desfoque de movimento.

Métodos anteriores tentaram corresponder às saídas de sistemas de vigilância históricos ou de baixo custo, mas essas eram ampliações 'cegas'. Em contraste, o CFSM usa feedback direto do sistema alvo durante o treinamento e adapta-se por meio de transferência de estilo para imitar esse domínio.

Atriz Natalie Portman, não estranha aos poucos conjuntos de dados que dominam a comunidade de visão computacional, aparece entre as identidades neste exemplo de CFSM realizando adaptação de domínio correspondente ao estilo com base no feedback do domínio do modelo alvo real.*Atriz Natalie Portman, não estranha aos poucos conjuntos de dados que dominam a comunidade de visão computacional, aparece entre as identidades neste exemplo de CFSM realizando adaptação de domínio correspondente ao estilo com base no feedback do domínio do modelo alvo real.*

A arquitetura dos autores usa o Método do Sinal de Gradiente Rápido (FGSM) para importar estilos e características da saída do sistema alvo. À medida que o treinamento avança, a parte de geração de imagens do pipeline torna-se mais fiel ao sistema alvo, melhorando o desempenho e as capacidades de generalização do reconhecimento facial.

Testes e Resultados

Os pesquisadores testaram o CFSM usando trabalhos anteriores da MSU como modelo, empregando MS-Celeb-1m e MS1M-V2 como conjuntos de dados de treinamento. Os dados alvo foram o conjunto WiderFace da Universidade Chinesa de Hong Kong, projetado para detecção de rostos em situações desafiadoras.

O sistema foi avaliado contra quatro referências de reconhecimento facial: IJB-B, IJB-C, IJB-S e TinyFace. O CFSM foi treinado com cerca de 10% dos dados do MS-Celeb-1m, cerca de 0,4 milhão de imagens, por 125.000 iterações com um tamanho de lote de 32 usando o otimizador Adam com uma taxa de aprendizado de 1e-4.

O modelo de reconhecimento facial alvo usou um ResNet-50 modificado com a função de perda ArcFace. Um modelo adicional foi treinado com CFSM para comparação, rotulado como 'ArcFace' nos resultados.

Resultados dos testes primários para o CFSM. Números mais altos são melhores.*Resultados dos testes primários para o CFSM. Números mais altos são melhores.*

Os resultados mostraram que o modelo ArcFace, aprimorado pelo CFSM, superou todas as linhas de base em tarefas de identificação e verificação facial, alcançando um novo desempenho de ponta.

A capacidade de extrair domínios de várias características de sistemas de vigilância legados também permite comparar e avaliar a similaridade de distribuição entre esses sistemas, apresentando cada um em termos de um estilo visual que pode ser aproveitado em trabalhos futuros.

Exemplos de vários conjuntos de dados exibem diferenças claras de estilo.*Exemplos de vários conjuntos de dados exibem diferenças claras de estilo.*

Os autores também observaram que o CFSM demonstra como a manipulação adversária pode ser usada para aumentar as precisões de reconhecimento em tarefas de visão. Eles introduziram uma métrica de similaridade de conjunto de dados baseada em bases de estilo aprendidas, capturando diferenças de estilo de maneira agnóstica a rótulos ou preditores.

A pesquisa destaca o potencial de modelos de síntese de rostos controláveis e guiados para reconhecimento facial irrestrito e fornece insights sobre diferenças de conjuntos de dados.

Artigo relacionado
A Bayer utiliza a Iambic AI para acelerar a descoberta de medicamentos A Bayer utiliza a Iambic AI para acelerar a descoberta de medicamentos O Dr. Juergen Eckhardt atua como chefe de Desenvolvimento de Negócios e Licenciamento da Bayer Pharmaceuticals.A Bayer está aproveitando a Iambic Therapeutics para implementar modelos de IA de ponta n
A IA orientada para a otimização surge como um novo caminho para modelos de uso geral A IA orientada para a otimização surge como um novo caminho para modelos de uso geral Pesquisadores da Universidade de Illinois Urbana-Champaign e da Universidade da Virgínia criaram uma nova arquitetura de modelo que pode abrir caminho para sistemas de IA mais resilientes com maior ca
O boom da IA ecoa as preocupações com a bolha da era das pontocom O boom da IA ecoa as preocupações com a bolha da era das pontocom O influxo de investimentos multimilionários em IA alimentou um debate acalorado: o setor está caminhando para uma bolha semelhante à das empresas ponto com?Os investidores estão atentos a qualquer arr
Recomendações de tópicos especiais relacionados
Criação de vídeo Geradores de ganchos para vídeos curtos com IA para Reels, Shorts e campanhas de lançamento de produtos
Geradores de ganchos para vídeos curtos com IA para Reels, Shorts e campanhas de lançamento de produtos

Os melhores geradores de ganchos para vídeos curtos com IA de 2026 para Reels, Shorts e campanhas de lançamento de produtos! A XIX.AI seleciona as ferramentas mais bem avaliadas, poderosas e revolucionárias, que oferecem resultados imperdíveis comprovados por testes reais. Esta página, atualizada semanalmente, apresenta rankings comparativos entre opções gratuitas e pagas para ajudar você a encontrar a solução perfeita para impulsionar a criatividade e a produtividade do seu conteúdo. Explore agora para descobrir sua vantagem com IA!

11 ferramentas
xix.ai
escrita Ferramentas de IA para esboço de artigos em formato longo
Ferramentas de IA para esboço de artigos em formato longo

2026: As melhores e mais bem avaliadas ferramentas de esboço com IA para redação de textos longos! Esta coleção selecionada apresenta ferramentas poderosas e revolucionárias que geram esboços precisos e estruturados, comprovados em testes reais, para aumentar significativamente a eficiência na redação. A XIX.AI faz parte dessa seleção de elite. Veja uma comparação entre as versões gratuita e paga para ajudá-lo a escolher a ferramenta perfeita. Explore agora e descubra sua vantagem com a IA!

9 ferramentas
xix.ai
chatbot Melhores aplicativos de chat de interpretação de papéis com IA para prática de idiomas, preparação para entrevistas e fluência diária
Melhores aplicativos de chat de interpretação de papéis com IA para prática de idiomas, preparação para entrevistas e fluência diária

2026 Últimas Melhores Aplicativos de Chat de Interpretação de Papéis por IA Mais Bem Avaliados para Prática de Idiomas, Preparação para Entrevistas e Fluência Diária! O XIX.AI seleciona uma poderosa coleção revolucionária que oferece comparação entre gratuito e pago, testes do mundo real e classificações atualizadas semanalmente. Essas ferramentas imperdíveis ajudam você a aprimorar suas habilidades de escrita, superar desafios de fluência e melhorar a eficiência da comunicação em todos os cenários diários. Explore agora para descobrir sua ferramenta perfeita para o crescimento do idioma!

10 ferramentas
xix.ai
Composição musical Ferramentas de separação de stems com IA para produção de remixes, preparação de samples e masters de karaokê
Ferramentas de separação de stems com IA para produção de remixes, preparação de samples e masters de karaokê

As melhores e mais bem avaliadas ferramentas de separação de faixas com IA de 2026, selecionadas especialmente para produção de remixes, preparação de samples e masters de karaokê. Essas ferramentas poderosas e revolucionárias passaram por testes práticos para oferecer isolamento de áudio preciso, aumentando significativamente a produtividade. A XIX.AI oferece um guia comparativo entre versões gratuitas e pagas, atualizado semanalmente, para ajudá-lo a encontrar a solução imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Análise de dados Copilotos de IA para SQL voltados para painéis de receita, análise de funis e métricas de produtos
Copilotos de IA para SQL voltados para painéis de receita, análise de funis e métricas de produtos

2026: Os melhores copilotos AI para SQL, atualizados e classificados entre os melhores! A XIX.AI reúne uma coleção poderosa e revolucionária, com testes em ambiente real atualizados semanalmente. Essas ferramentas indispensáveis ajudam a gerar painéis de controle de receita precisos, analisar funis de vendas e rastrear métricas de produtos de forma rápida, aumentando significativamente a produtividade. Explore agora e encontre a ferramenta perfeita para tomada de decisões baseadas em dados! 238 caracteres

9 ferramentas
xix.ai
Composição musical Melhores Ferramentas de IA para Criação de Melodias para Rascunhos de Músicas
Melhores Ferramentas de IA para Criação de Melodias para Rascunhos de Músicas

2026 Últimas Melhores Ferramentas de Escrita de Melodias por IA Mais Bem Avaliadas para Rascunhos de Músicas! A XIX.AI reuniu uma coleção altamente poderosa e transformadora, que passou por rigorosos testes no mundo real para oferecer a melhor experiência de escrita. Você pode encontrar comparações detalhadas entre as versões gratuita e paga, classificações precisas e opções imperdíveis projetadas para ajudá-lo a criar rascunhos de músicas impressionantes sem esforço e aumentar significativamente sua produtividade criativa. Explore agora para descobrir a ferramenta perfeita para você!

8 ferramentas
xix.ai
Comentários (13)
0/500
PaulThomas
PaulThomas 18 de Março de 2026 à59 22:00:59 WET

Интересный подход! Создание синтетических лиц с 'деградацией' для улучшения распознавания — звучит парадоксально, но логично. В России такие технологии могли бы помочь в системах видеонаблюдения, но вызывает опасения потенциальное использование не по назначению. Надеюсь, разработчики предусмотрели защитные механизмы.

MateoAdams
MateoAdams 16 de Setembro de 2025 à39 21:30:39 WEST

실제 얼굴의 불완전함을 모방한 합성 이미지라니... 정말 흥미로운 접근이네요! 🤯 근데 이 기술이 악용되지 않을까 조금 걱정되기도 해요. 얼굴인식 시스템의 정확도를 높이는 건 좋지만, 동시에 보안 문제도 신경써야 할 것 같아요.

TimothyEvans
TimothyEvans 23 de Agosto de 2025 à18 14:01:18 WEST

This is wild! Synthetic faces to boost facial recognition? I’m all for better tech, but I hope they keep an eye on privacy issues. 😎

LarryWilliams
LarryWilliams 27 de Abril de 2025 à26 08:58:26 WEST

C'est une initiative fascinante pour améliorer la reconnaissance faciale. Utiliser des visages synthétiques plutôt que de contribuer aux deepfakes est une bonne chose. J'espère qu'ils y arriveront bien. 😊🧐

CharlesJohnson
CharlesJohnson 27 de Abril de 2025 à41 08:57:41 WEST

¡Qué genial usar caras sintéticas para mejorar el reconocimiento facial! Me encanta que la tecnología se use para algo bueno y no para deepfakes. Lo único es que podría ser más fácil de usar, pero de todos modos, ¡innovación de primera! 👌

MatthewGonzalez
MatthewGonzalez 26 de Abril de 2025 à32 21:27:32 WEST

Que ideia genial usar faces sintéticas para melhorar o reconhecimento facial! Adoro que a tecnologia esteja sendo usada para o bem, e não para deepfakes. A única coisa é que poderia ser mais fácil de usar, mas ainda assim, inovação top! 👍

OR