option
Maison
Nouvelles
Les visages synthétiques «dégradés» peuvent améliorer la technologie de reconnaissance faciale

Les visages synthétiques «dégradés» peuvent améliorer la technologie de reconnaissance faciale

25 avril 2025
199

Des chercheurs de l'Université d'État du Michigan ont mis au point une méthode innovante pour utiliser des visages synthétiques dans une noble cause : améliorer la précision des systèmes de reconnaissance d'images. Au lieu de contribuer au phénomène des deepfakes, ces visages synthétiques sont conçus pour imiter les imperfections présentes dans les séquences de surveillance vidéo du monde réel.

L'équipe a développé un Module de Synthèse de Visages Contrôlable (CFSM) capable de régénérer des visages dans un style reflétant les défauts typiques des systèmes de vidéosurveillance, tels que le flou facial, la basse résolution et le bruit des capteurs. Cette approche diffère de l'utilisation d'images de célébrités de haute qualité provenant de datasets populaires, qui ne capturent pas les défis du monde réel rencontrés par les systèmes de reconnaissance faciale.

Architecture conceptuelle du Module de Synthèse de Visages Contrôlable (CFSM). Source : http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022.pdf*Architecture conceptuelle du Module de Synthèse de Visages Contrôlable (CFSM).* Source : http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022.pdf

Contrairement aux systèmes de deepfake qui se concentrent sur la réplication des poses de tête et des expressions, le CFSM vise à générer des vues alternatives correspondant au style du système de reconnaissance cible grâce au transfert de style. Ce module est particulièrement utile pour s'adapter aux systèmes hérités qui ne seront probablement pas mis à niveau en raison de contraintes budgétaires, mais qui doivent néanmoins contribuer aux technologies modernes de reconnaissance faciale.

Lors des tests du CFSM, les chercheurs ont observé des améliorations significatives dans les systèmes de reconnaissance d'images traitant des données de basse qualité. Ils ont également découvert un avantage inattendu : la capacité à caractériser et comparer les datasets cibles, ce qui simplifie le processus d'évaluation comparative et de création de datasets adaptés à divers systèmes de vidéosurveillance.

Entraînement des modèles de reconnaissance faciale pour s'adapter aux limitations des systèmes cibles. Source : http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022_supp.pdf*Entraînement des modèles de reconnaissance faciale pour s'adapter aux limitations des systèmes cibles.* Source : http://cvlab.cse.msu.edu/pdfs/Liu_Kim_Jain_Liu_ECCV2022_supp.pdf

La méthode peut également être appliquée aux datasets existants, effectuant une adaptation de domaine pour les rendre plus adaptés à la reconnaissance faciale. La recherche, intitulée **Synthèse de Visages Contrôlable et Guidée pour la Reconnaissance Faciale Non Contrôlée**, est partiellement soutenue par le Bureau du Directeur du Renseignement National des États-Unis (ODNI, à IARPA) et implique quatre chercheurs du département d'informatique et d'ingénierie de MSU.

Reconnaissance Faciale de Basse Qualité : Un Domaine en Croissance

Au cours des dernières années, la reconnaissance faciale de basse qualité (LQFR) est devenue un domaine d'étude important. De nombreux systèmes de vidéosurveillance plus anciens, conçus pour être durables et à longue durée de vie, sont devenus obsolètes et peinent à servir de sources de données efficaces pour l'apprentissage automatique en raison de la dette technique.

Niveaux variables de résolution faciale à travers une gamme de systèmes de vidéosurveillance historiques et plus récents. Source : https://arxiv.org/pdf/1805.11519.pdfNiveaux variables de résolution faciale à travers une gamme de systèmes de vidéosurveillance historiques et plus récents. Source : https://arxiv.org/pdf/1805.11519.pdf

Heureusement, les modèles de diffusion et autres modèles basés sur le bruit sont bien adaptés pour résoudre ce problème. De nombreux systèmes de synthèse d'images les plus récents incluent l'agrandissement d'images à basse résolution dans leur processus, ce qui est également crucial pour les techniques de compression neurale.

Le défi de la reconnaissance faciale est de maximiser la précision avec le moins de caractéristiques possibles extraites des images à basse résolution. Cela est non seulement utile pour identifier les visages à basse résolution, mais aussi nécessaire en raison des limitations de taille d'image dans l'espace latent des modèles d'entraînement.

En vision par ordinateur, les « caractéristiques » font référence aux traits distinctifs de n'importe quelle image, pas seulement des visages. Avec l'avancement des algorithmes d'agrandissement, diverses méthodes ont été proposées pour améliorer les séquences de surveillance à basse résolution, les rendant potentiellement utilisables à des fins légales comme les enquêtes sur les scènes de crime.

Cependant, il existe un risque d'erreur d'identification, et idéalement, les systèmes de reconnaissance faciale ne devraient pas nécessiter d'images à haute résolution pour effectuer des identifications précises. De telles transformations sont coûteuses et soulèvent des questions sur leur validité et leur légalité.

Le Besoin de Célébrités Plus « Usées »

Il serait plus bénéfique que les systèmes de reconnaissance faciale puissent extraire des caractéristiques directement à partir de la sortie des systèmes hérités sans avoir besoin de transformer les images. Cela nécessite une meilleure compréhension de la relation entre les identités à haute résolution et les images dégradées des systèmes de surveillance existants.

Le problème réside dans les normes : des datasets comme MS-Celeb-1M et WebFace260M sont largement utilisés car ils offrent des références cohérentes. Cependant, les auteurs soutiennent que les algorithmes de reconnaissance faciale entraînés sur ces datasets ne sont pas adaptés aux domaines visuels des systèmes de surveillance plus anciens.

Exemples du dataset populaire MS-Celeb1m de Microsoft. Source : https://www.microsoft.com/en-us/research/project/ms-celeb-1m-challenge-recognizing-one-million-celebrities-real-world/*Exemples du dataset populaire MS-Celeb1m de Microsoft.* Source : https://www.microsoft.com/en-us/research/project/ms-celeb-1m-challenge-recognizing-one-million-celebrities-real-world/

Le document souligne que les modèles de reconnaissance faciale de pointe ont du mal avec les images de surveillance du monde réel en raison de problèmes de décalage de domaine. Ces modèles sont entraînés sur des datasets semi-contraints qui manquent des variations trouvées dans les scénarios réels, comme le bruit des capteurs et le flou de mouvement.

Les méthodes précédentes ont tenté de correspondre aux sorties des systèmes de surveillance historiques ou à faible coût, mais il s'agissait d'augmentations « aveugles ». En revanche, le CFSM utilise un retour direct du système cible pendant l'entraînement et s'adapte via un transfert de style pour imiter ce domaine.

L'actrice Natalie Portman, bien connue des quelques datasets qui dominent la communauté de la vision par ordinateur, figure parmi les identités dans cet exemple de CFSM effectuant une adaptation de domaine basée sur le style, en fonction du retour du domaine du modèle cible réel.*L'actrice Natalie Portman, bien connue des quelques datasets qui dominent la communauté de la vision par ordinateur, figure parmi les identités dans cet exemple de CFSM effectuant une adaptation de domaine basée sur le style, en fonction du retour du domaine du modèle cible réel.*

L'architecture des auteurs utilise la Méthode du Signe de Gradient Rapide (FGSM) pour importer les styles et les caractéristiques de la sortie du système cible. À mesure que l'entraînement progresse, la partie de génération d'images du pipeline devient plus fidèle au système cible, améliorant les performances de reconnaissance faciale et les capacités de généralisation.

Tests et Résultats

Les chercheurs ont testé le CFSM en utilisant les travaux antérieurs de MSU comme modèle, en employant MS-Celeb-1m et MS1M-V2 comme datasets d'entraînement. Les données cibles étaient le dataset WiderFace de l'Université chinoise de Hong Kong, conçu pour la détection de visages dans des situations difficiles.

Le système a été évalué par rapport à quatre benchmarks de reconnaissance faciale : IJB-B, IJB-C, IJB-S et TinyFace. Le CFSM a été entraîné avec environ 10 % des données de MS-Celeb-1m, soit environ 0,4 million d'images, pendant 125 000 itérations avec une taille de lot de 32, en utilisant l'optimiseur Adam avec un taux d'apprentissage de 1e-4.

Le modèle de reconnaissance faciale cible utilisait un ResNet-50 modifié avec une fonction de perte ArcFace. Un modèle supplémentaire a été entraîné avec le CFSM pour comparaison, étiqueté comme « ArcFace » dans les résultats.

Résultats des tests principaux pour le CFSM. Des nombres plus élevés sont préférables.*Résultats des tests principaux pour le CFSM. Des nombres plus élevés sont préférables.*

Les résultats ont montré que le modèle ArcFace, amélioré par le CFSM, a surpassé toutes les références dans les tâches d'identification et de vérification des visages, atteignant une performance de pointe.

La capacité à extraire des domaines à partir de diverses caractéristiques des systèmes de surveillance hérités permet également de comparer et d'évaluer la similarité de distribution parmi ces systèmes, en les présentant chacun en termes de style visuel qui peut être exploité dans les travaux futurs.

Exemples de divers datasets montrent des différences claires de style.*Exemples de divers datasets montrent des différences claires de style.*

Les auteurs ont également noté que le CFSM démontre comment la manipulation adversariale peut être utilisée pour augmenter la précision de la reconnaissance dans les tâches de vision. Ils ont introduit une métrique de similarité de dataset basée sur des bases de style apprises, capturant les différences de style de manière agnostique par rapport aux étiquettes ou aux prédicteurs.

La recherche souligne le potentiel des modèles de synthèse de visages contrôlables et guidés pour la reconnaissance faciale non contrainte et fournit des insights sur les différences entre datasets.

Article connexe
Bayer s'appuie sur Iambic AI pour accélérer la découverte de médicaments Bayer s'appuie sur Iambic AI pour accélérer la découverte de médicaments Le Dr Juergen Eckhardt occupe le poste de responsable du développement commercial et des licences chez Bayer Pharmaceuticals.Bayer s'appuie sur Iambic Therapeutics pour déployer des modèles d'IA de po
L'IA axée sur l'optimisation apparaît comme une nouvelle voie vers des modèles à usage général L'IA axée sur l'optimisation apparaît comme une nouvelle voie vers des modèles à usage général Des chercheurs de l'université de l'Illinois à Urbana-Champaign et de l'université de Virginie ont créé une nouvelle architecture de modèle qui pourrait ouvrir la voie à des systèmes d'IA plus résilie
Le boom de l'IA fait écho aux inquiétudes liées à la bulle Internet Le boom de l'IA fait écho aux inquiétudes liées à la bulle Internet L'afflux d'investissements de plusieurs milliards de dollars dans l'IA a alimenté un débat houleux : le secteur se dirige-t-il vers une bulle spéculative similaire à celle des dot-com ?Les investisseu
Recommandations de sujets spéciaux liés
chatbot Meilleures applications de chat de jeu de rôle par IA pour la pratique des langues, la préparation aux entretiens et la fluidité quotidienne
Meilleures applications de chat de jeu de rôle par IA pour la pratique des langues, la préparation aux entretiens et la fluidité quotidienne

2026 Dernières Meilleures Applications de Chat IA pour le Jeu de Rôle, les plus bien notées pour la Pratique des Langues, la Préparation aux Entretiens et la Fluidité Quotidienne ! XIX.AI sélectionne une collection puissante et révolutionnaire qui propose une comparaison gratuit vs payant, des tests en conditions réelles et des classements mis à jour chaque semaine. Ces outils à essayer absolument vous aident à améliorer vos compétences en écriture, à surmonter les défis de fluidité et à optimiser l’efficacité de la communication dans tous les scénarios quotidiens. Explorez dès maintenant pour découvrir l’outil parfait pour votre progression linguistique !

10 outils
xix.ai
Composition musicale Outils de séparation des pistes audio par IA pour la production de remix, la préparation de samples et les masters de karaoké
Outils de séparation des pistes audio par IA pour la production de remix, la préparation de samples et les masters de karaoké

2026 : Les meilleures et plus récentes outils de séparation des pistes audio par IA, hautement notés, sélectionnés spécialement pour la production de remix, la préparation de samples et l’enregistrement de karaokés. Ces outils puissants et révolutionnaires, éprouvés dans des conditions réelles, permettent une isolation audio précise, ce qui améliore considérablement la productivité. XIX.AI propose un guide de comparaison gratuit mis à jour chaque semaine entre les versions payantes et gratuites, afin de vous aider à trouver la solution idéale adaptée à vos besoins. Découvrez-les dès maintenant pour tirer parti des avantages offerts par l’IA.

8 outils
xix.ai
Analyse des données Copilotes SQL basés sur l’IA pour les tableaux de bord de chiffre d’affaires, l’analyse des funnels et les indicateurs de produits
Copilotes SQL basés sur l’IA pour les tableaux de bord de chiffre d’affaires, l’analyse des funnels et les indicateurs de produits

2026 : Les meilleurs copilotes AI SQL actuels, classés parmi les plus performants ! XIX.AI a sélectionné une collection puissante et révolutionnaire, mise à jour chaque semaine grâce à des tests concrets. Ces outils indispensables vous aident à créer des tableaux de bord financiers précis, à analyser les canaux de vente et à suivre en temps réel les indicateurs produits, ce qui améliore considérablement votre productivité. Découvrez-les dès maintenant pour trouver l’outil idéal pour des décisions basées sur les données ! 238 caractères

9 outils
xix.ai
Composition musicale Meilleurs outils d’écriture de mélodies par IA pour les ébauches de chansons
Meilleurs outils d’écriture de mélodies par IA pour les ébauches de chansons

2026 Derniers Meilleurs Outils d’Écriture de Mélodie par IA les Mieux Notés pour des Ébauches de Chansons ! XIX.AI a sélectionné une collection hautement puissante et révolutionnaire, soumise à des tests rigoureux en conditions réelles, afin d’offrir la meilleure expérience d’écriture. Vous pouvez y trouver des comparaisons détaillées entre versions gratuites et payantes, des classements précis, ainsi que des options incontournables conçues pour vous aider à créer sans effort des ébauches de chansons remarquables et à booster significativement votre productivité créative. Explorez dès maintenant pour découvrir l’outil qui vous correspond parfaitement !

8 outils
xix.ai
chatbot Meilleurs outils d’entraînement à la conversation par IA pour la préparation aux entretiens
Meilleurs outils d’entraînement à la conversation par IA pour la préparation aux entretiens

Les derniers outils de formation à la conversation par IA les mieux notés pour 2026 sont disponibles sur XIX.AI ! Cette sélection rigoureuse propose des outils puissants et révolutionnaires, testés rigoureusement dans des conditions réelles pour fournir des retours précis. Vous y trouverez une comparaison entre les versions gratuites et payantes, ainsi que des classements détaillés pour vous aider à choisir l’option incontournable qui renforce votre confiance et vos compétences. Explorez dès maintenant pour découvrir l’outil parfait pour réussir vos entretiens !

12 outils
xix.ai
Conception et art Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives
Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives

Les meilleurs outils de transfert de style par IA de 2026, les mieux notés, pour des expériences créatives ! XIX.AI a sélectionné une collection d’outils puissants et révolutionnaires à essayer absolument, qui offrent des résultats exceptionnels grâce à des tests en conditions réelles et à un classement rigoureux. Ces solutions de pointe aident les créatifs à booster considérablement leur productivité en accélérant la création de contenu et en ouvrant la voie à des possibilités créatives infinies. Découvrez-les dès maintenant pour trouver l'outil qui vous convient le mieux et commencez à créer dès aujourd'hui !

9 outils
xix.ai
commentaires (13)
0/500
PaulThomas
PaulThomas 18 mars 2026 23:00:59 UTC+01:00

Интересный подход! Создание синтетических лиц с 'деградацией' для улучшения распознавания — звучит парадоксально, но логично. В России такие технологии могли бы помочь в системах видеонаблюдения, но вызывает опасения потенциальное использование не по назначению. Надеюсь, разработчики предусмотрели защитные механизмы.

MateoAdams
MateoAdams 16 septembre 2025 22:30:39 UTC+02:00

실제 얼굴의 불완전함을 모방한 합성 이미지라니... 정말 흥미로운 접근이네요! 🤯 근데 이 기술이 악용되지 않을까 조금 걱정되기도 해요. 얼굴인식 시스템의 정확도를 높이는 건 좋지만, 동시에 보안 문제도 신경써야 할 것 같아요.

TimothyEvans
TimothyEvans 23 août 2025 15:01:18 UTC+02:00

This is wild! Synthetic faces to boost facial recognition? I’m all for better tech, but I hope they keep an eye on privacy issues. 😎

LarryWilliams
LarryWilliams 27 avril 2025 09:58:26 UTC+02:00

C'est une initiative fascinante pour améliorer la reconnaissance faciale. Utiliser des visages synthétiques plutôt que de contribuer aux deepfakes est une bonne chose. J'espère qu'ils y arriveront bien. 😊🧐

CharlesJohnson
CharlesJohnson 27 avril 2025 09:57:41 UTC+02:00

¡Qué genial usar caras sintéticas para mejorar el reconocimiento facial! Me encanta que la tecnología se use para algo bueno y no para deepfakes. Lo único es que podría ser más fácil de usar, pero de todos modos, ¡innovación de primera! 👌

MatthewGonzalez
MatthewGonzalez 26 avril 2025 22:27:32 UTC+02:00

Que ideia genial usar faces sintéticas para melhorar o reconhecimento facial! Adoro que a tecnologia esteja sendo usada para o bem, e não para deepfakes. A única coisa é que poderia ser mais fácil de usar, mas ainda assim, inovação top! 👍

OR