L'équipe principale de GPT Image2, composée de 13 membres, dévoilée après quatre mois de refonte

Maison

Nouvelles

20 mai 2026

AlbertThomas

Récemment, GPT Image2 a fait sensation sur les réseaux sociaux grâce à sa capacité à générer des images d'un réalisme saisissant. Alors que la popularité du projet montait en flèche, la petite équipe discrète à l'origine de ce succès s'est retrouvée sous les feux de la rampe. Selon les informations disponibles, l'équipe principale ne compte que 13 personnes, qui ont réussi à réécrire entièrement l'architecture sous-jacente en seulement quatre mois. Bien que le responsable de la recherche, Chen Boyuan, n'ait pas divulgué de détails techniques spécifiques, il décrit ce nouveau modèle comme « le GPT du domaine visuel », annonçant ainsi un bond en avant majeur en matière de capacités polyvalentes.

La figure clé de l'équipe, Chen Boyuan, a un parcours personnel remarquable. Au cours de son doctorat, il a été le pionnier d'approches innovantes telles que le « Diffusion Forcing » et a contribué aux techniques d'ajustement des instructions adoptées par la suite par Gemini 2.0 de Google. Il est intéressant de noter qu'il ne connaissait même pas Python lorsqu'il a rejoint pour la première fois un camp scientifique au lycée. Après avoir rejoint OpenAI, il a non seulement dirigé l’ensemble de la formation du modèle d’image GPT, mais a également été un membre clé de l’équipe de génération vidéo Sora. Lors d’une démonstration, il a mis en avant la compréhension linguistique avancée du modèle en générant des affiches avec du texte parfaitement rendu en chinois, en coréen et en bengali.

Au-delà du rendu de texte, GPT Image2 a atteint de nouveaux sommets dans la compréhension des connaissances du monde et le suivi d'instructions complexes. Ce module, dirigé par le Dr Jianfeng Wang de l'Université des sciences et technologies de Chine, s'attaque à un problème récurrent dans la génération d'images par IA — comme le fait que les anciens modèles dessinaient toujours par défaut des horloges à 10 h 10. Le nouveau modèle interprète avec précision toute heure spécifiée et toute disposition spatiale complexe. Le Dr Wang souligne que le modèle comble efficacement le fossé entre la vision créative de l'utilisateur et le résultat final généré.

En matière de productivité, Yuguang Yang, du Zhuyuan College de l'université du Zhejiang, a présenté la capacité de l'outil à convertir instantanément de longs articles de recherche en présentations PowerPoint et en infographies de haute précision. Cette capacité découle de l'intégration poussée par l'équipe de la compréhension multimodale, de l'architecture Mixture of Experts (MoE) et de la technologie de guidage à long contexte.

Du DALL-E original au GPT Image2 d'aujourd'hui

Article connexe

Le MIIT sollicite les avis du public concernant 121 normes industrielles, y compris le protocole de contexte pour les modèles d'intelligence artificielle. Le ministère de l’Industrie et de l’Information technologique de la Chine a officiellement publié une annonce demandant aux citoyens de donner leur avis sur 121 projets de normalisation industrielle, y compris les “Exigences en matière de sécurité ap

OpenAI s’allie avec le Département de la Défense des États-Unis ; les installations de ChatGPT augmentent de 295 %. Indignation du public : La collaboration militaire d’OpenAI déclenche une vague de désinstallationsRécemment, le leader de l’intelligence artificielle OpenAI a annoncé un partenariat étroit avec le Département de la Défense des États-Unis, intégrant

OpenAI lance la fonctionnalité « Sites », marquant la fin de l'ère du « no-code » avec des sites web créés à partir de texte OpenAI a lancé « Sites », une nouvelle fonctionnalité pour Codex, son outil d'IA dédié à l'ingénierie logicielle. Actuellement en phase de préversion, elle n'est accessible qu'aux abonnés payants des

Recommandations de sujets spéciaux liés

Éducation et apprentissage

Meilleurs outils d'entraînement par répétition espacée avec intelligence artificielle : optimisez vos programmes d'études pour les étudiants en médecine et en droit

Découvrez les meilleurs outils d’entraînement par répétition espacée en AI pour 2026, sélectionnés par XIX.AI. Nos choix phares, révolutionnaires dans leur domaine, aident les étudiants en médecine et en droit à optimiser leurs programmes de révision afin d’améliorer leur mémorisation. Comparez les options gratuites et payantes grâce à des tests concrets et aux classements mis à jour chaque semaine. Développez rapidement un avantage dans votre apprentissage.

10 outils

xix.ai

Création vidéo

Les meilleures plateformes d'IA de conversion de texte en vidéo pour la rédaction de scénarios et la narration visuelle

Les meilleures plateformes d'IA de conversion de texte en vidéo en 2026 : les outils les mieux notés pour la rédaction de scénarios et la narration visuelle. Découvrez des solutions puissantes et révolutionnaires pour transformer votre texte en vidéos captivantes. Comparez les options gratuites et payantes grâce à nos classements mis à jour chaque semaine et à nos tests en conditions réelles. Trouvez la plateforme idéale pour booster votre créativité et votre productivité. Découvrez notre sélection soigneusement choisie sur XIX.AI.

10 outils

xix.ai

chatbot

Orchestrateurs multi-agents AI : Concevoir des flux de travail automatisés complexes à l'aide du langage naturel

Dernières informations de 2026 : Découvrez les meilleurs outils d’orchestration multi-agent basés sur l’intelligence artificielle pour concevoir des workflows automatisés complexes à l’aide du langage naturel. Notre sélection révèle des plateformes reconnues et puissantes, idéales pour une automation des tâches sans faille et une gestion intelligente des processus. Comparez les options gratuites et payantes en vous basant sur des données issues du monde réel. Optimisez vos performances grâce aux classements mis à jour chaque semaine par les experts de XIX.AI.

10 outils

xix.ai

Édition d'images

Meilleurs logiciels d'optimisation du bruit par intelligence artificielle : éliminez les grains et les artefacts des photos prises la nuit dans des conditions de faible luminosité.

Découvrez les meilleurs logiciels de réduction du bruit par intelligence artificielle en 2026 pour la photographie nocturne en faible luminosité. Notre liste sélectionnée compare les outils gratuits et payants, et inclut des tests pratiques ainsi que des classements mis à jour chaque semaine. Éliminez facilement les grains d'image et autres artefacts. Développez votre avantage grâce à l’intelligence artificielle sur XIX.AI.

10 outils

xix.ai

chatbot

Les meilleurs générateurs d'IA pour créer une petite amie sur mesure : concevez des personnalités, des loisirs et des histoires personnelles uniques

Découvrez les meilleurs générateurs personnalisés de « copines IA » de 2026 sur XIX.AI. Parcourez notre sélection triée sur le volet et très bien notée pour créer des personnalités, des passe-temps et des histoires personnelles uniques. Comparez les options gratuites et payantes grâce à des avis concrets. Trouvez dès aujourd'hui votre compagnon créatif idéal.

10 outils

xix.ai

Productivité

Concepteurs d'architectures IA : concevez des architectures système évolutives à l'aide du langage naturel

Découvrez les meilleurs outils de conception d'architectures d'IA de 2026 sur XIX.AI. Notre sélection des outils les mieux notés propose des solutions puissantes et révolutionnaires pour créer des architectures système évolutives à l'aide du langage naturel. Comparez les options gratuites et payantes grâce à des avis concrets. Tirez pleinement parti de votre avantage en matière d'IA et optimisez votre développement dès aujourd'hui.

10 outils

xix.ai