Maison
OpenAI lance ChatGPT Images 2.0, capable de générer 8 images cohérentes par session
OpenAI vient de lancer un générateur d’images basé sur son nouveau modèle GPT Image2 : ChatGPT Images 2.0. La principale nouveauté de cette version réside dans le fait qu’elle dote l’IA d’une « capacité de raisonnement » renforcée, ce qui lui permet d’agir davantage comme un créateur logique lorsqu’elle aborde des tâches visuelles complexes.

Grâce à la planification par raisonnement, la génération d’images cesse d’être un « jeu de devinettes »
Contrairement à l’approche précédente qui générait directement des images, Images 2.0 intègre un système de planification logique approfondi. Lorsque le raisonnement est activé, l’IA recherche d’abord des informations en ligne et analyse les fichiers mis en ligne par l’utilisateur. En anticipant la structure de l’image et en planifiant sa mise en page, le résultat obtenu correspond davantage à une intuition logique plutôt qu’à un simple assemblage d’éléments. Cette fonctionnalité avancée est actuellement accessible aux abonnés ChatGPT Plus, Pro, Business et Enterprise.

Une avancée en matière de cohérence : générez jusqu’à 8 images à la fois pour les bandes dessinées et le design
En matière de génération multi-images, la dernière version marque une avancée majeure. Images 2.0 peut désormais produire jusqu’à 8 images cohérentes à partir d’une seule consigne. Plus impressionnant encore, le système préserve rigoureusement la cohérence de l’apparence des personnages, des détails des objets et du style visuel global lors des transitions entre les différentes scènes. Cette capacité réduit considérablement les obstacles à la création de longues bandes dessinées, d’illustrations pour des séries sur les réseaux sociaux ou de projets complets d’aménagement intérieur.
Améliorations de la qualité et optimisation multilingue
Sur le plan technique, la nouvelle version porte la résolution maximale à 2K et propose des formats d’image allant de 3:1 à 1:3, ce qui la rend idéale pour les photos de films, le pixel art et d’autres styles spécifiques. Afin de répondre aux besoins d’un public international, l’équipe a également affiné la précision de la génération de texte en chinois, japonais, coréen, hindi et bengali, remédiant ainsi à des problèmes courants tels que les erreurs d’encodage de texte et les interprétations erronées observées dans les images générées par l’IA précédentes.
Cette mise à jour marque une évolution du dessin par IA, qui passe de la simple « génération de pixels » à la « compréhension et à la création », offrant ainsi aux designers professionnels comme aux utilisateurs lambda des outils visuels plus efficaces.
Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles
Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
commentaires (0)
OpenAI vient de lancer un générateur d’images basé sur son nouveau modèle GPT Image2 : ChatGPT Images 2.0. La principale nouveauté de cette version réside dans le fait qu’elle dote l’IA d’une « capacité de raisonnement » renforcée, ce qui lui permet d’agir davantage comme un créateur logique lorsqu’elle aborde des tâches visuelles complexes.

Grâce à la planification par raisonnement, la génération d’images cesse d’être un « jeu de devinettes »
Contrairement à l’approche précédente qui générait directement des images, Images 2.0 intègre un système de planification logique approfondi. Lorsque le raisonnement est activé, l’IA recherche d’abord des informations en ligne et analyse les fichiers mis en ligne par l’utilisateur. En anticipant la structure de l’image et en planifiant sa mise en page, le résultat obtenu correspond davantage à une intuition logique plutôt qu’à un simple assemblage d’éléments. Cette fonctionnalité avancée est actuellement accessible aux abonnés ChatGPT Plus, Pro, Business et Enterprise.

Une avancée en matière de cohérence : générez jusqu’à 8 images à la fois pour les bandes dessinées et le design
En matière de génération multi-images, la dernière version marque une avancée majeure. Images 2.0 peut désormais produire jusqu’à 8 images cohérentes à partir d’une seule consigne. Plus impressionnant encore, le système préserve rigoureusement la cohérence de l’apparence des personnages, des détails des objets et du style visuel global lors des transitions entre les différentes scènes. Cette capacité réduit considérablement les obstacles à la création de longues bandes dessinées, d’illustrations pour des séries sur les réseaux sociaux ou de projets complets d’aménagement intérieur.
Améliorations de la qualité et optimisation multilingue
Sur le plan technique, la nouvelle version porte la résolution maximale à 2K et propose des formats d’image allant de 3:1 à 1:3, ce qui la rend idéale pour les photos de films, le pixel art et d’autres styles spécifiques. Afin de répondre aux besoins d’un public international, l’équipe a également affiné la précision de la génération de texte en chinois, japonais, coréen, hindi et bengali, remédiant ainsi à des problèmes courants tels que les erreurs d’encodage de texte et les interprétations erronées observées dans les images générées par l’IA précédentes.
Cette mise à jour marque une évolution du dessin par IA, qui passe de la simple « génération de pixels » à la « compréhension et à la création », offrant ainsi aux designers professionnels comme aux utilisateurs lambda des outils visuels plus efficaces.
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés











