L'outil JoyAI-Image-Edit de JD.com transforme les photos en modèles 3D
L'institut de recherche de JD.com a mis en open source son modèle JoyAI-Image-Edit, développé en interne, marquant ainsi une avancée majeure dans le domaine de la retouche photo par IA : on passe de la manipulation 2D classique à la modélisation spatiale 3D avancée. Premier modèle open source du secteur axé sur l'« intelligence spatiale », il dote l'IA de la capacité de véritablement comprendre et de reconstruire des environnements physiques.

Modélisation spatiale 3D avancée
Le modèle est conçu pour respecter étroitement les lois de la physique du monde réel, en modélisant de manière exhaustive des aspects tels que la perception de la caméra et le déplacement des objets. Cela permet aux développeurs d'utiliser du code d'inférence pour effectuer des retouches spatiales précises tout en préservant la cohérence géométrique de la scène.
JoyAI-Image-Edit répond aux défis persistants de la compréhension spatiale au sein de la communauté open source, en offrant une grande précision de reconnaissance. L'une de ses principales fonctionnalités est sa capacité à ajuster de manière flexible les niveaux de lacet, de tangage et de zoom de la caméra à partir de commandes en langage naturel.
Des applications polyvalentes
De plus, le modèle prend en charge le mouvement continu de la perspective, générant des séquences visuelles logiquement cohérentes. Il préserve l'intégrité structurelle globale tout en redimensionnant ou en déplaçant des objets spécifiques, garantissant ainsi des effets naturels d'éclairage, d'ombres et d'occlusion.
Au-delà de ses fonctionnalités spatiales pionnières, le modèle prend entièrement en charge 15 tâches d'édition courantes, telles que l'ajout, la suppression et le transfert de style d'objets. Il est déjà utilisé dans la production e-commerce, la conception créative et l'intelligence incarnée, fournissant une technologie fondamentale essentielle à divers secteurs.
Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles
Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
commentaires (0)
L'institut de recherche de JD.com a mis en open source son modèle JoyAI-Image-Edit, développé en interne, marquant ainsi une avancée majeure dans le domaine de la retouche photo par IA : on passe de la manipulation 2D classique à la modélisation spatiale 3D avancée. Premier modèle open source du secteur axé sur l'« intelligence spatiale », il dote l'IA de la capacité de véritablement comprendre et de reconstruire des environnements physiques.

Modélisation spatiale 3D avancée
Le modèle est conçu pour respecter étroitement les lois de la physique du monde réel, en modélisant de manière exhaustive des aspects tels que la perception de la caméra et le déplacement des objets. Cela permet aux développeurs d'utiliser du code d'inférence pour effectuer des retouches spatiales précises tout en préservant la cohérence géométrique de la scène.
JoyAI-Image-Edit répond aux défis persistants de la compréhension spatiale au sein de la communauté open source, en offrant une grande précision de reconnaissance. L'une de ses principales fonctionnalités est sa capacité à ajuster de manière flexible les niveaux de lacet, de tangage et de zoom de la caméra à partir de commandes en langage naturel.
Des applications polyvalentes
De plus, le modèle prend en charge le mouvement continu de la perspective, générant des séquences visuelles logiquement cohérentes. Il préserve l'intégrité structurelle globale tout en redimensionnant ou en déplaçant des objets spécifiques, garantissant ainsi des effets naturels d'éclairage, d'ombres et d'occlusion.
Au-delà de ses fonctionnalités spatiales pionnières, le modèle prend entièrement en charge 15 tâches d'édition courantes, telles que l'ajout, la suppression et le transfert de style d'objets. Il est déjà utilisé dans la production e-commerce, la conception créative et l'intelligence incarnée, fournissant une technologie fondamentale essentielle à divers secteurs.
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés





Maison






