Maison
Apple dévoile le modèle LiTo Large pour la 3D à partir d'une seule image avec éclairage et textures complets : un partenaire idéal pour le Vision Pro ?
Apple a récemment présenté une technologie révolutionnaire dans le domaine de la reconstruction 3D basée sur l'IA, un défi longtemps considéré comme particulièrement difficile à relever.
D'après des informations récentes, l'équipe de recherche en IA d'Apple a publié un nouveau modèle appelé LiTo (Surface Light Field Tokenization). Sa principale avancée réside dansla capacité à reconstruire un objet 3D complet à partir d'une simple image 2D, avec un niveau de détail atteignant le réalisme physique.

Depuis des années, le principal défi dans la génération de modèles 3D à partir d’une seule image réside dans le maintien de la cohérence de l’éclairage. Lorsque l’on change d’angle de vue, les reflets et les zones lumineuses à la surface de l’objet apparaissent souvent déformés ou peu naturels. Le modèle LiTo résout toutefois ce problème en introduisant une représentation innovante dite « d’espace latent ». Au lieu de se contenter de mémoriser des pixels, il comprend les lois fondamentales régissant l’interaction de la lumière avec les surfaces à l’aide de vecteurs mathématiques.
En termes simples, LiTo dispose de solides capacités d’« imagination ». Même à partir d’une simple photo prise de face, il peut prédire avec précision les reflets miroirs et les reflets de Fresnel à l’arrière de l’objet sous différentes conditions d’éclairage. Lors de tests comparatifs officiels, LiTo a largement surpassé le modèle TRELLIS, leader du secteur, en matière de précision d’éclairage multi-vues.

Pour affiner cette IA axée sur les détails, les chercheurs l’ont entraînée sur des milliers d’objets 3D capturés depuis 150 points de vue sous trois conditions d’éclairage. Cette attention quasi obsessionnelle portée aux détails d’éclairage témoigne clairement des efforts d’Apple pour jeter les bases d’un écosystème d’informatique spatiale.

Imaginez à l’avenir : il vous suffira de prendre une photo avec votre iPhone, et LiTo la convertira instantanément en un modèle 3D réaliste, intégré de manière transparente dans l’espace virtuel de Vision Pro. Cette transition fluide du contenu 2D vers des ressources 3D pourrait constituer l’atout majeur d’Apple pour bénéficier d’un « avantage du retardataire » dans la course à l’IA.
Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles
Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
commentaires (0)
Apple a récemment présenté une technologie révolutionnaire dans le domaine de la reconstruction 3D basée sur l'IA, un défi longtemps considéré comme particulièrement difficile à relever.
D'après des informations récentes, l'équipe de recherche en IA

Depuis des années, le principal défi dans la génération de modèles 3D à partir d’une seule image réside dans le maintien de la cohérence de l’éclairage. Lorsque l’on change d’angle de vue, les reflets et les zones lumineuses à la surface de l’objet apparaissent souvent déformés ou peu naturels. Le modèle
En termes simples,

Pour affiner cette IA axée sur les détails, les chercheurs l’ont entraînée sur des milliers d’objets 3D capturés depuis 150 points de vue sous trois conditions d’éclairage. Cette attention quasi obsessionnelle portée aux détails d’éclairage témoigne clairement des efforts d’Apple pour jeter les bases d’un écosystème d’informatique spatiale.

Imaginez à l’avenir : il vous suffira de prendre une photo avec votre iPhone, et
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés











