Maison
Tencent met en open source le modèle 3D « Huan Yuan 3D World Model 2.0 » pour permettre la modification en un clic des ressources 3D d'espaces virtuels
L'équipe Huan Yuan de Tencent a annoncé aujourd'hui la sortie et la mise en open source de « Huan Yuan 3D World Model 2.0 » (HY-World2.0), une mise à jour majeure de son modèle de monde multimodal. Cette version marque le passage de la simple génération de vidéos à la création de ressources 3D interactives et modifiables. Elle prend en charge les entrées de texte, d’images et de vidéos, permettant ainsi la génération, la reconstruction et la simulation d’espaces 3D complets comprenant des personnes, des objets et des scènes. Le modèle permet également l’exportation vers plusieurs formats, tels que Mesh, 3DGS et les nuages de points, et s’intègre de manière transparente aux moteurs de jeu courants comme Unity et Unreal Engine.

Sur le plan technique, HY-World 2.0 unifie la compréhension spatiale, la génération et la reconstruction en un seul processus. Parmi les principales améliorations, on peut citer le modèle HY-Pano 2.0, qui utilise une approche d’apprentissage implicite de bout en bout pour générer des cartes panoramiques à 360 degrés sans nécessiter de paramètres de caméra ; un agent spatial développé en interne qui combine le VLM avec une représentation par navmesh, permettant une planification intelligente des trajectoires de déplacement ; et le mécanisme WorldStereo, qui garantit une grande cohérence en termes de géométrie et d’aspect visuel entre les zones nouvellement générées et les scènes existantes.


De plus, l’architecture WorldMirror 2.0 améliorée reproduit des scènes du monde réel en prédisant des nuages de points denses et les paramètres de caméra en un seul passage, ce qui permet la construction de jumeaux numériques de haute précision.
Par rapport aux modèles courants tels que Genie3 de Google, Huan Yuan 2.0 se distingue par le fait que ses éléments générés présentent des propriétés de collision physiques réalistes et prennent en charge l’exploration libre en mode personnage. Cela réduit considérablement les obstacles à la création de prototypes de niveaux de jeu et d’environnements de simulation intelligents incarnés.
Cette version marque une évolution pour Tencent Huan Yuan, qui passe de la « manipulation d’objets » à la « création de mondes » dans le domaine de la génération 3D. Grâce à un mécanisme de mémoire à cohérence spatiale de pointe, elle fait entrer la création de contenu 3D pilotée par l’IA dans une phase pratique et concrète.
Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles
Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
commentaires (0)
L'équipe Huan Yuan de Tencent a annoncé aujourd'hui la sortie et la mise en open source de « Huan Yuan 3D World Model 2.0 » (HY-World2.0), une mise à jour majeure de son modèle de monde multimodal. Cette version marque le passage de la simple génération de vidéos à la création de ressources 3D interactives et modifiables. Elle prend en charge les entrées de texte, d’images et de vidéos, permettant ainsi la génération, la reconstruction et la simulation d’espaces 3D complets comprenant des personnes, des objets et des scènes. Le modèle permet également l’exportation vers plusieurs formats, tels que Mesh, 3DGS et les nuages de points, et s’intègre de manière transparente aux moteurs de jeu courants comme Unity et Unreal Engine.

Sur le plan technique, HY-World 2.0 unifie la compréhension spatiale, la génération et la reconstruction en un seul processus. Parmi les principales améliorations, on peut citer le modèle HY-Pano 2.0, qui utilise une approche d’apprentissage implicite de bout en bout pour générer des cartes panoramiques à 360 degrés sans nécessiter de paramètres de caméra ; un agent spatial développé en interne qui combine le VLM avec une représentation par navmesh, permettant une planification intelligente des trajectoires de déplacement ; et le mécanisme WorldStereo, qui garantit une grande cohérence en termes de géométrie et d’aspect visuel entre les zones nouvellement générées et les scènes existantes.


De plus, l’architecture WorldMirror 2.0 améliorée reproduit des scènes du monde réel en prédisant des nuages de points denses et les paramètres de caméra en un seul passage, ce qui permet la construction de jumeaux numériques de haute précision.
Par rapport aux modèles courants tels que Genie3 de Google, Huan Yuan 2.0 se distingue par le fait que ses éléments générés présentent des propriétés de collision physiques réalistes et prennent en charge l’exploration libre en mode personnage. Cela réduit considérablement les obstacles à la création de prototypes de niveaux de jeu et d’environnements de simulation intelligents incarnés.
Cette version marque une évolution pour Tencent Huan Yuan, qui passe de la « manipulation d’objets » à la « création de mondes » dans le domaine de la génération 3D. Grâce à un mécanisme de mémoire à cohérence spatiale de pointe, elle fait entrer la création de contenu 3D pilotée par l’IA dans une phase pratique et concrète.
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés











