Maison
Tencent met en open source le modèle 3D « Huan Yuan 3D World Model 2.0 » pour permettre la modification en un clic des ressources 3D d'espaces virtuels
L'équipe Huan Yuan de Tencent a annoncé aujourd'hui la sortie et la mise en open source de « Huan Yuan 3D World Model 2.0 » (HY-World2.0), une mise à jour majeure de son modèle de monde multimodal. Cette version marque le passage de la simple génération de vidéos à la création de ressources 3D interactives et modifiables. Elle prend en charge les entrées de texte, d’images et de vidéos, permettant ainsi la génération, la reconstruction et la simulation d’espaces 3D complets comprenant des personnes, des objets et des scènes. Le modèle permet également l’exportation vers plusieurs formats, tels que Mesh, 3DGS et les nuages de points, et s’intègre de manière transparente aux moteurs de jeu courants comme Unity et Unreal Engine.

Sur le plan technique, HY-World 2.0 unifie la compréhension spatiale, la génération et la reconstruction en un seul processus. Parmi les principales améliorations, on peut citer le modèle HY-Pano 2.0, qui utilise une approche d’apprentissage implicite de bout en bout pour générer des cartes panoramiques à 360 degrés sans nécessiter de paramètres de caméra ; un agent spatial développé en interne qui combine le VLM avec une représentation par navmesh, permettant une planification intelligente des trajectoires de déplacement ; et le mécanisme WorldStereo, qui garantit une grande cohérence en termes de géométrie et d’aspect visuel entre les zones nouvellement générées et les scènes existantes.


De plus, l’architecture WorldMirror 2.0 améliorée reproduit des scènes du monde réel en prédisant des nuages de points denses et les paramètres de caméra en un seul passage, ce qui permet la construction de jumeaux numériques de haute précision.
Par rapport aux modèles courants tels que Genie3 de Google, Huan Yuan 2.0 se distingue par le fait que ses éléments générés présentent des propriétés de collision physiques réalistes et prennent en charge l’exploration libre en mode personnage. Cela réduit considérablement les obstacles à la création de prototypes de niveaux de jeu et d’environnements de simulation intelligents incarnés.
Cette version marque une évolution pour Tencent Huan Yuan, qui passe de la « manipulation d’objets » à la « création de mondes » dans le domaine de la génération 3D. Grâce à un mécanisme de mémoire à cohérence spatiale de pointe, elle fait entrer la création de contenu 3D pilotée par l’IA dans une phase pratique et concrète.
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)
L'équipe Huan Yuan de Tencent a annoncé aujourd'hui la sortie et la mise en open source de « Huan Yuan 3D World Model 2.0 » (HY-World2.0), une mise à jour majeure de son modèle de monde multimodal. Cette version marque le passage de la simple génération de vidéos à la création de ressources 3D interactives et modifiables. Elle prend en charge les entrées de texte, d’images et de vidéos, permettant ainsi la génération, la reconstruction et la simulation d’espaces 3D complets comprenant des personnes, des objets et des scènes. Le modèle permet également l’exportation vers plusieurs formats, tels que Mesh, 3DGS et les nuages de points, et s’intègre de manière transparente aux moteurs de jeu courants comme Unity et Unreal Engine.

Sur le plan technique, HY-World 2.0 unifie la compréhension spatiale, la génération et la reconstruction en un seul processus. Parmi les principales améliorations, on peut citer le modèle HY-Pano 2.0, qui utilise une approche d’apprentissage implicite de bout en bout pour générer des cartes panoramiques à 360 degrés sans nécessiter de paramètres de caméra ; un agent spatial développé en interne qui combine le VLM avec une représentation par navmesh, permettant une planification intelligente des trajectoires de déplacement ; et le mécanisme WorldStereo, qui garantit une grande cohérence en termes de géométrie et d’aspect visuel entre les zones nouvellement générées et les scènes existantes.


De plus, l’architecture WorldMirror 2.0 améliorée reproduit des scènes du monde réel en prédisant des nuages de points denses et les paramètres de caméra en un seul passage, ce qui permet la construction de jumeaux numériques de haute précision.
Par rapport aux modèles courants tels que Genie3 de Google, Huan Yuan 2.0 se distingue par le fait que ses éléments générés présentent des propriétés de collision physiques réalistes et prennent en charge l’exploration libre en mode personnage. Cela réduit considérablement les obstacles à la création de prototypes de niveaux de jeu et d’environnements de simulation intelligents incarnés.
Cette version marque une évolution pour Tencent Huan Yuan, qui passe de la « manipulation d’objets » à la « création de mondes » dans le domaine de la génération 3D. Grâce à un mécanisme de mémoire à cohérence spatiale de pointe, elle fait entrer la création de contenu 3D pilotée par l’IA dans une phase pratique et concrète.
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter











