Hogar
Alibaba presenta su serie de robots Qwen-R, compuesta por tres modelos grandes con cuerpo físico, destinados a abordar el problema de la adaptación de robots heterogéneos.

El 16 de junio, Alibaba presentó la serie de modelos de inteligencia encarnada Qwen-Robot, compuesta por tres componentes principales: el modelo de manipulación VLA Qwen-RobotManip, el modelo de navegación VLN Qwen-RobotNav y el modelo del mundo Qwen-RobotWorld. Este lanzamiento estratégico refleja un compromiso aún mayor por parte de los principales actores tecnológicos con los modelos base de inteligencia encarnada, lo que permite una coordinación fluida entre el control de robots, la navegación y el razonamiento físico.
Para superar el problema crítico del sector, donde los modelos VLA tradicionales tienen dificultades para adaptarse a cambios en el hardware o en las situaciones, Qwen-RobotManip introduce una representación unificada de acciones de 80 dimensiones que define un “lenguaje corporal” universal para diversos tipos de hardware, lo que permite una adaptación automática entre dispositivos con solo unos pocos pasos de retroalimentación. El modelo VLN Qwen-RobotNav, diseñado para la navegación y ejecución de tareas, se basa en Qwen-VL y, por primera vez, integra cinco familias de tareas —incluida la navegación guiada por lenguaje, la búsqueda de objetivos y la conducción autónoma— en un único marco, eliminando la necesidad de cambiar de modelo en tareas complejas.
Como núcleo cognitivo, Qwen-RobotWorld otorga al sistema la capacidad de razonar sobre el mundo físico, prediciendo y simulando acciones y estados futuros. La inteligencia encarnada está pasando actualmente de aplicaciones en escenarios específicos a usos generalizados. Con el lanzamiento conjunto de los tres modelos, Alibaba está en posición de acelerar la implementación práctica de robots heterogéneos al desacoplar su arquitectura técnica e integrar capacidades multimodales.
Artículo relacionado
El lanzamiento global de la campaña de campus de Seed de ByteDance ofrece acciones virtuales para captar a los mejores talentos en modelos grandes
En el competitivo panorama de los modelos de lenguaje grandes, asegurar el talento de primer nivel sigue siendo el activo estratégico más crítico.El 1 de abril, ByteDance anunció el lanzamiento de su iniciativa global de reclutamiento de campus Seed
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

El 16 de junio, Alibaba presentó la serie de modelos de inteligencia encarnada Qwen-Robot, compuesta por tres componentes principales: el modelo de manipulación VLA Qwen-RobotManip, el modelo de navegación VLN Qwen-RobotNav y el modelo del mundo Qwen-RobotWorld. Este lanzamiento estratégico refleja un compromiso aún mayor por parte de los principales actores tecnológicos con los modelos base de inteligencia encarnada, lo que permite una coordinación fluida entre el control de robots, la navegación y el razonamiento físico.
Para superar el problema crítico del sector, donde los modelos VLA tradicionales tienen dificultades para adaptarse a cambios en el hardware o en las situaciones, Qwen-RobotManip introduce una representación unificada de acciones de 80 dimensiones que define un “lenguaje corporal” universal para diversos tipos de hardware, lo que permite una adaptación automática entre dispositivos con solo unos pocos pasos de retroalimentación. El modelo VLN Qwen-RobotNav, diseñado para la navegación y ejecución de tareas, se basa en Qwen-VL y, por primera vez, integra cinco familias de tareas —incluida la navegación guiada por lenguaje, la búsqueda de objetivos y la conducción autónoma— en un único marco, eliminando la necesidad de cambiar de modelo en tareas complejas.
Como núcleo cognitivo, Qwen-RobotWorld otorga al sistema la capacidad de razonar sobre el mundo físico, prediciendo y simulando acciones y estados futuros. La inteligencia encarnada está pasando actualmente de aplicaciones en escenarios específicos a usos generalizados. Con el lanzamiento conjunto de los tres modelos, Alibaba está en posición de acelerar la implementación práctica de robots heterogéneos al desacoplar su arquitectura técnica e integrar capacidades multimodales.
El lanzamiento global de la campaña de campus de Seed de ByteDance ofrece acciones virtuales para captar a los mejores talentos en modelos grandes
En el competitivo panorama de los modelos de lenguaje grandes, asegurar el talento de primer nivel sigue siendo el activo estratégico más crítico.El 1 de abril, ByteDance anunció el lanzamiento de su iniciativa global de reclutamiento de campus Seed
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se











