El modelo de IA de código abierto Qwen de Alibaba bate récords en razonamiento
El equipo Qwen de Alibaba ha presentado una nueva versión de su modelo de IA de razonamiento de código abierto, con unos resultados de referencia extraordinarios.
Introducing Qwen3-235B-A22B-Thinking-2507. Durante los últimos tres meses, el equipo de Qwen ha estado ampliando intensamente lo que denominan la "capacidad de pensamiento" del modelo, esforzándose por mejorar tanto la calidad como la profundidad de sus procesos de razonamiento.
El resultado es un modelo que realmente brilla en las áreas más exigentes: razonamiento lógico, matemáticas complejas, retos científicos y codificación avanzada. En campos que normalmente exigen experiencia humana, este último modelo de Qwen está estableciendo un nuevo listón para la IA de código abierto.
En las pruebas de razonamiento, el modelo de IA de código abierto más reciente de Qwen obtiene una puntuación de 92,3 en AIME25 y de 74,1 en LiveCodeBench v6 para codificación. También obtiene buenos resultados en evaluaciones de capacidad más amplias, con un 79,7 en Arena-Hard v2, una métrica que evalúa la alineación con las preferencias humanas.

Básicamente, se trata de un modelo de IA de razonamiento a gran escala del equipo Qwen, con un total de 235.000 millones de parámetros. Sin embargo, emplea una arquitectura de Mezcla de Expertos (MDE), lo que significa que sólo un subconjunto de estos parámetros -aproximadamente 22.000 millones- están activos en un momento dado. Imagíneselo como un vasto equipo de 128 especialistas a la espera, en el que sólo trabajan los ocho mejores expertos para una tarea concreta.
Uno de sus atributos más destacados es su excepcional capacidad de memoria. El modelo de IA de razonamiento de código abierto de Qwen admite de forma nativa una longitud de contexto de 262.144 tokens, lo que supone una ventaja significativa para tareas que requieren la comprensión de información extensa.
Para desarrolladores y entusiastas, el equipo de Qwen ha simplificado el proceso de puesta en marcha. El modelo es accesible en Hugging Face y puede desplegarse utilizando herramientas como sglang o vllm para configurar un punto final de API personal. El equipo también destaca su marco Qwen-Agent como el método óptimo para aprovechar las funcionalidades de llamada a herramientas del modelo.
Para alcanzar el máximo rendimiento con este modelo de razonamiento de IA de código abierto, el equipo de Qwen ofrece varias recomendaciones. Aconsejan una longitud de salida de unos 32.768 tokens para tareas estándar, pero para problemas muy complejos, aumentar esta longitud a 81.920 tokens permite a la IA disponer de espacio suficiente para "pensar". También sugieren utilizar instrucciones explícitas en sus indicaciones, como solicitar un enfoque de "razonamiento paso a paso" para problemas matemáticos, para obtener las respuestas más precisas y bien organizadas.
El lanzamiento de este nuevo modelo Qwen ofrece una IA de razonamiento potente y de código abierto capaz de competir con los principales modelos patentados, sobre todo a la hora de abordar retos intrincados e intelectualmente exigentes. Será fascinante observar lo que la comunidad de desarrolladores crea con esta tecnología.
Véase también: Plan de acción sobre IA: El liderazgo de EE.UU. debe ser "indiscutible
¿Está interesado en profundizar sus conocimientos sobre IA y big data de la mano de expertos del sector? Asista a la AI & Big Data Expo en Ámsterdam, California y Londres. Este completo evento se celebra junto con otras importantes conferencias, como la Intelligent Automation Conference, BlockX, la Digital Transformation Week y la Cyber Security & Cloud Expo.
Descubra aquí más eventos y seminarios web sobre tecnología empresarial organizados por TechForge.
Artículo relacionado
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
Recomendaciones de temas especiales relacionados
comentario (1)
0/500
El equipo Qwen de Alibaba ha presentado una nueva versión de su modelo de IA de razonamiento de código abierto, con unos resultados de referencia extraordinarios.
Introducing Qwen3-235B-A22B-Thinking-2507. Durante los últimos tres meses, el equipo de Qwen ha estado ampliando intensamente lo que denominan la "capacidad de pensamiento" del modelo, esforzándose por mejorar tanto la calidad como la profundidad de sus procesos de razonamiento.
El resultado es un modelo que realmente brilla en las áreas más exigentes: razonamiento lógico, matemáticas complejas, retos científicos y codificación avanzada. En campos que normalmente exigen experiencia humana, este último modelo de Qwen está estableciendo un nuevo listón para la IA de código abierto.
En las pruebas de razonamiento, el modelo de IA de código abierto más reciente de Qwen obtiene una puntuación de 92,3 en AIME25 y de 74,1 en LiveCodeBench v6 para codificación. También obtiene buenos resultados en evaluaciones de capacidad más amplias, con un 79,7 en Arena-Hard v2, una métrica que evalúa la alineación con las preferencias humanas.

Básicamente, se trata de un modelo de IA de razonamiento a gran escala del equipo Qwen, con un total de 235.000 millones de parámetros. Sin embargo, emplea una arquitectura de Mezcla de Expertos (MDE), lo que significa que sólo un subconjunto de estos parámetros -aproximadamente 22.000 millones- están activos en un momento dado. Imagíneselo como un vasto equipo de 128 especialistas a la espera, en el que sólo trabajan los ocho mejores expertos para una tarea concreta.
Uno de sus atributos más destacados es su excepcional capacidad de memoria. El modelo de IA de razonamiento de código abierto de Qwen admite de forma nativa una longitud de contexto de 262.144 tokens, lo que supone una ventaja significativa para tareas que requieren la comprensión de información extensa.
Para desarrolladores y entusiastas, el equipo de Qwen ha simplificado el proceso de puesta en marcha. El modelo es accesible en Hugging Face y puede desplegarse utilizando herramientas como sglang o vllm para configurar un punto final de API personal. El equipo también destaca su marco Qwen-Agent como el método óptimo para aprovechar las funcionalidades de llamada a herramientas del modelo.
Para alcanzar el máximo rendimiento con este modelo de razonamiento de IA de código abierto, el equipo de Qwen ofrece varias recomendaciones. Aconsejan una longitud de salida de unos 32.768 tokens para tareas estándar, pero para problemas muy complejos, aumentar esta longitud a 81.920 tokens permite a la IA disponer de espacio suficiente para "pensar". También sugieren utilizar instrucciones explícitas en sus indicaciones, como solicitar un enfoque de "razonamiento paso a paso" para problemas matemáticos, para obtener las respuestas más precisas y bien organizadas.
El lanzamiento de este nuevo modelo Qwen ofrece una IA de razonamiento potente y de código abierto capaz de competir con los principales modelos patentados, sobre todo a la hora de abordar retos intrincados e intelectualmente exigentes. Será fascinante observar lo que la comunidad de desarrolladores crea con esta tecnología.
Véase también: Plan de acción sobre IA: El liderazgo de EE.UU. debe ser "indiscutible
¿Está interesado en profundizar sus conocimientos sobre IA y big data de la mano de expertos del sector? Asista a la AI & Big Data Expo en Ámsterdam, California y Londres. Este completo evento se celebra junto con otras importantes conferencias, como la Intelligent Automation Conference, BlockX, la Digital Transformation Week y la Cyber Security & Cloud Expo.
Descubra aquí más eventos y seminarios web sobre tecnología empresarial organizados por TechForge.
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est





Hogar






