Hogar
Zhipu presenta GLM-5.3-Flash, un modelo multimodal nativo de código abierto a una cuarta parte del precio
Zhipu ha lanzado oficialmente y ha puesto a disposición como código abierto el GLM-5.3-Flash (320B-A18B), el primer modelo multimodal nativo de la serie GLM-5, que ofrece un rendimiento de IA de vanguardia a un coste sin precedentes.
Con capacidades líderes a nivel mundial, el modelo ha obtenido una puntuación de 57 en el Índice de Inteligencia Artificial Analítica, igualando a Claude Opus4.8. Demuestra un rendimiento global superior y una mayor competencia en programación en comparación con el GLM-5.2, de mayor tamaño. Antes de su lanzamiento, encabezó de forma anónima las listas de uso en OpenCode y OpenRouter bajo el nombre de «Ox-Alpha».

La rentabilidad es una ventaja clave. Con un precio de tan solo una décima parte del GLM-5.3 estándar —y de hasta una vigésima parte durante promociones por tiempo limitado—, el GLM-5.3-Flash cuesta aproximadamente una cuadragésima parte de Opus4.8, lo que reduce drásticamente las barreras de acceso a la IA de vanguardia.
Desde el punto de vista arquitectónico, el modelo utiliza un mecanismo híbrido de atención dispersa y lineal, una novedad en los modelos de vanguardia de código abierto. Potenciado por superconexiones con restricciones de variedad, reduce el cálculo de atención en 3,01 veces y el uso de la caché KV en 4,44 veces, optimizando el equilibrio entre el manejo de contextos largos y los costes de inferencia. Su integración visual nativa permite la ejecución independiente del desarrollo front-end, el modelado 3D y la creación de documentos, destacando en ámbitos profesionales como las finanzas y el derecho.

Cabe destacar que el modelo se ejecuta íntegramente en clústeres de chips nacionales. Aprovechando un motor de inferencia personalizado con separación EPD y optimizaciones avanzadas de memoria, el equipo logró triplicar la velocidad de inferencia de extremo a extremo, igualando la eficiencia en la utilización del hardware de las GPU NVIDIA convencionales y validando la potencia de cálculo nacional para la IA a gran escala.
GLM-5.3-Flash es de código totalmente abierto y ofrece acceso a la API, demostraciones en línea e integración con plataformas de agentes como ZCode y AutoClaw. También ofrece tarjetas de experiencia diarias que otorgan diez mil usos, disponibles para desarrolladores de todo el mundo.
Experiencia en línea
Z.ai: https://chat.z.ai
Aplicación Zhipu Qingyan: https://chatglm.cn
Artículo relacionado
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Zhipu ha lanzado oficialmente y ha puesto a disposición como código abierto el GLM-5.3-Flash (320B-A18B), el primer modelo multimodal nativo de la serie GLM-5, que ofrece un rendimiento de IA de vanguardia a un coste sin precedentes.
Con capacidades líderes a nivel mundial, el modelo ha obtenido una puntuación de 57 en el Índice de Inteligencia Artificial Analítica, igualando a Claude Opus4.8. Demuestra un rendimiento global superior y una mayor competencia en programación en comparación con el GLM-5.2, de mayor tamaño. Antes de su lanzamiento, encabezó de forma anónima las listas de uso en OpenCode y OpenRouter bajo el nombre de «Ox-Alpha».

La rentabilidad es una ventaja clave. Con un precio de tan solo una décima parte del GLM-5.3 estándar —y de hasta una vigésima parte durante promociones por tiempo limitado—, el GLM-5.3-Flash cuesta aproximadamente una cuadragésima parte de Opus4.8, lo que reduce drásticamente las barreras de acceso a la IA de vanguardia.
Desde el punto de vista arquitectónico, el modelo utiliza un mecanismo híbrido de atención dispersa y lineal, una novedad en los modelos de vanguardia de código abierto. Potenciado por superconexiones con restricciones de variedad, reduce el cálculo de atención en 3,01 veces y el uso de la caché KV en 4,44 veces, optimizando el equilibrio entre el manejo de contextos largos y los costes de inferencia. Su integración visual nativa permite la ejecución independiente del desarrollo front-end, el modelado 3D y la creación de documentos, destacando en ámbitos profesionales como las finanzas y el derecho.

Cabe destacar que el modelo se ejecuta íntegramente en clústeres de chips nacionales. Aprovechando un motor de inferencia personalizado con separación EPD y optimizaciones avanzadas de memoria, el equipo logró triplicar la velocidad de inferencia de extremo a extremo, igualando la eficiencia en la utilización del hardware de las GPU NVIDIA convencionales y validando la potencia de cálculo nacional para la IA a gran escala.
GLM-5.3-Flash es de código totalmente abierto y ofrece acceso a la API, demostraciones en línea e integración con plataformas de agentes como ZCode y AutoClaw. También ofrece tarjetas de experiencia diarias que otorgan diez mil usos, disponibles para desarrolladores de todo el mundo.
Experiencia en línea
Z.ai: https://chat.z.ai
Aplicación Zhipu Qingyan: https://chatglm.cn
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de











