Hogar
Zhipu rompe el récord mundial de velocidad en inteligencia artificial con la versión de alta velocidad GLM-5.1
El reconocido equipo de IA de China, Zhipu, anunció hoy oficialmente el lanzamiento de una nueva API de alta velocidad GLM-5.1 para clientes empresariales seleccionados. Bautizada como “GLM-5.1-highspeed”, esta versión ha sorprendido a la industria desde su lanzamiento, al ofrecer una velocidad de salida de 400 tokens por segundo.
Este número supera directamente el actual estándar mundial de velocidad de API establecido por los principales proveedores de grandes modelos, demostrando una clara ventaja técnica. Anteriormente, la industria de IA consideraba que la velocidad y el tamaño de los modelos eran mutuamente excluyentes, ya que mayor velocidad generalmente requería compromisos en las capacidades del modelo.
Rompiendo las normas de la industria con un rendimiento de primer nivel
Sin embargo, la versión GLM-5.1-highspeed ha derribado la creencia establecida de que “lo rápido significa lo pequeño”. Por primera vez entre los grandes modelos nacionales, logra integrar capacidades técnicas de primer nivel y una latencia extremadamente baja en entornos de producción reales.
Según se informa, este modelo fue desarrollado conjuntamente por el equipo GLM de Zhipu y el equipo TileRT. Ambos equipos realizaron optimizaciones profundas y exhaustivas a nivel de sistema en tres áreas: el motor de inferencia, el sistema de programación y la infraestructura subyacente, alejándose de los métodos tradicionales de programación dinámica.
Tres niveles de optimización garantizan una salida estable
Desde el punto de vista técnico, el equipo de desarrollo no solo reescribió la ruta central de inferencia del modelo para aumentar la capacidad de procesamiento por tarjeta, sino que también redujo la latencia en escenarios de alta concurrencia mediante técnicas como el agrupamiento dinámico de solicitudes. Al mismo tiempo, las optimizaciones conjuntas en la infraestructura aseguraron que una velocidad de 400 TPS se convirtiera en una capacidad estable y utilizable en entornos de producción.
Este modelo de alta velocidad tiene amplias aplicaciones, especialmente adecuado para escenarios que requieren una respuesta rápida. Ya sea para programación de IA, interacción vocal en tiempo real o toma de decisiones empresariales frecuentes, este modelo está ahora disponible en la plataforma MaaS de Zhipu para empresas seleccionadas.
Artículo relacionado
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr
Google prueba el agente Remy AI para Gemini a medida que el enfoque se desplaza hacia el control del usuario
Según Business Insider, Google está probando Remy, un nuevo agente personal de IA para Gemini. Esta herramienta tiene como objetivo ejecutar tareas en nombre de los usuarios, optimizando tanto los flujos de trabajo profesionales como las rutinas diar
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
El reconocido equipo de IA de China, Zhipu, anunció hoy oficialmente el lanzamiento de una nueva API de alta velocidad GLM-5.1 para clientes empresariales seleccionados. Bautizada como “GLM-5.1-highspeed”, esta versión ha sorprendido a la industria desde su lanzamiento, al ofrecer una velocidad de salida de 400 tokens por segundo.
Este número supera directamente el actual estándar mundial de velocidad de API establecido por los principales proveedores de grandes modelos, demostrando una clara ventaja técnica. Anteriormente, la industria de IA consideraba que la velocidad y el tamaño de los modelos eran mutuamente excluyentes, ya que mayor velocidad generalmente requería compromisos en las capacidades del modelo.
Rompiendo las normas de la industria con un rendimiento de primer nivel
Sin embargo, la versión GLM-5.1-highspeed ha derribado la creencia establecida de que “lo rápido significa lo pequeño”. Por primera vez entre los grandes modelos nacionales, logra integrar capacidades técnicas de primer nivel y una latencia extremadamente baja en entornos de producción reales.
Según se informa, este modelo fue desarrollado conjuntamente por el equipo GLM de Zhipu y el equipo TileRT. Ambos equipos realizaron optimizaciones profundas y exhaustivas a nivel de sistema en tres áreas: el motor de inferencia, el sistema de programación y la infraestructura subyacente, alejándose de los métodos tradicionales de programación dinámica.
Tres niveles de optimización garantizan una salida estable
Desde el punto de vista técnico, el equipo de desarrollo no solo reescribió la ruta central de inferencia del modelo para aumentar la capacidad de procesamiento por tarjeta, sino que también redujo la latencia en escenarios de alta concurrencia mediante técnicas como el agrupamiento dinámico de solicitudes. Al mismo tiempo, las optimizaciones conjuntas en la infraestructura aseguraron que una velocidad de 400 TPS se convirtiera en una capacidad estable y utilizable en entornos de producción.
Este modelo de alta velocidad tiene amplias aplicaciones, especialmente adecuado para escenarios que requieren una respuesta rápida. Ya sea para programación de IA, interacción vocal en tiempo real o toma de decisiones empresariales frecuentes, este modelo está ahora disponible en la plataforma MaaS de Zhipu para empresas seleccionadas.
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr











