智普凭借GLM-5.1高速版本打破了全球AI速度记录
中国著名的AI团队智普今日正式宣布,为部分企业客户推出了全新的GLM-5.1高速API。这款被命名为“GLM-5.1-highspeed”的模型自发布以来便震撼了整个行业,其输出速度高达每秒400个token。
这一数字直接超越了目前全球主要大型模型提供商设定的API速度基准,充分体现了其强大的技术实力。此前,AI行业普遍认为模型的速度与规模是相互矛盾的,即想要提高速度,往往就需要牺牲模型的功能。
以旗舰级性能打破行业常规
然而,GLM-5.1高速版本彻底打破了“速度快意味着模型规模小”这一长期存在的行业观念。在国内大型模型中,这是首次将旗舰级的技术实力和超低的延迟能力应用到实际生产环境中。
据报道,这款模型是由智普的GLM团队与TileRT团队共同开发的。两个团队从三个层面进行了深入、全面的系统级优化:推理引擎、调度系统以及底层基础设施,并摒弃了传统的动态调度机制。
三层优化确保稳定输出
在技术层面上,开发团队不仅重新设计了模型架构的核心推理路径,以提高单卡的处理能力,还通过动态批处理等技术,在高并发场景下有效降低了延迟。同时,围绕基础设施进行的协同优化也使得每秒400个token的输出速度成为一种稳定且可实用的生产级能力。
这款高速模型具有广泛的应用前景,尤其适用于那些对响应延迟有严格要求的场景。无论是用于AI编程、实时语音交互,还是辅助企业进行频繁的业务决策,该模型都已经可以在智普的MaaS平台上为部分企业提供服务了。
相关文章
字节跳动旗下 Seed 启动全球校园招聘,以虚拟股份争夺顶尖大模型人才
在大型语言模型的竞争格局中,争夺顶尖人才仍然是最关键的战略资产。4月1日,字节跳动宣布启动Seed全球校园招聘计划,作为其大模型人才培养项目的一部分。该活动面向2027届毕业生及现有实习生,旨在全球范围内发掘并锁定AI领域的精英研发与工程人才。规模扩张:全球甄选100名“AI种子”在技术快速进步的背景下,字节跳动有限公司今年大幅增加了对基础AI人才的投入:招聘范围: 该计划旨在从全球范围内招聘约100名专注于大模型的杰出候选人,对象为2027届毕业生。发展路径: Seed计划将核心业务
Suno 在法律诉讼中为歌曲添加水印
Suno,这个允许用户生成由人工智能创作的音乐的平台,近日推出了新功能,包括为平台制作的曲目添加标签、限制下载,并更新社区标准以遏制未经授权的复制品。这些更新是在Suno面临多家唱片公司和艺术家组织提起的多起诉讼之际推出的。在博客文章中,联合创始人兼首席执行官Mikey Shulman概述了核心原则,强调该平台旨在促进原创创作,同时扩大更广泛受众对人工智能音乐工具的访问权限。一个主要的争议点在于,用户将人工智能生成的歌曲上传到其他流媒体服务并通过操纵系统获取收入。Suno表示,现在将采用音频
马斯克承认 Grok 构建过程中泄露了用户代码,并承诺清除所有历史数据
埃隆·马斯克直接回应了围绕 Grok Build 的隐私争议,首先以简单的“True”(属实)确认了该事件的有效性。他承诺,此前上传至 SpaceXAI 的所有用户数据将被永久删除,并表示“不留一个字节”。这是人工智能行业首次由主要科技领袖公开承认错误并主动删除用户数据。安全研究人员的“钓鱼”测试揭示了数据泄露的具体证据此次争议源于独立人工智能安全研究人员 @cereblab 的一份报告。SpaceXAI 推出的 AI 编程助手 Grok Build 在其官方网站上声称其“优先本地运行,代码
相关专题推荐
评论 (0)
0/500
中国著名的AI团队智普今日正式宣布,为部分企业客户推出了全新的GLM-5.1高速API。这款被命名为“GLM-5.1-highspeed”的模型自发布以来便震撼了整个行业,其输出速度高达每秒400个token。
这一数字直接超越了目前全球主要大型模型提供商设定的API速度基准,充分体现了其强大的技术实力。此前,AI行业普遍认为模型的速度与规模是相互矛盾的,即想要提高速度,往往就需要牺牲模型的功能。
以旗舰级性能打破行业常规
然而,GLM-5.1高速版本彻底打破了“速度快意味着模型规模小”这一长期存在的行业观念。在国内大型模型中,这是首次将旗舰级的技术实力和超低的延迟能力应用到实际生产环境中。
据报道,这款模型是由智普的GLM团队与TileRT团队共同开发的。两个团队从三个层面进行了深入、全面的系统级优化:推理引擎、调度系统以及底层基础设施,并摒弃了传统的动态调度机制。
三层优化确保稳定输出
在技术层面上,开发团队不仅重新设计了模型架构的核心推理路径,以提高单卡的处理能力,还通过动态批处理等技术,在高并发场景下有效降低了延迟。同时,围绕基础设施进行的协同优化也使得每秒400个token的输出速度成为一种稳定且可实用的生产级能力。
这款高速模型具有广泛的应用前景,尤其适用于那些对响应延迟有严格要求的场景。无论是用于AI编程、实时语音交互,还是辅助企业进行频繁的业务决策,该模型都已经可以在智普的MaaS平台上为部分企业提供服务了。
字节跳动旗下 Seed 启动全球校园招聘,以虚拟股份争夺顶尖大模型人才
在大型语言模型的竞争格局中,争夺顶尖人才仍然是最关键的战略资产。4月1日,字节跳动宣布启动Seed全球校园招聘计划,作为其大模型人才培养项目的一部分。该活动面向2027届毕业生及现有实习生,旨在全球范围内发掘并锁定AI领域的精英研发与工程人才。规模扩张:全球甄选100名“AI种子”在技术快速进步的背景下,字节跳动有限公司今年大幅增加了对基础AI人才的投入:招聘范围: 该计划旨在从全球范围内招聘约100名专注于大模型的杰出候选人,对象为2027届毕业生。发展路径: Seed计划将核心业务
Suno 在法律诉讼中为歌曲添加水印
Suno,这个允许用户生成由人工智能创作的音乐的平台,近日推出了新功能,包括为平台制作的曲目添加标签、限制下载,并更新社区标准以遏制未经授权的复制品。这些更新是在Suno面临多家唱片公司和艺术家组织提起的多起诉讼之际推出的。在博客文章中,联合创始人兼首席执行官Mikey Shulman概述了核心原则,强调该平台旨在促进原创创作,同时扩大更广泛受众对人工智能音乐工具的访问权限。一个主要的争议点在于,用户将人工智能生成的歌曲上传到其他流媒体服务并通过操纵系统获取收入。Suno表示,现在将采用音频
马斯克承认 Grok 构建过程中泄露了用户代码,并承诺清除所有历史数据
埃隆·马斯克直接回应了围绕 Grok Build 的隐私争议,首先以简单的“True”(属实)确认了该事件的有效性。他承诺,此前上传至 SpaceXAI 的所有用户数据将被永久删除,并表示“不留一个字节”。这是人工智能行业首次由主要科技领袖公开承认错误并主动删除用户数据。安全研究人员的“钓鱼”测试揭示了数据泄露的具体证据此次争议源于独立人工智能安全研究人员 @cereblab 的一份报告。SpaceXAI 推出的 AI 编程助手 Grok Build 在其官方网站上声称其“优先本地运行,代码





首页






