谷歌和英伟达将DiffusionGemma开源,单显卡推理速度提升4倍
2026年6月10日,谷歌推出了DiffusionGemma——一款实验性的开源语言模型,它打破了传统自回归范式中“逐词生成文本”的模式。 该模型率先将图像AI中的扩散机制应用于文本生成,从随机噪声开始,通过迭代精炼,每步可并行输出256个令牌的文本块。

在硬件性能方面,得益于英伟达的深度优化,该模型在单GPU单用户模式下的运行速度比同类传统模型快近四倍。 在 H100 GPU 上,单次请求的输出速度可达每秒 1,000 个令牌;即使在 RTX 5090 等高端消费级 GPU 上,其输出速度也能超过每秒 700 个令牌。
DiffusionGemma 拥有 260 亿个参数,采用专家混合(MoE)架构,每步仅激活 38 亿个参数。 虽然在标准基准测试中,其文本生成质量和准确度略逊于传统的 Gemma4 系列模型,但其独特的“全块感知”能力克服了自回归模型仅能向前推导的局限性。 由于在生成过程中所有令牌均可相互引用,该模型在涉及非线性及结构化数据的任务中表现尤为出色,例如文本补全、代码填充、数独求解和氨基酸序列处理。

该模型的权重现已根据 Apache 2.0 许可证在 Hugging Face 上开源,并可与 vLLM 和 MLX 等主流推理框架无缝兼容。这一探索不仅消除了 GPU 计算能力在内存带宽方面的限制,还为未来人工智能在复杂逻辑和非线性文本生成领域的应用开辟了一条新的技术路径。
相关文章
字节跳动加大核心AI激励,豆包增长14.6%
字节跳动近日召开豆包股权说明会,公布面向豆包部门员工的最新激励政策。豆包股票的行权价已从2026年6月的14.85美元上调至17.02美元,涨幅约为14.6%。此次调整不仅提升了豆包股票的估值,还大幅扩大了其覆盖范围。根据员工岗位的不同,部分员工可能获得相当于其总薪酬约5%的豆包股票。根据新的兑换机制,字节跳动允许员工在整体薪酬包中,将部分现金工资兑换为豆包股权。兑换比例因职级而异,设有20%和30%等不同档位。例如,L2和L3级员工可选择20%的全覆盖兑换比例,而L3和L4级员工的该比例可
MiniMax 推出 10 倍团队计划,以激励全球 AI 专家
MiniMax(稀宇科技)通用人工智能实验室正式推出“10x Team”,这是一项全球人才协作计划。该计划旨在招募跨行业的顶尖专家,探索大模型在垂直领域的深度应用。通过将深厚的行业知识与前沿人工智能技术相结合,MiniMax 致力于将大模型的生产力从通用场景拓展至专业场景,最终推动行业效率实现“十倍增长”。验证行业认知价值,开放多模态核心资源过去与行业专家的合作表明,深厚的专业洞察对于构建高质量、实用的行业专属大模型至关重要。在此基础上,“10x Team”计划将向合作伙伴开放包括多模态模型
韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成
韩国媒体EtNews报道,韩国AI计算中心(KOACC)的奠基仪式于8月3日在全罗南道顺天市的Solar City数据中心园区举行。该项目总投资额为2.5万亿韩元(约合118.38亿元人民币),计划于2028年投入运营,成为迄今为止韩国在AI基础设施领域规模最大的国家投资之一。该项目的股权分布凸显了深化政企合作的战略意图。三星SDS作为最大股东持有30%的股份,而包括科学技术信息通信部、金融监督院和国家成长基金在内的公共实体合计持有29%的股份。NAVER Cloud紧随其后,持股26.1%,
相关专题推荐
评论 (0)
0/500
2026年6月10日,谷歌推出了DiffusionGemma——一款实验性的开源语言模型,它打破了传统自回归范式中“逐词生成文本”的模式。 该模型率先将图像AI中的扩散机制应用于文本生成,从随机噪声开始,通过迭代精炼,每步可并行输出256个令牌的文本块。

在硬件性能方面,得益于英伟达的深度优化,该模型在单GPU单用户模式下的运行速度比同类传统模型快近四倍。 在 H100 GPU 上,单次请求的输出速度可达每秒 1,000 个令牌;即使在 RTX 5090 等高端消费级 GPU 上,其输出速度也能超过每秒 700 个令牌。
DiffusionGemma 拥有 260 亿个参数,采用专家混合(MoE)架构,每步仅激活 38 亿个参数。 虽然在标准基准测试中,其文本生成质量和准确度略逊于传统的 Gemma4 系列模型,但其独特的“全块感知”能力克服了自回归模型仅能向前推导的局限性。 由于在生成过程中所有令牌均可相互引用,该模型在涉及非线性及结构化数据的任务中表现尤为出色,例如文本补全、代码填充、数独求解和氨基酸序列处理。

该模型的权重现已根据 Apache 2.0 许可证在 Hugging Face 上开源,并可与 vLLM 和 MLX 等主流推理框架无缝兼容。这一探索不仅消除了 GPU 计算能力在内存带宽方面的限制,还为未来人工智能在复杂逻辑和非线性文本生成领域的应用开辟了一条新的技术路径。
字节跳动加大核心AI激励,豆包增长14.6%
字节跳动近日召开豆包股权说明会,公布面向豆包部门员工的最新激励政策。豆包股票的行权价已从2026年6月的14.85美元上调至17.02美元,涨幅约为14.6%。此次调整不仅提升了豆包股票的估值,还大幅扩大了其覆盖范围。根据员工岗位的不同,部分员工可能获得相当于其总薪酬约5%的豆包股票。根据新的兑换机制,字节跳动允许员工在整体薪酬包中,将部分现金工资兑换为豆包股权。兑换比例因职级而异,设有20%和30%等不同档位。例如,L2和L3级员工可选择20%的全覆盖兑换比例,而L3和L4级员工的该比例可
MiniMax 推出 10 倍团队计划,以激励全球 AI 专家
MiniMax(稀宇科技)通用人工智能实验室正式推出“10x Team”,这是一项全球人才协作计划。该计划旨在招募跨行业的顶尖专家,探索大模型在垂直领域的深度应用。通过将深厚的行业知识与前沿人工智能技术相结合,MiniMax 致力于将大模型的生产力从通用场景拓展至专业场景,最终推动行业效率实现“十倍增长”。验证行业认知价值,开放多模态核心资源过去与行业专家的合作表明,深厚的专业洞察对于构建高质量、实用的行业专属大模型至关重要。在此基础上,“10x Team”计划将向合作伙伴开放包括多模态模型
韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成
韩国媒体EtNews报道,韩国AI计算中心(KOACC)的奠基仪式于8月3日在全罗南道顺天市的Solar City数据中心园区举行。该项目总投资额为2.5万亿韩元(约合118.38亿元人民币),计划于2028年投入运营,成为迄今为止韩国在AI基础设施领域规模最大的国家投资之一。该项目的股权分布凸显了深化政企合作的战略意图。三星SDS作为最大股东持有30%的股份,而包括科学技术信息通信部、金融监督院和国家成长基金在内的公共实体合计持有29%的股份。NAVER Cloud紧随其后,持股26.1%,





首页






