谷歌Gemma 4以开源形式发布,凭借310亿参数与顶级模型一较高下
4月3日凌晨4点03分,谷歌DeepMind正式发布了其全新的开源模型系列Gemma4。此次发布恰逢上一版本发布一周年。谷歌不仅在性能上实现了“代际飞跃”,还在开源承诺方面迈出了重要一步:将许可证从自有的专有协议切换为广泛采用的Apache 2.0协议。这一变更使开发者能够自由地将这些模型用于商业目的并进行修改。

完整产品线:覆盖移动端至工作站的四款模型
Gemma4首发推出四款各具特色的模型,覆盖所有应用场景:
31B Dense(旗舰版):拥有310亿个完全激活的参数,支持长达256K的超长上下文。该模型在Arena AI开源排行榜上名列第三。其非量化版本可在单张H100 GPU上运行。
26B A4B MoE(性价比之王):采用专家混合(Mixture-of-Experts)架构,总参数252亿,每次推理仅激活38亿参数。其推理速度媲美40亿参数模型,但质量超越同类产品,在排行榜上名列第六。
E4B & E2B(边缘精英):专为移动和嵌入式设备优化。通过采用分层嵌入技术,有效参数分别压缩至45亿和23亿。在某些设备上,E2B模型可将内存占用降至1.5GB以下。

性能飞跃:代码与数学能力取得重大突破
与上一代Gemma327B相比,Gemma4在核心基准测试中表现突飞猛进:
数学竞赛:在 AIME2026 测试中的得分从 20.8% 跃升至89.2%。
编程实力:Codeforces ELO 评级从 110 跃升至2150。在 LiveCodeBench 上的表现从 29.1% 提升至 80.0%,使其成为目前最强大的开源编程助手之一。
综合推理能力:在研究生级科学问题(GPQA Diamond)上的得分几乎翻倍,从42.4%跃升至84.3%。
多语言能力:原生支持超过140种语言,在MMMLU测试中取得88.4%的得分。

核心功能:内置“思考模式”与代理能力
Gemma4不仅拥有更多参数,其交互逻辑也与旗舰 Gemini 模型保持一致:
思考模式:包含内部推理模式,允许模型在给出答案前处理多步骤计划,从而显著提升复杂任务的准确率。
原生代理支持:支持函数调用和结构化 JSON 输出。Google 同时发布了开源的代理开发工具包 (ADK),使设备端模型能够充当“智能代理”。
深度多模态:所有版本均支持图像和视频输入。即使是较小的模型,也额外包含用于语音识别和翻译的音频编码器。
行业视角:开源领域的“权力重组”
过去一年间,国内开源模型(如DeepSeek、Qwen和GLM)发展迅猛,在一定程度上削弱了谷歌在开源领域的影响力。Gemma4的发布标志着谷歌正通过“极致的边缘端工程”和“更彻底的许可开放”重返前沿。
结论:当科技巨头开始谈论“真诚”时
相关文章
字节跳动加大核心AI激励,豆包增长14.6%
字节跳动近日召开豆包股权说明会,公布面向豆包部门员工的最新激励政策。豆包股票的行权价已从2026年6月的14.85美元上调至17.02美元,涨幅约为14.6%。此次调整不仅提升了豆包股票的估值,还大幅扩大了其覆盖范围。根据员工岗位的不同,部分员工可能获得相当于其总薪酬约5%的豆包股票。根据新的兑换机制,字节跳动允许员工在整体薪酬包中,将部分现金工资兑换为豆包股权。兑换比例因职级而异,设有20%和30%等不同档位。例如,L2和L3级员工可选择20%的全覆盖兑换比例,而L3和L4级员工的该比例可
MiniMax 推出 10 倍团队计划,以激励全球 AI 专家
MiniMax(稀宇科技)通用人工智能实验室正式推出“10x Team”,这是一项全球人才协作计划。该计划旨在招募跨行业的顶尖专家,探索大模型在垂直领域的深度应用。通过将深厚的行业知识与前沿人工智能技术相结合,MiniMax 致力于将大模型的生产力从通用场景拓展至专业场景,最终推动行业效率实现“十倍增长”。验证行业认知价值,开放多模态核心资源过去与行业专家的合作表明,深厚的专业洞察对于构建高质量、实用的行业专属大模型至关重要。在此基础上,“10x Team”计划将向合作伙伴开放包括多模态模型
韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成
韩国媒体EtNews报道,韩国AI计算中心(KOACC)的奠基仪式于8月3日在全罗南道顺天市的Solar City数据中心园区举行。该项目总投资额为2.5万亿韩元(约合118.38亿元人民币),计划于2028年投入运营,成为迄今为止韩国在AI基础设施领域规模最大的国家投资之一。该项目的股权分布凸显了深化政企合作的战略意图。三星SDS作为最大股东持有30%的股份,而包括科学技术信息通信部、金融监督院和国家成长基金在内的公共实体合计持有29%的股份。NAVER Cloud紧随其后,持股26.1%,
相关专题推荐
评论 (0)
0/500
4月3日凌晨4点03分,谷歌DeepMind正式发布了其全新的开源模型系列Gemma4。此次发布恰逢上一版本发布一周年。谷歌不仅在性能上实现了“代际飞跃”,还在开源承诺方面迈出了重要一步:将许可证从自有的专有协议切换为广泛采用的Apache 2.0协议。这一变更使开发者能够自由地将这些模型用于商业目的并进行修改。

完整产品线:覆盖移动端至工作站的四款模型
Gemma4首发推出四款各具特色的模型,覆盖所有应用场景:
31B Dense(旗舰版):拥有310亿个完全激活的参数,支持长达256K的超长上下文。该模型在Arena AI开源排行榜上名列第三。其非量化版本可在单张H100 GPU上运行。
26B A4B MoE(性价比之王):采用专家混合(Mixture-of-Experts)架构,总参数252亿,每次推理仅激活38亿参数。其推理速度媲美40亿参数模型,但质量超越同类产品,在排行榜上名列第六。
E4B & E2B(边缘精英):专为移动和嵌入式设备优化。通过采用分层嵌入技术,有效参数分别压缩至45亿和23亿。在某些设备上,E2B模型可将内存占用降至1.5GB以下。

性能飞跃:代码与数学能力取得重大突破
与上一代Gemma327B相比,Gemma4在核心基准测试中表现突飞猛进:
数学竞赛:在 AIME2026 测试中的得分从 20.8% 跃升至89.2%。
编程实力:Codeforces ELO 评级从 110 跃升至2150。在 LiveCodeBench 上的表现从 29.1% 提升至 80.0%,使其成为目前最强大的开源编程助手之一。
综合推理能力:在研究生级科学问题(GPQA Diamond)上的得分几乎翻倍,从42.4%跃升至84.3%。
多语言能力:原生支持超过140种语言,在MMMLU测试中取得88.4%的得分。

核心功能:内置“思考模式”与代理能力
Gemma4不仅拥有更多参数,其交互逻辑也与旗舰 Gemini 模型保持一致:
思考模式:包含内部推理模式,允许模型在给出答案前处理多步骤计划,从而显著提升复杂任务的准确率。
原生代理支持:支持函数调用和结构化 JSON 输出。Google 同时发布了开源的代理开发工具包 (ADK),使设备端模型能够充当“智能代理”。
深度多模态:所有版本均支持图像和视频输入。即使是较小的模型,也额外包含用于语音识别和翻译的音频编码器。
行业视角:开源领域的“权力重组”
过去一年间,国内开源模型(如DeepSeek、Qwen和GLM)发展迅猛,在一定程度上削弱了谷歌在开源领域的影响力。Gemma4的发布标志着谷歌正通过“极致的边缘端工程”和“更彻底的许可开放”重返前沿。
结论:当科技巨头开始谈论“真诚”时
字节跳动加大核心AI激励,豆包增长14.6%
字节跳动近日召开豆包股权说明会,公布面向豆包部门员工的最新激励政策。豆包股票的行权价已从2026年6月的14.85美元上调至17.02美元,涨幅约为14.6%。此次调整不仅提升了豆包股票的估值,还大幅扩大了其覆盖范围。根据员工岗位的不同,部分员工可能获得相当于其总薪酬约5%的豆包股票。根据新的兑换机制,字节跳动允许员工在整体薪酬包中,将部分现金工资兑换为豆包股权。兑换比例因职级而异,设有20%和30%等不同档位。例如,L2和L3级员工可选择20%的全覆盖兑换比例,而L3和L4级员工的该比例可
MiniMax 推出 10 倍团队计划,以激励全球 AI 专家
MiniMax(稀宇科技)通用人工智能实验室正式推出“10x Team”,这是一项全球人才协作计划。该计划旨在招募跨行业的顶尖专家,探索大模型在垂直领域的深度应用。通过将深厚的行业知识与前沿人工智能技术相结合,MiniMax 致力于将大模型的生产力从通用场景拓展至专业场景,最终推动行业效率实现“十倍增长”。验证行业认知价值,开放多模态核心资源过去与行业专家的合作表明,深厚的专业洞察对于构建高质量、实用的行业专属大模型至关重要。在此基础上,“10x Team”计划将向合作伙伴开放包括多模态模型
韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成
韩国媒体EtNews报道,韩国AI计算中心(KOACC)的奠基仪式于8月3日在全罗南道顺天市的Solar City数据中心园区举行。该项目总投资额为2.5万亿韩元(约合118.38亿元人民币),计划于2028年投入运营,成为迄今为止韩国在AI基础设施领域规模最大的国家投资之一。该项目的股权分布凸显了深化政企合作的战略意图。三星SDS作为最大股东持有30%的股份,而包括科学技术信息通信部、金融监督院和国家成长基金在内的公共实体合计持有29%的股份。NAVER Cloud紧随其后,持股26.1%,





首页






