DeepSeek V4 计划于4月中旬发布,拥有万亿级参数并支持国产芯片
DeepSeek创始人梁文峰近日在一份内部备忘录中透露,该公司下一代旗舰模型DeepSeek V4正按计划推进,预计将于2026年4月下旬正式发布。这一消息标志着国内大型语言模型在全球万亿参数规模竞赛中迎来关键时刻。 在V4发布之前,DeepSeek已在网页平台上线了“极速模式”和“专家模式”,通过快速搜索和处理复杂的多步骤查询等差异化交互,让用户得以一窥其强大功能。

从技术层面看,DeepSeek V4预计将实现重大飞跃,目标参数规模达万亿级,并支持高达100万令牌的上下文窗口。其关键突破在于与华为昇腾系列芯片等国产硬件的深度原生兼容。这一战略性进展被视为中国AI行业减少对CUDA生态系统依赖、构建自主计算基础的关键一步。 为满足这一需求,包括阿里巴巴、字节跳动和腾讯在内的国内科技巨头已批量订购数十万颗新型AI芯片,旨在通过其云服务快速集成V4。这一需求激增导致近期AI芯片价格上涨了约20%。
随着DeepSeek V4的问世,大模型领域的竞争正从单纯的算法比拼,转向涵盖“模型性能、算力及生态系统建设”的全方位角逐。通过针对国内计算基础设施进行优化,DeepSeek不仅提升了模型推理的成本效益,更在当前的算力格局下,为本土大模型的成长开辟了一条可持续的发展路径。
相关文章
前 Ramp 工程师在从首个产品转型后,为 Melius 平台筹集了 2000 万美元
Melius,一个由人工智能驱动的广告活动、图片和视频创建平台,于周二宣布已获得总计 2500 万美元的资金。其中包括由 CRV 领投的 2000 万美元 A 轮融资,以及由 General Catalyst 支持的 500 万美元种子轮融资。尽管这家初创公司在今年 7 月结束隐身期后的短短两个月内就实现了超过 100 万美元的年化收入,但联合创始人金周元(右图)承认,Melius 并未立即取得成功。这家总部位于纽约的公司一年多前成立时,金周元及其联合创始人金英(左图)和阿尔纳夫·拉穆(中图
WeRide 发布 WIIT,一种物理 AI 感知模型,用于解码现实世界
在2026世界人工智能大会(WAIC)上,WeRide发布了WIIT,这是一个物理AI认知基础模型,为人工智能开辟了新的发展路径,将焦点从数据解读转向现实世界的认知。WIIT引入了源自真实场景的“最小物理事实单元”概念。它将动态环境分解为可识别、可验证的基本单元,从而建立起理解物理世界的稳健AI框架。借助这些物理事实,WIIT提供了四项核心能力:事实提取、推理、验证和编排。事实提取用于识别复杂环境中的关键要素,而事实验证则厘清不同事实之间的关系。事实验证增强了AI评估现实世界信息准确性的能力
Anthropic首席执行官Amodei驳斥悲观观点,将AI信任危机归咎于未兑现的承诺
在公众关于人工智能风险与监管的讨论日益激烈的背景下,Anthropic 首席执行官 Dario Amodei 反驳了那些声称其言论过于悲观的说法。这一澄清直接回应了投资者 Gavin Baker 的批评,后者在 All-In 播客和 X 平台上表示,Amodei 关于人工智能危险的警告加剧了公众对美国人工智能基础设施(如数据中心)的抵制。Baker 认为 Amodei 实际上“输掉”了监管辩论,并敦促他作为行业领导者采取更具建设性的立场。Amodei 否认其沟通具有负面性质,指出他的文章《充满爱
相关专题推荐
评论 (2)
0/500
Trillion parameters and domestic chip support? Sounds like they're finally trying to break free from Nvidia's grip. But how's the power consumption? Hope it doesn't turn into a space heater 🔥
DeepSeek创始人梁文峰近日在一份内部备忘录中透露,该公司下一代旗舰模型DeepSeek V4正按计划推进,预计将于2026年4月下旬正式发布。这一消息标志着国内大型语言模型在全球万亿参数规模竞赛中迎来关键时刻。 在V4发布之前,DeepSeek已在网页平台上线了“极速模式”和“专家模式”,通过快速搜索和处理复杂的多步骤查询等差异化交互,让用户得以一窥其强大功能。

从技术层面看,DeepSeek V4预计将实现重大飞跃,目标参数规模达万亿级,并支持高达100万令牌的上下文窗口。其关键突破在于与华为昇腾系列芯片等国产硬件的深度原生兼容。这一战略性进展被视为中国AI行业减少对CUDA生态系统依赖、构建自主计算基础的关键一步。 为满足这一需求,包括阿里巴巴、字节跳动和腾讯在内的国内科技巨头已批量订购数十万颗新型AI芯片,旨在通过其云服务快速集成V4。这一需求激增导致近期AI芯片价格上涨了约20%。
随着DeepSeek V4的问世,大模型领域的竞争正从单纯的算法比拼,转向涵盖“模型性能、算力及生态系统建设”的全方位角逐。通过针对国内计算基础设施进行优化,DeepSeek不仅提升了模型推理的成本效益,更在当前的算力格局下,为本土大模型的成长开辟了一条可持续的发展路径。
前 Ramp 工程师在从首个产品转型后,为 Melius 平台筹集了 2000 万美元
Melius,一个由人工智能驱动的广告活动、图片和视频创建平台,于周二宣布已获得总计 2500 万美元的资金。其中包括由 CRV 领投的 2000 万美元 A 轮融资,以及由 General Catalyst 支持的 500 万美元种子轮融资。尽管这家初创公司在今年 7 月结束隐身期后的短短两个月内就实现了超过 100 万美元的年化收入,但联合创始人金周元(右图)承认,Melius 并未立即取得成功。这家总部位于纽约的公司一年多前成立时,金周元及其联合创始人金英(左图)和阿尔纳夫·拉穆(中图
WeRide 发布 WIIT,一种物理 AI 感知模型,用于解码现实世界
在2026世界人工智能大会(WAIC)上,WeRide发布了WIIT,这是一个物理AI认知基础模型,为人工智能开辟了新的发展路径,将焦点从数据解读转向现实世界的认知。WIIT引入了源自真实场景的“最小物理事实单元”概念。它将动态环境分解为可识别、可验证的基本单元,从而建立起理解物理世界的稳健AI框架。借助这些物理事实,WIIT提供了四项核心能力:事实提取、推理、验证和编排。事实提取用于识别复杂环境中的关键要素,而事实验证则厘清不同事实之间的关系。事实验证增强了AI评估现实世界信息准确性的能力
Anthropic首席执行官Amodei驳斥悲观观点,将AI信任危机归咎于未兑现的承诺
在公众关于人工智能风险与监管的讨论日益激烈的背景下,Anthropic 首席执行官 Dario Amodei 反驳了那些声称其言论过于悲观的说法。这一澄清直接回应了投资者 Gavin Baker 的批评,后者在 All-In 播客和 X 平台上表示,Amodei 关于人工智能危险的警告加剧了公众对美国人工智能基础设施(如数据中心)的抵制。Baker 认为 Amodei 实际上“输掉”了监管辩论,并敦促他作为行业领导者采取更具建设性的立场。Amodei 否认其沟通具有负面性质,指出他的文章《充满爱
Trillion parameters and domestic chip support? Sounds like they're finally trying to break free from Nvidia's grip. But how's the power consumption? Hope it doesn't turn into a space heater 🔥





首页






