DeepSeek V4 預計於四月中旬推出,具備兆級參數並支援國產晶片
DeepSeek 創辦人梁文峰近日在一份內部備忘錄中透露,該公司的下一代旗艦模型 DeepSeek V4 預計將於 2026 年 4 月底正式發布。這項公告標誌著在邁向兆參數規模的全球競賽中,國內大型語言模型迎來了一個關鍵時刻。 在 V4 發布之前,DeepSeek 已在其網頁平台上推出「快速模式」和「專家模式」,透過快速搜尋及處理複雜的多步驟查詢等差異化互動,讓使用者一窺其能力。

技術層面而言,DeepSeek V4 預計將實現重大飛躍,目標參數規模達一兆,並支援高達一百萬個標記的上下文視窗。其關鍵突破在於與華為昇騰系列晶片等國產硬體具備深層的原生相容性。此戰略性發展被視為中國 AI 產業減少對 CUDA 生態系統依賴、建立自主運算基礎的關鍵一步。 為因應此需求,包括阿里巴巴、字節跳動及騰訊在內的國內科技巨頭已大量訂購數十萬顆新型AI晶片,旨在透過其雲端服務快速整合V4。這股需求激增已導致近期AI晶片價格上漲約20%。
隨著 DeepSeek V4 的問世,大型模型領域的競爭正從純粹的演算法競賽,轉變為涵蓋「模型效能、運算能力及生態系發展」的全方位戰役。透過針對國內運算基礎設施進行優化,DeepSeek 不僅提升了模型推論的成本效益,更在當前的運算能力格局下,為本土大型模型的成長開闢了一條可持續的發展道路。
相關文章
前 Ramp 工程師在從首個產品轉型後,為 Melius 平臺籌集了 2000 萬美元
Melius,一個由人工智慧驅動的廣告活動、圖片和影片建立平臺,於週二宣佈已獲得總計 2500 萬美元的資金。其中包括由 CRV 領投的 2000 萬美元 A 輪融資,以及由 General Catalyst 支援的 500 萬美元種子輪融資。儘管這家初創公司在今年 7 月結束隱身期後的短短兩個月內就實現了超過 100 萬美元的年化收入,但聯合創始人金周元(右圖)承認,Melius 並未立即取得成功。這家總部位於紐約的公司一年多前成立時,金周元及其聯合創始人金英(左圖)和阿爾納夫·拉穆(中圖
WeRide 釋出 WIIT,一種物理 AI 感知模型,用於解碼現實世界
在2026世界人工智慧大會(WAIC)上,WeRide釋出了WIIT,這是一個物理AI認知基礎模型,為人工智慧開闢了新的發展路徑,將焦點從資料解讀轉向現實世界的認知。WIIT引入了源自真實場景的“最小物理事實單元”概念。它將動態環境分解為可識別、可驗證的基本單元,從而建立起理解物理世界的穩健AI框架。藉助這些物理事實,WIIT提供了四項核心能力:事實提取、推理、驗證和編排。事實提取用於識別複雜環境中的關鍵要素,而事實驗證則釐清不同事實之間的關係。事實驗證增強了AI評估現實世界資訊準確性的能力
Anthropic執行長Amodei駁斥悲觀觀點,將AI信任危機歸咎於未兌現的承諾
在公眾關於人工智慧風險與監管的討論日益激烈的背景下,Anthropic 執行長 Dario Amodei 反駁了那些聲稱其言論過於悲觀的說法。這一澄清直接回應了投資者 Gavin Baker 的批評,後者在 All-In 播客和 X 平臺上表示,Amodei 關於人工智慧危險的警告加劇了公眾對美國人工智慧基礎設施(如資料中心)的抵制。Baker 認為 Amodei 實際上“輸掉”了監管辯論,並敦促他作為行業領導者採取更具建設性的立場。Amodei 否認其溝通具有負面性質,指出他的文章《充滿愛
相關專題推薦
評論 (2)
0/500
Trillion parameters and domestic chip support? Sounds like they're finally trying to break free from Nvidia's grip. But how's the power consumption? Hope it doesn't turn into a space heater 🔥
DeepSeek 創辦人梁文峰近日在一份內部備忘錄中透露,該公司的下一代旗艦模型 DeepSeek V4 預計將於 2026 年 4 月底正式發布。這項公告標誌著在邁向兆參數規模的全球競賽中,國內大型語言模型迎來了一個關鍵時刻。 在 V4 發布之前,DeepSeek 已在其網頁平台上推出「快速模式」和「專家模式」,透過快速搜尋及處理複雜的多步驟查詢等差異化互動,讓使用者一窺其能力。

技術層面而言,DeepSeek V4 預計將實現重大飛躍,目標參數規模達一兆,並支援高達一百萬個標記的上下文視窗。其關鍵突破在於與華為昇騰系列晶片等國產硬體具備深層的原生相容性。此戰略性發展被視為中國 AI 產業減少對 CUDA 生態系統依賴、建立自主運算基礎的關鍵一步。 為因應此需求,包括阿里巴巴、字節跳動及騰訊在內的國內科技巨頭已大量訂購數十萬顆新型AI晶片,旨在透過其雲端服務快速整合V4。這股需求激增已導致近期AI晶片價格上漲約20%。
隨著 DeepSeek V4 的問世,大型模型領域的競爭正從純粹的演算法競賽,轉變為涵蓋「模型效能、運算能力及生態系發展」的全方位戰役。透過針對國內運算基礎設施進行優化,DeepSeek 不僅提升了模型推論的成本效益,更在當前的運算能力格局下,為本土大型模型的成長開闢了一條可持續的發展道路。
前 Ramp 工程師在從首個產品轉型後,為 Melius 平臺籌集了 2000 萬美元
Melius,一個由人工智慧驅動的廣告活動、圖片和影片建立平臺,於週二宣佈已獲得總計 2500 萬美元的資金。其中包括由 CRV 領投的 2000 萬美元 A 輪融資,以及由 General Catalyst 支援的 500 萬美元種子輪融資。儘管這家初創公司在今年 7 月結束隱身期後的短短兩個月內就實現了超過 100 萬美元的年化收入,但聯合創始人金周元(右圖)承認,Melius 並未立即取得成功。這家總部位於紐約的公司一年多前成立時,金周元及其聯合創始人金英(左圖)和阿爾納夫·拉穆(中圖
WeRide 釋出 WIIT,一種物理 AI 感知模型,用於解碼現實世界
在2026世界人工智慧大會(WAIC)上,WeRide釋出了WIIT,這是一個物理AI認知基礎模型,為人工智慧開闢了新的發展路徑,將焦點從資料解讀轉向現實世界的認知。WIIT引入了源自真實場景的“最小物理事實單元”概念。它將動態環境分解為可識別、可驗證的基本單元,從而建立起理解物理世界的穩健AI框架。藉助這些物理事實,WIIT提供了四項核心能力:事實提取、推理、驗證和編排。事實提取用於識別複雜環境中的關鍵要素,而事實驗證則釐清不同事實之間的關係。事實驗證增強了AI評估現實世界資訊準確性的能力
Anthropic執行長Amodei駁斥悲觀觀點,將AI信任危機歸咎於未兌現的承諾
在公眾關於人工智慧風險與監管的討論日益激烈的背景下,Anthropic 執行長 Dario Amodei 反駁了那些聲稱其言論過於悲觀的說法。這一澄清直接回應了投資者 Gavin Baker 的批評,後者在 All-In 播客和 X 平臺上表示,Amodei 關於人工智慧危險的警告加劇了公眾對美國人工智慧基礎設施(如資料中心)的抵制。Baker 認為 Amodei 實際上“輸掉”了監管辯論,並敦促他作為行業領導者採取更具建設性的立場。Amodei 否認其溝通具有負面性質,指出他的文章《充滿愛
Trillion parameters and domestic chip support? Sounds like they're finally trying to break free from Nvidia's grip. But how's the power consumption? Hope it doesn't turn into a space heater 🔥





首頁






