DeepSeek 的下一代模型可能具備 3 萬億引數,旨在對標 GPT-6 Astra 的效能

DeepSeek 近期推出了 V4.1 Flash,其架構調整幅度之大,足以媲美 V5 版本的釋出,但公司仍選擇保留現有的版本號。儘管 Pro 系列更新版 V4.1 Pro 已得到確認,但詳細規格尚未公佈。假設其改程序度與 V4 到 V4.1 的過渡相當,V4.1 Pro 有望實現卓越的效能;然而,鑑於此前 V4 Pro-0813 最終版的反響平平,市場對其預期應保持理性。
DeepSeek Code 2.0 即將釋出,重點強化計算機控制能力
行業報告顯示,DeepSeek Code 2.0 計劃於 9 月釋出,其效能將超越目前的市場領導者 Mythos 5.1 和 GPT-6 Astra。這款新一代模型旨在超越當今最先進的語言大模型的能力。
DeepSeek Code 2.0 預計將繼續保持開源承諾,其設計重點主要放在“計算機使用”(Computer Use)上。該功能使 AI 能夠自主操作計算機,代表使用者執行復雜的工作流程——這一特性顯著提升了 Astra 等模型的實用性。
3 萬億引數:中國最大規模
據報道,該模型擁有超過 3 萬億個引數,這是其效能提升的關鍵驅動力。作為參考,中國目前最強的模型包括擁有 2.8 萬億引數的 K3、擁有 2.4 萬億引數的 Qwen 3.8 Max,以及擁有 1.6 萬億引數的 DeepSeek V4 Pro。
鑑於 V4.1 Flash 採用了引數數量翻倍的新技術架構,DeepSeek Code 2.0 達到 3 萬億引數的規模顯得合情合理。要與 Mythos 5.1 和 Astra 等巨頭競爭,這種規模是必要的;否則,實現更高的效能上限將極具挑戰性。
儘管如此,此次洩露資訊的可信度仍存疑。DeepSeek 此前在 2023 年至 2024 年間釋出了三個 Code 模型,但結果平平。如果 DeepSeek 現在將一款專注於程式碼和邏輯的 Code 模型定位為其旗艦產品,這將是其產品線中合乎邏輯的演進,同時戰略性地將 V4.1 Pro 和 Flash 保留給通用智慧體任務。
相關文章
瑞典人工智慧初創公司Lovable Eyes在完成主要融資輪後估值達132億美元
隨著人工智慧驅動的編碼工具日益普及,瑞典初創公司 Lovable 已獲一輪重大融資。該公司計劃籌集 30 億美元,其估值有望升至 132 億美元——這是去年 12 月記錄的 66 億美元的兩倍。預計 Menlo Ventures 將主導此次投資。Lovable 的吸引力源於其核心的“氛圍編碼”(vibe coding)技術,該技術透過消除對複雜編碼技能的需求來簡化軟體開發。使用者只需以自然語言描述其需求,系統即可自動生成應用程式。這種直觀的方法吸引了個人開發者、設計師和小企業,並擴充套件至 Work
Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制
根據《商業內幕》的報道,谷歌正在測試 Remy,這是 Gemini 的一款全新 AI 個人代理工具。該工具旨在代表使用者執行任務,從而簡化專業工作流程和日常事務。目前,Remy 正在 Gemini 應用的內部員工專屬版本中進行測試。該報告引用了一份內部檔案以及對兩位熟悉該專案的個人的採訪。內部資料將 Remy 描述為“全天候個人代理”,將 Gemini 定位為能夠代表使用者行事的主動助手。接近該專案的訊息人士證實,谷歌員工正在積極測試 Remy。谷歌發言人拒絕提供進一步評論。該報告未提及公開發布
如何修復核心網頁指標以獲得更好的 SEO 排名
利用 AI 工具簡化成績單評語撰寫引言用於生成成績單評語的 AI 工具Magic SchoolAlmanac AIChat GPT使用 Magic School 生成成績單評語登入 Magic School選擇成績單評語工具為學生定製評語使用 Almanac AI 生成成績單評語設定課程與評分方案配置評語長度與學生資訊使用 Almanac AI 生成評語比較 Magic School 與 Almanac AI設定的便捷性可定製性與課程內容的整合速度與效率使用
相關專題推薦
評論 (0)
0/500

DeepSeek 近期推出了 V4.1 Flash,其架構調整幅度之大,足以媲美 V5 版本的釋出,但公司仍選擇保留現有的版本號。儘管 Pro 系列更新版 V4.1 Pro 已得到確認,但詳細規格尚未公佈。假設其改程序度與 V4 到 V4.1 的過渡相當,V4.1 Pro 有望實現卓越的效能;然而,鑑於此前 V4 Pro-0813 最終版的反響平平,市場對其預期應保持理性。
DeepSeek Code 2.0 即將釋出,重點強化計算機控制能力
行業報告顯示,DeepSeek Code 2.0 計劃於 9 月釋出,其效能將超越目前的市場領導者 Mythos 5.1 和 GPT-6 Astra。這款新一代模型旨在超越當今最先進的語言大模型的能力。
DeepSeek Code 2.0 預計將繼續保持開源承諾,其設計重點主要放在“計算機使用”(Computer Use)上。該功能使 AI 能夠自主操作計算機,代表使用者執行復雜的工作流程——這一特性顯著提升了 Astra 等模型的實用性。
3 萬億引數:中國最大規模
據報道,該模型擁有超過 3 萬億個引數,這是其效能提升的關鍵驅動力。作為參考,中國目前最強的模型包括擁有 2.8 萬億引數的 K3、擁有 2.4 萬億引數的 Qwen 3.8 Max,以及擁有 1.6 萬億引數的 DeepSeek V4 Pro。
鑑於 V4.1 Flash 採用了引數數量翻倍的新技術架構,DeepSeek Code 2.0 達到 3 萬億引數的規模顯得合情合理。要與 Mythos 5.1 和 Astra 等巨頭競爭,這種規模是必要的;否則,實現更高的效能上限將極具挑戰性。
儘管如此,此次洩露資訊的可信度仍存疑。DeepSeek 此前在 2023 年至 2024 年間釋出了三個 Code 模型,但結果平平。如果 DeepSeek 現在將一款專注於程式碼和邏輯的 Code 模型定位為其旗艦產品,這將是其產品線中合乎邏輯的演進,同時戰略性地將 V4.1 Pro 和 Flash 保留給通用智慧體任務。
瑞典人工智慧初創公司Lovable Eyes在完成主要融資輪後估值達132億美元
隨著人工智慧驅動的編碼工具日益普及,瑞典初創公司 Lovable 已獲一輪重大融資。該公司計劃籌集 30 億美元,其估值有望升至 132 億美元——這是去年 12 月記錄的 66 億美元的兩倍。預計 Menlo Ventures 將主導此次投資。Lovable 的吸引力源於其核心的“氛圍編碼”(vibe coding)技術,該技術透過消除對複雜編碼技能的需求來簡化軟體開發。使用者只需以自然語言描述其需求,系統即可自動生成應用程式。這種直觀的方法吸引了個人開發者、設計師和小企業,並擴充套件至 Work
如何修復核心網頁指標以獲得更好的 SEO 排名
利用 AI 工具簡化成績單評語撰寫引言用於生成成績單評語的 AI 工具Magic SchoolAlmanac AIChat GPT使用 Magic School 生成成績單評語登入 Magic School選擇成績單評語工具為學生定製評語使用 Almanac AI 生成成績單評語設定課程與評分方案配置評語長度與學生資訊使用 Almanac AI 生成評語比較 Magic School 與 Almanac AI設定的便捷性可定製性與課程內容的整合速度與效率使用





首頁






