Groq 公佈核心技術,轉向雲模式,融資 44 億元以擴充套件算力
去年,AI晶片初創公司Groq將其專有的LPU推理技術授權給NVIDIA,交易金額達20億美元,部分團隊成員也加入了NVIDIA。這筆交易引發了外界對Groq未來的質疑,但公司在六個月內迅速調整戰略,轉型為AI推理雲服務提供商,併成功完成了一輪6.5億美元(約合44億元人民幣)的融資。
自信源於“獨特性”
Groq的自信建立在一種獨特的優勢之上:擁有一支具備大規模LPU運營實戰經驗的全球工程團隊。LPU(語言處理單元)是Groq開發的一種專用推理晶片,在處理大型模型推理任務時具有極低延遲的優勢,憑藉卓越的生成速度贏得了開發者的信任。
儘管該技術已授權給NVIDIA,但團隊和專業能力依然完整。Groq將這種“肌肉記憶”視為其對抗其他雲服務提供商的核心競爭優勢。目前,Groq在北美、歐洲、中東和亞太地區的四個區域運營著13個資料中心,服務超過500萬名開發者和數千家AI原生公司,每週處理的Token消耗量已達萬億級別。
聚焦2027年,押注200兆瓦算力
這筆融資將主要用於擴充套件AI推理基礎設施。Groq計劃部署最新的推理技術和NVIDIA LPX系統,目標是在2027年底前將算力提升至200兆瓦,以支援更大規模的推理操作。
從晶片設計公司轉型為AI推理雲服務提供商,Groq的轉變不僅僅是簡單的業務重組。在由NVIDIA主導的市場中,將技術授權給最強的競爭對手,同時透過平臺快速擴大自身的雲服務版圖,這種“以退為進”的策略可能正成為AI初創企業新興的生存智慧。
相關文章
Claude Opus 5.2 夜灰色版釋出,響應速度更快,解決懶惰問題
Opus 5.2 今晨悄然上線,促使許多開發者注意到,更新後的模型 Claude Opus 5.2 已在 Claude Code 內部開始有限範圍的推送。昨晚,X 平臺使用者觀察到,在 Claude Code 中呼叫 Opus 5 時,其效能遠超標準網頁版,宛如“降維打擊”。這種路由策略在頂級 AI 公司中十分常見。資料包分析顯示,儘管前端標籤未變,但底層模型識別符號已切換為 Opus 5.2,這表明 Anthropic 可能完全跳過了 5.1 版本。速度、精度與自動“高強度迴圈”下的持續執
Fireworks AI 釋出搭載 Opus 的 FireRouter:編碼成本降低 57%,精度損失極小
Fireworks AI 推出了搭載 Opus 的 FireRouter,這是業界首個專為 Claude Opus 系列定製的快取感知路由系統。目前,該獨立路由模型已透過無伺服器端點開放使用。經過超過一個月的內部 A/B 測試,FireRouter 在編碼任務中實現了 98.1% 的準確率,同時與單獨使用 Opus 相比,成本降低了 57%。FireRouter 的工作原理是在每次使用者互動時評估每個模型對當前任務的適用性。它計算處理成本(包括提示詞快取),並判斷切換模型所節省的成本是否足以抵消緩
NVIDIA 釋出 Nemotron-Labs-Audex-30B-A3B 統一音訊智慧模型
隨著多模態大模型的快速發展,音訊處理能力往往受到妥協——許多模型在提升音訊理解能力的同時,卻犧牲了文字邏輯。為解決這一問題,NVIDIA 研究人員推出了 Nemotron-Labs-Audex-30B-A3B(Audex),這是一款統一的音訊-文字大語言模型,旨在彌合這一差距。Audex 採用精簡高效的設計,基於強大的純文字混合專家(MoE)架構構建。透過利用單個 Transformer 解碼器,它同時處理文字和量化音訊令牌。該方法將音訊輸入投影到文字嵌入空間,確保與現有用於多模態任務的大語言
相關專題推薦
評論 (0)
0/500
去年,AI晶片初創公司Groq將其專有的LPU推理技術授權給NVIDIA,交易金額達20億美元,部分團隊成員也加入了NVIDIA。這筆交易引發了外界對Groq未來的質疑,但公司在六個月內迅速調整戰略,轉型為AI推理雲服務提供商,併成功完成了一輪6.5億美元(約合44億元人民幣)的融資。
自信源於“獨特性”
Groq的自信建立在一種獨特的優勢之上:擁有一支具備大規模LPU運營實戰經驗的全球工程團隊。LPU(語言處理單元)是Groq開發的一種專用推理晶片,在處理大型模型推理任務時具有極低延遲的優勢,憑藉卓越的生成速度贏得了開發者的信任。
儘管該技術已授權給NVIDIA,但團隊和專業能力依然完整。Groq將這種“肌肉記憶”視為其對抗其他雲服務提供商的核心競爭優勢。目前,Groq在北美、歐洲、中東和亞太地區的四個區域運營著13個資料中心,服務超過500萬名開發者和數千家AI原生公司,每週處理的Token消耗量已達萬億級別。
聚焦2027年,押注200兆瓦算力
這筆融資將主要用於擴充套件AI推理基礎設施。Groq計劃部署最新的推理技術和NVIDIA LPX系統,目標是在2027年底前將算力提升至200兆瓦,以支援更大規模的推理操作。
從晶片設計公司轉型為AI推理雲服務提供商,Groq的轉變不僅僅是簡單的業務重組。在由NVIDIA主導的市場中,將技術授權給最強的競爭對手,同時透過平臺快速擴大自身的雲服務版圖,這種“以退為進”的策略可能正成為AI初創企業新興的生存智慧。
Claude Opus 5.2 夜灰色版釋出,響應速度更快,解決懶惰問題
Opus 5.2 今晨悄然上線,促使許多開發者注意到,更新後的模型 Claude Opus 5.2 已在 Claude Code 內部開始有限範圍的推送。昨晚,X 平臺使用者觀察到,在 Claude Code 中呼叫 Opus 5 時,其效能遠超標準網頁版,宛如“降維打擊”。這種路由策略在頂級 AI 公司中十分常見。資料包分析顯示,儘管前端標籤未變,但底層模型識別符號已切換為 Opus 5.2,這表明 Anthropic 可能完全跳過了 5.1 版本。速度、精度與自動“高強度迴圈”下的持續執
Fireworks AI 釋出搭載 Opus 的 FireRouter:編碼成本降低 57%,精度損失極小
Fireworks AI 推出了搭載 Opus 的 FireRouter,這是業界首個專為 Claude Opus 系列定製的快取感知路由系統。目前,該獨立路由模型已透過無伺服器端點開放使用。經過超過一個月的內部 A/B 測試,FireRouter 在編碼任務中實現了 98.1% 的準確率,同時與單獨使用 Opus 相比,成本降低了 57%。FireRouter 的工作原理是在每次使用者互動時評估每個模型對當前任務的適用性。它計算處理成本(包括提示詞快取),並判斷切換模型所節省的成本是否足以抵消緩
NVIDIA 釋出 Nemotron-Labs-Audex-30B-A3B 統一音訊智慧模型
隨著多模態大模型的快速發展,音訊處理能力往往受到妥協——許多模型在提升音訊理解能力的同時,卻犧牲了文字邏輯。為解決這一問題,NVIDIA 研究人員推出了 Nemotron-Labs-Audex-30B-A3B(Audex),這是一款統一的音訊-文字大語言模型,旨在彌合這一差距。Audex 採用精簡高效的設計,基於強大的純文字混合專家(MoE)架構構建。透過利用單個 Transformer 解碼器,它同時處理文字和量化音訊令牌。該方法將音訊輸入投影到文字嵌入空間,確保與現有用於多模態任務的大語言





首頁






