Groq、中核技術を公開しクラウドモデルへ移行、計算資源の拡大のために44億元を調達
昨年、AIチップスタートアップのGroqは、独自のLPU推論技術を20億ドルでNVIDIAにライセンス供与し、一部のチームメンバーがNVIDIAに加わった。この取引はGroqの将来に関する疑問を投げかけたが、同社は6ヶ月以内にAI推論クラウドサービスプロバイダーへの転換という対応を示し、6億5000万ドルの資金調達ラウンド(約44億元)を獲得した。
「独自性」に裏打ちされた自信
Groqの自信は、大規模なLPU運用の実務経験を持つグローバルエンジニアリングチームという明確な優位性に根ざしている。Groqが開発した専用推論チップであるLPU(Language Processing Unit)は、極めて低レイテンシで大規模モデルの推論タスクを処理することに優れており、その顕著な生成速度を通じて開発者の信頼を獲得している。
技術はNVIDIAにライセンス供与されたものの、チームと専門知識は維持されている。Groqは、この「筋肉の記憶」を、他のクラウドプロバイダーに対する中核的な競争優位と見なしている。現在、Groqは北米、欧州、中東、アジア太平洋の4つの地域に13のデータセンターを運用し、500万人以上の開発者および数千社のAIネイティブ企業にサービスを提供しており、週間のトークン消費量は兆の単位に達している。
2027年を見据え、200MWの計算能力に賭ける
この資金は主にAI推論インフラの拡大に充てられる。Groqは最新の推論技術およびNVIDIAのLPXシステムを導入し、2027年末までに計算能力を200メガワットに増強し、より大規模な推論運用をサポートする計画である。
チップ設計会社からAI推論クラウドサービスプロバイダーへの変革は、単なる事業再編以上の意味を持つ。NVIDIAが支配する市場において、最強の競合他社に技術をライセンス供与しつつ、自社のプラットフォームを通じてクラウドサービスの展開を急速に拡大するという、この「退いて進め」戦略は、AIスタートアップにとって新たな生存の知恵として浮上しつつある。
関連記事
Claude Opus 5.2 ナイトグレーがより高速なレスポンスで発売され、怠慢な問題が解決されました
Opus 5.2 が今朝静かにリリースされ、多くの開発者が更新されたモデル「Claude Opus 5.2」が Claude Code 内で限定ロールアウトを開始したことに気づいた。昨日の夜、X のユーザーは Claude Code で Opus 5 を呼び出すと、標準的なウェブバージョンよりも大幅に優れたパフォーマンスを発揮し、「次元の壁を越えた攻撃」のような結果になることを観察した。このルーティング戦略はトップ AI 企業では一般的である。パケット分析の結果、フロントエンドのラベルは変更さ
Fireworks AI、Opus搭載のFireRouterを発表:精度の大幅な低下を抑えつつ、エンコーディングコストを57%削減
Fireworks AIは、Claude Opusシリーズ向けに設計された業界初のキャッシュ対応ルーティングシステム「FireRouter with Opus」を発表しました。サーバーレスエンドポイントを通じて利用可能となったこの独立型ルーティングモデルは、1ヶ月以上の内部A/Bテストを経て、エンコーディングタスクにおいて98.1%の精度を達成し、Opus単独使用と比較してコストを57%削減しました。FireRouterは、各ユーザーインタラクション中に現在のタスクに対する各モデルの適合性を評価
NVIDIA、Nemotron-Labs-Audex-30B-A3B 統合音声知能モデルを公開
マルチモーダル大規模モデルが急速に進化する中、音声処理能力がしばしば犠牲になっている—多くのモデルはテキストの論理を犠牲にして音声理解を向上させている。この課題に対処するため、NVIDIAの研究者たちはNemotron-Labs-Audex-30B-A3B(Audex)を発表した。これは、このギャップを埋めるために設計された統一された音声・テキスト大規模言語モデルである。Audexは、堅牢な純粋テキストベースのMixture of Experts(MoE)アーキテクチャを基盤とした、簡潔で効率
関連特集おすすめ
コメント (0)
0/500
昨年、AIチップスタートアップのGroqは、独自のLPU推論技術を20億ドルでNVIDIAにライセンス供与し、一部のチームメンバーがNVIDIAに加わった。この取引はGroqの将来に関する疑問を投げかけたが、同社は6ヶ月以内にAI推論クラウドサービスプロバイダーへの転換という対応を示し、6億5000万ドルの資金調達ラウンド(約44億元)を獲得した。
「独自性」に裏打ちされた自信
Groqの自信は、大規模なLPU運用の実務経験を持つグローバルエンジニアリングチームという明確な優位性に根ざしている。Groqが開発した専用推論チップであるLPU(Language Processing Unit)は、極めて低レイテンシで大規模モデルの推論タスクを処理することに優れており、その顕著な生成速度を通じて開発者の信頼を獲得している。
技術はNVIDIAにライセンス供与されたものの、チームと専門知識は維持されている。Groqは、この「筋肉の記憶」を、他のクラウドプロバイダーに対する中核的な競争優位と見なしている。現在、Groqは北米、欧州、中東、アジア太平洋の4つの地域に13のデータセンターを運用し、500万人以上の開発者および数千社のAIネイティブ企業にサービスを提供しており、週間のトークン消費量は兆の単位に達している。
2027年を見据え、200MWの計算能力に賭ける
この資金は主にAI推論インフラの拡大に充てられる。Groqは最新の推論技術およびNVIDIAのLPXシステムを導入し、2027年末までに計算能力を200メガワットに増強し、より大規模な推論運用をサポートする計画である。
チップ設計会社からAI推論クラウドサービスプロバイダーへの変革は、単なる事業再編以上の意味を持つ。NVIDIAが支配する市場において、最強の競合他社に技術をライセンス供与しつつ、自社のプラットフォームを通じてクラウドサービスの展開を急速に拡大するという、この「退いて進め」戦略は、AIスタートアップにとって新たな生存の知恵として浮上しつつある。
Claude Opus 5.2 ナイトグレーがより高速なレスポンスで発売され、怠慢な問題が解決されました
Opus 5.2 が今朝静かにリリースされ、多くの開発者が更新されたモデル「Claude Opus 5.2」が Claude Code 内で限定ロールアウトを開始したことに気づいた。昨日の夜、X のユーザーは Claude Code で Opus 5 を呼び出すと、標準的なウェブバージョンよりも大幅に優れたパフォーマンスを発揮し、「次元の壁を越えた攻撃」のような結果になることを観察した。このルーティング戦略はトップ AI 企業では一般的である。パケット分析の結果、フロントエンドのラベルは変更さ
Fireworks AI、Opus搭載のFireRouterを発表:精度の大幅な低下を抑えつつ、エンコーディングコストを57%削減
Fireworks AIは、Claude Opusシリーズ向けに設計された業界初のキャッシュ対応ルーティングシステム「FireRouter with Opus」を発表しました。サーバーレスエンドポイントを通じて利用可能となったこの独立型ルーティングモデルは、1ヶ月以上の内部A/Bテストを経て、エンコーディングタスクにおいて98.1%の精度を達成し、Opus単独使用と比較してコストを57%削減しました。FireRouterは、各ユーザーインタラクション中に現在のタスクに対する各モデルの適合性を評価
NVIDIA、Nemotron-Labs-Audex-30B-A3B 統合音声知能モデルを公開
マルチモーダル大規模モデルが急速に進化する中、音声処理能力がしばしば犠牲になっている—多くのモデルはテキストの論理を犠牲にして音声理解を向上させている。この課題に対処するため、NVIDIAの研究者たちはNemotron-Labs-Audex-30B-A3B(Audex)を発表した。これは、このギャップを埋めるために設計された統一された音声・テキスト大規模言語モデルである。Audexは、堅牢な純粋テキストベースのMixture of Experts(MoE)アーキテクチャを基盤とした、簡潔で効率





家






