Gimlet LabsがAI推論のボトルネックを解決するために採用している洗練されたアプローチ

Stanford大学の非常勤教授であり、優れたスタートアップ起業家でもあるZain Asgarは、AI推論におけるボトルネックを極めて巧妙な方法で解決する企業向けに、8,000万ドル規模のシリーズA資金調達に成功した。このラウンドではMenlo Venturesが主導役を務めた。
同スタートアップのGimlet Labsは、世界で初かつ唯一の「マルチシリコン推論クラウド」を構築したとしている。これはAI処理ワークロードをさまざまな種類のハードウェア上で同時に実行可能にするソフトウェアであり、従来型CPU、AI向けに最適化されたGPU、大容量メモリシステムなど、異なるハードウェア間でタスクを分割処理できる。
「基本的には利用可能なあらゆる種類のハードウェア上で処理を行っている」とAsgarはTechCrunchの取材に答えている。
「1つのエージェントが複数のステップを連続して実行する場合、それぞれ異なるハードウェアが必要となる。推論処理は計算能力に依存し、デコード処理はメモリ容量に依存し、ツール呼び出しはネットワーク速度に依存するのだ」と、この資金調達に関するブログ記事で主要投資家であるMenlo VenturesのTim Tullyは記している。
現時点ではどのチップもこれらすべてをこなせないが、新しいハードウェアが登場し、古くなったGPUが再利用されるにつれて、「マルチシリコン環境は既に整っている。あとはそれを動作させるためのソフトウェア層が欠けているだけだ」とTullyは考えており、Gimlet Labsがまさにそのソフトウェア層を提供する存在だとしている。
もし現在のように計算リソースの投入が続く傾向が維持されれば、McKinseyの推計では2030年までにデータセンターへの支出は約7兆ドルに達する可能性がある。Asgarによれば、現在のアプリケーションは既存のハードウェアを「15%から30%程度」しか活用していないという。
「別の見方をすれば、未使用のリソースが放置されているため、何千億ドルもの資源が無駄になっているのだ」と彼は語る。「私たちの目標は、AI処理ワークロードの効率を今日より10倍向上させる方法を見出すことだった」。
そこで彼と共同創業者であるMichelle Nguyen、Omid Azizi、Natalie Serrinoは、エージェントベースのワークロードを分割し、あらゆる種類のハードウェア上で同時に実行できるオーケストレーションソフトウェアの開発に取り組んだ。
Gimlet Labsは、同等のコストと消費電力でAI推論の速度を3倍から10倍まで確実に向上させられると主張している。さらに、基盤となるモデルを分割し、異なるアーキテクチャ上でそれぞれ最適なチップを使用して処理を行うことも可能だとしている。
同社はすでにNVIDIA、AMD、Intel、ARM、Cerebras、d-Matrixといったチップメーカー各社と提携している。
Gimletの製品は、ソフトウェア形態または独自のGimlet Cloudを通じたAPIとして提供されており、一般のAIアプリ開発者向けではない。主なターゲットは大規模なAIモデルラボやデータセンターだ。
同社は10月に正式にサービスを開始し、当初から8桁台の売上(少なくとも1,000万ドル以上)を記録した。Asgarによると、過去4か月間で顧客数は2倍以上に増加し、現在では大手モデル開発企業や超大規模クラウドコンピューティング企業も顧客に含まれているが、具体的な名称は明かしていない。
共同創業者たちは以前、Kubernetes向けのオープンソース可観測性ツールを開発したスタートアップPixieで一緒に働いていた。Pixieは2020年にBenchmarkが主導する900万ドル規模のシリーズA資金調達の2か月後にNew Relicに買収された。(Pixieの技術は現在、Kubernetesを管理するオープンソースコミュニティの一部となっている。)
約1年前にAsgarが偶然Tullyに出会ったことや、Stanford大学の教授たちからエンジェル投資を受けたことをきっかけに、ベンチャーキャピタリストたちから連絡が舞い込むようになった。サービス開始後、Asgarの元には投資条件書が届いた。Asgarが他社からのオファーを検討していると聞くと、「かなり多くの資金提供の申し出が殺到した」と彼は語り、このラウンドはすぐに過剰な応募があった。
これまでのシードラウンドを含め、同スタートアップは現在までに合計9,200万ドルの資金を調達しており、SequoiaのBill Coughran、Stanford大学教授のNick McKeown、VMware元CEOのRaghu Raghuram、Intel CEOのLip-Bu Tanといった多くのエンジェル投資家からも資金を得ている。現在、同社には30人の従業員が在籍している。
その他の出資者には、シードラウンドを主導したFactory、Eclipse Ventures、Prosperity7、Intel Capitalなどが含まれる。
関連記事
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ
Google、Geminiへの焦点がユーザー制御へシフトする中で、Remy AIエージェントをテスト
『Business Insider』によると、GoogleはGemini向けの新しいAIパーソナルエージェント「Remy」をテスト中である。このツールはユーザーに代わってタスクを実行することを目的としており、業務フローと日常のルーチンの両方を効率化する。現在、RemyはGeminiアプリケーションの社内限定版においてテストが行われている。この報道は社内文書と、プロジェクトに精通した2人の人物へのインタビューを引用している。社内資料では、Remyを「24時間365日のパーソナルエージェント」と位
関連特集おすすめ
コメント (0)
0/500

Stanford大学の非常勤教授であり、優れたスタートアップ起業家でもあるZain Asgarは、AI推論におけるボトルネックを極めて巧妙な方法で解決する企業向けに、8,000万ドル規模のシリーズA資金調達に成功した。このラウンドではMenlo Venturesが主導役を務めた。
同スタートアップのGimlet Labsは、世界で初かつ唯一の「マルチシリコン推論クラウド」を構築したとしている。これはAI処理ワークロードをさまざまな種類のハードウェア上で同時に実行可能にするソフトウェアであり、従来型CPU、AI向けに最適化されたGPU、大容量メモリシステムなど、異なるハードウェア間でタスクを分割処理できる。
「基本的には利用可能なあらゆる種類のハードウェア上で処理を行っている」とAsgarはTechCrunchの取材に答えている。
「1つのエージェントが複数のステップを連続して実行する場合、それぞれ異なるハードウェアが必要となる。推論処理は計算能力に依存し、デコード処理はメモリ容量に依存し、ツール呼び出しはネットワーク速度に依存するのだ」と、この資金調達に関するブログ記事で主要投資家であるMenlo VenturesのTim Tullyは記している。
現時点ではどのチップもこれらすべてをこなせないが、新しいハードウェアが登場し、古くなったGPUが再利用されるにつれて、「マルチシリコン環境は既に整っている。あとはそれを動作させるためのソフトウェア層が欠けているだけだ」とTullyは考えており、Gimlet Labsがまさにそのソフトウェア層を提供する存在だとしている。
もし現在のように計算リソースの投入が続く傾向が維持されれば、McKinseyの推計では2030年までにデータセンターへの支出は約7兆ドルに達する可能性がある。Asgarによれば、現在のアプリケーションは既存のハードウェアを「15%から30%程度」しか活用していないという。
「別の見方をすれば、未使用のリソースが放置されているため、何千億ドルもの資源が無駄になっているのだ」と彼は語る。「私たちの目標は、AI処理ワークロードの効率を今日より10倍向上させる方法を見出すことだった」。
そこで彼と共同創業者であるMichelle Nguyen、Omid Azizi、Natalie Serrinoは、エージェントベースのワークロードを分割し、あらゆる種類のハードウェア上で同時に実行できるオーケストレーションソフトウェアの開発に取り組んだ。
Gimlet Labsは、同等のコストと消費電力でAI推論の速度を3倍から10倍まで確実に向上させられると主張している。さらに、基盤となるモデルを分割し、異なるアーキテクチャ上でそれぞれ最適なチップを使用して処理を行うことも可能だとしている。
同社はすでにNVIDIA、AMD、Intel、ARM、Cerebras、d-Matrixといったチップメーカー各社と提携している。
Gimletの製品は、ソフトウェア形態または独自のGimlet Cloudを通じたAPIとして提供されており、一般のAIアプリ開発者向けではない。主なターゲットは大規模なAIモデルラボやデータセンターだ。
同社は10月に正式にサービスを開始し、当初から8桁台の売上(少なくとも1,000万ドル以上)を記録した。Asgarによると、過去4か月間で顧客数は2倍以上に増加し、現在では大手モデル開発企業や超大規模クラウドコンピューティング企業も顧客に含まれているが、具体的な名称は明かしていない。
共同創業者たちは以前、Kubernetes向けのオープンソース可観測性ツールを開発したスタートアップPixieで一緒に働いていた。Pixieは2020年にBenchmarkが主導する900万ドル規模のシリーズA資金調達の2か月後にNew Relicに買収された。(Pixieの技術は現在、Kubernetesを管理するオープンソースコミュニティの一部となっている。)
約1年前にAsgarが偶然Tullyに出会ったことや、Stanford大学の教授たちからエンジェル投資を受けたことをきっかけに、ベンチャーキャピタリストたちから連絡が舞い込むようになった。サービス開始後、Asgarの元には投資条件書が届いた。Asgarが他社からのオファーを検討していると聞くと、「かなり多くの資金提供の申し出が殺到した」と彼は語り、このラウンドはすぐに過剰な応募があった。
これまでのシードラウンドを含め、同スタートアップは現在までに合計9,200万ドルの資金を調達しており、SequoiaのBill Coughran、Stanford大学教授のNick McKeown、VMware元CEOのRaghu Raghuram、Intel CEOのLip-Bu Tanといった多くのエンジェル投資家からも資金を得ている。現在、同社には30人の従業員が在籍している。
その他の出資者には、シードラウンドを主導したFactory、Eclipse Ventures、Prosperity7、Intel Capitalなどが含まれる。
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ





家






