Lar
Groq revela tecnologia central, muda para modelo em nuvem e capta 4,4 bilhões de yuans para expansão de capacidade computacional
No ano passado, a Groq, uma startup de chips de IA, licenciou sua tecnologia proprietária de inferência LPU para a NVIDIA por US$ 2 bilhões, com membros selecionados da equipe se juntando à NVIDIA. Este acordo levantou questões sobre o futuro da Groq, mas, em seis meses, a empresa respondeu mudando seu foco para se tornar um provedor de serviços de nuvem de inferência de IA, garantindo uma rodada de financiamento de US$ 650 milhões (aproximadamente 4,4 bilhões de yuans).
A confiança vem da "unicidade"
A confiança da Groq está enraizada em uma vantagem distinta: uma equipe global de engenharia com experiência prática em operações de LPU em larga escala. O LPU (Unidade de Processamento de Linguagem), um chip de inferência especializado desenvolvido pela Groq, destaca-se no tratamento de tarefas de inferência de grandes modelos com latência excepcionalmente baixa, conquistando a confiança dos desenvolvedores por meio de sua velocidade de geração notável.
Embora a tecnologia tenha sido licenciada para a NVIDIA, a equipe e a expertise permanecem intactas. A Groq considera essa "memória muscular" sua principal vantagem competitiva em relação a outros provedores de nuvem. Atualmente, a Groq opera 13 data centers em quatro regiões — América do Norte, Europa, Oriente Médio e Ásia-Pacífico — atendendo mais de 5 milhões de desenvolvedores e milhares de empresas nativas de IA, com o consumo semanal de tokens atingindo trilhões.
Focando em 2027, apostando em 200 MW de poder computacional
Este financiamento será usado principalmente para expandir a infraestrutura de inferência de IA. A Groq planeja implantar a mais recente tecnologia de inferência e os sistemas NVIDIA LPX, com o objetivo de aumentar a capacidade computacional para 200 megawatts até o final de 2027, suportando operações de inferência em escala maior.
De uma empresa de design de chips para um provedor de serviços de nuvem de inferência de IA, a transformação da Groq é mais do que uma simples reestruturação de negócios. Em um mercado dominado pela NVIDIA, licenciar tecnologia para o principal concorrente enquanto expande rapidamente sua própria presença em serviços de nuvem por meio de sua plataforma, essa estratégia de "recuar para avançar" pode estar emergindo como uma nova sabedoria de sobrevivência para startups de IA.
Artigo relacionado
O Claude Opus 5.2 Night Gray é lançado com resposta mais rápida, resolvendo o problema de preguiça
O Opus 5.2 foi lançado discretamente nesta manhã, levando muitos desenvolvedores a notar que o modelo atualizado, Claude Opus 5.2, iniciou uma rollout limitada dentro do Claude Code.Na noite de ontem, usuários do X observaram que invocar o Opus 5 no
A Fireworks AI apresenta o FireRouter com Opus: reduz os custos de codificação em 57% com uma queda mínima na precisão
A Fireworks AI apresentou o FireRouter com Opus, o primeiro sistema de roteamento consciente de cache do setor, desenvolvido especificamente para a série Claude Opus. Agora disponível por meio de um endpoint serverless, este modelo de roteamento inde
A NVIDIA apresenta o modelo de inteligência unificada de áudio Nemotron-Labs-Audex-30B-A3B
As grandes modelos multimodais evoluem rapidamente, as capacidades de processamento de áudio são frequentemente comprometidas — muitos modelos melhoram a compreensão de áudio em detrimento da lógica textual. Para resolver isso, pesquisadores da NVIDI
Recomendações de tópicos especiais relacionados
Comentários (0)
No ano passado, a Groq, uma startup de chips de IA, licenciou sua tecnologia proprietária de inferência LPU para a NVIDIA por US$ 2 bilhões, com membros selecionados da equipe se juntando à NVIDIA. Este acordo levantou questões sobre o futuro da Groq, mas, em seis meses, a empresa respondeu mudando seu foco para se tornar um provedor de serviços de nuvem de inferência de IA, garantindo uma rodada de financiamento de US$ 650 milhões (aproximadamente 4,4 bilhões de yuans).
A confiança vem da "unicidade"
A confiança da Groq está enraizada em uma vantagem distinta: uma equipe global de engenharia com experiência prática em operações de LPU em larga escala. O LPU (Unidade de Processamento de Linguagem), um chip de inferência especializado desenvolvido pela Groq, destaca-se no tratamento de tarefas de inferência de grandes modelos com latência excepcionalmente baixa, conquistando a confiança dos desenvolvedores por meio de sua velocidade de geração notável.
Embora a tecnologia tenha sido licenciada para a NVIDIA, a equipe e a expertise permanecem intactas. A Groq considera essa "memória muscular" sua principal vantagem competitiva em relação a outros provedores de nuvem. Atualmente, a Groq opera 13 data centers em quatro regiões — América do Norte, Europa, Oriente Médio e Ásia-Pacífico — atendendo mais de 5 milhões de desenvolvedores e milhares de empresas nativas de IA, com o consumo semanal de tokens atingindo trilhões.
Focando em 2027, apostando em 200 MW de poder computacional
Este financiamento será usado principalmente para expandir a infraestrutura de inferência de IA. A Groq planeja implantar a mais recente tecnologia de inferência e os sistemas NVIDIA LPX, com o objetivo de aumentar a capacidade computacional para 200 megawatts até o final de 2027, suportando operações de inferência em escala maior.
De uma empresa de design de chips para um provedor de serviços de nuvem de inferência de IA, a transformação da Groq é mais do que uma simples reestruturação de negócios. Em um mercado dominado pela NVIDIA, licenciar tecnologia para o principal concorrente enquanto expande rapidamente sua própria presença em serviços de nuvem por meio de sua plataforma, essa estratégia de "recuar para avançar" pode estar emergindo como uma nova sabedoria de sobrevivência para startups de IA.
O Claude Opus 5.2 Night Gray é lançado com resposta mais rápida, resolvendo o problema de preguiça
O Opus 5.2 foi lançado discretamente nesta manhã, levando muitos desenvolvedores a notar que o modelo atualizado, Claude Opus 5.2, iniciou uma rollout limitada dentro do Claude Code.Na noite de ontem, usuários do X observaram que invocar o Opus 5 no
A Fireworks AI apresenta o FireRouter com Opus: reduz os custos de codificação em 57% com uma queda mínima na precisão
A Fireworks AI apresentou o FireRouter com Opus, o primeiro sistema de roteamento consciente de cache do setor, desenvolvido especificamente para a série Claude Opus. Agora disponível por meio de um endpoint serverless, este modelo de roteamento inde
A NVIDIA apresenta o modelo de inteligência unificada de áudio Nemotron-Labs-Audex-30B-A3B
As grandes modelos multimodais evoluem rapidamente, as capacidades de processamento de áudio são frequentemente comprometidas — muitos modelos melhoram a compreensão de áudio em detrimento da lógica textual. Para resolver isso, pesquisadores da NVIDI











