Groq, 핵심 기술 공개 및 클라우드 모델로 전환, 컴퓨팅 확장 위해 44억 위안 조달
작년, AI 칩 스타트업인 Groq는 자체 개발한 LPU 추론 기술을 20억 달러에 NVIDIA에 라이선스했으며, 일부 핵심 팀원들은 NVIDIA에 합류했습니다. 이 거래는 Groq의 미래에 대한 의문을 제기했지만, 6개월 이내에 동사는 AI 추론 클라우드 서비스 제공업체로 사업 방향을 전환하며 6억 5천만 달러(약 44억 위안) 규모의 자금 조달 라운드를 성공적으로 완료했습니다.
신뢰는 '독창성'에서 비롯된다
Groq의 자신감은 독특한 강점, 즉 대규모 LPU 운영에 대한 실무 경험을 갖춘 글로벌 엔지니어링 팀에 뿌리를 두고 있습니다. Groq가 개발한 전용 추론 칩인 LPU(Language Processing Unit)는 극도로 낮은 지연 시간으로 대규모 모델 추론 작업을 처리하는 데 탁월한 성능을 발휘하며, 놀라운 생성 속도를 통해 개발자들의 신뢰를 얻었습니다.
기술은 NVIDIA에 라이선스되었지만, 팀과 전문성은 그대로 유지됩니다. Groq는 이를 다른 클라우드 제공업체들과의 경쟁에서 핵심적인 우위로 간주하며, 이를 '근육 기억'이라고 부릅니다. 현재 Groq는 북미, 유럽, 중동, 아시아태평양 등 4개 지역에 13개의 데이터 센터를 운영하며 500만 명 이상의 개발자와 수천 개의 AI 네이티브 기업을 지원하고 있으며, 주간 토큰 소비량은 수조 단위에 달합니다.
2027년을 목표로, 200MW의 컴퓨팅 파워에 베팅
이번 자금 조달은 주로 AI 추론 인프라 확장에 사용될 예정입니다. Groq는 최신 추론 기술과 NVIDIA LPX 시스템을 도입하여 2027년 말까지 컴퓨팅 용량을 200메가와트(MW)로 확대하는 것을 목표로 하고 있으며, 이는 더 대규모의 추론 작업을 지원하기 위한 것입니다.
칩 설계 회사에서 AI 추론 클라우드 서비스 제공업체로의 전환은 단순한 비즈니스 재구성이 아닙니다. NVIDIA가 지배하는 시장에서 가장 강력한 경쟁자에게 기술을 라이선스하면서도 자체 플랫폼을 통해 클라우드 서비스 영역을 빠르게 확장하는 이 '후퇴를 통한 진격' 전략은 AI 스타트업들에게 새로운 생존 지혜로 부상하고 있습니다.
관련 기사
Claude Opus 5.2 다크 그레이 출시, 더 빠른 응답 속도와 게으름 문제 해결
Opus 5.2가 오늘 아침 조용히 출시되면서, 많은 개발자들이 업데이트된 모델인 Claude Opus 5.2가 Claude Code 내에서 제한적인 롤아웃을 시작했음을 눈치챘습니다.어제 저녁 X 사용자들은 Claude Code에서 Opus 5를 호출했을 때 표준 웹 버전보다 훨씬 뛰어난 성능을 보인다는 것을 관찰했으며, 이는 마치 '차원적 일격'과 같았습니다. 이러한 라우팅 전략은 최상위 AI 기업들 사이에서 흔하게 나타나는 현상입니다. 패
Fireworks AI가 Opus와 함께 FireRouter를 공개: 최소한의 정확도 하락으로 인코딩 비용을 57% 절감
Fireworks AI는 Claude Opus 시리즈를 위해 설계된 업계 최초의 캐시 인식 라우팅 시스템인 FireRouter with Opus를 출시했습니다. 이제 서버리스 엔드포인트를 통해 접근할 수 있는 이 독립적인 라우팅 모델은 한 달 이상 내부 A/B 테스트를 거쳤으며, 인코딩 작업에서 98.1%의 정확도를 달성하고 Opus 단독 사용 대비 비용을 57% 절감했습니다.FireRouter는 각 사용자 상호작용마다 현재 작업에 대한 각 모
NVIDIA, Nemotron-Labs-Audex-30B-A3B 통합 오디오 지능 모델 공개
다중 모달 대규모 모델이 빠르게 진화함에 따라 오디오 처리 기능이 종종 희생되는데, 많은 모델이 텍스트 논리를 희생하면서 오디오 이해도를 향상시킵니다. 이를 해결하기 위해 NVIDIA 연구진은 Nemotron-Labs-Audex-30B-A3B(Audex)를 도입했으며, 이는 이 격차를 메우기 위해 설계된 통합 오디오-텍스트 대규모 언어 모델입니다.Audex는 간소화되고 효율적인 설계를 채택했으며, 견고한 순수 텍스트 기반 전문가 혼합(MoE)
관련 특별 주제 추천
의견 (0)
0/500
작년, AI 칩 스타트업인 Groq는 자체 개발한 LPU 추론 기술을 20억 달러에 NVIDIA에 라이선스했으며, 일부 핵심 팀원들은 NVIDIA에 합류했습니다. 이 거래는 Groq의 미래에 대한 의문을 제기했지만, 6개월 이내에 동사는 AI 추론 클라우드 서비스 제공업체로 사업 방향을 전환하며 6억 5천만 달러(약 44억 위안) 규모의 자금 조달 라운드를 성공적으로 완료했습니다.
신뢰는 '독창성'에서 비롯된다
Groq의 자신감은 독특한 강점, 즉 대규모 LPU 운영에 대한 실무 경험을 갖춘 글로벌 엔지니어링 팀에 뿌리를 두고 있습니다. Groq가 개발한 전용 추론 칩인 LPU(Language Processing Unit)는 극도로 낮은 지연 시간으로 대규모 모델 추론 작업을 처리하는 데 탁월한 성능을 발휘하며, 놀라운 생성 속도를 통해 개발자들의 신뢰를 얻었습니다.
기술은 NVIDIA에 라이선스되었지만, 팀과 전문성은 그대로 유지됩니다. Groq는 이를 다른 클라우드 제공업체들과의 경쟁에서 핵심적인 우위로 간주하며, 이를 '근육 기억'이라고 부릅니다. 현재 Groq는 북미, 유럽, 중동, 아시아태평양 등 4개 지역에 13개의 데이터 센터를 운영하며 500만 명 이상의 개발자와 수천 개의 AI 네이티브 기업을 지원하고 있으며, 주간 토큰 소비량은 수조 단위에 달합니다.
2027년을 목표로, 200MW의 컴퓨팅 파워에 베팅
이번 자금 조달은 주로 AI 추론 인프라 확장에 사용될 예정입니다. Groq는 최신 추론 기술과 NVIDIA LPX 시스템을 도입하여 2027년 말까지 컴퓨팅 용량을 200메가와트(MW)로 확대하는 것을 목표로 하고 있으며, 이는 더 대규모의 추론 작업을 지원하기 위한 것입니다.
칩 설계 회사에서 AI 추론 클라우드 서비스 제공업체로의 전환은 단순한 비즈니스 재구성이 아닙니다. NVIDIA가 지배하는 시장에서 가장 강력한 경쟁자에게 기술을 라이선스하면서도 자체 플랫폼을 통해 클라우드 서비스 영역을 빠르게 확장하는 이 '후퇴를 통한 진격' 전략은 AI 스타트업들에게 새로운 생존 지혜로 부상하고 있습니다.
Claude Opus 5.2 다크 그레이 출시, 더 빠른 응답 속도와 게으름 문제 해결
Opus 5.2가 오늘 아침 조용히 출시되면서, 많은 개발자들이 업데이트된 모델인 Claude Opus 5.2가 Claude Code 내에서 제한적인 롤아웃을 시작했음을 눈치챘습니다.어제 저녁 X 사용자들은 Claude Code에서 Opus 5를 호출했을 때 표준 웹 버전보다 훨씬 뛰어난 성능을 보인다는 것을 관찰했으며, 이는 마치 '차원적 일격'과 같았습니다. 이러한 라우팅 전략은 최상위 AI 기업들 사이에서 흔하게 나타나는 현상입니다. 패
Fireworks AI가 Opus와 함께 FireRouter를 공개: 최소한의 정확도 하락으로 인코딩 비용을 57% 절감
Fireworks AI는 Claude Opus 시리즈를 위해 설계된 업계 최초의 캐시 인식 라우팅 시스템인 FireRouter with Opus를 출시했습니다. 이제 서버리스 엔드포인트를 통해 접근할 수 있는 이 독립적인 라우팅 모델은 한 달 이상 내부 A/B 테스트를 거쳤으며, 인코딩 작업에서 98.1%의 정확도를 달성하고 Opus 단독 사용 대비 비용을 57% 절감했습니다.FireRouter는 각 사용자 상호작용마다 현재 작업에 대한 각 모
NVIDIA, Nemotron-Labs-Audex-30B-A3B 통합 오디오 지능 모델 공개
다중 모달 대규모 모델이 빠르게 진화함에 따라 오디오 처리 기능이 종종 희생되는데, 많은 모델이 텍스트 논리를 희생하면서 오디오 이해도를 향상시킵니다. 이를 해결하기 위해 NVIDIA 연구진은 Nemotron-Labs-Audex-30B-A3B(Audex)를 도입했으며, 이는 이 격차를 메우기 위해 설계된 통합 오디오-텍스트 대규모 언어 모델입니다.Audex는 간소화되고 효율적인 설계를 채택했으며, 견고한 순수 텍스트 기반 전문가 혼합(MoE)





집






