지푸, GLM-5.1 고속 버전으로 세계 AI 속도 기록을 경신했다
중국의 유명한 AI 팀인 지푸는 오늘 일부 기업 고객을 대상으로 새로운 GLM-5.1 고속 API를 출시한다고 공식적으로 발표했습니다. “GLM-5.1-highspeed”라는 코드명으로 불리는 이 모델은 출시 이후 업계에 큰 충격을 주었으며, 초당 400개의 토큰을 출력하는 빠른 속도를 자랑합니다.
이 수치는 현재 주요 대형 모델 제공업체들이 설정한 전 세계 API 속도 기준을 직접 넘어서며, 강력한 기술적 우위를 보여줍니다. 이전에는 AI 업계에서 모델의 속도와 크기가 상충된다고 여겨져 왔으며, 더 빠른 속도를 얻기 위해서는 모델의 기능을 타협해야 한다고 생각되었습니다.
업계 규범을 깨는 플래그십 성능
하지만 GLM-5.1 고속 버전은 “빠르다는 것은 작다는 것”이라는 오랫동안 지켜져 온 업계의 믿음을 깨뜨렸습니다. 국내 대형 모델 중에서 처음으로 플래그십 수준의 기술적 성능과 초저 지연 시간을 실제 생산 환경에 적용하는 데 성공했습니다.
보도에 따르면, 이 모델은 지푸의 GLM 팀과 TileRT 팀이 공동으로 개발했습니다. 두 팀은 추론 엔진, 스케줄링 시스템, 기반 인프라 등 세 가지 계층에서 깊이 있고 포괄적인 시스템 수준의 최적화를 진행했으며, 전통적인 동적 스케줄링 방식을 벗어났습니다.
3단계 최적화로 안정적인 출력 보장
기술적 측면에서 개발 팀은 모델 아키텍처의 핵심 추론 경로를 재작성하여 단일 카드의 처리량을 높였으며, 동적 배치와 같은 기술을 통해 고동시성 시나리오에서의 지연 시간을 줄였습니다. 동시에 인프라 관련 협력 최적화를 통해 초당 400개의 TPS가 안정적이고 실용적인 생산 수준의 성능으로 확보되었습니다.
이 고속 모델은 다양한 응용 분야에서 큰 잠재력을 가지고 있으며, 특히 응답 지연 시간에 엄격한 요구가 있는 상황에 매우 적합합니다. AI 프로그래밍, 실시간 음성 상호작용, 빈번한 비즈니스 결정 등 다양한 분야에서 이 모델을 활용할 수 있으며, 현재 지푸의 MaaS 플랫폼을 통해 일부 기업들이 이 모델을 사용하고 있습니다.
관련 기사
ByteDance의 Seed가 글로벌 캠퍼스 채용을 시작하며, 최상위 대형 모델 인재 영입을 위해 가상 주식을 제공합니다
대규모 언어 모델의 치열한 경쟁 구도에서 최상위 인재 확보는 여전히 가장 중요한 전략적 자산입니다.4월 1일, ByteDance은 대규모 모델 인재 양성 프로그램의 일환으로 글로벌 캠퍼스 채용 프로그램 Seed를 시작한다고 발표했습니다. 이 캠페인은 2027년 졸업 예정자와 현재 인턴을 대상으로 전 세계 AI 분야의 엘리트 연구 및 엔지니어링 전문가를 식별하고 확보하는 것을 목표로 합니다.확장: 전 세계 100명의 "AI 시드" 식별급속한
법적 분쟁 속에서 Suno의 워터마크 삽입
Suno는 사용자가 AI 생성 음악을 생성할 수 있게 하는 플랫폼으로, 플랫폼에서 생성된 트랙에 레이블을 지정하고 다운로드를 제한하며, 무단 복제를 억제하기 위해 커뮤니티 기준을 업데이트하는 새로운 기능을 공개했습니다. 이러한 업데이트는 Suno가 레이블 및 아티스트 조직으로부터 여러 소송에 직면하는 시점에 이루어집니다.공동 창립자이자 CEO인 Mikey Shulman은 블로그 게시물을 통해 핵심 원칙을 제시하며, 플랫폼이 광범위한 청중을 대
머스크, Grok 구축 과정에서 사용자 코드 유출 인정, 모든 과거 데이터 삭제 약속
Elon Musk는 Grok Build와 관련된 프라이버시 논란에 대해 직접적으로 언급하며, 사건의 타당성을 확인하기 위해 간단한 "True"로 답변했습니다. 그는 SpaceXAI에 이전에 업로드된 모든 사용자 데이터를 영구적으로 삭제하겠다고 약속하며, "바이트 하나도 남기지 않겠다"고 밝혔습니다. 이는 주요 기술 리더가 실수를 공개적으로 인정하고 사용자 데이터를 능동적으로 삭제한 AI 산업 최초의 사례입니다.안전 연구원의 '피싱' 테스트는
관련 특별 주제 추천
의견 (0)
0/500
중국의 유명한 AI 팀인 지푸는 오늘 일부 기업 고객을 대상으로 새로운 GLM-5.1 고속 API를 출시한다고 공식적으로 발표했습니다. “GLM-5.1-highspeed”라는 코드명으로 불리는 이 모델은 출시 이후 업계에 큰 충격을 주었으며, 초당 400개의 토큰을 출력하는 빠른 속도를 자랑합니다.
이 수치는 현재 주요 대형 모델 제공업체들이 설정한 전 세계 API 속도 기준을 직접 넘어서며, 강력한 기술적 우위를 보여줍니다. 이전에는 AI 업계에서 모델의 속도와 크기가 상충된다고 여겨져 왔으며, 더 빠른 속도를 얻기 위해서는 모델의 기능을 타협해야 한다고 생각되었습니다.
업계 규범을 깨는 플래그십 성능
하지만 GLM-5.1 고속 버전은 “빠르다는 것은 작다는 것”이라는 오랫동안 지켜져 온 업계의 믿음을 깨뜨렸습니다. 국내 대형 모델 중에서 처음으로 플래그십 수준의 기술적 성능과 초저 지연 시간을 실제 생산 환경에 적용하는 데 성공했습니다.
보도에 따르면, 이 모델은 지푸의 GLM 팀과 TileRT 팀이 공동으로 개발했습니다. 두 팀은 추론 엔진, 스케줄링 시스템, 기반 인프라 등 세 가지 계층에서 깊이 있고 포괄적인 시스템 수준의 최적화를 진행했으며, 전통적인 동적 스케줄링 방식을 벗어났습니다.
3단계 최적화로 안정적인 출력 보장
기술적 측면에서 개발 팀은 모델 아키텍처의 핵심 추론 경로를 재작성하여 단일 카드의 처리량을 높였으며, 동적 배치와 같은 기술을 통해 고동시성 시나리오에서의 지연 시간을 줄였습니다. 동시에 인프라 관련 협력 최적화를 통해 초당 400개의 TPS가 안정적이고 실용적인 생산 수준의 성능으로 확보되었습니다.
이 고속 모델은 다양한 응용 분야에서 큰 잠재력을 가지고 있으며, 특히 응답 지연 시간에 엄격한 요구가 있는 상황에 매우 적합합니다. AI 프로그래밍, 실시간 음성 상호작용, 빈번한 비즈니스 결정 등 다양한 분야에서 이 모델을 활용할 수 있으며, 현재 지푸의 MaaS 플랫폼을 통해 일부 기업들이 이 모델을 사용하고 있습니다.
ByteDance의 Seed가 글로벌 캠퍼스 채용을 시작하며, 최상위 대형 모델 인재 영입을 위해 가상 주식을 제공합니다
대규모 언어 모델의 치열한 경쟁 구도에서 최상위 인재 확보는 여전히 가장 중요한 전략적 자산입니다.4월 1일, ByteDance은 대규모 모델 인재 양성 프로그램의 일환으로 글로벌 캠퍼스 채용 프로그램 Seed를 시작한다고 발표했습니다. 이 캠페인은 2027년 졸업 예정자와 현재 인턴을 대상으로 전 세계 AI 분야의 엘리트 연구 및 엔지니어링 전문가를 식별하고 확보하는 것을 목표로 합니다.확장: 전 세계 100명의 "AI 시드" 식별급속한
법적 분쟁 속에서 Suno의 워터마크 삽입
Suno는 사용자가 AI 생성 음악을 생성할 수 있게 하는 플랫폼으로, 플랫폼에서 생성된 트랙에 레이블을 지정하고 다운로드를 제한하며, 무단 복제를 억제하기 위해 커뮤니티 기준을 업데이트하는 새로운 기능을 공개했습니다. 이러한 업데이트는 Suno가 레이블 및 아티스트 조직으로부터 여러 소송에 직면하는 시점에 이루어집니다.공동 창립자이자 CEO인 Mikey Shulman은 블로그 게시물을 통해 핵심 원칙을 제시하며, 플랫폼이 광범위한 청중을 대
머스크, Grok 구축 과정에서 사용자 코드 유출 인정, 모든 과거 데이터 삭제 약속
Elon Musk는 Grok Build와 관련된 프라이버시 논란에 대해 직접적으로 언급하며, 사건의 타당성을 확인하기 위해 간단한 "True"로 답변했습니다. 그는 SpaceXAI에 이전에 업로드된 모든 사용자 데이터를 영구적으로 삭제하겠다고 약속하며, "바이트 하나도 남기지 않겠다"고 밝혔습니다. 이는 주요 기술 리더가 실수를 공개적으로 인정하고 사용자 데이터를 능동적으로 삭제한 AI 산업 최초의 사례입니다.안전 연구원의 '피싱' 테스트는





집






