알리바바 투하오 M890, 3배의 성능으로 출시되어 칩-클라우드-모델-추론을 위한 풀스택 에이전트 시대를 열다

2026년 5월 20일, 알리바바 클라우드 서밋에서 알리바바 클라우드는 에이전트 시대를 위해 설계된 풀스택 기술 시스템 업그레이드가 완료되었다고 발표했습니다. 이 변화는 기본 칩과 클라우드 플랫폼부터 모델 및 추론 솔루션에 이르기까지 전체 시스템을 재구성했습니다. 이를 통해 알리바바 클라우드는 거대한 에이전트들이 24시간 연중무휴로 작동할 수 있도록 지원하는 AI 공장으로 자리매김하게 되었으며, 이는 더 이상 인간 사용자에게 직접 서비스를 제공하는 것을 넘어서는 의미입니다.
1. 핵심 기반: 텡쉰 젠우 M890 칩과 슈퍼 노드 서버
이번 업그레이드의 핵심은 텡쉰의 차세대 AI 칩인 젠우 M890으로, 이 칩은 훈련과 추론 기능을 통합하고 있습니다.
성능 향상: M890은 144GB의 메모리를 탑재하고 있으며, 이전 모델인 젠우 810E보다 성능이 3배 향상되었습니다. 또한 FP32부터 FP4에 이르는 다양한 데이터 정밀도 수준을 기본적으로 지원하기 때문에, 고정밀도 훈련과 초저정밀도 동시 추론에 이상적입니다.
클러스터 상호 연결의 혁신: 자체 개발한 ICN 스위치 1.0 상호 연결 칩을 통합하여, 알리바바 클라우드는 젠우 M890을 기반으로 한 판지우 AL128 슈퍼 노드 서버를 출시했습니다. 이 서버는 128개의 AI 칩을 시스템 수준에서 효율적으로 관리함으로써, 나노초 단위의 통신 지연 시간을 실현하고 대규모 지능 컴퓨팅 클러스터의 효율성과 안정성을 크게 향상시켰습니다.
미래 계획: 텡쉰은 젠우 시리즈 칩의 로드맵을 공개했으며, 젠우 V900과 젠우 J900이 향후 2년 내에 출시될 것이라고 밝혔습니다. 이를 통해 데이터 센터 컴퓨팅 시장에서의 장기적인 경쟁력을 더욱 강화할 예정입니다.
2. 핵심 접근 포인트: 새롭게 디자인된 “쿤 클라우드”와 에이전트 중심의 상호작용
알리바바 클라우드는 클라우드 상호작용 논리를 근본적으로 변화시켰습니다. 기존의 클라우드 플랫폼은 인간을 위해 설계되었지만(제어판과 대시보드 등), 에이전트 시대의 클라우드는 에이전트를 위해 설계되어야 합니다.
AI 기반 웹사이트 “쿤 클라우드”: AI 기반 웹사이트인 쿤 클라우드는 기존의 복잡한 제품 카탈로그를 표준화된 스킬 설치 코드로 대체했습니다. 에이전트들은 이러한 코드 지시를 직접 해석하여 컴퓨팅, 저장, 모델 기능을 자동으로 호출할 수 있으므로, 수동적인 제어판 설정이 더 이상 필요하지 않습니다.
기능의 표준화: 알리바바 클라우드는 150개 이상의 주류 모델과 클라우드 제품 기능을 표준화된 스킬과 CLI 도구로 패키징했습니다. 단 한 줄의 명령어만으로도 클로드 코드나 주류 에이전트 프레임워크와 같은 도구들을 사용하여 알리바바 클라우드의 모든 인프라 기능을 빠르게 설치하고 이용할 수 있습니다.
3. 기술 전략: 칩, 클라우드, 모델, 추론의 풀스택 통합
이 새로운 시스템은 불규칙한 탄력성, 짧은 수명 주기, 매우 높은 순간적 동시성을 특징으로 하는 에이전트 작업 부하의 고유한 문제들을 해결하기 위해 설계되었습니다.
심층 최적화: 알리바바 클라우드는 플래그십 모델인 쿤3.7-Max와 같은 모델뿐만 아니라, 기본적인 젠우 시리즈 칩과 추론 프레임워크 간의 심층적인 통합을 통해 최적의 컴퓨팅 리소스 배분을 실현했습니다.
목표의 변화: 알리바바 클라우드의 CTO인 리페이 리와 다른 전문가들은 대규모 모델의 초점이 인간의 선호도에 맞추는 것에서 작업 목표를 달성하는 데 맞추는 것으로 변화했다고 지적했습니다. 이러한 시스템의 진화는 에이전트들이 수백만 분의 1초 내에 복잡한 엔지니어링 작업을 효율적으로 완료할 수 있도록 보장함으로써, 다양한 산업에서 AI의 활용 장벽을 낮추는 데 기여합니다.
요약:
텡쉰 칩 매트릭스와 쿤 클라우드 접근 포인트, 그리고 풀스택 모델 추론 기능을 결합함으로써, 알리바바 클라우드는 업계 최초로 컴퓨팅 파워 임대 제공업체에서 AI 공장으로 전환하는 데 성공했습니다. 이 시스템은 에이전트들의 폭발적인 성장을 지원할 인프라를 제공할 뿐만 아니라, 중국의 기술 리더들이 에이전트 시대에 하드웨어와 소프트웨어의 협력을 통해 전 세계 생산성의 문턱을 재구성하려는 야망을 보여줍니다.
관련 기사
ByteDance, Doubao 14.6% 급증에 핵심 AI 인센티브 강화
ByteDance는 최근 DouBao 지주 설명회를 소집하여 DouBao 부서에 종사하는 직원들을 위한 새로운 인센티브 정책을 공개했다. DouBao 주식의 행사가액은 2026년 6월의 14.85달러에서 17.02달러로 인상되었으며, 이는 약 14.6%의 증가를 의미한다.이번 개정은 DouBao 주식의 가치를 높일 뿐만 아니라 그 분배 범위를 크게 확대한다. 개인의 역할에 따라 일부 직원은 총 보상액의 약 5%에 해당하는 DouBao 주식을
MiniMax, 전 세계 AI 전문가들을 장려하기 위해 10배 팀 프로그램을 공개합니다
MiniMax(시위 테크놀로지)의 범용 인공지능 연구소는 글로벌 인재 협력 프로그램인 '10x 팀'을 공식적으로 출시했습니다. 이 프로그램은 다양한 산업 분야의 최고 전문가들을 모집하여 대형 모델의 전문 수직 분야에 대한 심층적인 응용을 탐구하는 것을 목표로 합니다. 심층적인 산업 지식과 최첨단 AI를 통합함으로써 MiniMax는 대형 모델의 생산성을 일반적인 사용에서 전문적인 시나리오로 확장하여 궁극적으로 산업 효율성의 '10배 증가'를 주도
관련 특별 주제 추천
의견 (0)
0/500

2026년 5월 20일, 알리바바 클라우드 서밋에서 알리바바 클라우드는 에이전트 시대를 위해 설계된 풀스택 기술 시스템 업그레이드가 완료되었다고 발표했습니다. 이 변화는 기본 칩과 클라우드 플랫폼부터 모델 및 추론 솔루션에 이르기까지 전체 시스템을 재구성했습니다. 이를 통해 알리바바 클라우드는 거대한 에이전트들이 24시간 연중무휴로 작동할 수 있도록 지원하는 AI 공장으로 자리매김하게 되었으며, 이는 더 이상 인간 사용자에게 직접 서비스를 제공하는 것을 넘어서는 의미입니다.
1. 핵심 기반: 텡쉰 젠우 M890 칩과 슈퍼 노드 서버
이번 업그레이드의 핵심은 텡쉰의 차세대 AI 칩인 젠우 M890으로, 이 칩은 훈련과 추론 기능을 통합하고 있습니다.
성능 향상: M890은 144GB의 메모리를 탑재하고 있으며, 이전 모델인 젠우 810E보다 성능이 3배 향상되었습니다. 또한 FP32부터 FP4에 이르는 다양한 데이터 정밀도 수준을 기본적으로 지원하기 때문에, 고정밀도 훈련과 초저정밀도 동시 추론에 이상적입니다.
클러스터 상호 연결의 혁신: 자체 개발한 ICN 스위치 1.0 상호 연결 칩을 통합하여, 알리바바 클라우드는 젠우 M890을 기반으로 한 판지우 AL128 슈퍼 노드 서버를 출시했습니다. 이 서버는 128개의 AI 칩을 시스템 수준에서 효율적으로 관리함으로써, 나노초 단위의 통신 지연 시간을 실현하고 대규모 지능 컴퓨팅 클러스터의 효율성과 안정성을 크게 향상시켰습니다.
미래 계획: 텡쉰은 젠우 시리즈 칩의 로드맵을 공개했으며, 젠우 V900과 젠우 J900이 향후 2년 내에 출시될 것이라고 밝혔습니다. 이를 통해 데이터 센터 컴퓨팅 시장에서의 장기적인 경쟁력을 더욱 강화할 예정입니다.
2. 핵심 접근 포인트: 새롭게 디자인된 “쿤 클라우드”와 에이전트 중심의 상호작용
알리바바 클라우드는 클라우드 상호작용 논리를 근본적으로 변화시켰습니다. 기존의 클라우드 플랫폼은 인간을 위해 설계되었지만(제어판과 대시보드 등), 에이전트 시대의 클라우드는 에이전트를 위해 설계되어야 합니다.
AI 기반 웹사이트 “쿤 클라우드”: AI 기반 웹사이트인 쿤 클라우드는 기존의 복잡한 제품 카탈로그를 표준화된 스킬 설치 코드로 대체했습니다. 에이전트들은 이러한 코드 지시를 직접 해석하여 컴퓨팅, 저장, 모델 기능을 자동으로 호출할 수 있으므로, 수동적인 제어판 설정이 더 이상 필요하지 않습니다.
기능의 표준화: 알리바바 클라우드는 150개 이상의 주류 모델과 클라우드 제품 기능을 표준화된 스킬과 CLI 도구로 패키징했습니다. 단 한 줄의 명령어만으로도 클로드 코드나 주류 에이전트 프레임워크와 같은 도구들을 사용하여 알리바바 클라우드의 모든 인프라 기능을 빠르게 설치하고 이용할 수 있습니다.
3. 기술 전략: 칩, 클라우드, 모델, 추론의 풀스택 통합
이 새로운 시스템은 불규칙한 탄력성, 짧은 수명 주기, 매우 높은 순간적 동시성을 특징으로 하는 에이전트 작업 부하의 고유한 문제들을 해결하기 위해 설계되었습니다.
심층 최적화: 알리바바 클라우드는 플래그십 모델인 쿤3.7-Max와 같은 모델뿐만 아니라, 기본적인 젠우 시리즈 칩과 추론 프레임워크 간의 심층적인 통합을 통해 최적의 컴퓨팅 리소스 배분을 실현했습니다.
목표의 변화: 알리바바 클라우드의 CTO인 리페이 리와 다른 전문가들은 대규모 모델의 초점이 인간의 선호도에 맞추는 것에서 작업 목표를 달성하는 데 맞추는 것으로 변화했다고 지적했습니다. 이러한 시스템의 진화는 에이전트들이 수백만 분의 1초 내에 복잡한 엔지니어링 작업을 효율적으로 완료할 수 있도록 보장함으로써, 다양한 산업에서 AI의 활용 장벽을 낮추는 데 기여합니다.
요약:
텡쉰 칩 매트릭스와 쿤 클라우드 접근 포인트, 그리고 풀스택 모델 추론 기능을 결합함으로써, 알리바바 클라우드는 업계 최초로 컴퓨팅 파워 임대 제공업체에서 AI 공장으로 전환하는 데 성공했습니다. 이 시스템은 에이전트들의 폭발적인 성장을 지원할 인프라를 제공할 뿐만 아니라, 중국의 기술 리더들이 에이전트 시대에 하드웨어와 소프트웨어의 협력을 통해 전 세계 생산성의 문턱을 재구성하려는 야망을 보여줍니다.
ByteDance, Doubao 14.6% 급증에 핵심 AI 인센티브 강화
ByteDance는 최근 DouBao 지주 설명회를 소집하여 DouBao 부서에 종사하는 직원들을 위한 새로운 인센티브 정책을 공개했다. DouBao 주식의 행사가액은 2026년 6월의 14.85달러에서 17.02달러로 인상되었으며, 이는 약 14.6%의 증가를 의미한다.이번 개정은 DouBao 주식의 가치를 높일 뿐만 아니라 그 분배 범위를 크게 확대한다. 개인의 역할에 따라 일부 직원은 총 보상액의 약 5%에 해당하는 DouBao 주식을
MiniMax, 전 세계 AI 전문가들을 장려하기 위해 10배 팀 프로그램을 공개합니다
MiniMax(시위 테크놀로지)의 범용 인공지능 연구소는 글로벌 인재 협력 프로그램인 '10x 팀'을 공식적으로 출시했습니다. 이 프로그램은 다양한 산업 분야의 최고 전문가들을 모집하여 대형 모델의 전문 수직 분야에 대한 심층적인 응용을 탐구하는 것을 목표로 합니다. 심층적인 산업 지식과 최첨단 AI를 통합함으로써 MiniMax는 대형 모델의 생산성을 일반적인 사용에서 전문적인 시나리오로 확장하여 궁극적으로 산업 효율성의 '10배 증가'를 주도





집







