옵션
속보
콘텐츠
JuanTaylor
JuanTaylor
2026년 7월 3일

NVIDIA는 7월 2일에 Nemotron-Labs-TwoTower 디스크리트 디퓨전 언어 모델을 공개했으며, 이 모델은 각각 30B 파라미터를 가진 두 개의 네트워크로 구성된 60B 파라미터의 듀얼 타워 아키텍처를 특징으로 합니다. 디퓨전 기술을 활용한 병렬 텍스트 생성 방식을 채택함으로써 처리 속도를 2.42배 향상시키면서도 기존 성능의 98.7%를 그대로 유지합니다. 이 모델은 Huggingface에 오픈소스로 공개되어 있으며, 완전한 추론을 수행하려면 H100 또는 A100 80GB GPU가 두 대 필요합니다.

NVIDIA는 7월 2일에 Nemotron-Labs-TwoTower 디스크리트 디퓨전 언어 모델을 공개했으며, 이 모델은 각각 30B 파라미터를 가진 두 개의 네트워크로 구성된 60B 파라미터의 듀얼 타워 아키텍처를 특징으로 합니다. 디퓨전 기술을 활용한 병렬 텍스트 생성 방식을 채택함으로써 처리 속도를 2.42배 향상시키면서도 기존 성능의 98.7%를 그대로 유지합니다. 이 모델은 Huggingface에 오픈소스로 공개되어 있으며, 완전한 추론을 수행하려면 H100 또는 A100 80GB GPU가 두 대 필요합니다.
의견 (0)
0/300
OR