opção
JuanTaylor
JuanTaylor
3 de Julho de 2026

Em 2 de julho, a NVIDIA lançou o modelo de linguagem de difusão discreta Nemotron-Labs-TwoTower, que possui uma arquitetura de torre dupla com 60 bilhões de parâmetros, composta por duas redes de 30 bilhões cada. Ele utiliza geração de texto em paralelo por meio do processo de difusão, aumentando a taxa de processamento em 2,42 vezes sem perder 98,7% das capacidades originais. O modelo está disponível em código aberto no Huggingface e requer duas GPUs H100 ou A100 de 80 GB para realizar inferências completas.

Em 2 de julho, a NVIDIA lançou o modelo de linguagem de difusão discreta Nemotron-Labs-TwoTower, que possui uma arquitetura de torre dupla com 60 bilhões de parâmetros, composta por duas redes de 30 bilhões cada. Ele utiliza geração de texto em paralelo por meio do processo de difusão, aumentando a taxa de processamento em 2,42 vezes sem perder 98,7% das capacidades originais. O modelo está disponível em código aberto no Huggingface e requer duas GPUs H100 ou A100 de 80 GB para realizar inferências completas.
Comentários (0)
0/300
OR