option
Maison
Flash info
Contenu
JuanTaylor
JuanTaylor
3 juillet 2026

Le 2 juillet, NVIDIA a publié le modèle de langage à diffusion discrète Nemotron-Labs-TwoTower, doté d’une architecture à deux tours comprenant 60 milliards de paramètres et deux réseaux de 30 milliards chacun. Il utilise une génération de texte en parallèle via la méthode de diffusion, ce qui permet d’augmenter le débit de 2,42 fois tout en conservant 98,7 % des capacités initiales du modèle. Ce dernier est disponible en source ouverte sur Huggingface et nécessite deux GPU H100 ou A100 de 80 GB pour une inférence complète.

Le 2 juillet, NVIDIA a publié le modèle de langage à diffusion discrète Nemotron-Labs-TwoTower, doté d’une architecture à deux tours comprenant 60 milliards de paramètres et deux réseaux de 30 milliards chacun. Il utilise une génération de texte en parallèle via la méthode de diffusion, ce qui permet d’augmenter le débit de 2,42 fois tout en conservant 98,7 % des capacités initiales du modèle. Ce dernier est disponible en source ouverte sur Huggingface et nécessite deux GPU H100 ou A100 de 80 GB pour une inférence complète.
commentaires (0)
0/300
OR