選項
首頁
快訊
內容
JuanTaylor
JuanTaylor
2026-07-03

NVIDIA於7月2日釋出了Nemotron-Labs-TwoTower離散擴散語言模型,該模型採用600億引數的雙塔架構,由兩個各300億引數的神經網路組成。它透過擴散機制實現並行文字生成,在保持原有98.7%功能效能的同時,將處理效率提升了2.42倍。該模型已在Huggingface上開源,若要完成完整推理,則需要兩塊H100或A100 80GB規格的GPU。

NVIDIA於7月2日釋出了Nemotron-Labs-TwoTower離散擴散語言模型,該模型採用600億引數的雙塔架構,由兩個各300億引數的神經網路組成。它透過擴散機制實現並行文字生成,在保持原有98.7%功能效能的同時,將處理效率提升了2.42倍。該模型已在Huggingface上開源,若要完成完整推理,則需要兩塊H100或A100 80GB規格的GPU。
評論 (0)
0/300
OR