вариант
Дом
Срочные новости
Содержание
JuanTaylor
JuanTaylor
3 июля 2026 г.

2 июля NVIDIA выпустила дискретную языковую модель для диффузионного генерирования текста Nemotron-Labs-TwoTower, основанную на архитектуре с двумя башнями и 60 миллиардами параметров, включающей по две сети по 30 миллиардов параметров каждая. Эта модель использует параллельное генерирование текста с применением технологии диффузии, что позволяет увеличить скорость обработки в 2,42 раза при сохранении 98,7% первоначальных возможностей. Модель опубликована с открытым исходным кодом на платформе Huggingface, и для полноценной работы требуются две видеокарты типа H100 или A100 объемом по 80 ГБ.

2 июля NVIDIA выпустила дискретную языковую модель для диффузионного генерирования текста Nemotron-Labs-TwoTower, основанную на архитектуре с двумя башнями и 60 миллиардами параметров, включающей по две сети по 30 миллиардов параметров каждая. Эта модель использует параллельное генерирование текста с применением технологии диффузии, что позволяет увеличить скорость обработки в 2,42 раза при сохранении 98,7% первоначальных возможностей. Модель опубликована с открытым исходным кодом на платформе Huggingface, и для полноценной работы требуются две видеокарты типа H100 или A100 объемом по 80 ГБ.
Автор GeorgeMiller GeorgeMiller 20 сентября 2026 г.
Step Zenith представила Step5Preview — флагманскую модель искусственного интеллекта нового поколения, оптимизированную для программирования, программной инженерии и финансов. Модель использует разреженную архитектуру MoE с 600 миллиардами параметров, из которых 27 миллиардов являются активными, поддерживает контекстное окно на 1 миллион токенов и нативный мультимодальный ввод. Модель входит в мировую тройку лидеров по уровню интеллекта среди открытых моделей, демонстрируя производительность, сопоставимую с Claude Opus5, при стоимости в восемь раз меньшей. Она обеспечивает баланс между интеллектом, стоимостью и эффективностью для решения реальных задач агентов. Официальный открытый релиз Step5Preview запланирован на 15 октября; модель ориентирована на сложные профессиональные рабочие процессы и направлена на повышение общей операционной эффективности.
/ru/live/7463
OR