opção
Lar
Notícias
O novo llama-3.1 Nemotron da NVIDIA supera o Deepseek R1 na metade do tamanho

O novo llama-3.1 Nemotron da NVIDIA supera o Deepseek R1 na metade do tamanho

13 de Abril de 2025
205

O novo llama-3.1 Nemotron da NVIDIA supera o Deepseek R1 na metade do tamanho

Enquanto a Meta enfrenta o escrutínio em torno de sua mais recente família de modelos Llama 4, a Nvidia lançou silenciosamente um novo modelo de linguagem de grande escala (LLM) totalmente open-source, baseado no modelo anterior da Meta, Llama-3.1-405B-Instruct. Nomeado Llama-3.1-Nemotron-Ultra-253B-v1, este modelo possui 253 bilhões de parâmetros e foi projetado para excelência em raciocínio avançado, seguimento de instruções e fluxos de trabalho de assistentes de IA. A Nvidia deu a primeira dica sobre este modelo durante sua Conferência Anual de Tecnologia de GPU (GTC) em março.

O lançamento destaca o compromisso contínuo da Nvidia em melhorar o desempenho por meio de inovação arquitetônica e processos meticulosos de pós-treinamento. Anunciado em 7 de abril de 2025, o código, os pesos e os dados de pós-treinamento do modelo agora estão livremente acessíveis no Hugging Face. Ele foi projetado para alternar perfeitamente entre tarefas de raciocínio complexo e saídas mais simples com base em prompts do sistema, oferecendo flexibilidade aos desenvolvedores em suas aplicações.

Projetado para Inferência Eficiente

Com base nos esforços anteriores da Nvidia em otimizar LLMs para inferência, o Llama-3.1-Nemotron-Ultra-253B incorpora um processo de Busca de Arquitetura Neural (NAS) para refinar sua arquitetura. Isso inclui recursos inovadores como camadas de atenção puladas, redes feedforward fundidas (FFNs) e taxas de compressão de FFN variáveis. Essas modificações reduzem o uso de memória e os requisitos computacionais do modelo, tornando-o implantável em um único nó de GPU 8x H100 sem comprometer a qualidade da saída.

A Nvidia afirma que este modelo oferece desempenho robusto enquanto é econômico para implantações em data centers. Ele é compatível com as microarquiteturas B100 e Hopper da Nvidia e foi testado nos modos de precisão BF16 e FP8.

Pós-Treinamento para Raciocínio e Alinhamento

O modelo passou por um regime abrangente de pós-treinamento. Isso incluiu ajuste fino supervisionado em vários domínios, como matemática, geração de código, chat e uso de ferramentas, seguido por aprendizado por reforço com Otimização de Política Relativa de Grupo (GRPO) para aprimorar suas capacidades de seguimento de instruções e raciocínio.

Um refinamento adicional veio através de uma fase de destilação de conhecimento com mais de 65 bilhões de tokens, e pré-treinamento contínuo em mais 88 bilhões de tokens. As fontes de dados de treinamento incluíram FineWeb, Buzz-V1.2 e Dolma, com prompts e respostas de pós-treinamento extraídos de corpora públicos e métodos de geração sintética. Essa abordagem ajudou o modelo a diferenciar entre seus modos de raciocínio.

Desempenho Aprimorado em Diversos Domínios e Benchmarks

Quando habilitado para raciocínio, o modelo mostrou melhorias significativas em vários benchmarks. Por exemplo, no benchmark MATH500, seu desempenho aumentou de 80,40% no modo padrão para 97,00% com o raciocínio ativado. Da mesma forma, as pontuações do AIME25 saltaram de 16,67% para 72,50%, e os resultados do LiveCodeBench mais que dobraram, de 29,03% para 66,31%.

O modelo também se destacou em tarefas baseadas em ferramentas e em respostas a perguntas gerais (GPQA), alcançando 76,01% no modo de raciocínio em comparação com 56,60% sem. Esses benchmarks foram conduzidos com um comprimento máximo de sequência de 32.000 tokens, e cada teste foi repetido até 16 vezes para maior precisão.

Comparado ao modelo MoE de última geração DeepSeek R1, que possui 671 bilhões de parâmetros, o modelo da Nvidia se mantém firme apesar de ter menos parâmetros. Ele supera o DeepSeek R1 em tarefas como GPQA (76,01 vs. 71,5), IFEval de seguimento de instruções (89,45 vs. 83,3) e tarefas de codificação LiveCodeBench (66,31 vs. 65,9). No entanto, o DeepSeek R1 leva uma ligeira vantagem em algumas avaliações matemáticas, particularmente AIME25 (79,8 vs. 72,50) e MATH500 (97,3 vs. 97,00).

Esses resultados indicam que o modelo denso da Nvidia pode igualar ou superar os modelos MoE em raciocínio e alinhamento geral de instruções, embora fique ligeiramente atrás em categorias intensivas em matemática.

Uso e Integração

O modelo integra-se perfeitamente à biblioteca Hugging Face Transformers (versão 4.48.3 recomendada) e suporta sequências de até 128.000 tokens. Os desenvolvedores podem alternar o comportamento de raciocínio usando prompts do sistema e escolher estratégias de decodificação com base nas necessidades da tarefa. Para tarefas de raciocínio, a Nvidia sugere usar amostragem de temperatura (0,6) com um valor top-p de 0,95, enquanto a decodificação gulosa é recomendada para saídas determinísticas.

O Llama-3.1-Nemotron-Ultra-253B suporta aplicações multilíngues, incluindo inglês, alemão, francês, italiano, português, hindi, espanhol e tailandês. Ele é bem adequado para vários casos de uso de LLM, como desenvolvimento de chatbots, fluxos de trabalho de agentes de IA, geração aumentada por recuperação (RAG) e geração de código.

Licenciado para Uso Comercial

Lançado sob a Licença de Modelo Aberto da Nvidia e regido pelo Acordo de Licença da Comunidade Llama 3.1, o modelo está pronto para aplicações comerciais. A Nvidia enfatiza a importância do desenvolvimento responsável de IA, instando as equipes a avaliarem o alinhamento, segurança e viés do modelo para seus casos de uso específicos.

Oleksii Kuchaiev, Diretor de Pós-Treinamento de Modelos de IA da Nvidia, compartilhou a empolgação sobre este lançamento aberto no X, destacando seu design denso de 253B com capacidades de raciocínio alternáveis e a inclusão de pesos e dados abertos.

Artigo relacionado
O CEO da Nvidia, Jensen Huang, diz a Trump: “não vamos permitir que [um desaceleramento da IA] aconteça” O CEO da Nvidia, Jensen Huang, diz a Trump: “não vamos permitir que [um desaceleramento da IA] aconteça” Durante sua participação na Cúpula All-In, em Los Angeles, na segunda-feira, o CEO da Nvidia, Jensen Huang, recebeu uma ligação inesperada do presidente Donald Trump, à qual não poderia simplesmente ignorar.“Estou no palco com os amigos”, explicou H
Jensen Huang revela a “nova” oportunidade de mercado de US$ 200 bilhões da Nvidia Jensen Huang revela a “nova” oportunidade de mercado de US$ 200 bilhões da Nvidia O fundador e CEO da Nvidia, Jensen Huang, destaca-se como um dos visionários corporativos mais convincentes, se não o maior, ao impulsionar a narrativa de sua empresa. Ele pode até superar Marc Benioff, da Salesforce, em seu otimismo inabalável sobre
A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes Pesquisas recentes indicam que muito poucos laboratórios líderes em IA publicaram ou demonstraram planos de resposta para contenção. Um plano de contenção define os procedimentos a serem seguidos quan
Recomendações de tópicos especiais relacionados
escrita Os melhores geradores de esboços com IA para artigos longos de SEO
Os melhores geradores de esboços com IA para artigos longos de SEO

Os melhores e mais bem avaliados geradores de esboços com IA de 2026 para artigos longos de SEO, cuidadosamente selecionados pela XIX.AI. Essas ferramentas poderosas oferecem um auxílio revolucionário na criação rápida de conteúdo de alta qualidade, aumentando significativamente a eficiência na redação. Confira uma comparação entre versões gratuitas e pagas, além de testes práticos e classificações detalhadas, para ajudá-lo a encontrar a opção imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Edição de imagem Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor
Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor

2026 Últimas Melhores Ferramentas de Retoque com IA do Photoshop para roupas de comércio eletrônico, limpeza de pele e consistência de cores! Esta lista curada de alta classificação apresenta soluções poderosas que mudam o jogo, ajudando você a aumentar a eficiência da escrita, simplificar a criação de conteúdo e obter resultados visuais perfeitos sem esforço. Cada ferramenta passou por testes do mundo real através de classificações atualizadas semanalmente, com detalhes completos sobre comparação entre gratuito e pago. Com o apoio da XIX.AI, é o guia essencial para quem deseja desbloquear sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
Incitar As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT
As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT

As melhores e mais bem avaliadas bibliotecas de prompts de IA de 2026 para otimizar todos os tipos de fluxos de trabalho do ChatGPT. A XIX.AI selecionou uma coleção poderosa e revolucionária, submetida a rigorosos testes no mundo real para garantir o máximo desempenho. Você encontra comparações detalhadas entre opções gratuitas e pagas, além de classificações de especialistas, para ajudá-lo a escolher as ferramentas indispensáveis que aumentam sua produtividade e potencializam suas vantagens em IA. Explore agora!

11 ferramentas
xix.ai
Comentários (54)
0/500
JonathanNelson
JonathanNelson 9 de Dezembro de 2025 à42 08:30:42 WET

Интересно, как Nvidia удалось упаковать все эти параметры в модель размером вдвое меньше. Выходит, вложения в архитектуру дают больше преимуществ, чем просто увеличение данных? Хотя, конечно, с учётом их вычислительных ресурсов не стоит удивляться. Что особенно ценно, так это тот факт, что модель открыта. На этом фоне заявления Meta порой звучат слишком громко и с многочисленными оговорками 🤔 Это может изменить правила игры для независимых исследователей!

CharlesYoung
CharlesYoung 3 de Novembro de 2025 à34 04:30:34 WET

¿Nvidia saca otro modelo open-source más potente que DeepSeek R1? 🤔 Me pregunto si esto realmente marcará una diferencia práctica para los desarrolladores o es solo otra carrera por los números en los benchmarks. ¡253 mil millones de parámetros parece excesivo!

DouglasMartínez
DouglasMartínez 18 de Agosto de 2025 à0 16:01:00 WEST

Nvidia's new model sounds like a beast! Half the size of DeepSeek R1 but still outperforms it? That's wild efficiency. Can't wait to see how devs play with this open-source gem! 🚀

StephenRoberts
StephenRoberts 1 de Agosto de 2025 à18 03:48:18 WEST

Nvidia's new model sounds like a beast! Half the size of DeepSeek R1 but still outshines it? That's some serious tech flex. Can't wait to see how devs play with this open-source gem! 😎

AnthonyRoberts
AnthonyRoberts 24 de Abril de 2025 à7 09:35:07 WEST

Nvidia's new Llama-3.1 Nemotron Ultra is a beast! It's amazing how it outperforms DeepSeek R1 with half the size. I've been using it for my projects and the results are incredible. Just wish it was a bit faster, but overall, a solid choice! 🚀

JohnRoberts
JohnRoberts 23 de Abril de 2025 à45 01:03:45 WEST

¡El Llama-3.1 Nemotron Ultra de Nvidia es impresionante! Supera al DeepSeek R1 con la mitad del tamaño, lo cual es alucinante. Lo he estado usando en mis proyectos y es súper eficiente. Lo único es que puede ser un poco complicado de configurar. Aún así, una excelente opción para quien busque un LLM potente. 🚀

OR