opção
Lar
Notícias
Nvidia revela modelo de IA de código aberto Nemotron-Nano-9B-v2 com raciocínio alternável

Nvidia revela modelo de IA de código aberto Nemotron-Nano-9B-v2 com raciocínio alternável

28 de Dezembro de 2025
168

Os modelos de linguagem pequenos estão causando impacto. Após o lançamento do modelo de visão do tamanho de um smartwatch da Liquid AI, uma spin-off do MIT, e da oferta pronta para smartphones do Google, a Nvidia agora entra em cena com seu próprio concorrente simplificado: o Nemotron-Nano-9B-V2. Esse novo modelo lidera sua classe em benchmarks importantes e apresenta um recurso exclusivo que permite aos usuários ativar ou desativar o “raciocínio” da IA — essencialmente um processo de autoverificação antes de fornecer uma resposta final.

Embora 9 bilhões de parâmetros excedam a escala dos micromodelos com milhões de parâmetros sobre os quais relatamos recentemente, a Nvidia destaca isso como uma otimização significativa em relação aos seus 12 bilhões de parâmetros originais. O tamanho revisado foi projetado especificamente para rodar em uma única GPU Nvidia A10 amplamente disponível.

Como Oleksii Kuchiaev, diretor de pós-treinamento de modelos de IA da Nvidia, explicou em resposta a uma pergunta no X: “Reduzimos o modelo de 12 bilhões para 9 bilhões para se encaixar perfeitamente na A10, uma GPU de implantação popular. É também uma arquitetura híbrida, o que permite lidar com tamanhos de lote maiores e atingir velocidades até seis vezes mais rápidas do que os modelos transformadores tradicionais de tamanho semelhante.”

Para se ter uma perspectiva, muitos modelos de linguagem grandes líderes operam na faixa de mais de 70 bilhões de parâmetros. Os parâmetros são as configurações internas que definem o comportamento de um modelo, onde contagens mais altas normalmente indicam maior capacidade, mas também exigem significativamente mais poder computacional.

O modelo suporta vários idiomas, incluindo inglês, alemão, espanhol, francês, italiano e japonês. Recursos estendidos também abrangem coreano, português, russo e chinês. É adequado para tarefas que vão desde seguir instruções até gerar código.

O Nemotron-Nano-9B-V2 e seus conjuntos de dados de pré-treinamento estão disponíveis atualmente no Hugging Face e no catálogo de modelos da Nvidia.

Uma fusão das arquiteturas Transformer e Mamba

O modelo é baseado no Nemotron-H, uma família de modelos híbridos Mamba-Transformer que servem de base para as mais recentes ofertas de IA da Nvidia.

Embora os LLMs dominantes normalmente dependam exclusivamente da arquitetura Transformer e seus mecanismos de atenção, eles podem se tornar proibitivamente caros em termos de memória e computação à medida que o comprimento das sequências de entrada aumenta.

Os modelos Nemotron-H e outros que utilizam a arquitetura Mamba — pioneira dos pesquisadores da Carnegie Mellon University e Princeton — incorporam modelos de espaço de estado seletivo (SSMs). Esses SSMs gerenciam com eficiência sequências extremamente longas, mantendo um estado interno.

Essas camadas são dimensionadas linearmente com o comprimento da sequência, permitindo que processem contextos muito mais longos do que a autoatenção padrão, sem a mesma sobrecarga computacional.

Um design híbrido Mamba-Transformer reduz os custos ao substituir a maioria das camadas de atenção por camadas de espaço de estado de tempo linear. Isso pode render um rendimento até 2 a 3 vezes maior em tarefas de contexto longo, mantendo uma precisão comparável.

A Nvidia não está sozinha nessa abordagem; outros laboratórios de pesquisa em IA, como o AI2, também lançaram modelos baseados na arquitetura Mamba.

Ative ou desative o raciocínio com comandos simples

O Nemotron-Nano-9B-v2 foi projetado como um modelo unificado, somente de texto, capaz de interação conversacional e raciocínio complexo, treinado inteiramente do zero.

Por padrão, o sistema gera um rastreamento detalhado do raciocínio antes de produzir sua resposta final. Os usuários podem controlar esse comportamento usando tokens de comando simples, como /think ou /no_think.

O modelo também introduz o gerenciamento de “orçamento de raciocínio” em tempo de execução. Isso permite que os desenvolvedores definam um limite máximo para o número de tokens que o modelo pode usar para raciocínio interno antes de ter que entregar uma resposta.

Esse mecanismo tem como objetivo equilibrar a precisão com a latência da resposta, o que é crucial para aplicativos como chatbots de suporte ao cliente ou agentes autônomos.

Benchmarks mostram forte desempenho

Os resultados da avaliação demonstram precisão competitiva em relação a outros modelos abertos de pequena escala líderes. Quando testado com raciocínio habilitado usando o pacote NeMo-Skills, o Nemotron-Nano-9B-v2 alcançou pontuações de 72,1% no AIME25, 97,8% no MATH500, 64,0% no GPQA e 71,1% no LiveCodeBench.

As pontuações nos benchmarks de seguimento de instruções e contexto longo também são fortes: 90,3% no IFEval e 78,9% no teste RULER 128K, com ganhos mensuráveis adicionais no BFCL v3 e no benchmark HLE.

Em várias avaliações, o Nano-9B-v2 mostra consistentemente uma precisão maior do que um ponto de comparação comum, o modelo Qwen3-8B.

A Nvidia apresenta esses resultados com curvas de precisão versus orçamento que ilustram como o desempenho melhora à medida que a permissão de tokens para raciocínio aumenta. A empresa observa que o controle cuidadoso do orçamento permite que os desenvolvedores otimizem a qualidade e a velocidade em ambientes de produção.

Treinado em conjuntos de dados sintéticos

Tanto o modelo Nano quanto a família Nemotron-H mais ampla são treinados em uma mistura de dados da web cuidadosamente selecionados, fontes proprietárias e dados de treinamento sintéticos.

O corpus de treinamento inclui textos gerais, códigos, matemática, literatura científica, documentos jurídicos e financeiros, bem como conjuntos de dados de perguntas e respostas com foco no alinhamento.

A Nvidia confirma o uso de traços de raciocínio sintéticos gerados por outros modelos grandes para melhorar o desempenho em tarefas de benchmark complexas.

Licenciamento e uso comercial

O modelo Nano-9B-v2 é lançado sob o Contrato de Licença de Modelo Aberto da Nvidia, que foi atualizado pela última vez em junho de 2025.

Esta licença foi concebida para ser permissiva e favorável às empresas. A Nvidia afirma explicitamente que os modelos são comercialmente utilizáveis imediatamente e que os desenvolvedores são livres para criar e distribuir trabalhos derivados.

Fundamentalmente, a Nvidia não reivindica a propriedade de quaisquer resultados gerados pelo modelo, deixando todos os direitos e responsabilidades com o desenvolvedor ou organização que o utiliza.

Para desenvolvedores empresariais, isso significa que o modelo pode ser implantado em produção imediatamente, sem a necessidade de negociar uma licença comercial separada ou pagar taxas com base no volume de uso, receita ou número de usuários. Ao contrário de algumas licenças abertas em camadas de outros fornecedores, não há cláusulas que exijam o pagamento de uma licença quando uma empresa atinge um determinado tamanho.

Dito isso, o contrato inclui várias condições importantes que as empresas devem seguir:

  • Barreiras de proteção: os usuários não podem contornar ou desativar os mecanismos de segurança integrados (conhecidos como “barreiras de proteção”) sem implementar substitutos adequados e equivalentes para sua implantação específica.
  • Redistribuição: qualquer redistribuição do modelo ou de seus derivados deve incluir o texto completo da Licença de Modelo Aberto da Nvidia e a atribuição adequada (“Licenciado pela Nvidia Corporation sob a Licença de Modelo Aberto da Nvidia”).
  • Conformidade: os usuários devem cumprir todas as regulamentações e restrições comerciais aplicáveis, como as leis de controle de exportação dos EUA.
  • Termos de IA confiável: o uso deve estar alinhado com as diretrizes de IA confiável da Nvidia, que abrangem princípios para implantação responsável e considerações éticas.
  • Cláusula de litígio: a licença é automaticamente rescindida se um usuário iniciar um litígio de direitos autorais ou patentes contra outra parte, alegando violação relacionada ao modelo.

Essas condições se concentram em garantir a conformidade legal e o uso responsável, em vez de restringir a escala comercial. As empresas não precisam solicitar permissão adicional ou pagar royalties à Nvidia para criar produtos, monetizar serviços ou ampliar sua base de usuários. Em vez disso, elas devem garantir que suas práticas de implantação respeitem a segurança, forneçam a atribuição adequada e cumpram todas as obrigações de conformidade.

Posicionamento no mercado

Com o Nemotron-Nano-9B-v2, a Nvidia tem como alvo desenvolvedores que precisam equilibrar a capacidade de raciocínio com a eficiência de implantação em menor escala.

Os recursos de controle de orçamento de tempo de execução e alternância de raciocínio foram projetados para dar aos criadores de sistemas maior flexibilidade no gerenciamento do equilíbrio entre precisão e velocidade de resposta.

Sua disponibilidade no Hugging Face e no catálogo de modelos da Nvidia sinaliza uma intenção de ampla acessibilidade, incentivando a experimentação e a integração.

O lançamento do Nemotron-Nano-9B-v2 pela Nvidia ressalta o foco contínuo da empresa em eficiência e raciocínio controlável em modelos de linguagem.

Ao combinar arquiteturas híbridas com técnicas avançadas de compressão e treinamento, a Nvidia visa fornecer aos desenvolvedores ferramentas que mantêm alta precisão e, ao mesmo tempo, reduzem os custos operacionais e a latência.

Artigo relacionado
O CEO da Nvidia, Jensen Huang, diz a Trump: “não vamos permitir que [um desaceleramento da IA] aconteça” O CEO da Nvidia, Jensen Huang, diz a Trump: “não vamos permitir que [um desaceleramento da IA] aconteça” Durante sua participação na Cúpula All-In, em Los Angeles, na segunda-feira, o CEO da Nvidia, Jensen Huang, recebeu uma ligação inesperada do presidente Donald Trump, à qual não poderia simplesmente ignorar.“Estou no palco com os amigos”, explicou H
Jensen Huang revela a “nova” oportunidade de mercado de US$ 200 bilhões da Nvidia Jensen Huang revela a “nova” oportunidade de mercado de US$ 200 bilhões da Nvidia O fundador e CEO da Nvidia, Jensen Huang, destaca-se como um dos visionários corporativos mais convincentes, se não o maior, ao impulsionar a narrativa de sua empresa. Ele pode até superar Marc Benioff, da Salesforce, em seu otimismo inabalável sobre
A OneRail utiliza a IA da Nvidia para otimizar entregas em tempo real na “última milha” A OneRail utiliza a IA da Nvidia para otimizar entregas em tempo real na “última milha” A OneRail lançou uma plataforma de entregas baseada em inteligência artificial que utiliza a tecnologia da Nvidia para auxiliar varejistas, atacadistas e distribuidores a determinar os métodos de entr
Recomendações de tópicos especiais relacionados
Análise de dados Melhores ferramentas de detecção de anomalias com IA para monitoramento de KPIs entre equipes de SaaS e comércio eletrônico
Melhores ferramentas de detecção de anomalias com IA para monitoramento de KPIs entre equipes de SaaS e comércio eletrônico

2026 Últimas Melhores Ferramentas de Detecção de Anomalias por IA Mais Bem Avaliadas para Monitoramento de KPIs em Equipes de SaaS e E-commerce! A XIX.AI compilou uma coleção poderosa e transformadora, baseada em testes rigorosos do mundo real e classificações atualizadas semanalmente. Você encontrará insights detalhados sobre comparações entre versões gratuitas e pagas para ajudá-lo a identificar a solução que deve ser testada, aumentando a produtividade e desbloqueando sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
escrita Os melhores geradores de esboços com IA para artigos longos de SEO
Os melhores geradores de esboços com IA para artigos longos de SEO

Os melhores e mais bem avaliados geradores de esboços com IA de 2026 para artigos longos de SEO, cuidadosamente selecionados pela XIX.AI. Essas ferramentas poderosas oferecem um auxílio revolucionário na criação rápida de conteúdo de alta qualidade, aumentando significativamente a eficiência na redação. Confira uma comparação entre versões gratuitas e pagas, além de testes práticos e classificações detalhadas, para ajudá-lo a encontrar a opção imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Edição de imagem Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor
Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor

2026 Últimas Melhores Ferramentas de Retoque com IA do Photoshop para roupas de comércio eletrônico, limpeza de pele e consistência de cores! Esta lista curada de alta classificação apresenta soluções poderosas que mudam o jogo, ajudando você a aumentar a eficiência da escrita, simplificar a criação de conteúdo e obter resultados visuais perfeitos sem esforço. Cada ferramenta passou por testes do mundo real através de classificações atualizadas semanalmente, com detalhes completos sobre comparação entre gratuito e pago. Com o apoio da XIX.AI, é o guia essencial para quem deseja desbloquear sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
Comentários (1)
0/500
DanielThomas
DanielThomas 14 de Janeiro de 2026 à34 04:30:34 WET

이 작은 언어 모델 경쟁이 정말 흥미롭네요! Nvidia가 추론 기능을 끄고 켤 수 있는 옵션을 넣은 건 실용적이면서도 재미있는 접근법인 것 같아요. 개인적으로는 이런 경량화 모델들이 스마트워치나 스마트폰 같은 엣지 디바이스에서 어떻게 활용될지 궁금해요. 🤔 AI가 점점 더 일상 속으로 스며들고 있는 느낌이에요.

OR