DeepSeek V4 é lançado com as versões Flash e Pro; preços divulgados
Chegou uma grande atualização no campo dos modelos de grande porte. A DeepSeek, empresa chinesa líder em IA, lançou hoje seu novo modelo principal, o DeepSeek V4. O principal destaque é sua estratégia diferenciada, que atende a diversas necessidades — desde tarefas leves de alta frequência até raciocínios complexos — por meio de duas versões: Flash e Pro. Com preços competitivos, ela mais uma vez estabelece um novo padrão de referência para os custos comerciais da IA.
Matriz de Modelos: Posicionamento Diferenciado do Flash e do Pro
O DeepSeek V4 integra e aprimora os modelos originais deepseek-chat e deepseek-reasoner, dividindo-os oficialmente em duas versões:
DeepSeek-V4-Flash: Focado em extrema eficiência de custo e alto rendimento, ideal para conversas gerais de resposta rápida e tarefas básicas de texto.
DeepSeek-V4-Pro: Otimizado para lógica complexa, raciocínio profundo e computação de alto desempenho, oferecendo capacidades de raciocínio e processamento mais robustas.
Ambos os modelos oferecem suporte ao modo de raciocínio (exceto em cenários específicos), saída em JSON, chamadas de ferramentas, continuação de prefixos de diálogo (Beta) e uma janela de contexto de até 1 milhão de tokens com uma saída máxima de 384 mil tokens, proporcionando uma base sólida para implementações complexas de engenharia.

Sistema de preços: faturamento transparente e por níveis
A estrutura de preços do DeepSeek é clara e reduz significativamente o custo marginal para chamadas de API corporativas de longo prazo por meio de um mecanismo de cache. Aqui estão as taxas de cobrança por milhão de tokens (em RMB):
ModeloEntrada (acerto no cache)Entrada (erro no cache)SaídaDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBObservação: as taxas são deduzidas primeiro do saldo gratuito e, em seguida, do saldo pago.
Análise do setor: por que esse preço é um marco
A lógica de precificação mostra que o DeepSeek está incentivando os desenvolvedores a reduzir o desperdício de computação por meio da otimização do uso do cache, permitindo um controle de custos mais preciso graças à diferença significativa de preço entre entradas em cache e fora do cache.
Para os desenvolvedores, a versão Flash, a 1 RMB por milhão de tokens (falha de cache), reduz drasticamente a barreira para acessar arquiteturas de modelos MoE de ponta. Ao mesmo tempo, o preço da versão Pro para tarefas complexas de raciocínio oferece uma solução nacional para a construção de sistemas de perguntas e respostas baseados em conhecimento, agentes autônomos e outras aplicações avançadas, equilibrando desempenho e custo.
Observação importante sobre compatibilidade
Lembrete oficial: os nomes originais dos modelos, deepseek-chat e deepseek-reasoner, serão formalmente descontinuados. Para garantir uma transição tranquila, os desenvolvedores agora podem chamar deepseek-v4-flash (correspondente ao modo sem raciocínio) e deepseek-v4-pro (correspondente ao modo com raciocínio).
Para obter informações detalhadas sobre a API e guias de migração, os desenvolvedores podem acessar a documentação oficial da API do DeepSeek .
Artigo relacionado
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Recomendações de tópicos especiais relacionados
Comentários (0)
Chegou uma grande atualização no campo dos modelos de grande porte. A DeepSeek, empresa chinesa líder em IA, lançou hoje seu novo modelo principal, o DeepSeek V4. O principal destaque é sua estratégia diferenciada, que atende a diversas necessidades — desde tarefas leves de alta frequência até raciocínios complexos — por meio de duas versões: Flash e Pro. Com preços competitivos, ela mais uma vez estabelece um novo padrão de referência para os custos comerciais da IA.
Matriz de Modelos: Posicionamento Diferenciado do Flash e do Pro
O DeepSeek V4 integra e aprimora os modelos originais deepseek-chat e deepseek-reasoner, dividindo-os oficialmente em duas versões:
DeepSeek-V4-Flash: Focado em extrema eficiência de custo e alto rendimento, ideal para conversas gerais de resposta rápida e tarefas básicas de texto.
DeepSeek-V4-Pro: Otimizado para lógica complexa, raciocínio profundo e computação de alto desempenho, oferecendo capacidades de raciocínio e processamento mais robustas.
Ambos os modelos oferecem suporte ao modo de raciocínio (exceto em cenários específicos), saída em JSON, chamadas de ferramentas, continuação de prefixos de diálogo (Beta) e uma janela de contexto de até 1 milhão de tokens com uma saída máxima de 384 mil tokens, proporcionando uma base sólida para implementações complexas de engenharia.

Sistema de preços: faturamento transparente e por níveis
A estrutura de preços do DeepSeek é clara e reduz significativamente o custo marginal para chamadas de API corporativas de longo prazo por meio de um mecanismo de cache. Aqui estão as taxas de cobrança por milhão de tokens (em RMB):
ModeloEntrada (acerto no cache)Entrada (erro no cache)SaídaDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBObservação: as taxas são deduzidas primeiro do saldo gratuito e, em seguida, do saldo pago.
Análise do setor: por que esse preço é um marco
A lógica de precificação mostra que o DeepSeek está incentivando os desenvolvedores a reduzir o desperdício de computação por meio da otimização do uso do cache, permitindo um controle de custos mais preciso graças à diferença significativa de preço entre entradas em cache e fora do cache.
Para os desenvolvedores, a versão Flash, a 1 RMB por milhão de tokens (falha de cache), reduz drasticamente a barreira para acessar arquiteturas de modelos MoE de ponta. Ao mesmo tempo, o preço da versão Pro para tarefas complexas de raciocínio oferece uma solução nacional para a construção de sistemas de perguntas e respostas baseados em conhecimento, agentes autônomos e outras aplicações avançadas, equilibrando desempenho e custo.
Observação importante sobre compatibilidade
Lembrete oficial: os nomes originais dos modelos, deepseek-chat e deepseek-reasoner, serão formalmente descontinuados. Para garantir uma transição tranquila, os desenvolvedores agora podem chamar deepseek-v4-flash (correspondente ao modo sem raciocínio) e deepseek-v4-pro (correspondente ao modo com raciocínio).
Para obter informações detalhadas sobre a API e guias de migração, os desenvolvedores podem acessar
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr





Lar






