Preço do cache de entrada da API DeepSeek reduzido para um décimo do valor original
O DeepSeek, principal modelo de linguagem de grande porte do mercado nacional, anunciou recentemente uma redução significativa nos preços, diminuindo o custo por acerto no cache de entrada em todas as séries de API para um décimo da tarifa original. Essa medida marca uma nova fase na gestão de custos da IA nacional, com o objetivo de atrair mais desenvolvedores e empresas ao oferecer uma excelente relação custo-benefício.
Reduções de preço essenciais abordam os pontos críticos do setor
Este ajuste de preço abrange toda a série V4-Pro e V4-Flash. O preço do cache de entrada para o V4-Pro foi reduzido para 0,1 RMB por milhão de tokens e, com uma promoção por tempo limitado, o pagamento efetivo é de apenas 0,025 RMB. Em comparação com concorrentes internacionais, o preço do cache de entrada é de apenas 1/700 do GPT-5.5 Pro, demonstrando forte competitividade no mercado.
Além dos cenários de acerto de cache, os preços para cenários de falha de cache e saída também foram reduzidos para um quarto do preço original. Essa estratégia de preços visa precisamente casos de uso de alta frequência, como bases de conhecimento RAG, atendimento inteligente ao cliente e análise de documentos, com potencial para reduzir os custos operacionais das empresas em mais de 90%.

A capacidade do DeepSeek de reduzir significativamente os preços decorre de sua arquitetura de atenção esparsa desenvolvida internamente. Essa tecnologia suporta o processamento de contextos ultralongos de até 160 mil caracteres, melhorando a eficiência no tratamento de textos longos e, ao mesmo tempo, reduzindo efetivamente o consumo de energia de computação e os custos de armazenamento subjacentes.
Artigo relacionado
A Seed, da ByteDance, lança campanha global de captação de talentos em campus universitários, oferecendo ações virtuais para conquistar os melhores especialistas em grandes modelos de inteligência artificial
No cenário competitivo dos grandes modelos de linguagem, garantir talentos de alto nível continua sendo o ativo estratégico mais crítico.Em 1º de abril, ByteDance anunciou o lançamento de sua iniciativa global de recrutamento campus Seed, parte de se
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Recomendações de tópicos especiais relacionados
Comentários (0)
O DeepSeek, principal modelo de linguagem de grande porte do mercado nacional, anunciou recentemente uma redução significativa nos preços, diminuindo o custo por acerto no cache de entrada em todas as séries de API para um décimo da tarifa original. Essa medida marca uma nova fase na gestão de custos da IA nacional, com o objetivo de atrair mais desenvolvedores e empresas ao oferecer uma excelente relação custo-benefício.
Reduções de preço essenciais abordam os pontos críticos do setor
Este ajuste de preço abrange toda a série V4-Pro e V4-Flash. O preço do cache de entrada para o V4-Pro foi reduzido para 0,1 RMB por milhão de tokens e, com uma promoção por tempo limitado, o pagamento efetivo é de apenas 0,025 RMB. Em comparação com concorrentes internacionais, o preço do cache de entrada é de apenas 1/700 do GPT-5.5 Pro, demonstrando forte competitividade no mercado.
Além dos cenários de acerto de cache, os preços para cenários de falha de cache e saída também foram reduzidos para um quarto do preço original. Essa estratégia de preços visa precisamente casos de uso de alta frequência, como bases de conhecimento RAG, atendimento inteligente ao cliente e análise de documentos, com potencial para reduzir os custos operacionais das empresas em mais de 90%.

A capacidade do DeepSeek de reduzir significativamente os preços decorre de sua arquitetura de atenção esparsa desenvolvida internamente. Essa tecnologia suporta o processamento de contextos ultralongos de até 160 mil caracteres, melhorando a eficiência no tratamento de textos longos e, ao mesmo tempo, reduzindo efetivamente o consumo de energia de computação e os custos de armazenamento subjacentes.
A Seed, da ByteDance, lança campanha global de captação de talentos em campus universitários, oferecendo ações virtuais para conquistar os melhores especialistas em grandes modelos de inteligência artificial
No cenário competitivo dos grandes modelos de linguagem, garantir talentos de alto nível continua sendo o ativo estratégico mais crítico.Em 1º de abril, ByteDance anunciou o lançamento de sua iniciativa global de recrutamento campus Seed, parte de se
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA





Lar






