Lar
Claude Mythos é lançado a US$ 125 por 1 milhão de tokens; o método “Homem das Cavernas da Montanha Frugal” ganha popularidade
Recentemente, a Anthropic lançou o modelo de IA Claude Mythos, descrito como seu lançamento mais poderoso até o momento. No entanto, o preço causou grande comoção na comunidade de desenvolvedores: os custos de geração de resultados foram fixados em US$ 125 por milhão de tokens, quase oito vezes mais do que os do atual modelo principal, o Claude Sonnet 4.6.

Foco principal: o Mythos, de custo proibitivo
A estrutura de preços do Claude Mythos sinaliza uma nova era de sobretaxas pelo poder de computação da IA:
Custos exorbitantes: a entrada e a saída custam US$ 25 e US$ 125 por milhão de tokens, respectivamente. Em comparação, o Claude Sonnet 4.6 custa apenas US$ 3 e US$ 15.
Alta barreira de entrada: devido ao seu poder extremo e ao alto custo, o modelo ainda não está acessível a usuários comuns. Alguns usuários do Reddit brincaram dizendo que até mesmo um simples “Olá” poderia consumir 13% da cota mensal de tokens.
Auto-resgate geek: o método viral de economia “Caveman”
Com os custos dos tokens rivalizando com o ouro, os desenvolvedores recorreram a táticas extremas de economia. Um projeto, apropriadamente chamado de Caveman, rapidamente se tornou viral no GitHub:
Lógica central: ele força a IA a cortar todas as formalidades (como “É um prazer atendê-lo”), eliminar artigos, evitar conversas triviais vagas e gerar apenas termos técnicos essenciais.
Resultados impressionantes: Testes indicam que esse modo de “linguagem do homem das cavernas” pode economizar cerca de 65% dos tokens sem sacrificar a precisão da resposta.
Base científica: Estudos mostram que forçar o modelo a produzir respostas concisas não apenas reduz custos, mas também elimina os efeitos negativos do excesso de reflexão, aumentando a precisão em alguns benchmarks em 26%.
Dicas práticas: 10 truques para economizar tokens
Além de soluções técnicas, os usuários comuns podem contornar o “assassino de tokens” ajustando seus hábitos de interação:
Edite no local: se um resultado não for satisfatório, use o botão “Editar” para refinar o prompt original, evitando cobranças repetidas decorrentes de conversas longas.
Encerre as conversas: inicie um novo chat a cada 15–20 mensagens para evitar que o acúmulo de contexto se transforme em um buraco negro de tokens.
Combine perguntas: agrupe várias instruções em uma única mensagem para reduzir a carga no sistema.
Use o Espaço de Projetos com sabedoria: envie documentos longos para os Projetos e aproveite o cache para que o documento não seja digitalizado repetidamente.
Opte por modelos mais econômicos quando possível: delegue tarefas simples, como verificações gramaticais, a modelos mais baratos, como o Haiku, reservando o Claude Mythos , que é mais caro, para tarefas mais complexas.
Aproveite os horários fora do pico: evite o horário de pico, das 5h às 11h, horário do Pacífico, para se beneficiar de custos mais baixos.
Conclusão: Do desperdício à precisão
Das mensagens curtas do ano 2000, cobradas por palavra, aos grandes modelos atuais, cobrados por token, nossa busca pela eficiência na comunicação completou um ciclo. Esta é a era da IA de alto custo inaugurada pelo Claude Mythos .
Artigo relacionado
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Recomendações de tópicos especiais relacionados
Comentários (0)
Recentemente,

Foco principal: o Mythos, de custo proibitivo
A estrutura de preços do
Custos exorbitantes: a entrada e a saída custam US$ 25 e US$ 125 por milhão de tokens, respectivamente. Em comparação,
Alta barreira de entrada: devido ao seu poder extremo e ao alto custo, o modelo ainda não está acessível a usuários comuns. Alguns usuários do Reddit brincaram dizendo que até mesmo um simples “Olá” poderia consumir 13% da cota mensal de tokens.
Auto-resgate geek: o método viral de economia “Caveman”
Com os custos dos tokens rivalizando com o ouro, os desenvolvedores recorreram a táticas extremas de economia. Um projeto, apropriadamente chamado de Caveman, rapidamente se tornou viral no GitHub:
Lógica central: ele força a IA a cortar todas as formalidades (como “É um prazer atendê-lo”), eliminar artigos, evitar conversas triviais vagas e gerar apenas termos técnicos essenciais.
Resultados impressionantes: Testes indicam que esse modo de “linguagem do homem das cavernas” pode economizar cerca de 65% dos tokens sem sacrificar a precisão da resposta.
Base científica: Estudos mostram que forçar o modelo a produzir respostas concisas não apenas reduz custos, mas também elimina os efeitos negativos do excesso de reflexão, aumentando a precisão em alguns benchmarks em 26%.
Dicas práticas: 10 truques para economizar tokens
Além de soluções técnicas, os usuários comuns podem contornar o “assassino de tokens” ajustando seus hábitos de interação:
Edite no local: se um resultado não for satisfatório, use o botão “Editar” para refinar o prompt original, evitando cobranças repetidas decorrentes de conversas longas.
Encerre as conversas: inicie um novo chat a cada 15–20 mensagens para evitar que o acúmulo de contexto se transforme em um buraco negro de tokens.
Combine perguntas: agrupe várias instruções em uma única mensagem para reduzir a carga no sistema.
Use o Espaço de Projetos com sabedoria: envie documentos longos para os Projetos e aproveite o cache para que o documento não seja digitalizado repetidamente.
Opte por modelos mais econômicos quando possível: delegue tarefas simples, como verificações gramaticais, a modelos mais baratos, como o Haiku, reservando o
Aproveite os horários fora do pico: evite o horário de pico, das 5h às 11h, horário do Pacífico, para se beneficiar de custos mais baixos.
Conclusão: Do desperdício à precisão
Das mensagens curtas do ano 2000, cobradas por palavra, aos grandes modelos atuais, cobrados por token, nossa busca pela eficiência na comunicação completou um ciclo. Esta é a era da IA de alto custo inaugurada pelo
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava











