A nova IA do Anthropic: surpreendentemente acessível para treinar

O último modelo de IA da Anthropic, Claude 3.7 Sonnet, foi supostamente treinado por apenas algumas dezenas de milhões de dólares, usando menos de 10^26 FLOPs de poder computacional. Essa informação vem do professor da Wharton, Ethan Mollick, que compartilhou no X que obteve isso diretamente da equipe de relações públicas da Anthropic. Eles disseram a ele: "Fui contatado pela Anthropic, que me disse que o Sonnet 3.7 não seria considerado um modelo de 10^26 FLOP e custou algumas dezenas de milhões de dólares", embora tenham sugerido que modelos futuros seriam muito maiores.
O TechCrunch tentou obter informações da Anthropic, mas não recebeu resposta antes de seu artigo ser publicado.
Se o Claude 3.7 Sonnet realmente custou apenas algumas dezenas de milhões para ser treinado, é bastante impressionante pensar o quanto está ficando mais barato lançar modelos de IA de ponta. Para dar uma ideia, o Claude 3.5, que foi lançado no outono de 2024, também custou algumas dezenas de milhões para ser treinado, segundo o CEO da Anthropic, Dario Amodei.
Quando você compara esses números com o que custou treinar os grandes modelos de 2023, é ainda mais impressionante. A OpenAI gastou mais de US$ 100 milhões para colocar seu modelo GPT-4 em funcionamento, segundo seu CEO, Sam Altman. E o Google? Eles gastaram cerca de US$ 200 milhões em seu modelo Gemini Ultra, se você acreditar em um estudo de Stanford.
Mas espere, Amodei acha que o custo dos futuros modelos de IA pode chegar a bilhões. E lembre-se, os custos de treinamento são apenas uma peça do quebra-cabeça. Há também testes de segurança, pesquisa fundamental e todo esse jazz. Além disso, à medida que o mundo da IA começa a investir em modelos de "raciocínio" que processam problemas por mais tempo, os custos para manter esses modelos funcionando provavelmente continuarão subindo.
Artigo relacionado
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica
A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada
A Anthropic lança o Opus 4.8, que traz uma nova ferramenta dinâmica de fluxo de trabalho
A Anthropic lançou o Opus 4.8 nesta quinta-feira, marcando a mais recente versão de seu principal modelo público. Com preço idêntico ao de seu antecessor, esta atualização já está disponível em todas
A Anthropic lança o Claude Fable 5, uma versão pública do Mythos
A Anthropic está disponibilizando seu modelo de IA mais poderoso ao público em geral pela primeira vez — mas com medidas de segurança em vigor.Na terça-feira, a empresa lançou o Claude Fable 5, a pri
Recomendações de tópicos especiais relacionados
Comentários (37)
Wait, only tens of millions to train a top-tier model? That's a game-changer for accessibility. Makes you wonder how much the others are spending... and what the real cost of compute will be in a few years. 🤔
Anthropicのコスト効率すごい!数十億ドルかかると思ってたのに、たった数千万ドルでトレーニング済みなの?🤯 でも本当に倫理的にデータ使ってるのか気になる。他社も追従してAI開発費が下がったら、もっと面白いプロジェクトが増えるかもね。
Wow, Anthropic trained Claude 3.7 Sonnet for just tens of millions? That’s a steal in the AI world! Makes me wonder how they optimized to keep costs so low. Exciting for smaller startups, but big players must be sweating. 😅
Wow, training Claude 3.7 for just tens of millions? That’s a steal in AI land! Makes me wonder how they cut corners without losing quality. 🤔 Exciting for startups, though—cheaper AI could shake things up!

O último modelo de IA da Anthropic, Claude 3.7 Sonnet, foi supostamente treinado por apenas algumas dezenas de milhões de dólares, usando menos de 10^26 FLOPs de poder computacional. Essa informação vem do professor da Wharton, Ethan Mollick, que compartilhou no X que obteve isso diretamente da equipe de relações públicas da Anthropic. Eles disseram a ele: "Fui contatado pela Anthropic, que me disse que o Sonnet 3.7 não seria considerado um modelo de 10^26 FLOP e custou algumas dezenas de milhões de dólares", embora tenham sugerido que modelos futuros seriam muito maiores.
O TechCrunch tentou obter informações da Anthropic, mas não recebeu resposta antes de seu artigo ser publicado.
Se o Claude 3.7 Sonnet realmente custou apenas algumas dezenas de milhões para ser treinado, é bastante impressionante pensar o quanto está ficando mais barato lançar modelos de IA de ponta. Para dar uma ideia, o Claude 3.5, que foi lançado no outono de 2024, também custou algumas dezenas de milhões para ser treinado, segundo o CEO da Anthropic, Dario Amodei.
Quando você compara esses números com o que custou treinar os grandes modelos de 2023, é ainda mais impressionante. A OpenAI gastou mais de US$ 100 milhões para colocar seu modelo GPT-4 em funcionamento, segundo seu CEO, Sam Altman. E o Google? Eles gastaram cerca de US$ 200 milhões em seu modelo Gemini Ultra, se você acreditar em um estudo de Stanford.
Mas espere, Amodei acha que o custo dos futuros modelos de IA pode chegar a bilhões. E lembre-se, os custos de treinamento são apenas uma peça do quebra-cabeça. Há também testes de segurança, pesquisa fundamental e todo esse jazz. Além disso, à medida que o mundo da IA começa a investir em modelos de "raciocínio" que processam problemas por mais tempo, os custos para manter esses modelos funcionando provavelmente continuarão subindo.
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica
A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada
A Anthropic lança o Opus 4.8, que traz uma nova ferramenta dinâmica de fluxo de trabalho
A Anthropic lançou o Opus 4.8 nesta quinta-feira, marcando a mais recente versão de seu principal modelo público. Com preço idêntico ao de seu antecessor, esta atualização já está disponível em todas
A Anthropic lança o Claude Fable 5, uma versão pública do Mythos
A Anthropic está disponibilizando seu modelo de IA mais poderoso ao público em geral pela primeira vez — mas com medidas de segurança em vigor.Na terça-feira, a empresa lançou o Claude Fable 5, a pri
Wait, only tens of millions to train a top-tier model? That's a game-changer for accessibility. Makes you wonder how much the others are spending... and what the real cost of compute will be in a few years. 🤔
Anthropicのコスト効率すごい!数十億ドルかかると思ってたのに、たった数千万ドルでトレーニング済みなの?🤯 でも本当に倫理的にデータ使ってるのか気になる。他社も追従してAI開発費が下がったら、もっと面白いプロジェクトが増えるかもね。
Wow, Anthropic trained Claude 3.7 Sonnet for just tens of millions? That’s a steal in the AI world! Makes me wonder how they optimized to keep costs so low. Exciting for smaller startups, but big players must be sweating. 😅
Wow, training Claude 3.7 for just tens of millions? That’s a steal in AI land! Makes me wonder how they cut corners without losing quality. 🤔 Exciting for startups, though—cheaper AI could shake things up!





Lar






