opção
Lar
Notícias
Claude 3,5 sonetos luta criativamente em testes de codificação de IA dominados por chatgpt

Claude 3,5 sonetos luta criativamente em testes de codificação de IA dominados por chatgpt

4 de Maio de 2025
203

Testando as Capacidades do Novo Claude 3.5 Sonnet da Anthropic

Na última semana, recebi um e-mail da Anthropic anunciando o lançamento do Claude 3.5 Sonnet. Eles afirmaram que ele "eleva o padrão da indústria em inteligência, superando modelos concorrentes e o Claude 3 Opus em uma ampla gama de avaliações." Eles também disseram que era perfeito para tarefas complexas como geração de código. Naturalmente, precisei testar essas afirmações.

Eu executei uma série de testes de codificação em várias IAs, e você também pode. Basta acessar Como eu testo a capacidade de codificação de um chatbot de IA - e você também pode para encontrar todos os detalhes. Vamos mergulhar em como o Claude 3.5 Sonnet se saiu nos meus testes padrão e ver como ele se compara a outras IAs como Microsoft Copilot, Meta AI, Meta Code Llama, Google Gemini Advanced e ChatGPT.

1. Escrevendo um Plugin para WordPress

Inicialmente, o Claude 3.5 Sonnet mostrou muito potencial. A interface de usuário que ele gerou foi impressionante, com um layout limpo que posicionou os campos de dados lado a lado pela primeira vez entre as IAs que testei.

Captura de tela da interface do plugin WordPress criada pelo Claude 3.5 SonnetCaptura de tela por David Gewirtz/ZDNET

O que chamou minha atenção foi como o Claude abordou a geração de código. Em vez dos arquivos separados habituais para PHP, JavaScript e CSS, ele forneceu um único arquivo PHP que gerava automaticamente os arquivos JavaScript e CSS no diretório do plugin. Embora essa seja uma abordagem inovadora, é arriscada porque depende das configurações do sistema operacional permitirem que um plugin escreva em sua própria pasta — uma grande falha de segurança em um ambiente de produção.

Infelizmente, apesar da solução criativa, o plugin não funcionou. O botão "Randomize" não fazia nada, o que foi decepcionante, dado o potencial inicial.

Aqui estão os resultados agregados em comparação com testes anteriores:

  • Claude 3.5 Sonnet: Interface: boa, funcionalidade: falhou
  • ChatGPT GPT-4o: Interface: boa, funcionalidade: boa
  • Microsoft Copilot: Interface: adequada, funcionalidade: falhou
  • Meta AI: Interface: adequada, funcionalidade: falhou
  • Meta Code Llama: Falha completa
  • Google Gemini Advanced: Interface: boa, funcionalidade: falhou
  • ChatGPT 4: Interface: boa, funcionalidade: boa
  • ChatGPT 3.5: Interface: boa, funcionalidade: boa

2. Reescrevendo uma Função de String

Este teste avalia o quão bem uma IA pode reescrever código para atender a necessidades específicas, neste caso, para conversões de dólar e centavos. O Claude 3.5 Sonnet fez um bom trabalho ao remover zeros à esquerda, lidar corretamente com inteiros e decimais e prevenir valores negativos. Ele também retornou inteligentemente "0" para entradas inesperadas, o que ajuda a evitar erros.

No entanto, ele não conseguiu permitir entradas como ".50" para 50 centavos, que era um requisito. Isso significa que o código revisado não funcionaria em um cenário do mundo real, então tenho que marcar como falha.

Aqui estão os resultados agregados:

  • Claude 3.5 Sonnet: Falhou
  • ChatGPT GPT-4o: Sucesso
  • Microsoft Copilot: Falhou
  • Meta AI: Falhou
  • Meta Code Llama: Sucesso
  • Google Gemini Advanced: Falhou
  • ChatGPT 4: Sucesso
  • ChatGPT 3.5: Sucesso

3. Encontrando um Bug Irritante

Este teste é complicado porque exige que a IA encontre um bug sutil que requer conhecimento específico do WordPress. É um bug que eu mesmo perdi e precisei recorrer ao ChatGPT para resolver inicialmente.

O Claude 3.5 Sonnet não apenas encontrou e corrigiu o bug, mas também notou um erro introduzido durante o processo de publicação, que eu então corrigi. Isso foi uma novidade entre as IAs que testei desde a publicação do conjunto completo de testes.

Aqui estão os resultados agregados:

  • Claude 3.5 Sonnet: Sucesso
  • ChatGPT GPT-4o: Sucesso
  • Microsoft Copilot: Falhou. Espetacularmente. Entusiasticamente. Com emojis.
  • Meta AI: Sucesso
  • Meta Code Llama: Falhou
  • Google Gemini Advanced: Falhou
  • ChatGPT 4: Sucesso
  • ChatGPT 3.5: Sucesso

Até agora, o Claude 3.5 Sonnet falhou em dois dos três testes. Vamos ver como ele se sai no último.

4. Escrevendo um Script

Este teste verifica o conhecimento da IA sobre ferramentas de programação especializadas como AppleScript e Keyboard Maestro. Enquanto o ChatGPT demonstrou proficiência em ambos, o Claude 3.5 Sonnet não se saiu tão bem. Ele escreveu um AppleScript que tentou interagir com o Chrome, mas ignorou completamente o componente Keyboard Maestro.

Além disso, o AppleScript continha um erro de sintaxe. Ao tentar tornar a correspondência insensível a maiúsculas e minúsculas, o Claude gerou uma linha que causaria um erro de execução:

if theTab's title contains input ignoring case then

A declaração "contains" já é insensível a maiúsculas e minúsculas, e a frase "ignoring case" foi colocada incorretamente, resultando em um erro.

Aqui estão os resultados agregados:

  • Claude 3.5 Sonnet: Falhou
  • ChatGPT GPT-4o: Sucesso, mas com ressalvas
  • Microsoft Copilot: Falhou
  • Meta AI: Falhou
  • Meta Code Llama: Falhou
  • Google Gemini Advanced: Sucesso
  • ChatGPT 4: Sucesso
  • ChatGPT 3.5: Falhou

Resultados Gerais

Aqui está como o Claude 3.5 Sonnet se saiu no geral em comparação com outras IAs:

  • Claude 3.5 Sonnet: 1 de 4 com sucesso
  • ChatGPT GPT-4o: 4 de 4 com sucesso, mas com uma resposta de escolha dupla estranha
  • Microsoft Copilot: 0 de 4 com sucesso
  • Meta AI: 1 de 4 com sucesso
  • Meta Code Llama: 1 de 4 com sucesso
  • Google Gemini Advanced: 1 de 4 com sucesso
  • ChatGPT 4: 4 de 4 com sucesso
  • ChatGPT 3.5: 3 de 4 com sucesso

Fiquei bastante decepcionado com o Claude 3.5 Sonnet. A Anthropic prometeu que ele era adequado para programação, mas não atendeu às expectativas. Não é que ele não consiga programar; ele simplesmente não consegue programar corretamente. Continuo esperando encontrar uma IA que supere o ChatGPT, especialmente à medida que esses modelos são integrados em ambientes de programação. Mas, por enquanto, vou continuar com o ChatGPT para ajuda com programação, e recomendo que você faça o mesmo.

Você já usou uma IA para programar? Qual, e como foi? Compartilhe suas experiências nos comentários abaixo.

Acompanhe as atualizações do meu projeto nas redes sociais, assine meu boletim semanal e conecte-se comigo no Twitter/X em @DavidGewirtz, no Facebook em Facebook.com/DavidGewirtz, no Instagram em Instagram.com/DavidGewirtz e no YouTube em YouTube.com/DavidGewirtzTV.

Artigo relacionado
A Flórida processa a OpenAI e Sam Altman por incidentes violentos A Flórida processa a OpenAI e Sam Altman por incidentes violentos O Procurador-Geral da Flórida entrou na segunda-feira com uma ação judicial estadual inédita contra a OpenAI e o seu CEO, Sam Altman, alegando que o ChatGPT da empresa está ligado a múltiplos incidentes violentos.A queixa argumenta que a OpenAI prio
A OpenAI apresenta modelos de voz avançados para conversas em tempo real mais naturais A OpenAI apresenta modelos de voz avançados para conversas em tempo real mais naturais A OpenAI lançou novos modelos conversacionais, o GPT-Live-1 e o GPT-Live-1 mini, projetados para soarem mais naturais e gerenciarem a alternância de turnos de forma mais eficaz. Esses modelos full-dup
A OpenAI apresenta o GPT-5.6, a mais recente adição à sua família de modelos A OpenAI apresenta o GPT-5.6, a mais recente adição à sua família de modelos A OpenAI lançou sua mais recente família de modelos na quinta-feira, introduzindo novas e poderosas opções em um cenário de IA cada vez mais competitivo.O GPT-5.6 está disponível em três variantes: So
Recomendações de tópicos especiais relacionados
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Edição de imagem Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor
Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor

2026 Últimas Melhores Ferramentas de Retoque com IA do Photoshop para roupas de comércio eletrônico, limpeza de pele e consistência de cores! Esta lista curada de alta classificação apresenta soluções poderosas que mudam o jogo, ajudando você a aumentar a eficiência da escrita, simplificar a criação de conteúdo e obter resultados visuais perfeitos sem esforço. Cada ferramenta passou por testes do mundo real através de classificações atualizadas semanalmente, com detalhes completos sobre comparação entre gratuito e pago. Com o apoio da XIX.AI, é o guia essencial para quem deseja desbloquear sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
Incitar As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT
As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT

As melhores e mais bem avaliadas bibliotecas de prompts de IA de 2026 para otimizar todos os tipos de fluxos de trabalho do ChatGPT. A XIX.AI selecionou uma coleção poderosa e revolucionária, submetida a rigorosos testes no mundo real para garantir o máximo desempenho. Você encontra comparações detalhadas entre opções gratuitas e pagas, além de classificações de especialistas, para ajudá-lo a escolher as ferramentas indispensáveis que aumentam sua produtividade e potencializam suas vantagens em IA. Explore agora!

11 ferramentas
xix.ai
Educação e Aprendizagem Plataformas de Construção de Questionários de IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes
Plataformas de Construção de Questionários de IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes

2026 Últimas Melhores Plataformas de Construção de Questionários com IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes! A XIX.AI compilou uma lista de ferramentas poderosas e transformadoras, testadas em cenários reais, para garantir classificações precisas. Essas plataformas imperdíveis ajudam a aumentar a eficiência na escrita, otimizar a criação de conteúdo e simplificar o design de questionários em todos os cenários de aprendizado. Explore agora para descobrir a ferramenta perfeita para desbloquear sua vantagem com IA no ensino!

13 ferramentas
xix.ai
Comentários (11)
0/500
CharlesYoung
CharlesYoung 6 de Outubro de 2025 à46 15:30:46 WEST

Intéressant de voir Claude 3.5 Sonnet avoir du mal avec le codage créatif. Est-ce qu'on attend trop des IA actuellement ? Après tout, l'intelligence humaine reste unique 🤷‍♂️

ScottMitchell
ScottMitchell 5 de Maio de 2025 à31 14:17:31 WEST

Claude 3.5 Sonnet is pretty good, but it's no match for ChatGPT in coding tests. It's like bringing a knife to a gunfight! 😂 Still, it's an improvement over the last version, so kudos to Anthropic for trying to keep up. Maybe next time, they'll surprise us!

JamesMiller
JamesMiller 5 de Maio de 2025 à50 09:59:50 WEST

Claude 3.5 Sonnet é bom, mas não chega aos pés do ChatGPT em testes de codificação. É como levar uma faca para uma batalha de armas! 😂 Ainda assim, é uma melhoria em relação à versão anterior, então parabéns à Anthropic por tentar acompanhar. Talvez da próxima vez eles nos surpreendam!

StevenNelson
StevenNelson 5 de Maio de 2025 à24 08:23:24 WEST

クロード3.5ソネットはコードテストではChatGPTにかなわないですね。まるでナイフを持って銃撃戦に挑むようなものです!😂 でも、前バージョンよりは改善されているので、アントロピックの努力には敬意を表します。次回は驚かせてくれるかも?

JoseDavis
JoseDavis 5 de Maio de 2025 à4 07:46:04 WEST

Claude 3.5 Sonnet qui galère en codage, c’est un peu décevant vu les promesses d’Anthropic. 😐 ChatGPT garde l’avantage, mais la course à l’IA est fascinante !

HaroldLopez
HaroldLopez 5 de Maio de 2025 à54 05:06:54 WEST

클로드 3.5 소넷은 코드 테스트에서 ChatGPT에 비해 많이 부족해요. 마치 칼을 들고 총격전에 나서는 느낌이죠! 😂 그래도 이전 버전보다는 나아졌으니, 앤트로픽의 노력에 박수를 보냅니다. 다음에는 놀라게 해줄지 모르겠네요!

OR