option
Maison
Nouvelles
Je mets GPT-4O à travers mes tests de codage et cela les a accédés - sauf pour un résultat étrange

Je mets GPT-4O à travers mes tests de codage et cela les a accédés - sauf pour un résultat étrange

17 avril 2025
173

Je mets GPT-4O à travers mes tests de codage et cela les a accédés - sauf pour un résultat étrange

Si vous suivez l'actualité du monde technologique, vous savez probablement qu'OpenAI vient de lancer son dernier grand modèle de langage, GPT-4o, où le "o" signifie "omni". Ce nouveau modèle promet une polyvalence à travers le texte, les graphiques et la voix, et j'étais impatient de le tester avec mon ensemble standard de tests de codage. Ces tests ont été effectués sur un large éventail de modèles d'IA, produisant des résultats plutôt fascinants. Restez avec moi jusqu'à la fin, car il y a une surprise que vous ne voudrez pas manquer.

Si vous souhaitez réaliser vos propres expériences, consultez ce guide : Comment je teste les capacités de codage d'un chatbot IA - et vous pouvez le faire aussi. Il décrit tous les tests que j'utilise, accompagnés d'explications détaillées sur leur fonctionnement et ce qu'il faut rechercher dans les résultats.

Maintenant, plongeons dans les résultats de chaque test et voyons comment GPT-4o se compare aux précédents concurrents comme Microsoft Copilot, Meta AI, Meta Code Llama, Google Gemini Advanced, et les versions antérieures de ChatGPT.

1. Écrire un plugin WordPress

Voici un aperçu de l'interface utilisateur de GPT-4o :

Intéressant, GPT-4o a pris la liberté d'inclure un fichier JavaScript, qui met à jour dynamiquement le comptage des lignes dans les deux champs. Bien que la consigne n'excluait pas explicitement JavaScript, cette approche créative était inattendue et efficace. Le JavaScript améliore également la fonctionnalité du bouton Randomize, permettant plusieurs ensembles de résultats sans rechargement complet de la page.

Les lignes étaient correctement disposées, et les doublons étaient séparés conformément aux spécifications. C'est un code solide, avec un seul petit bémol : le bouton Randomize n'était pas placé sur sa propre ligne, bien que je ne l'aie pas précisé dans la consigne, donc aucun point en moins pour cela.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Interface : bonne, fonctionnalité : bonne
  • Microsoft Copilot : Interface : adéquate, fonctionnalité : échec
  • Meta AI : Interface : adéquate, fonctionnalité : échec
  • Meta Code Llama : Échec complet
  • Google Gemini Advanced : Interface : bonne, fonctionnalité : échec
  • ChatGPT 4 : Interface : bonne, fonctionnalité : bonne
  • ChatGPT 3.5 : Interface : bonne, fonctionnalité : bonne

2. Réécrire une fonction de chaîne

Ce test évalue la capacité du modèle à gérer les conversions de dollars et de cents. GPT-4o a réussi à réécrire le code pour rejeter les entrées qui pourraient causer des problèmes avec les lignes suivantes, garantissant que seules les valeurs valides de dollars et de cents sont traitées.

J'étais un peu déçu qu'il n'ajoute pas automatiquement un zéro initial à des valeurs comme .75, les convertissant en 0.75. Cependant, comme je n'avais pas explicitement demandé cette fonctionnalité, ce n'est pas une faute de l'IA. Cela rappelle que même lorsque l'IA fournit un code fonctionnel, vous devrez peut-être affiner la consigne pour obtenir exactement ce dont vous avez besoin.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Réussi
  • Microsoft Copilot : Échoué
  • Meta AI : Échoué
  • Meta Code Llama : Réussi
  • Google Gemini Advanced : Échoué
  • ChatGPT 4 : Réussi
  • ChatGPT 3.5 : Réussi

3. Trouver un bogue gênant

Ce test est intrigant car la solution n'est pas immédiatement évidente. J'ai moi-même été initialement perplexe face à cette erreur lors de mon propre codage, alors je me suis tourné vers le premier modèle ChatGPT pour obtenir de l'aide. Il a trouvé l'erreur instantanément, ce qui était époustouflant à l'époque.

En revanche, trois des autres LLM que j'ai testés ont manqué la fausse piste dans ce problème. Le message d'erreur pointe vers une partie du code, mais le véritable problème se trouve ailleurs, nécessitant une connaissance approfondie du framework WordPress pour l'identifier.

Fort heureusement, GPT-4o a correctement identifié le problème et décrit la correction avec précision.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Réussi
  • Microsoft Copilot : Échoué. Spectaculairement. Enthousiastement. Avec des emojis.
  • Meta AI : Réussi
  • Meta Code Llama : Échoué
  • Google Gemini Advanced : Échoué
  • ChatGPT 4 : Réussi
  • ChatGPT 3.5 : Réussi

Jusqu'à présent, GPT-4o obtient trois sur trois. Voyons comment il se débrouille avec le test final.

4. Écrire un script

En réponse à ce test, GPT-4o a en fait fourni plus que ce que j'avais demandé. Le test implique l'utilisation de l'outil de script Mac peu connu Keyboard Maestro, AppleScript d'Apple, et le comportement de script de Chrome. Keyboard Maestro, d'ailleurs, est un véritable game-changer pour moi, rendant les Macs mon choix de prédilection pour la productivité grâce à sa capacité à reprogrammer le système d'exploitation et les applications.

Pour réussir, l'IA doit correctement décrire une solution utilisant une combinaison de code Keyboard Maestro, AppleScript, et la fonctionnalité de l'API Chrome.

Étonnamment, GPT-4o m'a donné deux versions différentes :

Les deux versions interagissaient correctement avec Keyboard Maestro, mais elles différaient dans la gestion de la sensibilité à la casse. La version de gauche était incorrecte car AppleScript ne prend pas en charge "as lowercase". La version de droite, qui utilisait "contains" et était insensible à la casse, fonctionnait bien.

Je donne un feu vert à GPT-4o, bien que prudemment, car il a fourni un code fonctionnel. Cependant, fournir deux options, dont une incorrecte, m'a fait faire un travail supplémentaire pour évaluer et choisir la bonne. Cela aurait pu être aussi chronophage que d'écrire le code moi-même.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Réussi, mais avec des réserves
  • Microsoft Copilot : Échoué
  • Meta AI : Échoué
  • Meta Code Llama : Échoué
  • Google Gemini Advanced : Réussi
  • ChatGPT 4 : Réussi
  • ChatGPT 3.5 : Échoué

Résultats globaux

Voici comment tous les modèles se sont comportés à travers les quatre tests :

  • ChatGPT GPT-4o : 4 sur 4 réussis, mais avec cette réponse à double choix étrange
  • Microsoft Copilot : 0 sur 4 réussis
  • Meta AI : 1 sur 4 réussi
  • Meta Code Llama : 1 sur 4 réussi
  • Google Gemini Advanced : 1 sur 4 réussi
  • ChatGPT 4 : 4 sur 4 réussis
  • ChatGPT 3.5 : 3 sur 4 réussis

Jusqu'à présent, ChatGPT a été mon choix de prédilection pour l'assistance au codage. Il a toujours répondu (sauf quand ce n'était pas le cas). Les autres IA ont généralement échoué dans mes tests. Mais GPT-4o m'a surpris avec cette dernière réponse à double choix. Cela m'a fait me demander ce qui se passe à l'intérieur de ce modèle qui pourrait causer un tel accroc.

Malgré cela, GPT-4o reste le meilleur performeur dans mes tests de codage, donc je vais probablement continuer à l'utiliser et me familiariser avec ses particularités. Alternativement, je pourrais revenir à GPT-3.5 ou GPT-4 dans ChatGPT Plus. Restez à l'écoute ; la prochaine fois que ChatGPT mettra à jour son modèle, je relancerai certainement ces tests pour voir s'il peut constamment choisir la bonne réponse à travers les quatre tests.

Avez-vous essayé de coder avec l'un de ces modèles d'IA ? Quelle a été votre expérience ? Faites-nous savoir dans les commentaires ci-dessous.

Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars. Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars. Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
en écrivant Les meilleurs générateurs de plans basés sur l'IA pour les articles SEO longs
Les meilleurs générateurs de plans basés sur l'IA pour les articles SEO longs

2026 : les meilleurs générateurs de plans basés sur l'IA pour les articles SEO longs, soigneusement sélectionnés par XIX.AI. Ces outils puissants offrent une aide révolutionnaire pour créer rapidement du contenu de haute qualité, améliorant ainsi considérablement l'efficacité de la rédaction. Découvrez une comparaison entre les versions gratuites et payantes, ainsi que des tests concrets et des classements détaillés pour vous aider à trouver l'option incontournable qui répond à vos besoins. Explorez dès maintenant pour tirer pleinement parti de l'IA.

8 outils
xix.ai
Éducation et apprentissage Outils d'étude basés sur l'IA pour les devoirs et la préparation aux examens
Outils d'étude basés sur l'IA pour les devoirs et la préparation aux examens

Les meilleurs outils d'IA de 2026 pour les devoirs et la préparation aux examens ! XIX.AI vous propose une sélection des outils les mieux notés, puissants et révolutionnaires, qui aident les élèves à booster leur productivité, à optimiser la réalisation de leurs devoirs et à réussir haut la main leurs examens grâce à des tests concrets. Découvrez un comparatif entre les versions gratuites et payantes, des classements détaillés et des options incontournables pour tirer pleinement parti de l'IA. Découvrez-les dès maintenant !

10 outils
xix.ai
Composition musicale Outils de démo vocale par IA pour les auteurs-compositeurs, les accroches, les mélodies principales et les sessions de brouillons multilingues
Outils de démo vocale par IA pour les auteurs-compositeurs, les accroches, les mélodies principales et les sessions de brouillons multilingues

2026 Derniers Meilleurs Outils de Démonstration Vocale par IA pour les Paroliers, Créateurs d’Accroches et Équipes de Contenu Multilingues ! XIX.AI a sélectionné une liste primée d’outils puissants et révolutionnaires, soumis à des tests rigoureux en conditions réelles. Vous y trouverez des données détaillées comparant les versions gratuites et payantes, des classements complets et des options incontournables à essayer pour améliorer votre efficacité d’écriture et libérer votre potentiel créatif. Explorez dès maintenant pour découvrir l’outil parfait répondant à tous vos besoins en contenu !

9 outils
xix.ai
Entreprise Les meilleurs outils de veille concurrentielle basés sur l'IA pour les petites entreprises
Les meilleurs outils de veille concurrentielle basés sur l'IA pour les petites entreprises

Les meilleurs outils de recherche concurrentielle basés sur l’IA les plus récents et les mieux notés pour les petites entreprises en 2026 ! XIX.AI a sélectionné une collection extrêmement puissante et révolutionnaire, mise à jour chaque semaine à l’issue de tests rigoureux en conditions réelles et accompagnée de classements détaillés. Vous y trouverez un comparatif complet entre les versions gratuites et payantes pour vous aider à identifier les outils incontournables qui boosteront votre productivité et vous donneront un avantage concurrentiel. Découvrez-la dès maintenant pour trouver l'outil qui vous convient le mieux !

9 outils
xix.ai
Édition d'images Outils de retouche par IA Photoshop pour les vêtements d’e-commerce, nettoyage de la peau et cohérence des couleurs
Outils de retouche par IA Photoshop pour les vêtements d’e-commerce, nettoyage de la peau et cohérence des couleurs

2026 Derniers meilleurs outils de retouche par IA Photoshop pour les vêtements e-commerce, le nettoyage de la peau et la cohérence des couleurs ! Cette liste soigneusement sélectionnée et hautement notée propose des solutions puissantes qui changent la donne, vous aidant à améliorer l’efficacité rédactionnelle, rationaliser la création de contenu et obtenir des résultats visuels parfaits sans effort. Chaque outil a été testé dans des conditions réelles grâce à des classements mis à jour chaque semaine, accompagnés de détails comparatifs entre versions gratuites et payantes. Soutenu par XIX.AI, c’est le guide incontournable pour quiconque souhaite exploiter son avantage grâce à l’IA. Explorez dès maintenant !

10 outils
xix.ai
Rapide Les meilleures bibliothèques de prompts d'IA pour les workflows ChatGPT
Les meilleures bibliothèques de prompts d'IA pour les workflows ChatGPT

2026 : les meilleures bibliothèques de prompts IA les mieux notées pour optimiser tous les types de flux de travail ChatGPT. XIX.AI a sélectionné une collection puissante et révolutionnaire, soumise à des tests rigoureux en conditions réelles afin de garantir des performances optimales. Vous trouverez des comparaisons détaillées entre les solutions gratuites et payantes, ainsi que des classements d'experts pour vous aider à choisir les outils incontournables qui boosteront votre productivité et vous permettront de tirer pleinement parti de l'IA. Découvrez-les dès maintenant !

11 outils
xix.ai
commentaires (22)
0/500
RoyMartínez
RoyMartínez 1 mai 2026 04:01:09 UTC+02:00

GPT-4o klingt beeindruckend, aber diese 'eine seltsame Ausnahme' macht mich neugierig. Was war das für ein seltsames Ergebnis? Vielleicht ein Hinweis darauf, dass KI bei bestimmten Logikaufgaben immer noch überraschend 'menschlich' scheitern kann? 🤔 Die Omni-Fähigkeiten sind cool, aber ich frage mich, wie stabil die Performance in allen Modi wirklich ist.

PaulYoung
PaulYoung 15 mars 2026 01:00:58 UTC+01:00

Bon article ! Les tests de programmation sont toujours révélateurs. Je me demande s’il y a des biais selon les langages utilisés pour l'entraînement… Ou peut-être que c’est lié à la façon dont la requête est formulée ? 🤔

JonathanAllen
JonathanAllen 26 avril 2025 13:46:22 UTC+02:00

GPT-4o é impressionante, passando na maioria dos meus testes de codificação! Mas aquele resultado estranho me deixou confuso. Ainda assim, é versátil em texto, gráficos e voz. Se ao menos pudesse explicar aquele resultado estranho, seria perfeito! 🤔

WillHarris
WillHarris 25 avril 2025 20:21:39 UTC+02:00

GPT-4o thật ấn tượng, vượt qua hầu hết các bài kiểm tra mã hóa của tôi! Nhưng kết quả lạ đó làm tôi bối rối. Tuy nhiên, nó rất linh hoạt trong văn bản, đồ họa và giọng nói. Giá mà nó có thể giải thích kết quả lạ đó, thì sẽ hoàn hảo! 🤔

DonaldGonzález
DonaldGonzález 24 avril 2025 13:41:59 UTC+02:00

GPT-4oは私のコードテストのほとんどを完璧にこなすので感動しました!しかし、その一つの奇妙な結果が気になりました。それでも、テキスト、グラフィック、音声での多様性は素晴らしいです。あの奇妙な結果を説明できれば完璧だったのに!🤔

JustinAnderson
JustinAnderson 23 avril 2025 07:12:28 UTC+02:00

¡El GPT-4o me impresionó con sus habilidades de codificación! Pasó todos mis tests excepto por un resultado extraño que me dejó pensando. Su versatilidad en texto, gráficos y voz es genial! Pero ese fallo, hay que arreglarlo, OpenAI! 😎

OR