option
Maison
Nouvelles
Je mets GPT-4O à travers mes tests de codage et cela les a accédés - sauf pour un résultat étrange

Je mets GPT-4O à travers mes tests de codage et cela les a accédés - sauf pour un résultat étrange

17 avril 2025
170

Je mets GPT-4O à travers mes tests de codage et cela les a accédés - sauf pour un résultat étrange

Si vous suivez l'actualité du monde technologique, vous savez probablement qu'OpenAI vient de lancer son dernier grand modèle de langage, GPT-4o, où le "o" signifie "omni". Ce nouveau modèle promet une polyvalence à travers le texte, les graphiques et la voix, et j'étais impatient de le tester avec mon ensemble standard de tests de codage. Ces tests ont été effectués sur un large éventail de modèles d'IA, produisant des résultats plutôt fascinants. Restez avec moi jusqu'à la fin, car il y a une surprise que vous ne voudrez pas manquer.

Si vous souhaitez réaliser vos propres expériences, consultez ce guide : Comment je teste les capacités de codage d'un chatbot IA - et vous pouvez le faire aussi. Il décrit tous les tests que j'utilise, accompagnés d'explications détaillées sur leur fonctionnement et ce qu'il faut rechercher dans les résultats.

Maintenant, plongeons dans les résultats de chaque test et voyons comment GPT-4o se compare aux précédents concurrents comme Microsoft Copilot, Meta AI, Meta Code Llama, Google Gemini Advanced, et les versions antérieures de ChatGPT.

1. Écrire un plugin WordPress

Voici un aperçu de l'interface utilisateur de GPT-4o :

Intéressant, GPT-4o a pris la liberté d'inclure un fichier JavaScript, qui met à jour dynamiquement le comptage des lignes dans les deux champs. Bien que la consigne n'excluait pas explicitement JavaScript, cette approche créative était inattendue et efficace. Le JavaScript améliore également la fonctionnalité du bouton Randomize, permettant plusieurs ensembles de résultats sans rechargement complet de la page.

Les lignes étaient correctement disposées, et les doublons étaient séparés conformément aux spécifications. C'est un code solide, avec un seul petit bémol : le bouton Randomize n'était pas placé sur sa propre ligne, bien que je ne l'aie pas précisé dans la consigne, donc aucun point en moins pour cela.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Interface : bonne, fonctionnalité : bonne
  • Microsoft Copilot : Interface : adéquate, fonctionnalité : échec
  • Meta AI : Interface : adéquate, fonctionnalité : échec
  • Meta Code Llama : Échec complet
  • Google Gemini Advanced : Interface : bonne, fonctionnalité : échec
  • ChatGPT 4 : Interface : bonne, fonctionnalité : bonne
  • ChatGPT 3.5 : Interface : bonne, fonctionnalité : bonne

2. Réécrire une fonction de chaîne

Ce test évalue la capacité du modèle à gérer les conversions de dollars et de cents. GPT-4o a réussi à réécrire le code pour rejeter les entrées qui pourraient causer des problèmes avec les lignes suivantes, garantissant que seules les valeurs valides de dollars et de cents sont traitées.

J'étais un peu déçu qu'il n'ajoute pas automatiquement un zéro initial à des valeurs comme .75, les convertissant en 0.75. Cependant, comme je n'avais pas explicitement demandé cette fonctionnalité, ce n'est pas une faute de l'IA. Cela rappelle que même lorsque l'IA fournit un code fonctionnel, vous devrez peut-être affiner la consigne pour obtenir exactement ce dont vous avez besoin.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Réussi
  • Microsoft Copilot : Échoué
  • Meta AI : Échoué
  • Meta Code Llama : Réussi
  • Google Gemini Advanced : Échoué
  • ChatGPT 4 : Réussi
  • ChatGPT 3.5 : Réussi

3. Trouver un bogue gênant

Ce test est intrigant car la solution n'est pas immédiatement évidente. J'ai moi-même été initialement perplexe face à cette erreur lors de mon propre codage, alors je me suis tourné vers le premier modèle ChatGPT pour obtenir de l'aide. Il a trouvé l'erreur instantanément, ce qui était époustouflant à l'époque.

En revanche, trois des autres LLM que j'ai testés ont manqué la fausse piste dans ce problème. Le message d'erreur pointe vers une partie du code, mais le véritable problème se trouve ailleurs, nécessitant une connaissance approfondie du framework WordPress pour l'identifier.

Fort heureusement, GPT-4o a correctement identifié le problème et décrit la correction avec précision.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Réussi
  • Microsoft Copilot : Échoué. Spectaculairement. Enthousiastement. Avec des emojis.
  • Meta AI : Réussi
  • Meta Code Llama : Échoué
  • Google Gemini Advanced : Échoué
  • ChatGPT 4 : Réussi
  • ChatGPT 3.5 : Réussi

Jusqu'à présent, GPT-4o obtient trois sur trois. Voyons comment il se débrouille avec le test final.

4. Écrire un script

En réponse à ce test, GPT-4o a en fait fourni plus que ce que j'avais demandé. Le test implique l'utilisation de l'outil de script Mac peu connu Keyboard Maestro, AppleScript d'Apple, et le comportement de script de Chrome. Keyboard Maestro, d'ailleurs, est un véritable game-changer pour moi, rendant les Macs mon choix de prédilection pour la productivité grâce à sa capacité à reprogrammer le système d'exploitation et les applications.

Pour réussir, l'IA doit correctement décrire une solution utilisant une combinaison de code Keyboard Maestro, AppleScript, et la fonctionnalité de l'API Chrome.

Étonnamment, GPT-4o m'a donné deux versions différentes :

Les deux versions interagissaient correctement avec Keyboard Maestro, mais elles différaient dans la gestion de la sensibilité à la casse. La version de gauche était incorrecte car AppleScript ne prend pas en charge "as lowercase". La version de droite, qui utilisait "contains" et était insensible à la casse, fonctionnait bien.

Je donne un feu vert à GPT-4o, bien que prudemment, car il a fourni un code fonctionnel. Cependant, fournir deux options, dont une incorrecte, m'a fait faire un travail supplémentaire pour évaluer et choisir la bonne. Cela aurait pu être aussi chronophage que d'écrire le code moi-même.

Voici les résultats agrégés pour ce test et les précédents :

  • ChatGPT GPT-4o : Réussi, mais avec des réserves
  • Microsoft Copilot : Échoué
  • Meta AI : Échoué
  • Meta Code Llama : Échoué
  • Google Gemini Advanced : Réussi
  • ChatGPT 4 : Réussi
  • ChatGPT 3.5 : Échoué

Résultats globaux

Voici comment tous les modèles se sont comportés à travers les quatre tests :

  • ChatGPT GPT-4o : 4 sur 4 réussis, mais avec cette réponse à double choix étrange
  • Microsoft Copilot : 0 sur 4 réussis
  • Meta AI : 1 sur 4 réussi
  • Meta Code Llama : 1 sur 4 réussi
  • Google Gemini Advanced : 1 sur 4 réussi
  • ChatGPT 4 : 4 sur 4 réussis
  • ChatGPT 3.5 : 3 sur 4 réussis

Jusqu'à présent, ChatGPT a été mon choix de prédilection pour l'assistance au codage. Il a toujours répondu (sauf quand ce n'était pas le cas). Les autres IA ont généralement échoué dans mes tests. Mais GPT-4o m'a surpris avec cette dernière réponse à double choix. Cela m'a fait me demander ce qui se passe à l'intérieur de ce modèle qui pourrait causer un tel accroc.

Malgré cela, GPT-4o reste le meilleur performeur dans mes tests de codage, donc je vais probablement continuer à l'utiliser et me familiariser avec ses particularités. Alternativement, je pourrais revenir à GPT-3.5 ou GPT-4 dans ChatGPT Plus. Restez à l'écoute ; la prochaine fois que ChatGPT mettra à jour son modèle, je relancerai certainement ces tests pour voir s'il peut constamment choisir la bonne réponse à travers les quatre tests.

Avez-vous essayé de coder avec l'un de ces modèles d'IA ? Quelle a été votre expérience ? Faites-nous savoir dans les commentaires ci-dessous.

Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin. PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin. Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
chatbot Meilleures applications de chat de jeu de rôle par IA pour la pratique des langues, la préparation aux entretiens et la fluidité quotidienne
Meilleures applications de chat de jeu de rôle par IA pour la pratique des langues, la préparation aux entretiens et la fluidité quotidienne

2026 Dernières Meilleures Applications de Chat IA pour le Jeu de Rôle, les plus bien notées pour la Pratique des Langues, la Préparation aux Entretiens et la Fluidité Quotidienne ! XIX.AI sélectionne une collection puissante et révolutionnaire qui propose une comparaison gratuit vs payant, des tests en conditions réelles et des classements mis à jour chaque semaine. Ces outils à essayer absolument vous aident à améliorer vos compétences en écriture, à surmonter les défis de fluidité et à optimiser l’efficacité de la communication dans tous les scénarios quotidiens. Explorez dès maintenant pour découvrir l’outil parfait pour votre progression linguistique !

10 outils
xix.ai
Composition musicale Outils de séparation des pistes audio par IA pour la production de remix, la préparation de samples et les masters de karaoké
Outils de séparation des pistes audio par IA pour la production de remix, la préparation de samples et les masters de karaoké

2026 : Les meilleures et plus récentes outils de séparation des pistes audio par IA, hautement notés, sélectionnés spécialement pour la production de remix, la préparation de samples et l’enregistrement de karaokés. Ces outils puissants et révolutionnaires, éprouvés dans des conditions réelles, permettent une isolation audio précise, ce qui améliore considérablement la productivité. XIX.AI propose un guide de comparaison gratuit mis à jour chaque semaine entre les versions payantes et gratuites, afin de vous aider à trouver la solution idéale adaptée à vos besoins. Découvrez-les dès maintenant pour tirer parti des avantages offerts par l’IA.

8 outils
xix.ai
Analyse des données Copilotes SQL basés sur l’IA pour les tableaux de bord de chiffre d’affaires, l’analyse des funnels et les indicateurs de produits
Copilotes SQL basés sur l’IA pour les tableaux de bord de chiffre d’affaires, l’analyse des funnels et les indicateurs de produits

2026 : Les meilleurs copilotes AI SQL actuels, classés parmi les plus performants ! XIX.AI a sélectionné une collection puissante et révolutionnaire, mise à jour chaque semaine grâce à des tests concrets. Ces outils indispensables vous aident à créer des tableaux de bord financiers précis, à analyser les canaux de vente et à suivre en temps réel les indicateurs produits, ce qui améliore considérablement votre productivité. Découvrez-les dès maintenant pour trouver l’outil idéal pour des décisions basées sur les données ! 238 caractères

9 outils
xix.ai
Composition musicale Meilleurs outils d’écriture de mélodies par IA pour les ébauches de chansons
Meilleurs outils d’écriture de mélodies par IA pour les ébauches de chansons

2026 Derniers Meilleurs Outils d’Écriture de Mélodie par IA les Mieux Notés pour des Ébauches de Chansons ! XIX.AI a sélectionné une collection hautement puissante et révolutionnaire, soumise à des tests rigoureux en conditions réelles, afin d’offrir la meilleure expérience d’écriture. Vous pouvez y trouver des comparaisons détaillées entre versions gratuites et payantes, des classements précis, ainsi que des options incontournables conçues pour vous aider à créer sans effort des ébauches de chansons remarquables et à booster significativement votre productivité créative. Explorez dès maintenant pour découvrir l’outil qui vous correspond parfaitement !

8 outils
xix.ai
chatbot Meilleurs outils d’entraînement à la conversation par IA pour la préparation aux entretiens
Meilleurs outils d’entraînement à la conversation par IA pour la préparation aux entretiens

Les derniers outils de formation à la conversation par IA les mieux notés pour 2026 sont disponibles sur XIX.AI ! Cette sélection rigoureuse propose des outils puissants et révolutionnaires, testés rigoureusement dans des conditions réelles pour fournir des retours précis. Vous y trouverez une comparaison entre les versions gratuites et payantes, ainsi que des classements détaillés pour vous aider à choisir l’option incontournable qui renforce votre confiance et vos compétences. Explorez dès maintenant pour découvrir l’outil parfait pour réussir vos entretiens !

12 outils
xix.ai
Conception et art Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives
Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives

Les meilleurs outils de transfert de style par IA de 2026, les mieux notés, pour des expériences créatives ! XIX.AI a sélectionné une collection d’outils puissants et révolutionnaires à essayer absolument, qui offrent des résultats exceptionnels grâce à des tests en conditions réelles et à un classement rigoureux. Ces solutions de pointe aident les créatifs à booster considérablement leur productivité en accélérant la création de contenu et en ouvrant la voie à des possibilités créatives infinies. Découvrez-les dès maintenant pour trouver l'outil qui vous convient le mieux et commencez à créer dès aujourd'hui !

9 outils
xix.ai
commentaires (22)
0/500
RoyMartínez
RoyMartínez 1 mai 2026 04:01:09 UTC+02:00

GPT-4o klingt beeindruckend, aber diese 'eine seltsame Ausnahme' macht mich neugierig. Was war das für ein seltsames Ergebnis? Vielleicht ein Hinweis darauf, dass KI bei bestimmten Logikaufgaben immer noch überraschend 'menschlich' scheitern kann? 🤔 Die Omni-Fähigkeiten sind cool, aber ich frage mich, wie stabil die Performance in allen Modi wirklich ist.

PaulYoung
PaulYoung 15 mars 2026 01:00:58 UTC+01:00

Bon article ! Les tests de programmation sont toujours révélateurs. Je me demande s’il y a des biais selon les langages utilisés pour l'entraînement… Ou peut-être que c’est lié à la façon dont la requête est formulée ? 🤔

JonathanAllen
JonathanAllen 26 avril 2025 13:46:22 UTC+02:00

GPT-4o é impressionante, passando na maioria dos meus testes de codificação! Mas aquele resultado estranho me deixou confuso. Ainda assim, é versátil em texto, gráficos e voz. Se ao menos pudesse explicar aquele resultado estranho, seria perfeito! 🤔

WillHarris
WillHarris 25 avril 2025 20:21:39 UTC+02:00

GPT-4o thật ấn tượng, vượt qua hầu hết các bài kiểm tra mã hóa của tôi! Nhưng kết quả lạ đó làm tôi bối rối. Tuy nhiên, nó rất linh hoạt trong văn bản, đồ họa và giọng nói. Giá mà nó có thể giải thích kết quả lạ đó, thì sẽ hoàn hảo! 🤔

DonaldGonzález
DonaldGonzález 24 avril 2025 13:41:59 UTC+02:00

GPT-4oは私のコードテストのほとんどを完璧にこなすので感動しました!しかし、その一つの奇妙な結果が気になりました。それでも、テキスト、グラフィック、音声での多様性は素晴らしいです。あの奇妙な結果を説明できれば完璧だったのに!🤔

JustinAnderson
JustinAnderson 23 avril 2025 07:12:28 UTC+02:00

¡El GPT-4o me impresionó con sus habilidades de codificación! Pasó todos mis tests excepto por un resultado extraño que me dejó pensando. Su versatilidad en texto, gráficos y voz es genial! Pero ese fallo, hay que arreglarlo, OpenAI! 😎

OR