option
Maison
Nouvelles
Claude 3.5 Sonnet lutte de manière créative dans les tests de codage AI dominés par le chatppt

Claude 3.5 Sonnet lutte de manière créative dans les tests de codage AI dominés par le chatppt

4 mai 2025
199

Test des capacités du nouveau Claude 3.5 Sonnet d'Anthropic

La semaine dernière, j'ai reçu un courriel d'Anthropic annonçant la sortie de Claude 3.5 Sonnet. Ils ont vanté qu'il "repousse les limites de l'industrie en matière d'intelligence, surpassant les modèles concurrents et Claude 3 Opus dans une large gamme d'évaluations." Ils ont également affirmé qu'il était parfait pour des tâches complexes comme la génération de code. Naturellement, j'ai dû mettre ces affirmations à l'épreuve.

J'ai effectué une série de tests de codage sur divers AIs, et vous pouvez le faire aussi. Rendez-vous sur Comment je teste les capacités de codage d'un chatbot AI - et vous pouvez le faire aussi pour tous les détails. Plongeons dans les performances de Claude 3.5 Sonnet face à mes tests standard, et voyons comment il se compare à d'autres AIs comme Microsoft Copilot, Meta AI, Meta Code Llama, Google Gemini Advanced, et ChatGPT.

1. Écriture d'un plugin WordPress

Au départ, Claude 3.5 Sonnet s'est montré très prometteur. L'interface utilisateur qu'il a générée était impressionnante, avec une mise en page propre qui plaçait les champs de données côte à côte pour la première fois parmi les AIs que j'ai testés.

Capture d'écran de l'interface du plugin WordPress créé par Claude 3.5 SonnetCapture d'écran par David Gewirtz/ZDNET

Ce qui a attiré mon attention, c'est la manière dont Claude a abordé la génération de code. Au lieu des fichiers séparés habituels pour PHP, JavaScript et CSS, il a fourni un seul fichier PHP qui générait automatiquement les fichiers JavaScript et CSS dans le répertoire du plugin. Bien que cette approche soit innovante, elle est risquée car elle dépend des paramètres du système d'exploitation permettant à un plugin d'écrire dans son propre dossier — une faille de sécurité majeure dans un environnement de production.

Malheureusement, malgré la solution créative, le plugin n'a pas fonctionné. Le bouton "Randomize" ne faisait rien, ce qui était décevant compte tenu de son potentiel initial.

Voici les résultats agrégés comparés aux tests précédents :

  • Claude 3.5 Sonnet : Interface : bonne, fonctionnalité : échec
  • ChatGPT GPT-4o : Interface : bonne, fonctionnalité : bonne
  • Microsoft Copilot : Interface : adéquate, fonctionnalité : échec
  • Meta AI : Interface : adéquate, fonctionnalité : échec
  • Meta Code Llama : Échec total
  • Google Gemini Advanced : Interface : bonne, fonctionnalité : échec
  • ChatGPT 4 : Interface : bonne, fonctionnalité : bonne
  • ChatGPT 3.5 : Interface : bonne, fonctionnalité : bonne

2. Réécriture d'une fonction de chaîne

Ce test évalue la capacité d'une AI à réécrire du code pour répondre à des besoins spécifiques, dans ce cas, pour des conversions en dollars et cents. Claude 3.5 Sonnet a bien réussi à supprimer les zéros initiaux, à gérer correctement les entiers et les décimales, et à empêcher les valeurs négatives. Il a également intelligemment renvoyé "0" pour les entrées inattendues, ce qui aide à éviter les erreurs.

Cependant, il n'a pas permis des entrées comme ".50" pour 50 cents, ce qui était une exigence. Cela signifie que le code révisé ne fonctionnerait pas dans un scénario réel, je dois donc le marquer comme un échec.

Voici les résultats agrégés :

  • Claude 3.5 Sonnet : Échec
  • ChatGPT GPT-4o : Succès
  • Microsoft Copilot : Échec
  • Meta AI : Échec
  • Meta Code Llama : Succès
  • Google Gemini Advanced : Échec
  • ChatGPT 4 : Succès
  • ChatGPT 3.5 : Succès

3. Trouver un bogue gênant

Ce test est délicat car il exige que l'AI trouve un bogue subtil nécessitant une connaissance spécifique de WordPress. C'est un bogue que j'ai moi-même manqué et que j'ai dû résoudre initialement avec ChatGPT.

Claude 3.5 Sonnet a non seulement trouvé et corrigé le bogue, mais a également remarqué une erreur introduite lors du processus de publication, que j'ai ensuite corrigée. C'était une première parmi les AIs que j'ai testées depuis la publication de l'ensemble complet des tests.

Voici les résultats agrégés :

  • Claude 3.5 Sonnet : Succès
  • ChatGPT GPT-4o : Succès
  • Microsoft Copilot : Échec. Spectaculairement. Enthousiastiquement. Avec des emojis.
  • Meta AI : Succès
  • Meta Code Llama : Échec
  • Google Gemini Advanced : Échec
  • ChatGPT 4 : Succès
  • ChatGPT 3.5 : Succès

Jusqu'à présent, Claude 3.5 Sonnet a échoué à deux des trois tests. Voyons comment il se débrouille avec le dernier.

4. Écriture d'un script

Ce test vérifie la connaissance de l'AI des outils de programmation spécialisés comme AppleScript et Keyboard Maestro. Alors que ChatGPT avait montré une maîtrise des deux, Claude 3.5 Sonnet n'a pas aussi bien performé. Il a écrit un AppleScript qui tentait d'interagir avec Chrome mais a complètement ignoré la composante Keyboard Maestro.

De plus, l'AppleScript contenait une erreur de syntaxe. En essayant de rendre la correspondance insensible à la casse, Claude a généré une ligne qui provoquerait une erreur d'exécution :

if theTab's title contains input ignoring case then

L'instruction "contains" est déjà insensible à la casse, et la phrase "ignoring case" était mal placée, entraînant une erreur.

Voici les résultats agrégés :

  • Claude 3.5 Sonnet : Échec
  • ChatGPT GPT-4o : Succès mais avec des réserves
  • Microsoft Copilot : Échec
  • Meta AI : Échec
  • Meta Code Llama : Échec
  • Google Gemini Advanced : Succès
  • ChatGPT 4 : Succès
  • ChatGPT 3.5 : Échec

Résultats globaux

Voici les performances globales de Claude 3.5 Sonnet comparées à d'autres AIs :

  • Claude 3.5 Sonnet : 1 sur 4 réussi
  • ChatGPT GPT-4o : 4 sur 4 réussis, mais avec une réponse étrange à double choix
  • Microsoft Copilot : 0 sur 4 réussi
  • Meta AI : 1 sur 4 réussi
  • Meta Code Llama : 1 sur 4 réussi
  • Google Gemini Advanced : 1 sur 4 réussi
  • ChatGPT 4 : 4 sur 4 réussis
  • ChatGPT 3.5 : 3 sur 4 réussis

J'ai été assez déçu par Claude 3.5 Sonnet. Anthropic avait promis qu'il était adapté à la programmation, mais il n'a pas répondu à ces attentes. Ce n'est pas qu'il ne peut pas programmer ; il ne programme tout simplement pas correctement. J'espère toujours trouver une AI qui surpasse ChatGPT, surtout à mesure que ces modèles sont intégrés dans des environnements de programmation. Mais pour l'instant, je reste avec ChatGPT pour l'aide à la programmation, et je vous recommande de faire de même.

Avez-vous utilisé une AI pour programmer ? Laquelle, et comment cela s'est-il passé ? Partagez vos expériences dans les commentaires ci-dessous.

Suivez les mises à jour de mon projet sur les réseaux sociaux, abonnez-vous à ma newsletter hebdomadaire, et connectez-vous avec moi sur Twitter/X à @DavidGewirtz, sur Facebook à Facebook.com/DavidGewirtz, sur Instagram à Instagram.com/DavidGewirtz, et sur YouTube à YouTube.com/DavidGewirtzTV.

Article connexe
La Floride intente un procès à OpenAI et Sam Altman pour des incidents violents La Floride intente un procès à OpenAI et Sam Altman pour des incidents violents L’avocat général de la Floride a intenté lundi une action en justice au niveau de l’État, sans précédent, contre OpenAI et son PDG, Sam Altman, alléguant que le ChatGPT de l’entreprise est lié à plusieurs incidents violents.Le recours soutient qu’Op
OpenAI dévoile des modèles vocaux avancés pour des conversations en temps réel plus naturelles OpenAI dévoile des modèles vocaux avancés pour des conversations en temps réel plus naturelles OpenAI a lancé de nouveaux modèles conversationnels, GPT-Live-1 et GPT-Live-1 mini, conçus pour offrir un son plus naturel et gérer plus efficacement les échanges. Ces modèles en duplex intégral peuve
OpenAI dévoile GPT-5.6, le dernier-né de sa gamme de modèles OpenAI dévoile GPT-5.6, le dernier-né de sa gamme de modèles OpenAI a lancé jeudi sa dernière gamme de modèles, apportant ainsi de nouvelles options performantes dans un secteur de l'IA de plus en plus concurrentiel.GPT-5.6 se décline en trois variantes :
Recommandations de sujets spéciaux liés
Composition musicale Outils de séparation des pistes audio par IA pour la production de remix, la préparation de samples et les masters de karaoké
Outils de séparation des pistes audio par IA pour la production de remix, la préparation de samples et les masters de karaoké

2026 : Les meilleures et plus récentes outils de séparation des pistes audio par IA, hautement notés, sélectionnés spécialement pour la production de remix, la préparation de samples et l’enregistrement de karaokés. Ces outils puissants et révolutionnaires, éprouvés dans des conditions réelles, permettent une isolation audio précise, ce qui améliore considérablement la productivité. XIX.AI propose un guide de comparaison gratuit mis à jour chaque semaine entre les versions payantes et gratuites, afin de vous aider à trouver la solution idéale adaptée à vos besoins. Découvrez-les dès maintenant pour tirer parti des avantages offerts par l’IA.

8 outils
xix.ai
Analyse des données Copilotes SQL basés sur l’IA pour les tableaux de bord de chiffre d’affaires, l’analyse des funnels et les indicateurs de produits
Copilotes SQL basés sur l’IA pour les tableaux de bord de chiffre d’affaires, l’analyse des funnels et les indicateurs de produits

2026 : Les meilleurs copilotes AI SQL actuels, classés parmi les plus performants ! XIX.AI a sélectionné une collection puissante et révolutionnaire, mise à jour chaque semaine grâce à des tests concrets. Ces outils indispensables vous aident à créer des tableaux de bord financiers précis, à analyser les canaux de vente et à suivre en temps réel les indicateurs produits, ce qui améliore considérablement votre productivité. Découvrez-les dès maintenant pour trouver l’outil idéal pour des décisions basées sur les données ! 238 caractères

9 outils
xix.ai
Composition musicale Meilleurs outils d’écriture de mélodies par IA pour les ébauches de chansons
Meilleurs outils d’écriture de mélodies par IA pour les ébauches de chansons

2026 Derniers Meilleurs Outils d’Écriture de Mélodie par IA les Mieux Notés pour des Ébauches de Chansons ! XIX.AI a sélectionné une collection hautement puissante et révolutionnaire, soumise à des tests rigoureux en conditions réelles, afin d’offrir la meilleure expérience d’écriture. Vous pouvez y trouver des comparaisons détaillées entre versions gratuites et payantes, des classements précis, ainsi que des options incontournables conçues pour vous aider à créer sans effort des ébauches de chansons remarquables et à booster significativement votre productivité créative. Explorez dès maintenant pour découvrir l’outil qui vous correspond parfaitement !

8 outils
xix.ai
chatbot Meilleurs outils d’entraînement à la conversation par IA pour la préparation aux entretiens
Meilleurs outils d’entraînement à la conversation par IA pour la préparation aux entretiens

Les derniers outils de formation à la conversation par IA les mieux notés pour 2026 sont disponibles sur XIX.AI ! Cette sélection rigoureuse propose des outils puissants et révolutionnaires, testés rigoureusement dans des conditions réelles pour fournir des retours précis. Vous y trouverez une comparaison entre les versions gratuites et payantes, ainsi que des classements détaillés pour vous aider à choisir l’option incontournable qui renforce votre confiance et vos compétences. Explorez dès maintenant pour découvrir l’outil parfait pour réussir vos entretiens !

12 outils
xix.ai
Conception et art Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives
Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives

Les meilleurs outils de transfert de style par IA de 2026, les mieux notés, pour des expériences créatives ! XIX.AI a sélectionné une collection d’outils puissants et révolutionnaires à essayer absolument, qui offrent des résultats exceptionnels grâce à des tests en conditions réelles et à un classement rigoureux. Ces solutions de pointe aident les créatifs à booster considérablement leur productivité en accélérant la création de contenu et en ouvrant la voie à des possibilités créatives infinies. Découvrez-les dès maintenant pour trouver l'outil qui vous convient le mieux et commencez à créer dès aujourd'hui !

9 outils
xix.ai
Création de bande dessinée Les meilleurs outils d'IA pour créer des bulles de dialogue destinés à la narration visuelle
Les meilleurs outils d'IA pour créer des bulles de dialogue destinés à la narration visuelle

Les meilleurs outils de 2026 pour la création de bulles de dialogue IA, les mieux notés pour la narration visuelle, sont disponibles ici sur XIX.AI ! Cette sélection regroupe des outils puissants et révolutionnaires qui aident les créateurs à booster leur productivité et à surmonter les blocages créatifs. Consultez un comparatif entre les versions gratuites et payantes, découvrez des tests en conditions réelles et consultez les derniers classements pour trouver les solutions incontournables, parfaites pour créer des récits visuels captivants. Explorez dès maintenant pour découvrir l'outil qui vous convient le mieux !

10 outils
xix.ai
commentaires (11)
0/500
CharlesYoung
CharlesYoung 6 octobre 2025 16:30:46 UTC+02:00

Intéressant de voir Claude 3.5 Sonnet avoir du mal avec le codage créatif. Est-ce qu'on attend trop des IA actuellement ? Après tout, l'intelligence humaine reste unique 🤷‍♂️

ScottMitchell
ScottMitchell 5 mai 2025 15:17:31 UTC+02:00

Claude 3.5 Sonnet is pretty good, but it's no match for ChatGPT in coding tests. It's like bringing a knife to a gunfight! 😂 Still, it's an improvement over the last version, so kudos to Anthropic for trying to keep up. Maybe next time, they'll surprise us!

JamesMiller
JamesMiller 5 mai 2025 10:59:50 UTC+02:00

Claude 3.5 Sonnet é bom, mas não chega aos pés do ChatGPT em testes de codificação. É como levar uma faca para uma batalha de armas! 😂 Ainda assim, é uma melhoria em relação à versão anterior, então parabéns à Anthropic por tentar acompanhar. Talvez da próxima vez eles nos surpreendam!

StevenNelson
StevenNelson 5 mai 2025 09:23:24 UTC+02:00

クロード3.5ソネットはコードテストではChatGPTにかなわないですね。まるでナイフを持って銃撃戦に挑むようなものです!😂 でも、前バージョンよりは改善されているので、アントロピックの努力には敬意を表します。次回は驚かせてくれるかも?

JoseDavis
JoseDavis 5 mai 2025 08:46:04 UTC+02:00

Claude 3.5 Sonnet qui galère en codage, c’est un peu décevant vu les promesses d’Anthropic. 😐 ChatGPT garde l’avantage, mais la course à l’IA est fascinante !

HaroldLopez
HaroldLopez 5 mai 2025 06:06:54 UTC+02:00

클로드 3.5 소넷은 코드 테스트에서 ChatGPT에 비해 많이 부족해요. 마치 칼을 들고 총격전에 나서는 느낌이죠! 😂 그래도 이전 버전보다는 나아졌으니, 앤트로픽의 노력에 박수를 보냅니다. 다음에는 놀라게 해줄지 모르겠네요!

OR