option
Maison
Nouvelles
Problème du Test de Turing Exposé par le GPT-4.5 d'OpenAI

Problème du Test de Turing Exposé par le GPT-4.5 d'OpenAI

22 mai 2025
199

Problème du Test de Turing Exposé par le GPT-4.5 d

Le test de Turing, conçu par le légendaire Alan Turing, est depuis longtemps une référence dans le monde de l'intelligence artificielle. Mais clarifions un malentendu dès le départ : réussir le test de Turing ne signifie pas nécessairement qu'une machine "pense" comme un humain. Il s'agit plutôt de convaincre les humains qu'elle l'est.

Des recherches récentes de l'Université de Californie à San Diego ont mis en lumière le dernier modèle d'OpenAI, GPT-4.5. Cette IA peut désormais tromper les humains en leur faisant croire qu'ils discutent avec une autre personne, encore plus efficacement que les humains ne peuvent se convaincre mutuellement de leur humanité. C'est un événement majeur dans le monde de l'IA—c'est comme regarder un tour de magie où l'on connaît le secret, mais qui reste époustouflant.

Preuve d'une AGI ?

Mais voici le hic : même les chercheurs de l'UC San Diego ne sont pas prêts à déclarer que nous avons atteint l'intelligence artificielle générale (AGI) simplement parce qu'un modèle d'IA réussit le test de Turing. L'AGI serait le Graal de l'IA—des machines capables de penser et de traiter l'information comme les humains.

Melanie Mitchell, une spécialiste de l'IA de l'Institut Santa Fe, soutient dans la revue Science que le test de Turing évalue davantage les présomptions humaines que l'intelligence réelle. Bien sûr, une IA peut sembler fluide et convaincante, mais cela ne signifie pas qu'elle est généralement intelligente. C'est comme être doué aux échecs—c'est impressionnant, mais ce n'est pas l'ensemble du tableau.

Le dernier engouement vient d'un article de Cameron Jones et Benjamin Bergen à l'UC San Diego, intitulé "Les grands modèles de langage réussissent le test de Turing", publié sur le serveur de prépublication arXiv. Ils mènent cette expérience depuis des années, avec l'aide d'étudiants de l'UC San Diego, et cela s'inscrit dans une longue lignée de recherches—plus de 800 affirmations et contre-arguments ont été faits sur des ordinateurs passant le test de Turing.

Comment fonctionne le test de Turing

Alors, comment fonctionne ce test ? À l'origine, Turing l'imaginait comme un jeu de messages texte entre un "juge" humain et deux "témoins"—l'un humain, l'autre informatique. Le défi pour les témoins est de convaincre le juge qu'ils sont humains. Le juge sait que l'un est humain, mais ne sait pas lequel, et doit deviner. C'est une configuration à trois qui repose autant sur la perception et la croyance que sur les capacités de l'ordinateur.

Jones et Bergen ont apporté leur propre touche à cette configuration classique, et vous pouvez même l'essayer en ligne, en jouant soit le rôle du juge, soit celui du témoin. Dans leur version, des étudiants de l'UC San Diego ont utilisé une application de chat texte. Certains jouaient le juge, d'autres le témoin humain, tandis que GPT-4.5 prenait le rôle du témoin informatique. Chaque juge discutait simultanément avec un humain et un ordinateur, restant fidèle au format original de Turing.

Pour jouer le témoin informatique, ils ont utilisé différents grands modèles de langage, en leur fournissant des instructions basées sur les défis du juge. GPT-4.5 a été testé avec deux instructions différentes : une avec des informations minimales, et une autre appelée PERSONA, qui incluait des instructions détaillées pour agir comme une personne jeune, introvertie, experte en internet et utilisant de l'argot.

Les résultats

Ils ont également testé trois autres programmes d'IA : le modèle précédent d'OpenAI, GPT-4o ; Llama 3.1 405b de Meta Platforms ; et le chatbot des années 1960, ELIZA. Ils ont inclus ELIZA pour voir si les grands modèles de langage trompaient les humains par hasard ou s'ils étaient réellement meilleurs.

Selon Jones et Bergen, GPT-4.5 a trompé les juges humains en leur faisant croire qu'il était humain dans 73 % des cas—un "taux de réussite" comme ils l'appellent. C'est bien meilleur que les autres modèles, qui ont obtenu entre 21 % et 56 %, même avec des instructions détaillées similaires. Et c'est un bond énorme par rapport au test de l'année dernière sur GPT-4, qui avait un taux de réussite de seulement 54 %, à peine au-dessus du hasard.

Jones et Bergen ont constaté que les juges étaient non seulement trompés par l'IA, mais étaient en réalité plus susceptibles de croire qu'elle était humaine que les véritables participants humains.

Le test est-il vraiment une mesure de l'intelligence ?

Alors, qu'est-ce que cela signifie si les humains ne peuvent pas distinguer un ordinateur d'une personne dans un chat ? La grande question, débattue depuis des décennies, est de savoir si le test de Turing mesure vraiment l'intelligence. Jones et Bergen suggèrent que peut-être les machines sont devenues si douées pour s'adapter à différents scénarios qu'elles peuvent passer pour humaines de manière convaincante. L'instruction PERSONA, créée par des humains, est quelque chose que GPT-4.5 a adapté et utilisé à son avantage.

Mais il y a un hic : peut-être que les humains sont simplement mauvais à reconnaître l'intelligence. Les auteurs soulignent qu'ELIZA, le chatbot ancien, a trompé les juges dans 23 % des cas, non pas parce qu'il était plus intelligent, mais parce qu'il ne correspondait pas à leurs attentes de ce que devrait être une IA. Certains juges pensaient qu'il était humain parce qu'il était "sarcastique" ou "grossier", ce qu'ils n'attendaient pas d'une IA.

Cela suggère que les juges sont influencés par leurs présomptions sur la façon dont les humains et les IA devraient se comporter, plutôt que de choisir l'agent qui semble le plus intelligent. Fait intéressant, les juges ne se sont pas beaucoup concentrés sur les connaissances, que Turing pensait être clés. Au contraire, ils étaient plus susceptibles de penser qu'un témoin était humain s'il semblait manquer de connaissances.

Sociabilité, pas intelligence

Tout cela indique que les humains repéraient la sociabilité plutôt que l'intelligence. Jones et Bergen concluent que le test de Turing n'est pas vraiment un test d'intelligence—c'est un test de ressemblance humaine.

Turing pensait peut-être que l'intelligence était le plus grand obstacle à paraître humain, mais à mesure que les machines se rapprochent de nous, d'autres différences deviennent plus évidentes. L'intelligence seule ne suffit plus à sembler convaincamment humain.

Ce qui n'est pas dit directement dans l'article, c'est que les humains sont tellement habitués à taper sur des ordinateurs, que ce soit à une personne ou à une machine, que le test de Turing n'est plus le test novateur d'interaction homme-machine qu'il était autrefois. C'est plus un test des habitudes humaines en ligne maintenant.

Les auteurs suggèrent que le test pourrait devoir être élargi, car l'intelligence est si complexe et multifacette qu'aucun test unique ne peut être décisif. Ils proposent des conceptions différentes, comme utiliser des experts en IA comme juges ou ajouter des incitations financières pour que les juges examinent plus attentivement. Ces changements pourraient montrer à quel point les attitudes et les attentes influencent les résultats.

Ils concluent que, bien que le test de Turing puisse faire partie du tableau, il devrait être considéré aux côtés d'autres types de preuves. Cela s'aligne avec une tendance croissante dans la recherche en IA à impliquer les humains "dans la boucle", évaluant ce que font les machines.

Le jugement humain est-il suffisant ?

Mais il reste la question de savoir si le jugement humain sera suffisant à long terme. Dans le film Blade Runner, les humains utilisent une machine, le "Voight-Kampff", pour distinguer les humains des robots réplicants. Alors que nous poursuivons l'AGI, et luttons pour définir ce que c'est, nous pourrions finir par compter sur des machines pour évaluer l'intelligence des machines.

Ou, à tout le moins, nous pourrions devoir demander aux machines ce qu'elles "pensent" des humains essayant de tromper d'autres humains avec des instructions. C'est un monde fou dans la recherche en IA, et ça devient de plus en plus intéressant.

Article connexe
Anthropic étend ses outils de codage IA Claude au Japon dans le cadre de sa stratégie de croissance à l’étranger Anthropic étend ses outils de codage IA Claude au Japon dans le cadre de sa stratégie de croissance à l’étranger Anthropic, une entreprise américaine d’intelligence artificielle de premier plan, intensifie sa portée mondiale. Mercredi, l’entreprise a organisé une grande réunion de développeurs, « Code with Claude », à Tokyo, rassemblant près de 500 ingénieurs l
Le géant indien du logiciel réduit ses embauches et promet des licenciements nuls à mesure que les agents IA se développent Le géant indien du logiciel réduit ses embauches et promet des licenciements nuls à mesure que les agents IA se développent Alors que l’intelligence artificielle redéfinit les modèles d’affaires traditionnellement intensifs en main-d’œuvre, Tata Consultancy Services (TCS), l’un des principaux prestataires indiens de sous-traitance logicielle, a dévoilé sa réponse stratégi
La Chine verrouille les modèles d'IA pendant le Gaokao pour bloquer l'aide instantanée aux devoirs La Chine verrouille les modèles d'IA pendant le Gaokao pour bloquer l'aide instantanée aux devoirs Avec l’approche rapide du Gaokao 2026, les rumeurs concernant la suspension des outils d’intelligence artificielle pendant la période d’examen ont déclenché un intense débat en ligne. En réponse aux préoccupations du public, les principales plateform
Recommandations de sujets spéciaux liés
Conception et art Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives
Les meilleurs outils de transfert de style basés sur l'IA pour des expériences créatives

Les meilleurs outils de transfert de style par IA de 2026, les mieux notés, pour des expériences créatives ! XIX.AI a sélectionné une collection d’outils puissants et révolutionnaires à essayer absolument, qui offrent des résultats exceptionnels grâce à des tests en conditions réelles et à un classement rigoureux. Ces solutions de pointe aident les créatifs à booster considérablement leur productivité en accélérant la création de contenu et en ouvrant la voie à des possibilités créatives infinies. Découvrez-les dès maintenant pour trouver l'outil qui vous convient le mieux et commencez à créer dès aujourd'hui !

9 outils
xix.ai
Création de bande dessinée Les meilleurs outils d'IA pour créer des bulles de dialogue destinés à la narration visuelle
Les meilleurs outils d'IA pour créer des bulles de dialogue destinés à la narration visuelle

Les meilleurs outils de 2026 pour la création de bulles de dialogue IA, les mieux notés pour la narration visuelle, sont disponibles ici sur XIX.AI ! Cette sélection regroupe des outils puissants et révolutionnaires qui aident les créateurs à booster leur productivité et à surmonter les blocages créatifs. Consultez un comparatif entre les versions gratuites et payantes, découvrez des tests en conditions réelles et consultez les derniers classements pour trouver les solutions incontournables, parfaites pour créer des récits visuels captivants. Explorez dès maintenant pour découvrir l'outil qui vous convient le mieux !

10 outils
xix.ai
Assistante de réunion Les meilleurs outils de synthèse de réunions basés sur l'IA : suivez clairement les décisions et les actions à mener
Les meilleurs outils de synthèse de réunions basés sur l'IA : suivez clairement les décisions et les actions à mener

2026 : les meilleurs outils d'IA pour la synthèse de réunions, les mieux notés, pour un suivi clair des décisions et des relances sans effort. Cette sélection présente des solutions puissantes et révolutionnaires qui boostent considérablement la productivité en automatisant la prise de notes lors des réunions, en identifiant les actions clés et en rationalisant la coordination des équipes sur l'ensemble des projets. Profitez d'une comparaison entre les versions gratuites et payantes, ainsi que de tests en conditions réelles et de classements mis à jour chaque semaine pour vous aider à trouver l'outil idéal. Découvrez-les dès maintenant pour tirer pleinement parti de l'IA !

9 outils
xix.ai
Analyse des données Meilleurs outils de nettoyage de données IA : corrigez rapidement les valeurs manquantes et les doublons
Meilleurs outils de nettoyage de données IA : corrigez rapidement les valeurs manquantes et les doublons

2026 : Les meilleures outils de nettoyage de données IA les plus récents et hautement notés pour corriger rapidement les valeurs manquantes et les doublons. Cette liste rigoureusement sélectionnée met en avant des solutions puissantes capables d’améliorer considérablement la productivité. Chaque outil a été soumis à des tests approfondis dans des conditions réelles afin de garantir sa fiabilité. Obtenez une comparaison gratuite et payante pour découvrir l’outil qu’il vous faut le mieux, adapté à vos besoins. Explorez dès maintenant XIX.AI pour tirer parti au maximum des capacités de l’IA.

11 outils
xix.ai
Conception et art Meilleurs outils d’idéation créative par IA pour les artistes : surmonter les blocages visuels
Meilleurs outils d’idéation créative par IA pour les artistes : surmonter les blocages visuels

2026 Derniers Meilleurs Outils d’Idéation Créative par IA les Mieux Notés pour les Artistes sont sélectionnés par XIX.AI pour aider les créateurs à surmonner les blocages visuels et stimuler instantanément leur créativité. Ces outils puissants et révolutionnaires offrent des tests concrets, une comparaison détaillée entre les versions gratuites et payantes, ainsi que des classements mis à jour chaque semaine. Découvrez l’outil parfait pour accélérer la création de contenu et débloquer votre avantage IA dès aujourd’hui. Explorez maintenant !

14 outils
xix.ai
Composition musicale Créateurs de musique par IA pour les pistes d'accompagnement TikTok, les fichiers audio Reels et la musique promotionnelle des créateurs
Créateurs de musique par IA pour les pistes d'accompagnement TikTok, les fichiers audio Reels et la musique promotionnelle des créateurs

Les meilleurs générateurs de rythmes IA de 2026 pour les musiques de fond TikTok, les Reels et les morceaux promotionnels des créateurs ! XIX.AI a sélectionné une liste des outils les mieux notés, véritables révolutionnaires qui ont fait leurs preuves dans la pratique pour offrir une musique irréprochable, quel que soit votre besoin en matière de contenu. Vous y trouverez des comparaisons détaillées entre les versions gratuites et payantes, des classements mis à jour chaque semaine, ainsi que des options incontournables pour vous aider à stimuler votre créativité et votre productivité. Explorez-la dès maintenant pour découvrir l'outil qui vous convient le mieux !

11 outils
xix.ai
commentaires (4)
0/500
CarlLewis
CarlLewis 20 août 2025 11:01:15 UTC+02:00

Mind-blowing read! GPT-4.5 exposing the Turing Test's flaws is wild—makes you wonder if we're chasing the wrong AI benchmark. 🤯 What’s next, machines outsmarting us at our own game?

JamesLopez
JamesLopez 11 août 2025 08:20:39 UTC+02:00

Mind-blowing read! GPT-4.5 exposing the Turing Test's flaws is wild. Makes me wonder if we're chasing the wrong AI benchmark. 🧠 What's next?

DavidGonzález
DavidGonzález 2 août 2025 17:07:14 UTC+02:00

Mind blown! GPT-4.5 is shaking up the Turing Test, but it’s wild to think it’s still just mimicking, not truly thinking like us. 🤯 Makes me wonder if we’re chasing the wrong goal in AI.

PaulWilson
PaulWilson 1 août 2025 08:08:50 UTC+02:00

GPT-4.5 blowing past the Turing Test is wild! 😲 But honestly, it just shows the test’s more about trickery than true smarts. Makes you wonder if we’re measuring AI’s brainpower or just its acting skills. What’s next, an Oscar for chatbots?

OR