OpenAI Dévoile des Modèles d'IA Avancés pour le Raisonnement, o3 et o4-mini

OpenAI a présenté mercredi o3 et o4-mini, de nouveaux modèles d'IA conçus pour faire une pause et analyser les questions avant de répondre.
OpenAI présente o3 comme son modèle de raisonnement le plus sophistiqué à ce jour, surpassant les modèles précédents dans les tests de mathématiques, de codage, de raisonnement, de sciences et de compréhension visuelle. Parallèlement, o4-mini équilibre coût, vitesse et performance, ce qui en fait un choix solide pour les développeurs créant des applications basées sur l'IA.
Contrairement aux modèles précédents, o3 et o4-mini exploitent les outils de ChatGPT comme la navigation sur le web, l'exécution de code Python, le traitement d'images et la génération d'images. Dès aujourd'hui, ces modèles, ainsi que o4-mini-high, qui prend plus de temps pour améliorer la précision des réponses, sont disponibles pour les abonnés aux plans Pro, Plus et Team d'OpenAI.
Les modèles font partie de l'effort d'OpenAI pour surpasser ses rivaux comme Google, Meta, xAI, Anthropic et DeepSeek dans la course mondiale à l'IA. Bien qu'OpenAI ait été pionnier dans le raisonnement IA avec o1, les concurrents ont depuis sorti des modèles comparables ou supérieurs, faisant des modèles de raisonnement un axe clé pour les laboratoires d'IA.
Initialement, o3 n'était pas prévu pour une sortie sur ChatGPT. Le PDG d'OpenAI, Sam Altman, avait laissé entendre en février se concentrer sur une alternative plus avancée utilisant la technologie d'o3. Cependant, les pressions concurrentielles ont probablement poussé OpenAI à le lancer.
OpenAI rapporte que o3 atteint des performances de premier plan sur SWE-bench vérifié (sans échafaudage personnalisé), obtenant 69,1 % sur les tâches de codage. O4-mini obtient 68,1 %, tandis que o3-mini atteint 49,3 %, comparé à 62,3 % pour Claude 3.7 Sonnet.
OpenAI affirme que o3 et o4-mini sont ses premiers modèles à traiter efficacement les images. Les utilisateurs peuvent télécharger des images comme des croquis sur tableau blanc ou des diagrammes PDF, et les modèles les analysent pendant leur processus de raisonnement, gérant des images floues ou de basse qualité et effectuant des tâches comme le zoom ou la rotation.
En plus des images, o3 et o4-mini exécutent du code Python dans le navigateur via la fonctionnalité Canvas de ChatGPT et effectuent des recherches sur le web pour des requêtes d'événements en temps réel.
Les trois modèles — o3, o4-mini et o4-mini-high — sont accessibles via l'API Chat Completions et l'API Responses d'OpenAI, permettant aux développeurs de les intégrer dans des applications avec une tarification basée sur l'utilisation.
OpenAI fixe le prix de o3 à 10 $ par million de jetons d'entrée (environ 750 000 mots) et 40 $ par million de jetons de sortie. O4-mini correspond à la tarification d'o3-mini à 1,10 $ par million de jetons d'entrée et 4,40 $ par million de jetons de sortie.
Dans les semaines à venir, OpenAI prévoit de lancer o3-pro, une version intensive en calcul de o3, exclusivement pour les abonnés ChatGPT Pro.
Le PDG Sam Altman a suggéré que o3 et o4-mini pourraient être les derniers modèles de raisonnement autonomes d'OpenAI dans ChatGPT avant GPT-5, qui intégrera les capacités des modèles traditionnels et de raisonnement.
Article connexe
OpenAI lance une version plus sûre de ChatGPT pour les adolescents, plusieurs années après qu’ils ont commencé à l’utiliser
À la suite d’une série de poursuites judiciaires liées à l’absence de protocoles de sécurité dans les chatbots basés sur l’IA — qui ont contribué à des suicides d’adolescents et à d’autres crises de s
Frontier AI Labs refuse de dévoiler ses stratégies de confinement des modèles indésirables
Des recherches récentes indiquent que très peu de grands laboratoires spécialisés dans l’IA ont publié ou présenté des plans d’intervention en cas de défaillance. Un plan d’intervention définit les pr
Le Tiffany Luck de NEA : les entreprises continuent de lutter pour justifier le retour sur investissement de l’IA
Chargement du lecteur…Plus tôt cette année, le « tokenmaxxing » a dominé la Silicon Valley, les PDG exhortant leurs employés à maximiser l’utilisation de l’IA. Cet enthousiasme a rapidement rencontré la réalité. Selon les informations rapportées, Ub
Recommandations de sujets spéciaux liés
commentaires (3)
Wow, OpenAI's o3 sounds like a game-changer! Pausing to think before answering? That's some next-level AI. Can't wait to see how it stacks up against other models in real-world tasks! 🤯

OpenAI a présenté mercredi o3 et o4-mini, de nouveaux modèles d'IA conçus pour faire une pause et analyser les questions avant de répondre.
OpenAI présente o3 comme son modèle de raisonnement le plus sophistiqué à ce jour, surpassant les modèles précédents dans les tests de mathématiques, de codage, de raisonnement, de sciences et de compréhension visuelle. Parallèlement, o4-mini équilibre coût, vitesse et performance, ce qui en fait un choix solide pour les développeurs créant des applications basées sur l'IA.
Contrairement aux modèles précédents, o3 et o4-mini exploitent les outils de ChatGPT comme la navigation sur le web, l'exécution de code Python, le traitement d'images et la génération d'images. Dès aujourd'hui, ces modèles, ainsi que o4-mini-high, qui prend plus de temps pour améliorer la précision des réponses, sont disponibles pour les abonnés aux plans Pro, Plus et Team d'OpenAI.
Les modèles font partie de l'effort d'OpenAI pour surpasser ses rivaux comme Google, Meta, xAI, Anthropic et DeepSeek dans la course mondiale à l'IA. Bien qu'OpenAI ait été pionnier dans le raisonnement IA avec o1, les concurrents ont depuis sorti des modèles comparables ou supérieurs, faisant des modèles de raisonnement un axe clé pour les laboratoires d'IA.
Initialement, o3 n'était pas prévu pour une sortie sur ChatGPT. Le PDG d'OpenAI, Sam Altman, avait laissé entendre en février se concentrer sur une alternative plus avancée utilisant la technologie d'o3. Cependant, les pressions concurrentielles ont probablement poussé OpenAI à le lancer.
OpenAI rapporte que o3 atteint des performances de premier plan sur SWE-bench vérifié (sans échafaudage personnalisé), obtenant 69,1 % sur les tâches de codage. O4-mini obtient 68,1 %, tandis que o3-mini atteint 49,3 %, comparé à 62,3 % pour Claude 3.7 Sonnet.
OpenAI affirme que o3 et o4-mini sont ses premiers modèles à traiter efficacement les images. Les utilisateurs peuvent télécharger des images comme des croquis sur tableau blanc ou des diagrammes PDF, et les modèles les analysent pendant leur processus de raisonnement, gérant des images floues ou de basse qualité et effectuant des tâches comme le zoom ou la rotation.
En plus des images, o3 et o4-mini exécutent du code Python dans le navigateur via la fonctionnalité Canvas de ChatGPT et effectuent des recherches sur le web pour des requêtes d'événements en temps réel.
Les trois modèles — o3, o4-mini et o4-mini-high — sont accessibles via l'API Chat Completions et l'API Responses d'OpenAI, permettant aux développeurs de les intégrer dans des applications avec une tarification basée sur l'utilisation.
OpenAI fixe le prix de o3 à 10 $ par million de jetons d'entrée (environ 750 000 mots) et 40 $ par million de jetons de sortie. O4-mini correspond à la tarification d'o3-mini à 1,10 $ par million de jetons d'entrée et 4,40 $ par million de jetons de sortie.
Dans les semaines à venir, OpenAI prévoit de lancer o3-pro, une version intensive en calcul de o3, exclusivement pour les abonnés ChatGPT Pro.
Le PDG Sam Altman a suggéré que o3 et o4-mini pourraient être les derniers modèles de raisonnement autonomes d'OpenAI dans ChatGPT avant GPT-5, qui intégrera les capacités des modèles traditionnels et de raisonnement.
OpenAI lance une version plus sûre de ChatGPT pour les adolescents, plusieurs années après qu’ils ont commencé à l’utiliser
À la suite d’une série de poursuites judiciaires liées à l’absence de protocoles de sécurité dans les chatbots basés sur l’IA — qui ont contribué à des suicides d’adolescents et à d’autres crises de s
Frontier AI Labs refuse de dévoiler ses stratégies de confinement des modèles indésirables
Des recherches récentes indiquent que très peu de grands laboratoires spécialisés dans l’IA ont publié ou présenté des plans d’intervention en cas de défaillance. Un plan d’intervention définit les pr
Le Tiffany Luck de NEA : les entreprises continuent de lutter pour justifier le retour sur investissement de l’IA
Chargement du lecteur…Plus tôt cette année, le « tokenmaxxing » a dominé la Silicon Valley, les PDG exhortant leurs employés à maximiser l’utilisation de l’IA. Cet enthousiasme a rapidement rencontré la réalité. Selon les informations rapportées, Ub
Wow, OpenAI's o3 sounds like a game-changer! Pausing to think before answering? That's some next-level AI. Can't wait to see how it stacks up against other models in real-world tasks! 🤯





Maison






