Maison
OpenAI dévoile les modèles GPT-6 Sol et Luna, divisant par deux les coûts de l’API tout en rivalisant avec les performances des meilleurs modèles phares
OpenAI a officiellement dévoilé les dernières ajouts à la gamme GPT-6 : GPT-6Sol et GPT-6Luna. Construits à l’aide d’une approche d’entraînement inspirée de GPT-6Astra, ces modèles visent à offrir les performances de haut niveau d’Astra dans les tâches professionnelles, la précision factuelle, la programmation, l’utilisation des ordinateurs et l’alignement, le tout au sein d’architectures plus petites, plus rapides et plus abordables. Bien que GPT-6Astra reste le choix privilégié pour ceux qui recherchent une qualité sans compromis, Sol et Luna démontrent une compétitivité exceptionnelle à un coût nettement inférieur.
En matière de tarification, les tarifs de l’API pour GPT-6Sol et Luna sont réduits de 50 % par rapport aux tarifs promotionnels de GPT-5.6. De plus, OpenAI a amélioré la mise en cache des invites pour les développeurs utilisant GPT-6, permettant un taux de hit de cache par défaut plus élevé. Cette optimisation permet une réutilisation intelligente du contexte, entraînant des temps de réponse plus rapides et des économies de coûts supplémentaires.

Les principales performances clés incluent :
Workflows commerciaux et capacités des agents : Dans les tests de processus inter-applications AutomationBench, GPT-6Sol a surpassé Claude Opus5 dans des conditions de haute intensité, ne coûtant que 9 % par tâche. Dans l’évaluation des agents Last Exam, GPT-6Sol a dépassé le score le plus élevé de Claude Opus5 tout en réduisant les coûts des tâches de 60 %.
Fiabilité factuelle : Dans des conversations réelles anonymisées, le taux d’erreur de GPT-6Sol est environ la moitié de celui de son prédécesseur, correspondant aux normes de fiabilité d’Astra. Luna a également connu des améliorations substantielles en matière de précision factuelle.

Programmation et génie logiciel : Les deux modèles sont fortement optimisés pour les charges de travail des agents de codage IA. Dans le benchmark de génie logiciel DeepSWE v1.1, GPT-6Sol a obtenu 68,8 %, se situant à seulement 1,1 point de pourcentage du score maximal, avec des coûts par tâche réduits d’environ 80 %. Les performances de Luna rivalisent avec celles des concurrents de milieu de gamme, offrant un avantage distinct en matière de coûts.
Capacités d’exploitation informatique : Dans les tests hors ligne OSWorld2.0, GPT-6Sol a obtenu des résultats comparables à ceux des concurrents de milieu de gamme, avec des coûts par tâche environ 80 % inférieurs. Parallèlement, Luna a surpassé le modèle phare de la génération précédente, fonctionnant à seulement un dixième de son coût.
Au-delà des gains de performance principaux, OpenAI a intégré le style de communication affiné de GPT-6Astra dans Sol et Luna. Cela rend les nouveaux modèles plus clairs et plus concis dans les discussions techniques et de codage, réduisant considérablement le jargon et les détails à faible valeur. En ce qui concerne l’alignement des valeurs, les deux modèles montrent des améliorations par rapport à GPT-5.6, notamment une réduction marquée des déclarations trompeuses lors des tâches de codage.
GPT-6Sol et GPT-6Luna sont désormais entièrement accessibles dans ChatGPT Work et Codex pour tous les utilisateurs Plus, Pro, Business, Enterprise et Edu. Les utilisateurs gratuits et Go peuvent également accéder à GPT-6Luna via l’application de bureau. Dans l’API OpenAI, ces modèles sont disponibles sous les identifiants gpt-6-sol et gpt-6-luna.
Article connexe
Harmattan AI : Comment les start-ups européennes développent l'IA dans le domaine de la défense
L'entreprise souligne que ses systèmes de défense intègrent l'IA, la détection et le renseignement de mission afin d'offrir « une capacité opérationnelle unifiée ». Crédit : Harmattan AIHarmattan AI e
Forbes Les 10 plus jeunes milliardaires d'Amérique : 7 ont surfé sur la vague de l'IA pour figurer dans le classement, 4 issus d'Anthropic
Business Insider rapporte que Forbes a publié son classement annuel des 400 Américains les plus riches, avec un seuil d’entrée atteignant un record de 4,4 milliards de dollars. Le nombre de milliardaires de moins de 40 ans est passé de quatre à dix,
Comment Legora développe le « système d'exploitation » de l'IA juridique
Legora a recruté des juristes-rédacteurs possédant plusieurs décennies d’expérience dans la conception d’outils de navigation pour les éditeurs afin de développer son outil de citation natif IA. Crédi
Recommandations de sujets spéciaux liés
commentaires (0)
OpenAI a officiellement dévoilé les dernières ajouts à la gamme GPT-6 : GPT-6Sol et GPT-6Luna. Construits à l’aide d’une approche d’entraînement inspirée de GPT-6Astra, ces modèles visent à offrir les performances de haut niveau d’Astra dans les tâches professionnelles, la précision factuelle, la programmation, l’utilisation des ordinateurs et l’alignement, le tout au sein d’architectures plus petites, plus rapides et plus abordables. Bien que GPT-6Astra reste le choix privilégié pour ceux qui recherchent une qualité sans compromis, Sol et Luna démontrent une compétitivité exceptionnelle à un coût nettement inférieur.
En matière de tarification, les tarifs de l’API pour GPT-6Sol et Luna sont réduits de 50 % par rapport aux tarifs promotionnels de GPT-5.6. De plus, OpenAI a amélioré la mise en cache des invites pour les développeurs utilisant GPT-6, permettant un taux de hit de cache par défaut plus élevé. Cette optimisation permet une réutilisation intelligente du contexte, entraînant des temps de réponse plus rapides et des économies de coûts supplémentaires.

Les principales performances clés incluent :
Workflows commerciaux et capacités des agents : Dans les tests de processus inter-applications AutomationBench, GPT-6Sol a surpassé Claude Opus5 dans des conditions de haute intensité, ne coûtant que 9 % par tâche. Dans l’évaluation des agents Last Exam, GPT-6Sol a dépassé le score le plus élevé de Claude Opus5 tout en réduisant les coûts des tâches de 60 %.
Fiabilité factuelle : Dans des conversations réelles anonymisées, le taux d’erreur de GPT-6Sol est environ la moitié de celui de son prédécesseur, correspondant aux normes de fiabilité d’Astra. Luna a également connu des améliorations substantielles en matière de précision factuelle.

Programmation et génie logiciel : Les deux modèles sont fortement optimisés pour les charges de travail des agents de codage IA. Dans le benchmark de génie logiciel DeepSWE v1.1, GPT-6Sol a obtenu 68,8 %, se situant à seulement 1,1 point de pourcentage du score maximal, avec des coûts par tâche réduits d’environ 80 %. Les performances de Luna rivalisent avec celles des concurrents de milieu de gamme, offrant un avantage distinct en matière de coûts.
Capacités d’exploitation informatique : Dans les tests hors ligne OSWorld2.0, GPT-6Sol a obtenu des résultats comparables à ceux des concurrents de milieu de gamme, avec des coûts par tâche environ 80 % inférieurs. Parallèlement, Luna a surpassé le modèle phare de la génération précédente, fonctionnant à seulement un dixième de son coût.
Au-delà des gains de performance principaux, OpenAI a intégré le style de communication affiné de GPT-6Astra dans Sol et Luna. Cela rend les nouveaux modèles plus clairs et plus concis dans les discussions techniques et de codage, réduisant considérablement le jargon et les détails à faible valeur. En ce qui concerne l’alignement des valeurs, les deux modèles montrent des améliorations par rapport à GPT-5.6, notamment une réduction marquée des déclarations trompeuses lors des tâches de codage.
GPT-6Sol et GPT-6Luna sont désormais entièrement accessibles dans ChatGPT Work et Codex pour tous les utilisateurs Plus, Pro, Business, Enterprise et Edu. Les utilisateurs gratuits et Go peuvent également accéder à GPT-6Luna via l’application de bureau. Dans l’API OpenAI, ces modèles sont disponibles sous les identifiants gpt-6-sol et gpt-6-luna.
Harmattan AI : Comment les start-ups européennes développent l'IA dans le domaine de la défense
L'entreprise souligne que ses systèmes de défense intègrent l'IA, la détection et le renseignement de mission afin d'offrir « une capacité opérationnelle unifiée ». Crédit : Harmattan AIHarmattan AI e
Forbes Les 10 plus jeunes milliardaires d'Amérique : 7 ont surfé sur la vague de l'IA pour figurer dans le classement, 4 issus d'Anthropic
Business Insider rapporte que Forbes a publié son classement annuel des 400 Américains les plus riches, avec un seuil d’entrée atteignant un record de 4,4 milliards de dollars. Le nombre de milliardaires de moins de 40 ans est passé de quatre à dix,
Comment Legora développe le « système d'exploitation » de l'IA juridique
Legora a recruté des juristes-rédacteurs possédant plusieurs décennies d’expérience dans la conception d’outils de navigation pour les éditeurs afin de développer son outil de citation natif IA. Crédi











