OpenAI lance GPT-6.1 Sol avec des performances proches d’Astra à un cinquième du prix
OpenAI a lancé GPT-6.1 Sol, une version améliorée de GPT-6 Sol qui cible le codage, l’utilisation de l’ordinateur et les flux de travail professionnels, tout en ne coûtant qu’un cinquième de GPT-6 Astra aux tarifs de jetons standard. L’entreprise indique que le nouveau modèle se rapproche d’Astra sur plusieurs évaluations exigeantes tout en améliorant significativement le précédent modèle Sol.
GPT-6.1 Sol offre un bond de performances majeur
GPT-6.1 Sol coûte 2 $ par million de jetons d’entrée et 10 $ par million de jetons de sortie, contre 10 $ et 50 $ pour GPT-6 Astra. L’entrée en cache est facturée à seulement 0,10 $ par million de jetons, ce qui, selon OpenAI, est 95 % moins cher que l’entrée standard et 50 % moins cher que la tarification de l’entrée en cache de GPT-6 Sol.
Sur le benchmark de codage DeepSWE v1.1, GPT-6.1 Sol égale GPT-6 Astra tout en affichant un score supérieur de 6,4 points de pourcentage à celui de GPT-6 Sol, avec un effort de raisonnement et un coût inférieurs.

Le modèle affiche également des gains de performances dans le traitement de documents professionnels. OpenAI indique que GPT-6.1 Sol obtient un score supérieur à Opus 5.5 avec des solutions de repli sur GDP.pdf, tout en coûtant moins de la moitié par tâche. L’utilisation de l’ordinateur est un autre axe majeur de ce dernier modèle. Sur l’ensemble hors ligne d’OSWorld 2.0, GPT-6.1 Sol obtient un score supérieur de sept points de pourcentage à celui de GPT-6 Sol avec un effort de raisonnement maximal. Il se situe à 2,1 points d’Astra tout en coûtant environ un septième par tâche.
GPT-6.1 Sol cible également les travaux scientifiques et factuels
OpenAI indique que GPT-6.1 Sol fait plus que doubler le score de GPT-6 Sol sur Terminal-Bench Science 0.1 avec un effort de raisonnement maximal, tout en coûtant moins de la moitié par tâche. Le modèle réduit également les erreurs factuelles sur les invites difficiles. Avec un effort de raisonnement faible, son taux d’erreur factuelle passe de 11,4 % avec GPT-6 Sol à 7,7 %, selon les tests d’OpenAI.
Disponibilité
GPT-6.1 Sol est désormais disponible pour les utilisateurs Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex, mais il n’est pas encore disponible dans le Chat standard. Les développeurs peuvent y accéder via l’API sous le nom gpt-6.1-sol. OpenAI prévoit également d’apporter Ultrafast à Codex, avec une génération de jetons jusqu’à huit fois plus rapide que la vitesse standard.
Consultez notre page de divulgation pour découvrir comment vous pouvez aider Windows Report à soutenir l'équipe éditoriale. Read more
Vous rencontrez toujours des problèmes? Corrigez-les avec cet outil:
User forum
0 messages