OpenAI lanceert GPT-6.1 Sol met Near-Astra-prestaties voor een vijfde van de prijs


OpenAI heeft GPT-6.1 Sol gelanceerd, een verbeterde versie van GPT-6 Sol die zich richt op programmeren, computergebruik en professionele workflows, en die tegen standaard tokenprijzen slechts een vijfde van GPT-6 Astra kost. Het bedrijf zegt dat het nieuwe model op verschillende veeleisende evaluaties in de buurt van Astra komt, terwijl het aanzienlijk beter presteert dan het vorige Sol-model.

GPT-6.1 Sol levert een forse prestatiesprong

GPT-6.1 Sol kost $2 per miljoen inputtokens en $10 per miljoen outputtokens, vergeleken met $10 en $50 voor GPT-6 Astra. Gecachte input kost slechts $0,10 per miljoen tokens, wat volgens OpenAI 95% goedkoper is dan standaard input en 50% goedkoper dan de gecachte inputprijs van GPT-6 Sol.

Op de DeepSWE v1.1-programmeerbenchmark presteert GPT-6.1 Sol even goed als GPT-6 Astra, terwijl het model 6,4 procentpunt hoger scoort dan GPT-6 Sol bij een lagere redeneerinspanning en tegen lagere kosten.

Beeldcredits: OpenAI

Het model laat ook prestatiewinst zien bij professioneel documentwerk. OpenAI zegt dat GPT-6.1 Sol hoger scoort dan Opus 5.5 met fallbacks op GDP.pdf en per taak minder dan de helft kost. Computergebruik is een ander belangrijk aandachtspunt van het nieuwste model. Op de offline set van OSWorld 2.0 scoort GPT-6.1 Sol zeven procentpunten hoger dan GPT-6 Sol bij maximale redeneerinspanning. Het komt tot op 2,1 punt in de buurt van Astra, terwijl het per taak ongeveer een zevende van Astra kost.

GPT-6.1 Sol richt zich ook op wetenschappelijk en feitelijk werk

OpenAI zegt dat GPT-6.1 Sol de score van GPT-6 Sol op Terminal-Bench Science 0.1 bij maximale redeneerinspanning meer dan verdubbelt, terwijl het per taak minder dan de helft kost. Het model vermindert ook feitelijke fouten bij moeilijke prompts. Bij lage redeneerinspanning daalt het percentage feitelijke fouten volgens tests van OpenAI van 11,4% bij GPT-6 Sol naar 7,7%.

Beschikbaarheid

GPT-6.1 Sol is nu beschikbaar voor Plus-, Pro-, Business-, Enterprise- en Edu-gebruikers in ChatGPT Work en Codex, maar nog niet in de reguliere Chat. Ontwikkelaars hebben er via de API toegang toe als gpt-6.1-sol. OpenAI is bovendien van plan om Ultrafast naar Codex te brengen, met tokengeneratie die tot acht keer sneller is dan de standaardsnelheid.

Lezers helpen Windows Report te ondersteunen. Wanneer u een aankoop doet via links op onze site, kunnen we een affiliate commissie verdienen. Tooltip Icon

Lees de pagina met affiliate onthullingen om erachter te komen hoe u Windows Report moeiteloos en zonder geld uit te geven kunt helpen. Read more

User forum

0 messages