AI Nieuws6 minGevorderd

GPT-6.1 Sol: bijna Astra-niveau voor een vijfde van de prijs

OpenAI's GPT-6.1 Sol kost $2 per miljoen input-tokens en komt volgens OpenAI dicht bij Astra. Wat dat voor je abonnement en je werk betekent, en wat nog ontbreekt.

Miniatuur diorama-illustratie bij artikel 'GPT-6.1 Sol: bijna Astra-niveau voor een vijfde van de prijs'

OpenAI presenteerde op 29 september tijdens DevDay GPT-6.1 Sol, en de slogan zegt het al: ‘near-Astra intelligence for a fifth of the price’ (Bron: OpenAI). Drie weken na het vlaggenschip Astra komt er dus een model dat er volgens de maker bijna aan tippelt, tegen $2 in plaats van $10. Wat je daarvan merkt hangt af van of je alleen chat, of ook bouwt.

Wat OpenAI precies aankondigde

GPT-6.1 Sol kost in de API $2 per miljoen input-tokens en $10 per miljoen output-tokens, met gecachte input voor $0,10 (Bron: OpenAI). Astra staat op $10 en $50, ook tot 272.000 tokens; wij rekenden eerder voor waar die rekening omslaat. Het verschil is dus letterlijk een factor vijf.

Het model is beschikbaar ‘starting today’ voor Plus-, Pro-, Business-, Enterprise- en Edu-gebruikers, in ChatGPT Work en in Codex, en in de API als gpt-6.1-sol. In de gewone ChatGPT-chat zit het nog niet. Een gratis versie is niet genoemd.

Beginner-tipEen token is ruwweg driekwart woord, en de prijs per miljoen tokens is wat ontwikkelaars betalen wanneer ze het model in hun eigen app bouwen. Gebruik je ChatGPT gewoon in de browser, dan betaal je een vast abonnement en raakt dit je portemonnee niet direct. Het bepaalt wel welke modellen OpenAI je durft te geven binnen dat abonnement. Begin bijonze uitleg over AI-licentiekostenals je die rekening wilt begrijpen.

Hoe dicht zit het bij Astra?

OpenAI noemt drie meetpunten. Op de codetest DeepSWE v1.1 evenaart GPT-6.1 Sol volgens het bedrijf Astra. Bij professionele documentanalyse (GDP.pdf) komt het ‘dicht in de buurt’ voor ongeveer een vijfde van de kosten. En op OSWorld 2.0, waar een model zelf een computer bedient, zit het binnen 2,1 procentpunt van Astra, voor ongeveer een zevende van de prijs (Bron: OpenAI).

Dat zijn cijfers van de verkoper, gemeten op benchmarks die OpenAI zelf koos. Een benchmark is geen werkdag: het zegt hoe een model scoort op een vaste set opdrachten, niet of het jouw rommelige spreadsheet of je slecht gedocumenteerde codebase aankan. Onafhankelijke tests waren er bij het verschijnen van dit stuk nog niet, en het contextvenster staat niet in de aankondiging.

Beter dan zijn eigen voorganger

Interessanter dan de vergelijking met Astra is die met de Sol van vorige week. GPT-6 Sol kwam op 22 september uit voor $2 en $10 (Bron: OpenAI); het nieuwe model staat volgens onze bronnen op dezelfde prijs. OpenAI zegt dat GPT-6.1 Sol op DeepSWE v1.1 6,4 procentpunt boven GPT-6 Sol uitkomt en op Terminal-Bench Science meer dan het dubbele scoort. Ook meldt het bedrijf ongeveer 32 procent minder feitelijke fouten bij lage redeneerinspanning (Bron: OpenAI).

GevorderdenDie lage-inspanningscijfers zijn relevanter dan ze lijken. Wie een model inzet voor bulkwerk (classificeren, samenvatten, tickets sorteren) draait het bijna altijd op laag redeneerniveau om kosten en wachttijd te drukken. Een foutreductie juist daar levert in productie meer op dan een record op de zwaarste benchmark.

Voor een bedrijf dat vorige week op GPT-6 Sol overstapte betekent dat: dezelfde rekening, een beter model. Voor iemand die op Astra draait: een reden om te testen of de duurste stap in zijn workflow echt Astra nodig heeft.

Wat je ervan merkt

Ben je gewone gebruiker, dan verandert er deze week weinig. Het model zit in ChatGPT Work en Codex, dus vooral in de omgevingen waar je agents laat werken, en niet in het chatvenster waar de meeste mensen zitten. Zit je bij een werkgever met een Business- of Enterprise-abonnement, dan is de kans groter dat het model bij je opduikt, al kan een beheerder dat sturen.

Werk je via de tool van een softwarebedrijf met AI, dan merk je het effect op termijn indirect. Salesforce-topman Jayesh Govindarajan zegt in de aankondiging dat GPT-6.1 Sol ‘het soort probleemoplossing liet zien dat we van een AI-codeerpartner willen’ (Bron: The Next Web). Lees dat als een klantenquote in een persbericht: nuttig als signaal, niet als meting.

De rest van het verhaal is een prijzenoorlog die we al eerder beschreven, toen GPT-5.6 tot 80 procent goedkoper werd. Elke maand krijg je meer model voor hetzelfde geld. Nog niet duidelijk is wanneer de Ultrafast-variant komt, die volgens OpenAI tot 8 keer sneller tokens genereert. Er staat alleen ‘coming soon’.

Veelgestelde vragen

Wat kost GPT-6.1 Sol per miljoen tokens?

In de API kost GPT-6.1 Sol $2 per miljoen input-tokens en $10 per miljoen output-tokens. Herhaalde invoer uit de cache kost $0,10 per miljoen tokens, volgens OpenAI 95 procent minder dan gewone invoer. Dat is een vijfde van de standaardprijs van GPT-6 Astra. Prijzen wijzigen geregeld; controleer de prijspagina van OpenAI voordat je erop rekent.

Kan ik GPT-6.1 Sol gratis gebruiken?

Nee. OpenAI zegt dat het model beschikbaar is voor Plus-, Pro-, Business-, Enterprise- en Edu-gebruikers in ChatGPT Work en Codex. Voor gratis gebruikers is niets aangekondigd. Het zit ook nog niet in de gewone ChatGPT-chat, alleen in die twee omgevingen en via de API onder de naam gpt-6.1-sol.

Is GPT-6.1 Sol beter dan GPT-6 Astra?

Nee, OpenAI claimt zelf 'near-Astra'. Bij de codetest DeepSWE v1.1 zou het Astra evenaren, bij de computertest OSWorld 2.0 zit het volgens OpenAI 2,1 procentpunt eronder. Dat zijn cijfers van de aanbieder zelf. Voor zware, lange taken blijft Astra het vlaggenschip, alleen zit daar ook een veel hogere prijs aan vast.

Wat is het verschil tussen GPT-6.1 Sol en GPT-6 Sol?

Volgens OpenAI scoort GPT-6.1 Sol op DeepSWE v1.1 6,4 procentpunt hoger dan GPT-6 Sol en meer dan het dubbele op Terminal-Bench Science. Voor zover we konden nagaan staan beide op dezelfde API-prijs van $2 en $10, dus je krijgt meer voor hetzelfde geld. Die prijs van GPT-6 Sol komt uit ons eerdere stuk over de Astra-prijzen.

Wanneer komt de ultrasnelle versie van GPT-6.1 Sol?

OpenAI kondigt een Ultrafast-variant aan die tot 8 keer sneller tokens genereert, maar noemt geen datum: het staat als 'coming soon'. The Next Web meldt dat die snelheidswinst in Codex geldt. Hoe de prijs van die variant eruitziet, is nog niet bekend.

Bronnen

Waar deze informatie vandaan komt.

  1. OpenAI — Introducing GPT-6.1 Solopenai.com