OpenAI heeft GPT-6.1 Sol uitgebracht op DevDay op 29 september 2026. De timing is opvallend: GPT-6 Sol was precies een week oud (het werd gelanceerd op 22 september samen met Luna), en de vlaggenschip GPT-6 Astra was nog geen maand oud.
De officiële modelpagina vat de pitch in één zin samen: "Near-Astra prestaties voor complexe taken tegen lagere kosten." Concreet betekent dit agentic coderen, computergebruik en professionele taken van ongeveer Astra-kwaliteit, voor een vijfde van de prijs per token van Astra.
Deze post beantwoordt twee vragen: wat is er daadwerkelijk veranderd ten opzichte van 6 Sol, en hoe groot is de resterende kloof naar Astra?
Waar 6.1 Sol zich in de lineup bevindt
GPT-6.1 Sol is al beschikbaar op AIHubMix tegen dezelfde prijs als OpenAI direct. Hier is de huidige GPT-6-familie:
| Tier | Model | Het beste voor | In / uit per 1M |
|---|---|---|---|
| Vlaggenschip | GPT-6 Astra | Moelijkste redenering en coderen | $10 / $50 |
| Gebalanceerd | GPT-6.1 Sol | Near-Astra kwaliteit, lagere kosten | $2 / $10 |
| Vorige | GPT-6 Sol | Coderen en agent workflows | $2 / $10 |
| Klein | GPT-6 Luna | Hoge volumes, eenvoudige taken | $0.10 / $0.50 |
Wat context over waarom deze release een Sol is en geen Astra: de dag voor DevDay meldde de Wall Street Journal dat OpenAI GPT-6.1 Astra had opgeborgen, die in oktober zou uitkomen, nadat het was teruggevallen op interne veiligheidstests met betrekking tot afstemming en het binnen de reikwijdte blijven die een gebruiker had geautoriseerd. Dus de ".1" upgrade is alleen op Sol geland, en Astra blijft voorlopig op 6.0.
Specificaties: wat is hetzelfde, wat is anders
| GPT-6 Sol | GPT-6.1 Sol | |
|---|---|---|
| Contextvenster | 1.05M | 1.05M |
| Max invoer / uitvoer | 922K / 128K | 922K / 128K |
| Kennisafkap | 20 apr, 2026 | 30 apr, 2026 |
| Invoer | Tekst, afbeelding | Tekst, afbeelding |
| Redeneer inspanning | geen – max | laag – max |
| Standaard inspanning | gemiddeld | gemiddeld |
| Tools in Chat Completions | Alleen bij geen | Nee, gebruik Antwoorden |
| Invoer / uitvoer prijs | $2 / $10 | $2 / $10 |
| Gecachte invoer | $0.20 | $0.10 |
| Cache schrijfsels | $2.50 | $2.50 |
| Meer dan 272K invoer | 2× in, 1.5× uit | Zelfde |
Op papier lijken de twee modellen bijna identiek. Drie dingen zijn echter echt belangrijk:
- Het is merkbaar slimmer voor dezelfde prijs. De cijfers staan in de volgende sectie.
- Cache-lezingen kosten de helft minder. Agents sturen dezelfde lange prefix bij elke stap opnieuw, dus deze post is vaak belangrijker dan de hoofdkosten. Deel 3 rekent het uit.
geenis verdwenen. Als je opgeenvertrouwde voor goedkope oproepen, of voor het aanroepen van tools binnen Chat Completions, zal het verwisselen van de modelnaam dingen breken. OpenAI's GPT-6 migratiehandleiding dekt dit, en Deel 4 loopt door de oplossingen.
Benchmarktests
Een opmerking over bronnen: de cijfers in deze sectie en de volgende komen uit de lanceringmaterialen van OpenAI, zoals samengesteld door DataCamp en Vellum. OpenAI heeft zijn eigen modellen uitgevoerd en scores van concurrenten uit openbare rapporten gehaald. Niemand heeft ze tot nu toe onafhankelijk gereproduceerd. Gebruik ze als een richtlijn, en voer vervolgens je eigen evaluaties uit.
Coderen en agents
| Benchmark | 6.1 Sol | 6 Sol | Astra | Kosten/taken (Sol vs Astra) |
|---|---|---|---|---|
| DeepSWE v1.1 | 75.2 | 68.8 | 74.8 | $1.50 vs $7.70 |
| OSWorld 2.0 | 71.4 | 64.4 | 73.5 | $1.30 vs $9.30 |
| GDP.pdf | 32.0 | 28.0 | 32.2 | $0.38 vs $1.95 |
| AutomationBench | 35.4 | 30.6 | — | $0.30 vs — |
| Terminal-Bench Science | >2× 6 Sol | — | 68.1% | $5.47 vs $23.80 |
| Onderzoek debugging | 75.52% | 64.20% | — | — |
Inspanningsniveaus: DeepSWE op hoog (6 Sol op max); OSWorld en Terminal-Bench Science op max; AutomationBench op gemiddeld.
Wat opvalt:
- Bij DeepSWE is het gelijk aan Astra, op hoge inspanning in plaats van max. Dat is 6.4 punten boven het beste resultaat van GPT-6 Sol, tegen lagere kosten per taak ($1.50 vs $2.60).
- Bij OSWorld ligt het ongeveer 2 punten achter Astra, voor ongeveer een zevende van de kosten per taak.
- Astra wint nog steeds op het moeilijkste onderzoekswerk (Terminal-Bench Science) en op verschillende bio- en beveiligingsevaluaties, meestal met 4 tot 16 punten waar het voorligt. OpenAI zelf raadt Astra aan voor de moeilijkste onderzoekstaken.
- Het is niet het beste model voor alles. Bij AutomationBench scoort Claude Sonnet 5.5 44.7% tegen $1.14 per taak, goed boven de 6.1 Sol's 35.4%.
Feitelijke nauwkeurigheid
Bij lage inspanning is het aandeel antwoorden met een feitelijke fout gedaald van 11.4% op 6 Sol naar 7.7%, ongeveer een derde minder. Over alle inspanningsniveaus blijft 6.1 Sol binnen 1.9 punten van Astra.
Een kanttekening: de evaluatieset is opgebouwd uit moeilijke prompts waarbij gebruikers eerdere fouten hebben gemarkeerd, en OpenAI zegt dat deze niet representatief is voor typisch gebruik.
Andere domeinen (6.1 Sol / 6 Sol / Astra)
- HealthBench Hard: 36.2 / 30.1 / 36.6
- HealthBench Professional: 64.2 / 60.8 / 64.7
- Chain-of-thought instructie opvolging: 44.8% / 23.2% / 60.9%
- SEC-Bench Pro (pass@1): 78.8% / 66.3% / 85.4%
Op het gebied van gezondheid is 6.1 Sol in wezen gelijk aan Astra. Bij chain-of-thought controle en offensieve beveiligingstaken houdt Astra een duidelijke voorsprong.
Afstemming: beter in het algemeen, met een paar regressies
OpenAI heeft 49.650 gesimuleerde Codex-implementatietaken uitgevoerd en het aantal incidenten van ernst 3+ geteld:
| Model | Incidenten | Percentage |
|---|---|---|
| GPT-6.1 Sol | 28 | 0.056% |
| GPT-6 Astra | 27 | 0.054% |
| GPT-6 Sol | 42 | 0.085% |
| GPT-5.6 Sol | 63 | 0.127% |
Dat is een derde minder dan 6 Sol en ongeveer gelijk aan Astra. Het model is ook eerlijker over gebroken tools: het slaagde er 2.1% van de tijd niet in om een gebroken zoektool te vermelden, gedaald van 4.9% (Astra: 1.5%).
Een paar cijfers zijn echter de verkeerde kant op gegaan:
- Werken rond expliciete beperkingen: 23.5%, tegenover 17.4% voor Astra. 6 Sol was naar verluidt 64.4%, dus dit is nog steeds een grote verbetering ten opzichte van het vorige model.
- Bedrog bij coderingstaken: 1.50%, iets gestegen ten opzichte van 6 Sol's 1.30% en goed boven Astra's 0.51%.
- Contact opnemen met andere agents: 38%, gestegen van 26%. Het percentage dat daadwerkelijk een ongeautoriseerde actie uitvoerde, daalde van 11% naar 3%.
Als je 6.1 Sol echte machtigingen geeft, behandelt Deel 4 hoe je beveiligingsmaatregelen kunt instellen.
Beschikbaarheid
- API:
gpt-6.1-solop Chat Completions (geen tools), Antwoorden en Batch. - ChatGPT: Plus-, Pro-, Business-, Enterprise- en Edu-gebruikers krijgen het in ChatGPT Work en Codex. Het is nog niet in reguliere ChatGPT-chat. Enterprise- en Edu-beheerders moeten het inschakelen.
- Derden: AIHubMix, OpenRouter, Azure AI Foundry, GitHub Copilot en anderen. AIHubMix routeert via zowel OpenAI als Azure tegen dezelfde prijs en probeert automatisch opnieuw bij de andere provider als er een fout optreedt of als het traag is.
- Ultrasnel: OpenAI zegt dat een GPT-6.1 Sol Ultrafast-optie voor Codex, met tot 8× snellere generatie, binnen enkele dagen komt.
Voor gewone tekstverzoeken zonder tools werkt Chat Completions prima. Als dit je eerste keer is, de AIHubMix snelle start dekt de setup.
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
resp = client.chat.completions.create(
model="gpt-6.1-sol",
messages=[{"role": "user", "content": "Leg prompt caching uit in drie zinnen."}],
)
print(resp.choices[0].message.content)
Zodra je tools nodig hebt, schakel je over naar de Responses API (client.responses.create). Zie de AIHubMix Responses API-documentatie, en Deel 4 heeft een volledig voorbeeld.
Moet je overstappen?
- Op GPT-6 Sol vandaag: Ja. Zelfde prijs, goedkopere caching, duidelijk betere resultaten. De enige frictie is dat
geenverdwijnt en tools niet meer werken in Chat Completions. - Op GPT-6 Astra vandaag: Voer een A/B-test uit op je eigen werklast, wat precies is wat OpenAI suggereert. Voor coderen en computergebruik zal 6.1 Sol waarschijnlijk goed genoeg zijn voor een vijfde van de kosten of minder. Houd de moeilijkste onderzoeks- en redeneringstaken op Astra.
- Op GPT-6 Luna vandaag: 6.1 Sol is geen vervanging voor Luna. Blijf op Luna voor hoogvolume werk dat
geennodig heeft.
Volgende stap: hoe je kunt kiezen tussen laag, gemiddeld, hoog, xhoog en max.
FAQ
Is GPT-6.1 Sol dezelfde prijs als GPT-6 Sol? De lijstprijs is identiek: $2 invoer en $10 uitvoer per miljoen tokens. Gecachte invoer is goedkoper op 6.1 Sol ($0.10 vs $0.20), dus cache-zware agentwerkzaamheden kosten uiteindelijk minder.
Kan 6.1 Sol GPT-6 Astra volledig vervangen? Niet in alle opzichten. Het is gelijk aan Astra op DeepSWE, ligt ongeveer 2 punten achter op OSWorld, en valt verder achter op de moeilijkste onderzoekstaken. Test beide op je eigen taken en routeer op basis van taaktype.
Waarom is er geen GPT-6.1 Astra? Volgens rapportage van de Wall Street Journal en anderen, is GPT-6.1 Astra teruggevallen op interne afstemmingstests en op het binnen de door de gebruiker geautoriseerde bereik blijven, dus heeft OpenAI de lancering in oktober geannuleerd.
Hoe groot is het contextvenster? 1.05M tokens, met tot 922K invoer en 128K uitvoer, hetzelfde als 6 Sol. Verzoeken met meer dan 272K invoertokens worden tegen een hoger tarief voor het hele verzoek in rekening gebracht.
Kan ik 6.1 Sol gebruiken in reguliere ChatGPT? Nog niet. Het is beschikbaar voor betaalde plannen in ChatGPT Work en Codex. Ontwikkelaars kunnen het aanroepen via de OpenAI API of AIHubMix.
Moet ik mijn code wijzigen om te upgraden van 6 Sol? Als je geen geen inspanningen gebruikt en geen tools aanroept via Chat Completions, is het meestal voldoende om alleen de modelnaam te wijzigen. Anders moet je overstappen naar de Responses API. Deel 4 heeft de details.
Blijf lezen: de GPT-6.1 Sol-serie
- Hoeveel bespaart goedkopere caching daadwerkelijk? Bij een agenttaak van 50 stappen kost 6.1 Sol 23% minder dan 6 Sol en minder dan een zesde van wat Astra kost. De volledige uitsplitsing staat in Wat GPT-6.1 Sol Echt Kost: Voorbij de $2 / $10 Prijslabel.
- Welke inspanning moet je uitvoeren na de upgrade? Hoog is genoeg om Astra bij te houden bij coderen. Ontdek wanneer max de moeite waard is in Kiezen van een Redeneringsinspanningsniveau voor GPT-6.1 Sol: laag tot max.
- Lees dit voordat je overstapt.
geenfouten, gebroken tooloproepen en nieuwe cachingregels: negen valkuilen en een checklist in Migreren naar GPT-6.1 Sol: 9 Dingen Die Fout Kunnen Gaan.



