Astra en Fable 5.1: bijna AGI, en wat koop jij eraan?
GPT-6 Astra en Claude Fable 5.1 kwamen in dezelfde week uit. Enorm slim, Astra sterk in computer use, allebei duur. Wat betekent dat voor jouw KMO?
In één week kregen we twee nieuwe topmodellen: Claude Fable 5.1 van Anthropic op 1 september en GPT-6 Astra van OpenAI op 3 september 2026. Ze zijn allebei ongelofelijk slim, ze kunnen allebei uren zelfstandig doorwerken, en Astra is opvallend goed in het bedienen van een computer. Ze hebben ook hetzelfde nadeel: ze zijn duur. Voor een Belgische KMO is de vraag dus niet welk model het slimste is, maar welk werk zo'n prijs waard is.
Wat is er precies uitgekomen?
Claude Fable 5.1 is de opvolger van Fable 5, het model dat in juni tijdelijk onbeschikbaar was. Anthropic noemt het zijn beste model voor programmeren, kenniswerk en lange taken zonder toezicht. Het is meteen overal beschikbaar: in de Claude-app, via de API en op de clouds van Amazon, Google en Microsoft. Er is ook een Mythos 5.1, hetzelfde model met minder beperkingen, maar dat krijgen alleen gescreende Amerikaanse organisaties in cybersecurity en biowetenschappen.
GPT-6 Astra is OpenAI's nieuwe vlaggenschip. OpenAI presenteert het niet als een betere chatbot, maar als een model dat software bedient zoals een mens: in de browser, in spreadsheets, in gewone desktopprogramma's en in de terminal. Astra rolt eerst uit naar een beperkte groep organisaties en komt in de dagen erna naar ChatGPT Plus, Pro, Business en Enterprise en naar de API. Bij bedrijfsaccounts staat het standaard uit.
Hoe slim zijn ze nu echt?
Heel slim, en op verschillende vlakken. Een paar cijfers, vertaald naar gewone taal:
- Astra haalt 97,6% op FrontierMath Tier 4, de zwaarste laag van een wiskundetest op onderzoeksniveau. Fable 5.1 zit daar op 87,8%. Voor de meeste bedrijven is dat een curiositeit, maar het toont hoe ver we staan.
- Fable 5.1 verdubbelt de score op Terminal-Bench-Science, een test waarin het model zelfstandig wetenschappelijk werk in een computeromgeving uitvoert: van 24,7% bij Fable 5 naar 52,6%.
- Beide scoren hoog op OSWorld, een test waarin een model echte taken uitvoert op een computer. Astra haalt 72,6% en doet er per taak bijna de helft minder lang over dan zijn voorganger. Anthropic meldt 77,9% voor Fable 5.1, maar op een andere versie van de test, dus die twee cijfers mag je niet naast elkaar leggen.
Wat mij meer zegt dan de cijfers: klanten van Anthropic melden dat Fable 5.1 lang zonder toezicht kan doorwerken zonder de draad te verliezen. En OpenAI zegt dat Astra tijdens een lange taak notities bijhoudt en tussendoor een vraag kan stellen terwijl het aan iets anders verder werkt. Dat zijn precies de dingen die een AI van een handige tool naar een medewerker brengen.
Waarom is computer use bij Astra zo'n groot ding?
Computer use betekent dat de AI naar je scherm kijkt en zelf klikt en typt, zonder koppeling. We schreven er al over bij Codex en AI die je scherm overneemt. Het is nuttig voor software die geen API heeft: een oud boekhoudpakket, een leveranciersportaal, een overheidsloket.
Astra is daarin gewoon beter dan alles wat er was. Op ScreenSpot-Pro, een test die meet of het model het juiste knopje op een scherm vindt, haalt het 92,7% tegenover 87,3% voor Fable 5. Klinkt als een klein verschil, maar bij een taak van vijftig klikken maakt elke misklik het verschil tussen klaar en opnieuw beginnen. OpenAI bouwde het model duidelijk met dit doel: een AI die je computer gebruikt, niet enkel een AI die je vragen beantwoordt.
Concreet voor een KMO: een order overtypen van een webshop naar je ERP, facturen uit een portaal halen en in Excel zetten, of een reeks formulieren invullen op een site zonder export. Dat werk kon vorig jaar al, maar met veel fouten. Nu wordt het betrouwbaar genoeg om er echt op te rekenen. Test het wel eerst op iets waar een fout geen ramp is.
Zijn we nu bij AGI?
Greg Brockman van OpenAI vindt van wel. Hij sloot de voorstelling af met "Welcome to the AGI era" en zei dat, als we over een paar jaar terugkijken naar het moment waarop AGI ontstond, het waarschijnlijk rond dit model zal zijn. AGI staat voor artificial general intelligence: een AI die zowat elk denkwerk kan dat een mens kan. Anthropic gebruikt het woord bewust niet en spreekt over "de meest geavanceerde modellen voor programmeren en kenniswerk".
Mijn nuchtere lezing: de discussie over het label is voor de fabrikanten interessant, voor jou niet. Wat telt, is dat deze modellen nu een reeks taken zelfstandig afwerken die vorig jaar nog een mens nodig hadden. Ze maken nog fouten, ze hebben nog begeleiding nodig, en ze zijn nog lang niet in elke situatie beter dan een ervaren medewerker. Maar de vraag 'kan AI dit?' verschuift steeds vaker naar 'wil ik dit door AI laten doen, en wat kost het?'. Lees ook welk werk je aan AI geeft en welk niet.
Er is één ding dat me wel bezighoudt. Beide modellen tonen hun redenering niet meer. Bij Fable 5.1 krijg je hoogstens een samenvatting, bij Astra zit de redenering door een nieuwe techniek grotendeels verborgen in het model zelf. Dat maakt het moeilijker om te controleren waarom een model een beslissing nam. Voor een offerte is dat geen probleem. Voor een beslissing over een klant of een medewerker wil je dat wel kunnen uitleggen.
Wat kost dit?
Hier wordt het minder feestelijk. Beide modellen kosten 10 dollar per miljoen inputtokens en 50 dollar per miljoen outputtokens. Ter vergelijking: Claude Sonnet 5 kost 2 en 10 dollar, Claude Haiku 4.5 kost 1 en 5 dollar. Je betaalt dus vijf tot tien keer meer voor het topmodel.
De verschillen zitten in de details:
- Cache. Als een model dezelfde context vaak opnieuw leest, betaal je bij Fable 5.1 nog 0,25 dollar per miljoen tokens. Bij Astra is dat 1 dollar. Voor lange taken waar het model steeds dezelfde documenten herleest, tikt dat aan. Anthropic zegt dat Fable 5.1 daardoor voor typisch gebruik ongeveer 25% goedkoper is dan Fable 5, en tot 45% voor lange zelfstandige taken.
- Lange invoer. Bij Astra betaal je boven de 272.000 inputtokens het dubbele voor invoer en anderhalf keer voor uitvoer. Anthropic heeft die toeslag niet.
- Snelle modus. Astra heeft een fast mode aan het dubbele tarief.
Een rekenvoorbeeld voor computer use: elke stap stuurt een screenshot mee, en een taak van vijftig stappen leest al snel 200.000 tokens en schrijft er 20.000. Dat is ruwweg 2 dollar invoer plus 1 dollar uitvoer, dus zo'n 3 dollar per taak. Doe je dat vijftig keer per dag, dan zit je aan 150 dollar per dag. Voor een taak die een medewerker een half uur kost, is dat een prima deal. Voor een taak van twee minuten niet.
Wat betekent dit voor jouw bedrijf?
Een paar praktische regels die ik zelf hanteer:
- Gebruik het topmodel voor het moeilijke werk. Complexe analyses, lange documenten, code, taken die uren zelfstandig moeten lopen. Daar verdient de extra intelligentie zichzelf terug.
- Gebruik een goedkoop model voor de rest. Mails, samenvattingen, classificatie, chatbots. Sonnet of Haiku doet dat even goed voor een fractie van de prijs.
- Meet per afgewerkte taak, niet per token. Een duur model dat het in één keer juist heeft, is vaak goedkoper dan een goedkoop model dat drie keer opnieuw moet.
- Bouw je workflow zo dat je kunt wisselen. Deze week kwamen er twee topmodellen uit. Volgende maand zijn er weer andere. Zet je bedrijf niet vast op één merk.
- Wees voorzichtig met computer use op productiesystemen. Laat het eerst meekijken en voorstellen doen. Laat het pas klikken als je een paar weken gezien hebt wat het doet.
Gebruik je ChatGPT of Claude gewoon als abonnement? Dan krijg je deze modellen automatisch en merk je vooral dat antwoorden beter worden en dat lange taken vaker lukken. De kostenvraag speelt pas als je AI in je eigen processen inbouwt, en dan is de modelkeuze per taak het verschil tussen een rendabele en een dure automatisering. Studio Koko helpt daarbij met een AI-kickstart: we bekijken welk werk in aanmerking komt en welk model daar bij past.
Veelgestelde vragen
Welk model moet ik kiezen: Astra of Fable 5.1?
Voor computer use en zware wiskunde of wetenschap lijkt Astra vandaag de sterkste. Voor lange programmeertaken, lange zelfstandige workflows en een lagere kost per afgewerkte taak is Fable 5.1 de logischere keuze. In de praktijk kies je per taak, niet per merk.
Kan ik Astra al gebruiken in België?
Astra rolt uit naar ChatGPT Plus, Pro, Business en Enterprise en naar de API. Bij bedrijfsaccounts moet een beheerder het aanzetten. De versie voor gewone gebruikers weigert bepaalde vragen rond cybersecurity, omdat OpenAI het model als eerste als 'critical' op dat vlak heeft ingeschaald.
Is dit nu AGI?
OpenAI zegt van wel, Anthropic zegt het niet. Voor jouw bedrijf verandert het label niets. Kijk naar wat het model concreet voor jou afwerkt en wat dat kost.
Moet ik nu alles overzetten naar het nieuwste model?
Nee. Zet het topmodel in waar de foutkost hoog is of waar goedkopere modellen falen. Voor de rest blijft een goedkoper model de betere keuze.
Bronnen
- Introducing Claude Fable 5.1 and Claude Mythos 5.1, Anthropic, 1 september 2026
- GPT-6 Astra: A new generation of intelligence, OpenAI, 3 september 2026
- GPT-6 Astra modelpagina met prijzen, OpenAI
- OpenAI releases new model GPT-6 Astra, says it may represent AGI, Axios, 3 september 2026
- GPT-6 Astra vs Claude Fable 5.1: Benchmarks and Pricing, DataCamp