This website uses cookies

Read our Privacy policy and Terms of use for more information.

Drie grote AI-updates in een paar dagen. OpenAI, Google en Anthropic kwamen allemaal met nieuwe modellen. Je zou bijna een dagtaak hebben aan het bijhouden ervan.

Maar wat heb je er als ondernemer aan? De belangrijkste verandering: AI wordt beter in het uitvoeren van een hele opdracht. Denk aan informatie uitzoeken, een spreadsheet bijwerken of een presentatie maken.

Een hoge score op een test zegt daarbij niet alles. Hoe goed is het eindresultaat? Hoeveel moet je zelf nog nakijken? En wat kost het om de klus echt af te krijgen?

Deze week kijken we naar GPT-6 Astra, Gemini 3.8 en Claude 5.1. Met één vraag in ons achterhoofd: welk werk kun jij er makkelijker mee afronden?

Hoofdverhaal: GPT-6 Astra maakt werk af

OpenAI presenteerde op 3 september GPT-6 Astra. Volgens het bedrijf is dit zijn krachtigste model dat op grote schaal beschikbaar is. Astra kan werken met websites, software, documenten, spreadsheets en presentaties.

Dat gaat verder dan een antwoord typen. Het model kan informatie opzoeken, gegevens aanpassen, softwareproblemen onderzoeken en zakelijke documenten opleveren.

In de OSWorld-test, een nagebootste computeromgeving, behaalde Astra volgens OpenAI betere resultaten dan GPT-5.6 Sol en had het ongeveer 47% minder tijd nodig.

Ook op het gebied van digitale beveiliging is Astra krachtig. In een test zonder de gebruikelijke veiligheidsmaatregelen vond en benutte het twee nog onbekende kwetsbaarheden. OpenAI deelt het daarom in zijn hoogste categorie voor cybervaardigheden in: Critical. Dat kan helpen om systemen veiliger te maken, maar vraagt om duidelijke grenzen.

Astra wordt beschikbaar in ChatGPT. Bedrijven kunnen het model ook in hun eigen programma's laten inbouwen. Voor die technische koppeling, de API, betaal je op basis van gebruik: $10 per miljoen tokens die je aanlevert en $50 per miljoen tokens die het model teruggeeft. Tokens zijn kleine stukjes tekst. Dit zijn dus geen prijzen voor een ChatGPT-abonnement.

Wat betekent dit voor jou? Laat Astra bijvoorbeeld een klantgesprek voorbereiden: bedrijfsinformatie opzoeken, de belangrijkste punten verzamelen en een korte presentatie maken. Jij kijkt het resultaat na en scherpt het aan. Kost die voorbereiding je normaal een uur en ben je nu met tien minuten nakijken klaar? Dan heb je vijftig minuten gewonnen. Zo ontdek je of AI je echt werk uit handen neemt.

Gemini 3.8: meer kunnen voor een lagere prijs

Google bracht Gemini 3.8 Flash uit, slechts drie weken na versie 3.7. Het is al de derde Flash-update in zes weken.

Flash is bedoeld voor programmeerwerk, uitgebreide analyses en AI-assistenten die zelfstandig meerdere stappen uitvoeren. Bij een lastige opdracht kan het model langer doorwerken en hulpmiddelen vaker gebruiken, in plaats van meteen een antwoord te geven.

De introductieprijs voor de API blijft $0,75 per miljoen invoertokens en $3,75 per miljoen uitvoertokens.

Daarnaast is er Gemini 3.8 Flash Cyber. Deze versie helpt beveiligingsspecialisten om kwetsbaarheden te vinden en te repareren. Alleen vertrouwde partijen krijgen toegang via het Fairwind-programma van Google DeepMind.

Wat betekent dit voor jou? Een goedkoper model kan ook geschikt zijn voor grotere klussen. Test wel of het jouw opdracht goed afmaakt en wat de totale kosten zijn.

Claude 5.1: goedkoper doorwerken aan lange opdrachten

Anthropic bracht Claude Fable 5.1 en Claude Mythos 5.1 uit. Onder de motorkap is het hetzelfde model, maar de veiligheidsgrenzen verschillen. Fable is breed beschikbaar voor programmeerwerk en werk met informatie. Mythos geeft vooraf beoordeelde specialisten in digitale beveiliging en biowetenschappen meer ruimte.

Voor ondernemers zit een belangrijk verschil in de kosten. AI leest bij een lange opdracht vaak dezelfde informatie opnieuw. Die informatie kan tijdelijk worden bewaard in een cache, zodat het model die voordeliger kan hergebruiken.

Dat opnieuw lezen is nu 75% goedkoper: $0,25 per miljoen tokens. Volgens Anthropic kost een doorsnee Fable-opdracht daardoor ongeveer 25% minder. Bij taken die veel informatie hergebruiken en vaak hulpmiddelen inzetten, kan de besparing oplopen tot ongeveer 45%.

Ook herkenbaarheid van AI-tekst speelt mee. Anthropic meldt dat de uitvoer van Claude-modellen die na 2 augustus zijn uitgebracht een onzichtbaar tekstwatermerk bevat, in het kader van de transparantieregels van de Europese AI Act. Een hulpmiddel om dat watermerk te herkennen is voorlopig beperkt beschikbaar voor geselecteerde organisaties.

Wat betekent dit voor jou? Vergelijk bij lange opdrachten ook de kosten voor hergebruik van informatie, veiligheidsinstellingen, bewaartermijnen voor gegevens en regels die voor jouw bedrijf gelden.

Probeer dit: geef modellen dezelfde opdracht

Kies één terugkerende klus uit je eigen werk. Geef de modellen die daarvoor geschikt zijn dezelfde informatie en dezelfde opdracht. Zo vergelijk je iets waar je echt wat aan hebt.

Gebruik bijvoorbeeld deze opzet:

Mijn opdracht is: [beschrijf één concrete klus].
Gebruik deze informatie: [voeg de benodigde informatie toe].
Het resultaat is goed als: [noem je eisen].
Lever dit op: [beschrijf het gewenste eindresultaat].
Geef duidelijk aan welke informatie ontbreekt of onzeker is.
Voer geen acties buiten deze opdracht uit.

Noteer daarna hoe goed het resultaat is, hoeveel je moest aanpassen en wat de klus in totaal kostte.

Houd zelf de regie

Een AI-assistent die zelfstandig stappen uitvoert, wordt ook wel een agent genoemd. Hoe meer zo'n assistent kan, hoe belangrijker het is om vooraf af te spreken wat hij mag doen.

  • Begin met één afgebakende taak. Maak vooraf duidelijk wanneer het werk goed genoeg is.

  • Geef alleen de toegang die nodig is. Niet meteen tot al je bestanden en systemen.

  • Laat belangrijke acties eerst goedkeuren. Zeker als ze gevolgen hebben voor klanten, geld of systemen waar je bedrijf op draait.

Van vraag naar afgeronde klus

AI helpt steeds vaker bij meerdere stappen van het werk.

Dit neem je mee uit de drie updates

  • GPT-6 Astra: interessant voor ingewikkeld werk in verschillende programma's. Bepaal vooraf welke acties het mag uitvoeren.

  • Gemini 3.8 Flash: een goedkoper model dat ook langere opdrachten aankan. Controleer of het jouw klus betrouwbaar afrondt.

  • Claude 5.1: lagere kosten voor het hergebruiken van informatie kunnen vooral bij lange opdrachten verschil maken.

De kern: kies eerst je klus

Je hoeft niet te bepalen welk AI-model overal de beste in is. Begin bij het werk dat jij gedaan wilt krijgen.

Laat geschikte modellen dezelfde echte opdracht uitvoeren. Vergelijk het eindresultaat, de tijd die je kwijt bent aan nakijken en de totale kosten. Dat vertelt je meer dan een ranglijst.

Kies deze week één terugkerende klus en probeer het uit. Klein beginnen maakt snel duidelijk wat AI jou oplevert.

Groet,
Corné van Willigen

P.S. Hieronder staat een knop om de PromptKlaar nieuwsbrief te delen met je vrienden, deel de link en krijg toegang tot onze AI assistenten!