
Ik ben de afgelopen weken behoorlijk veel aan het bouwen met AI. Vooral apps, dus ik zit bijna dagelijks in Codex en Claude.
En met Claude loop ik de laatste tijd steeds tegen hetzelfde irritante ding aan.
Ik werk met iOS 27, maar Claude Opus 5.5 komt nog verrassend vaak met instellingen of oplossingen voor iOS 26. Niet altijd, maar vaak genoeg dat ik eerst Claude zit bij te praten voordat ik verder kan met waar ik eigenlijk mee bezig was.
Sinds deze week grijp ik daarom steeds vaker naar GPT-6.1 Sol.
En dat bevalt verrassend goed.
Niet omdat ik ergens een benchmark heb gezien waarin Sol een paar procent beter scoort. Daar heb ik eerlijk gezegd steeds minder mee. Ik merk het vooral tijdens het werken. Sol voelt snel, pakt actuele documentatie beter op en ik hoef minder vaak dingen te corrigeren.
Maar terwijl ik daarmee bezig was, viel me iets anders op.
Sol is eigenlijk niet eens het interessantste AI-nieuws van deze week.
OpenAI kwam tijdens DevDay met Dots, Meta met Muse for Small Business en Codex kan taken nu in de cloud laten doorlopen terwijl jij alweer met iets anders bezig bent.
En daar begint AI voor mijn gevoel echt te veranderen.
Niet meer alleen een chatvenster waar je iets aan vraagt.
Maar iets dat een eigen computer heeft, toegang krijgt tot je software, zelfstandig verder werkt en pas weer bij je aanklopt als er echt een beslissing nodig is.
Volgens mij is dát de ontwikkeling om nu goed in de gaten te houden.
Waarom ik Sol nu vaker gebruik

OpenAI lanceerde GPT-6.1 Sol deze week voor complex programmeerwerk en ander professioneel werk.
Wat daarbij meteen opvalt, is de prijs.
Via de API kost Sol bij het standaardtarief 2 dollar per miljoen inputtokens en 10 dollar per miljoen outputtokens. Astra zit op 10 dollar input en 50 dollar output.
Astra is per token dus vijf keer zo duur.
Dat betekent natuurlijk niet dat iedere opdracht met Sol automatisch vijf keer goedkoper is. Een sterker model kan soms met minder stappen klaar zijn. Maar zodra je AI veel code laat lezen, grote hoeveelheden documenten laat verwerken of agents langere taken geeft, begint dat prijsverschil behoorlijk mee te tellen.
Zelf kijk ik daarom steeds minder naar de vraag welk model op papier “het beste” is.
Ik kijk vooral naar hoeveel werk ik er zelf nog aan heb.
Als Sol mijn opdracht goed begrijpt en ik daarna nauwelijks iets hoef te herstellen, heb ik weinig reden om automatisch Astra te pakken.
Mijn aanpak wordt voorlopig dus vrij simpel: Sol voor het meeste werk. Astra als het echt ingewikkeld wordt. En Claude daarnaast blijven gebruiken, want ik geloof niet dat één model overal het beste in is.
Claude Opus 5.5 werd trouwens ook goedkoper
Anthropic bracht vorige week Claude Opus 5.5 uit.
Volgens Anthropic presteert het bij veel werk ongeveer op het niveau van Claude Fable 5.1, terwijl een typische workload ongeveer 40 procent goedkoper zou moeten uitvallen dan met Opus 5.
Ook hier zou ik zelf niet te lang naar losse benchmarks of tokenprijzen staren.
Pak één echte opdracht die je goed kent. Geef exact dezelfde bestanden en instructies aan Sol en Opus en kijk daarna gewoon hoeveel je zelf nog moet aanpassen, hoe lang het duurde en waar het model de mist in ging.
Daar heb ik inmiddels veel meer aan dan aan een leaderboard.
Dots vind ik veel interessanter

OpenAI heeft deze week ook Dots uitgerold.
En eerlijk gezegd vind ik dit waarschijnlijk belangrijker dan Sol.
Een Dot is geen chatbot waar je steeds opnieuw een losse opdracht naartoe stuurt. Het is een AI-agent met een eigen computer in de cloud die kan blijven werken, gekoppelde apps kan gebruiken en onthoudt waar hij mee bezig is.
Je kunt hem dus echt iets geven dat langer loopt.
Onderzoek blijven doen. Een project volgen. Informatie uit verschillende systemen bij elkaar brengen. Of werk klaarzetten waar jij later alleen nog naar hoeft te kijken.
En als er iets gebeurt waar jouw beslissing voor nodig is, komt hij weer bij je terug.
Dat vind ik misschien nog wel het belangrijkste onderdeel.
Ik geloof namelijk niet zo in agents die onbeperkt alles mogen doen. Ik wil juist dat ze zoveel mogelijk uitvoerend werk overnemen, maar wel heel duidelijk weten wanneer ze moeten stoppen en mij erbij moeten halen.
Dots draaien op GPT-6 Astra en kunnen ook taken starten in onder andere Codex-cloudomgevingen.
Officieel is Dots nog niet beschikbaar voor particuliere gebruikers in de EU. Zelf heb ik er via een omweg inmiddels wel toegang toe. Dat voelt ergens ook wel typisch: echte tech freedom hebben we hier nog niet. Nieuwe AI-functies komen in Europa vaak later beschikbaar, terwijl de rest van de wereld er dan al mee aan het experimenteren is.
En daar heb ik eerlijk gezegd niet zoveel zin in. Ik wil niet maanden achterlopen op nieuwe technologie voordat ik überhaupt kan beoordelen of het iets waard is. Dus als ik iets eerder kan testen, doe ik dat graag. Juist om te zien wat er in de praktijk echt bruikbaar is en wat vooral mooie marketing is.
En Meta beweegt precies dezelfde kant op
Meta introduceerde deze week Muse for Small Business.
Wat ik daar vooral interessant aan vind, is niet eens de agent zelf. Het is waar hij allemaal bij kan.
Je kunt Muse koppelen aan onder andere Shopify, Klaviyo, HighLevel, Stripe, Slack, Notion, QuickBooks, Canva, Dropbox, Zoom en je Facebook- en Instagram-bedrijfsaccounts.
Dat begint ineens ergens op te lijken.
Een agent die alleen op internet kan zoeken is handig. Maar een agent die je webshop, e-mailmarketing, betalingen en interne communicatie begrijpt, begint echt onderdeel van je bedrijf te worden.
Meta heeft daar wel bewust een belangrijke grens ingebouwd: publiceren, versturen of geld uitgeven gebeurt niet zomaar zonder jouw goedkeuring.
En volgens mij is dat precies hoe dit soort agents moeten werken.
Zelfstandig waar het kan. Jou erbij halen zodra de gevolgen groter worden.
Voor Muse geldt eigenlijk hetzelfde. Officieel is het nog niet beschikbaar in de EU, maar ook Muse heb ik inmiddels via een omweg kunnen gebruiken. Niet omdat iedereen dat moet doen, maar omdat ik zelf niet wil wachten tot nieuwe technologie hier maanden later pas officieel wordt aangezet.
Voor e-commerce vind ik dit serieus interessant. Meta zit natuurlijk al op Facebook, Instagram en WhatsApp. Als daar straks een agent bovenop zit die ook Shopify, Klaviyo en Stripe begrijpt, hebben ze opeens een behoorlijk sterke positie.
Codex werkt nu gewoon door als jij weg bent

Deze update klinkt misschien wat kleiner, maar dit is er eentje waar ik zelf waarschijnlijk meteen iets aan heb.
Codex heeft nu cloudomgevingen waarin je je repository, dependencies, scripts en instellingen klaarzet. Daarna start je een taak en kan Codex gewoon verder werken, ook als je laptop dicht is.
Later kijk je vanaf je telefoon, browser of een andere computer hoe ver hij is. En als het nodig is, stuur je bij.
Dat klinkt simpel, maar het verandert behoorlijk hoe zo'n coding agent voelt.
Tot nu toe zit je er toch vaak een beetje naast. Je geeft iets door, kijkt mee en wacht op wat er gebeurt.
Dit voelt veel meer als echt delegeren.
Los dit op. Test het. Kom maar terug als je klaar bent.
Daar word ik persoonlijk veel enthousiaster van dan van alweer twintig procent betere codegeneratie.
OpenAI schuift ook samenwerking dichter naar AI toe
OpenAI rolt daarnaast Teams en Spaces verder uit in ChatGPT.
Het idee is simpel: je brengt mensen, context, bestanden en AI steeds meer bij elkaar in dezelfde werkomgeving.
Op papier klinkt dat een beetje als Notion of Google Drive met AI er middenin.
Ik wil het eerst echt gebruiken voordat ik er heel grote conclusies aan hang.
Maar ook hier zie je weer dezelfde richting. AI wordt minder iets waar je af en toe naartoe gaat voor een losse vraag. Het komt steeds meer midden in je dagelijkse werk te zitten.
Nog iets opvallends: YouTube wordt heel veel door AI gebruikt
Dan nog iets totaal anders wat deze week mijn aandacht trok.
Meltwater onderzocht in augustus ongeveer 7,3 miljoen bronvermeldingen in acht verschillende AI-platforms.
YouTube was daarin het meest geciteerde losse domein met ongeveer 212.500 vermeldingen. Reddit stond op twee en LinkedIn op drie.
Maar daar moet je wel één ding bij onthouden: niet iedere AI gebruikt dezelfde bronnen.
YouTube was vooral sterk bij Gemini, Google AI Mode, Google AI Overviews en Perplexity. In Meltwaters ChatGPT-sample zag je juist veel meer institutionele bronnen.
Dus nee, de conclusie is niet dat je een YouTube-video maakt en ChatGPT je vervolgens automatisch gaat citeren.
Zo simpel is het niet.
Maar ik vind het wel een extra reden om goede uitleg niet alleen als blog te publiceren.
Heb je een vraag die klanten steeds opnieuw stellen? Maak daar eens een goede video over. Geen gelikte bedrijfsvideo. Gewoon een duidelijke uitleg. Zorg dat titel, beschrijving en transcriptie kloppen en zet dezelfde informatie ook op je website.
Die content heeft sowieso waarde.
En als AI-systemen hem vervolgens ook als bron oppakken, is dat mooi meegenomen.
Prompt van deze week: geef een agent een echte verantwoordelijkheid
Als je agents wilt testen, zou ik niet beginnen met: “Schrijf deze e-mail.”
Dat kunnen we inmiddels wel.
Pak liever een taak die iedere week terugkomt en waar meerdere stappen in zitten.
Ik wil onderstaande terugkerende taak zoveel mogelijk aan een AI-agent delegeren.
De taak:
[vul in]
Zo voer ik deze taak op dit moment uit:
[vul in]
Deze informatie en software mag de agent gebruiken:
[vul in]
Dit mag de agent zelfstandig doen:
[vul in]
Voor deze beslissingen moet de agent altijd eerst mijn toestemming vragen:
[vul in]
Het gewenste eindresultaat:
[vul in]
Maak hier een duidelijke agent-opdracht van.
Bepaal:
1. Welke stappen de agent zelfstandig kan uitvoeren.
2. Welke informatie nog ontbreekt.
3. Wanneer de agent moet stoppen en mij om een beslissing moet vragen.
4. Hoe de agent controleert of het werk goed is uitgevoerd.
5. Welke vijf punten ik zelf achteraf moet controleren.
Gebruik actuele bronnen wanneer de taak afhankelijk is van actuele informatie.
Verzin geen gegevens.
Publiceer, verstuur, verwijder of betaal niets zonder mijn expliciete toestemming.Test hem daarna niet meteen op iets belangrijks.
Pak eerst een oude taak waarvan je zelf al weet wat de goede uitkomst was. Dan zie je heel snel waar je instructies nog rammelen.
Volgens mij verandert hier iets fundamenteels
Ik denk niet dat iedereen volgende maand ineens een digitale werknemer heeft die zijn hele bedrijf runt.
Daarvoor zie ik agents nog veel te vaak fouten maken.
Maar deze week voelt voor mij wel als een duidelijke volgende stap.
Sol en Opus worden goedkoper. Dots en Muse krijgen een eigen computer en toegang tot je software. Codex werkt door terwijl jij allang iets anders doet.
En daardoor verandert langzaam de belangrijkste vraag.
Niet meer: wat kan ik aan AI vragen?
Maar: welk werk durf ik aan AI over te laten?
Dat vind ik een veel interessantere vraag.
Ik ga Sol de komende weken in ieder geval veel meer gebruiken voor mijn eigen programmeerwerk. En met Dots en Muse wil ik vooral ontdekken waar het punt ligt waarop zo'n agent echt zelfstandig nuttig wordt, zonder dat je er alsnog de hele tijd naast moet blijven zitten.
Als jij al een agent echt zelfstandig werk laat uitvoeren, antwoord dan even op deze mail. Ik ben vooral benieuwd naar wat je inmiddels wél durft uit te besteden.
Groet,
Corné van Willigen
P.S. Ken je iemand die nog steeds denkt dat AI vooral een chatbot is? Stuur deze PromptKlaar dan even door.