Gebruik jij AI om binnenkomende aanvragen te sorteren? Dan wil je bijvoorbeeld weten of een bericht naar verkoop of naar support moet. Wat mij betreft is dat een prima taak om eens te kijken of het sneller en goedkoper kan.
TypeSafe heeft daar een nieuw model voor aangekondigd: Jev. Hieronder leg ik uit hoe dat werkt en waar ik bij een eerste test op zou letten.
Verder: OpenAI komt met AI voor juridisch werk, en een Amerikaans onderzoek laat zien hoe chatbots aankoopbeslissingen kunnen beïnvloeden. Inclusief een prompt waarmee je je eigen takenlijst kunt nalopen.
In deze nieuwsbrief
Jev: een aanvraag meteen naar de juiste afdeling
TypeSafe AI kondigde op 15 september Jev aan. Je legt vooraf vast welke uitkomsten mogelijk zijn. Het model geeft zo'n uitkomst terug, met informatie over hoe zeker het daarvan is. De introductie is via early access.
Stel: er komt een aanvraag binnen. Je wilt weten of het een verkoopvraag, een supportvraag of spam is. Jev is bedoeld voor dit soort keuzes, zodat software daarna de volgende stap kan uitvoeren.
Volgens TypeSafe kost de invoer $0,042 per miljoen tokens, de stukjes tekst waarmee het model rekent. Voor de uitvoer rekent het bedrijf geen aparte kosten. Het noemt reactietijden van 70 tot 500 milliseconden. Dat zijn leverancierscijfers; de snelheid in jouw eigen toepassing moet je testen.
Ik zou beginnen met aanvragen waarvan je de juiste afdeling al weet. Laat het model kiezen en vergelijk de antwoorden. Neem ook berichten mee die onduidelijk zijn of twee vragen tegelijk bevatten.
Een antwoord in het juiste formaat kan inhoudelijk nog steeds fout zijn. Spreek dus af welke aanvragen iemand zelf moet bekijken voordat je de opvolging automatiseert.
Astra for Law: betere bronnen voor juridisch werk
OpenAI kondigde op 17 september Astra for Law aan. Het combineert GPT-6 Astra met juridische instructies en hulpmiddelen, waaronder een zoekindex met meer dan 230 miljoen URL's rond Amerikaans recht.
OpenAI testte de complete inrichting op 200 Amerikaanse juridische onderzoeksvragen. Bij de hoogste redeneerinstelling haalde die op 54% van de vragen de correctheidscheck, tegenover 38,7% voor GPT-6 Astra met alleen webzoeken.
Dat is een verbetering binnen die test. Het betekent ook dat een flink deel de controle niet haalde. Ik zou hier dus vooral op letten hoe een jurist de bronnen en conclusies kan nakijken.
Volgens de aankondiging krijgen geselecteerde kantoren eerst toegang via het Trusted Access-programma. De API volgt later. Voor Nederlandse ondernemers is dit geen kant-en-klare oplossing voor vragen over Nederlands recht.
Wat ik er wel uit haal: vraag bij een AI-tool voor jouw vakgebied welke bronnen hij gebruikt en hoe je die kunt controleren. Denk bijvoorbeeld aan een antwoord op basis van jouw actuele voorwaarden. Je wilt kunnen terugzien op welke passage dat antwoord is gebaseerd.
Wat vertelt een chatbot over jouw aanbod?
Exploding Topics ondervroeg in juli 2.338 volwassenen in de Verenigde Staten. Semrush publiceerde de resultaten op 7 september. Van de ondervraagde AI-gebruikers zei ongeveer 65% productzoekopdrachten in Google deels of helemaal te hebben vervangen door gesprekken met chatbots.
Bij respondenten die minstens wekelijks AI gebruiken, zei ongeveer 74% ooit iets te hebben gekocht op basis van een AI-aanbeveling. Ongeveer 70% had juist weleens van een aankoop afgezien na AI-advies.
Dit zijn antwoorden uit een Amerikaanse enquête, geen gemeten aankopen of Nederlandse marktpercentages. Maar ik vind het wel een goede aanleiding om te controleren wat een chatbot over jouw bedrijf vertelt.
Stel eens een vraag die een klant ook zou stellen. Bijvoorbeeld: “Wat kost [jouw dienst] bij [jouw bedrijf], en wat zit daarbij inbegrepen?” Vraag om bronlinks en open die ook. Kloppen de bedragen? Worden er dingen beloofd die jij helemaal niet aanbiedt?
Zie je verouderde informatie op je eigen website, pas die dan aan. Duidelijke informatie geeft geen garantie dat een chatbot je aanbeveelt. Je kunt er wel voor zorgen dat klanten op je eigen site het juiste verhaal vinden.
Welke taak zou jij als eerste testen?
Pak een paar terugkerende taken uit je bedrijf. Denk aan aanvragen verdelen, gegevens uit een formulier overnemen of een eerste antwoord op een klantvraag schrijven. Met deze prompt kun je bepalen waar een kleine proef zinvol is.
Bekijk onderstaande taken uit mijn bedrijf.
Geef per taak:
- Welke informatie nodig is.
- Wat de gewenste uitkomst is, met een concreet voorbeeld.
- Of vaste regels mogelijk al voldoende zijn, of dat AI het onderzoeken waard is.
- Hoe ik met bestaande voorbeelden kan controleren of de uitkomst klopt.
- Welke fouten kunnen ontstaan en wanneer iemand moet meekijken.
Leid uit een kort antwoord niet af dat de taak eenvoudig is.
Adviseer geen specifiek model zonder testresultaten.
Als informatie ontbreekt, stel daar een vraag over.
Verzin geen taken.
Mijn taken:
[plak hier je takenlijst, zonder klantgegevens]Kies daarna één taak die weinig schade veroorzaakt als er iets fout gaat. Test met voorbeelden waarvan je het antwoord kent en houd bij wat goed en fout gaat, hoeveel tijd het kost en wat je betaalt. Daarmee kun je beoordelen of het voor jouw bedrijf bruikbaar is.
Welke terugkerende klus zou jij als eerste willen aanpakken? Antwoord gerust op deze mail met een voorbeeld.
Groet,
Corné van Willigen
P.S. Ken je een ondernemer die hier iets aan heeft? Deel PromptKlaar via de knop hieronder.