Door Marcel Mutsaarts
DOT en de toekomstige interface met onze digitale wereld

This image was created with Codex
Afgelopen dinsdag was de zogenaamde DevDay van OpenAI. Hier introduceerde het bedrijf ruim 20 nieuwe dingen voor ontwikkelaars. De belangrijkste ervan, DOT, is de aanleiding voor dit artikel. DOT is een persoonlijke AI-assistent binnen ChatGPT waaraan je werk kunt overdragen.
De bijzondere stap is dat DOT boven de afzonderlijke gesprekken en projecten staat waarin je je werk organiseert. In ChatGPT en Codex werk je bijvoorbeeld aan een artikel, bereid je een training voor en bouw je aan je website. Elk project heeft zijn eigen gesprekken, bestanden en lopende taken. DOT kan de context uit de projecten waartoe je hem toegang geeft samenbrengen en het werk daar aansturen. Je krijgt daarmee één aanspreekpunt voor het geheel.
Je kunt met DOT bespreken hoe je werk ervoor staat, wat prioriteit heeft en waar iets moet veranderen. Vanuit dat gesprek kan hij het werk in de betreffende projecten laten voortzetten en informatie uit het ene project betrekken bij het andere. Een inzicht uit het artikel kan bijvoorbeeld aanleiding zijn om ook de training en de website aan te passen. De samenhang die je nu zelf tussen al die gesprekken moet bewaren, kan zo onderdeel worden van het werk van je assistent.
Meta introduceerde begin september al Muse, en Grok Bot verscheen in augustus. Bij verschillende bedrijven zien we zo de ontwikkeling naar blijvende persoonlijke assistenten. Volgens mij wordt hiermee een veel grotere verandering zichtbaar. Deze assistenten kunnen de manier waarop wij toegang hebben tot onze hele digitale wereld gaan veranderen.
Wat DOT anders maakt
Om te begrijpen hoe ver dat gaat, helpt het om de eigenschappen even bij elkaar te zetten. In de beschrijving van DOT komen verschillende mogelijkheden samen die elkaar versterken.
- DOT is 24/7 beschikbaar. Je werkt met een blijvende assistent die tussen gesprekken door actief kan blijven en lopend werk kan volgen.
- Hij kan context uit verschillende projecten, gesprekken en gekoppelde toepassingen samenbrengen. Daardoor kan hij verbanden leggen tussen werkzaamheden die jij op verschillende plekken hebt georganiseerd.
- Hij is proactief. Hij kan zelf iets signaleren, bedenken wat een zinvolle volgende stap is en met voorstellen komen zonder dat jij daar eerst om hebt gevraagd.
- Hij heeft een eigen computer in de cloud. Werk dat daar draait, kan doorgaan wanneer jouw laptop dicht is. Zijn werkomgeving blijft beschikbaar terwijl jij iets anders doet.
- Je kunt met hem typen en praten. Het ‘bellen’ met je assistent is een voicegesprek, waarin je het werk bespreekt en opdrachten geeft. Zo kun je tijdens een wandeling of een autorit over je projecten overleggen.
Vooral die combinatie vind ik belangrijk. Een assistent die kan praten, maar niets van je lopende werk weet, blijft beperkt. Een assistent die het overzicht heeft, maar voor iedere handeling op jou wacht, vraagt nog steeds veel aansturing. Hier komen overzicht, initiatief en de mogelijkheid om daadwerkelijk iets uit te voeren bij elkaar. Het gesprek wordt de manier waarop je dat geheel aanstuurt.
Je assistent wordt de toegang tot je digitale werk
Als ik deze ontwikkelingen bij elkaar leg, is dit volgens mij de richting waarin die bedrijven bewegen: de AI-assistent wordt het enige aanspreekpunt dat je nodig hebt voor je digitale werk. Je bespreekt wat je wilt bereiken en de assistent zoekt uit welke toepassingen en handelingen daarvoor nodig zijn.
Dat gaat veel verder dan het bedienen van ChatGPT. Agents kunnen ook in een browser en in andere toepassingen werken. Daardoor kunnen ze werk uitvoeren op de plekken waar jij nu zelf naartoe gaat. Je mail, agenda en documenten komen binnen bereik van hetzelfde gesprek. De assistent kan een opdracht door verschillende programma's heen uitvoeren.
Neem het organiseren van een afspraak met een school. Nu lees je een mail, zoek je eerdere afspraken op en bekijk je je agenda. Daarna stel je een antwoord op en voeg je misschien nog een document toe. Bij iedere stap ga je zelf naar de juiste toepassing en neem je informatie uit de vorige stap mee.
In de manier van werken die ik voor me zie, bespreek je met je assistent wanneer je die school kunt bezoeken en wat er vooraf nodig is. De assistent betrekt de eerdere correspondentie en je agenda erbij, doet een voorstel en zet de benodigde stukken klaar. Je bekijkt het resultaat en spreekt af wat er verstuurd mag worden. De samenhang tussen die handelingen zit in het gesprek met je assistent.
De afzonderlijke apps verliezen daarmee hun rol als plek waar jij heen moet om iets gedaan te krijgen. Het mailprogramma en de browser kunnen op de achtergrond gebruikt blijven worden. Jij hoeft hun interface niet meer te bedienen. Hetzelfde geldt voor allerlei andere software: de assistent wordt degene die ermee werkt en jij communiceert met de assistent.
Daarmee verandert ook wat je moet weten om iets gedaan te krijgen. Je hoeft minder te weten waar een functie zit en welke reeks handelingen nodig is. Je moet duidelijk kunnen maken wat je bedoelt en kunnen beoordelen of de uitvoering daarbij past. Die bedoeling kun je tijdens het gesprek samen verder uitwerken.
Waarom zou de laptop centraal blijven staan
Wanneer je die gedachte doortrekt, verandert ook de rol van het apparaat waarmee je werkt. Een laptop met een toetsenbord is logisch wanneer je zelf door programma's navigeert en daarin je werk uitvoert. Maar als je vooral met een assistent overlegt die het werk elders doet, valt een belangrijke reden weg om daarvoor steeds achter een laptop te gaan zitten.
Spraak maakt die verandering heel concreet. Tijdens een wandeling kun je bespreken hoe de voorbereiding van een training ervoor staat. De assistent kan je vertellen wat er nog openstaat, een voorstel voorleggen en op basis van jullie gesprek verder werken. Je hoeft op dat moment geen bestanden te openen of tussen vensters te wisselen. Het werk gaat na afloop van het gesprek verder op zijn computer in de cloud.
Het apparaat dat je bij je draagt, hoeft dan vooral het contact met je assistent mogelijk te maken. Dat kan je telefoon zijn, maar ook een apparaat dat voor deze manier van werken wordt ontworpen. Meta heeft inmiddels Muse voor zijn AI-brillen en een apart apparaatje, Muse Charm, aangekondigd. Daarin zie ik dezelfde beweging: de assistent gaat met je mee, los van de plek waar je normaal achter een computer zit.
Ik verwacht dat spraak daarbij de belangrijkste manier van bedienen wordt. Een gesprek maakt het gemakkelijk om een bedoeling uit te leggen, op een voorstel te reageren en iets bij te sturen. Je kunt een gedachte ontwikkelen terwijl je assistent de informatie erbij haalt en aan de uitvoering werkt. De afstand tussen bedenken wat je wilt en ermee aan de slag gaan, wordt zo kleiner.
Alleen praten is niet genoeg
Er zit wel een duidelijke grens aan een interface die uitsluitend op spraak steunt. Sommige dingen wil je kunnen zien. Als ik een belangrijke mail verstuur, wil ik de precieze formulering lezen. Bij een artikel wil ik tussen alinea's kunnen terugkijken en de opbouw overzien. Een afbeelding moet ik bekijken en bij een video wil ik beoordelen hoe beeld en geluid samenkomen.
Een assistent die alles voorleest of beschrijft, maakt dat werk omslachtiger. Als je drie versies van een openingsalinea vergelijkt, helpt het dat ze naast elkaar staan. Je kunt een zin opnieuw lezen zonder te hoeven vragen of de assistent hem nog een keer uitspreekt. Het scherm biedt een overzicht waar je zelf in kunt kijken, in je eigen tempo.
Dat brengt mij bij mijn voorspelling. Ik verwacht een apparaat waarbij het contact met je persoonlijke AI-assistent centraal staat. Je praat ermee, en wanneer je iets wilt bekijken, verschijnt het op een scherm. Je leest een voorgestelde mail, bekijkt een ontwerp of speelt een video af. Vervolgens vraag je om een aanpassing of keur je het resultaat goed. Typen blijft beschikbaar wanneer dat beter uitkomt.
Op dat scherm hoeft geen vertrouwd bureaublad te staan met programma's die je zelf opent. Het toont wat je op dat moment nodig hebt om verder te kunnen. Een tekst als je aan een tekst werkt, een planning als je afspraken wilt bekijken. Bij Grok Bot zie je al hoe interactieve onderdelen in het gesprek verschijnen. De vorm van het antwoord past zich aan het werk aan.
Spraak wordt in dat beeld de belangrijkste bediening en het scherm de plek om te bekijken, aan te wijzen, te veranderen en te beslissen. Voor de gebruiker vormt dat één samenhangende omgeving. De assistent regelt welke software erachter nodig is.
Wat dit voor het onderwijs betekent
Voor het onderwijs betekent dit volgens mij dat we digitale vaardigheid opnieuw moeten bekijken. Leerlingen voorbereiden op digitaal werk kan steeds minder samenvallen met leren hoe je een verzameling programma's bedient. Ze moeten leren samenwerken met een assistent die voorstellen doet en werk uitvoert op basis van hun bedoeling.
Daarvoor zijn vakkennis en het vermogen om helder te communiceren in ieder geval belangrijk. Een leerling moet kunnen uitleggen wat het resultaat moet bereiken, herkennen waar een voorstel tekortschiet en de aanpak bijstellen. Bij een presentatie gaat het bijvoorbeeld om de vraag of het verhaal begrijpelijk en overtuigend is voor het publiek. De plek van een knop in de presentatiesoftware wordt minder bepalend voor wat die leerling kan maken.
Ik ben heel benieuwd hoe jullie dat zien, zeker als je kijkt naar de huidige (lees: net vernieuwde) SLO kerndoelen digitale geletterdheid. Ik heb hier recentelijk al een uitgebreid artikel over geschreven.
Terug naar Nederland en mijn eigen ervaring
Bovenstaande is mijn analyse van de richting waarin dit beweegt. Hoe snel dat gaat, durf ik eerlijk gezegd niet te voorspellen.
Voorlopig is DOT in Nederland alleen via een VPN te gebruiken. Ik werk er inmiddels een halve week mee en heb mijn assistent Vigo genoemd. Mijn laptop heeft Vigo nog niet vervangen. Ook blijf ik zelf in afzonderlijke projecten werken, omdat ik er nog onvoldoende op vertrouw dat Vigo het geheel goed overziet en uitvoert.
Praten met Vigo bevalt wisselend. Soms werkt het prettig, maar vaak voelt de reactie traag en sluit het gesprek onvoldoende aan op mijn denktempo. Of zo’n vrolijk wezentje de uiteindelijke vorm moet zijn, weet ik ook niet. Voor mij hoeft dat in ieder geval niet.
Ik zie hierin vooral een product dat nog moet groeien. De richting die ik hierboven beschrijf, blijft voor mij overeind. Hoe prettig en betrouwbaar deze manier van werken wordt, zal de verdere ontwikkeling moeten laten zien. Gezien het tempo waarin AI zich ontwikkelt, vermoed ik dat we daar sneller achter komen dan we nu denken.
