"Ze trainen hun model met jouw data." Je hebt het vast gehoord. Maar wat betekent dat eigenlijk, trainen met jouw data? Want de meeste mensen die dit roepen, weten ook niet hoe dat werkelijk in elkaar zit. En als je het niet begrijpt, kun je ook geen goede keuzes maken.
Als mensen zeggen "ze trainen hun model met jouw data", kan het gaan over drie heel verschillende dingen. Het is nuttig om die uit elkaar te halen.
Opslag. Zodra jij iets intypt in een publieke AI-tool als ChatGPT, gaat die tekst naar servers van de aanbieder. Die informatie wordt daar bewaard, in elk geval tijdelijk. Hoe lang, voor welk doel en onder welke voorwaarden: dat staat in de gebruikersovereenkomst die je bij aanmelding hebt gelezen (toch? ;-) ).
Verbetering van de dienst. Veel aanbieders gebruiken gesprekken om hun systemen te verbeteren. Dat betekent niet automatisch dat jouw tekst letterlijk in een volgend model terechtkomt, maar je input wordt wel geanalyseerd en kan worden meegenomen in hoe de tool zich verder ontwikkelt. Bij de meeste grote aanbieders kun je dit uitzetten. Dat is een opt-out. Je moet er zelf actie voor ondernemen.
Daadwerkelijke modeltraining. Dit is het meest technische deel. Een taalmodel wordt getraind op enorme hoeveelheden tekst. Jouw individuele gesprekken worden niet direct als bouwsteen gebruikt op de manier zoals mensen dat vaak voorstellen. Alsof jouw vraag over je klant morgen in het antwoord aan iemand anders opduikt. Zo werkt het niet. Maar je data kan wél bijdragen aan patronen die het model leert herkennen, en de grens is voor buitenstaanders moeilijk te controleren.
Het verschil tussen deze drie dingen is groot. Maar in de praktijk maakt dat onderscheid voor jou als ondernemer minder uit dan je misschien denkt. Want het echte risico zit ergens anders.
Wat er wél toe doet
De kern van het probleem is simpel: informatie die je in een publieke AI-tool stopt, verlaat je organisatie. Die gaat naar servers in de Verenigde Staten, valt onder Amerikaanse wetgeving, en wordt verwerkt door een bedrijf waarover jij geen zeggenschap hebt.
Dat is op zich niet per se rampzalig. Voor een samenvatting van een artikel dat je online vond, of het bedenken van een naam voor een intern project: prima. Maar voor klantgegevens, contracten, financiële cijfers, interne procedures of personeelsinformatie ligt dat anders. Niet omdat het model morgen jouw klantenbestand gaat rondbazuinen, maar omdat je de controle over die informatie bent kwijtgeraakt zodra je op Enter drukt.
En zonder de juiste afspraken is dat lastig te rijmen met de AVG. Iets wat de meeste organisaties zich niet realiseren.
Wat je eraan kunt doen
Het antwoord is niet "gebruik geen AI". Het antwoord is: weet wat je doet en maak bewuste keuzes.
Een praktische vuistregel: zou je deze informatie in een e-mail naar een onbekende sturen? Nee? Dan hoort het ook niet in een publieke AI-tool.
Een tweede check: gebruik je een persoonlijk of een zakelijk account? De meeste mensen loggen in met hun eigen e-mailadres en dus een persoonlijke account. Zakelijke versies van dezelfde tools hebben andere voorwaarden. Je data wordt er doorgaans niet voor training gebruikt, er is een verwerkersovereenkomst, en de verantwoordelijkheid ligt duidelijker. Dat is een betekenisvol verschil.
Maak intern afspraken over wat wel en niet in tools als ChatGPT mag. Dat hoeft geen ingewikkeld beleidsdocument te zijn. Twee A4'tjes die de lijn duidelijk maken, zijn al meer dan de meeste organisaties hebben.
En kijk naar alternatieven. Er zijn AI-oplossingen die werken met jouw eigen data, op jouw eigen omgeving of onder contractuele garanties over hoe je data wordt behandeld. Die bestaan, zijn betaalbaar en zijn niet ingewikkelder in gebruik dan de publieke tools.
Het begint met begrijpen
De discussie over "modeltraining" is terecht, maar schiet zijn doel voorbij als niemand precies weet waar het over gaat. Als jij als directeur begrijpt hoe het werkelijk in elkaar zit, kun je je team een helder kader geven. Geen angst, geen verbod, maar een verstandige aanpak.
Schrijf je in voor onze nieuwsbrief
In onze nieuwsbrief verzamelen we de beste updates over AI en de toepassing daarvan in organisaties. Wij maken de samenvatting, jij kiest wat je helemaal wilt lezen.