Kunstmatige intelligentie (Artificial Intelligence ofwel AI) is steeds meer onderdeel geworden van onze samenleving. Bewust en onbewust hebben we ermee te maken. Onbewust, als we bijvoorbeeld suggesties van bedrijven krijgen om bepaalde artikelen te kopen. Maar ook bewust, als we een vraag stellen aan AI-tools zoals ChatGPT en Claude. Niet zo gek dus dat steeds meer mensen AI gebruiken bij hun archiefonderzoek én om mails te schrijven over dit onderzoek. Ook het Nationaal Archief ontvangt steeds meer vragen over archiefonderzoek waarbij AI gebruikt is.
Informatie klopt niet altijd
Mensen gebruiken AI omdat zij daarmee snel een antwoord op hun vraag denken te krijgen. Bovendien bestaat het idee dat de informatie die AI geeft volledig en correct is. Dat is een misverstand. In de praktijk blijken AI-antwoorden lang niet altijd te kloppen. Big Tech noemt deze foute antwoorden ‘hallucinaties’. Een term die twijfelachtig is, omdat het suggereert dat AI menselijke eigenschappen heeft. Dat heeft het uiteraard niet. De hallucinaties komen juist voort uit de manier waarop AI technisch werkt. Maar daarover later meer.
Hoe herkent u een hallucinatie?
Het is belangrijk om hallucinaties te leren herkennen. Dat is lastig, omdat het antwoord van AI logisch klinkt. Toch zijn er antwoorden waarbij de alarmbellen moeten afgaan. Dat zijn vooral antwoorden die heel specifieke informatie bevatten, zonder bronvermelding. Als AI u precies kan vertellen in welk inventarisnummer de huwelijksakte van Jan Jansen uit 1712 te vinden is, dan kunt u beter voorzichtig zijn.
Een snelle manier om te checken of de informatie klopt, is om dezelfde vraag, anders geformuleerd, nogmaals te stellen. Dat doet u binnen een nieuw chatgesprek (let erop dat de informatie uit het eerdere chatgesprek niet gebruikt wordt). U kunt de vraag ook aan een ander AI-model stellen. Als het antwoord verandert is er een grote kans dat de tool aan het hallucineren is. Natuurlijk kunt u ook direct op de website van het archief controleren of het genoemde inventarisnummer inderdaad trouwaktes uit 1712 bevat. En of het genoemde archief op naam ontsloten is.
Mails schrijven met AI
Het Nationaal Archief ontvangt veel mails die zijn geschreven met AI. Vaak bevatten deze mails complete gesprekken met een AI-tool. Het kost medewerkers veel tijd om deze mails te lezen en te achterhalen wat nu de vraag aan het Nationaal Archief is. Ook kost het veel tijd om uit te zoeken welke informatie uit de mail klopt en welke informatie gehallucineerd is. De medewerkers van het Nationaal Archief kunnen u vaak beter én sneller helpen, als u zelf de mail schrijft en uitlegt wat u zoekt.
Daarnaast krijgt het Nationaal Archief in mails, geschreven met AI, vaak de vraag om informatie of documenten op te zoeken in openbare archieven. Hier kan het Nationaal Archief helaas niet mee helpen. De medewerkers van het Nationaal Archief doen geen onderzoek in de openbare archieven die het Nationaal Archief bewaart. Iedereen kan hier immers zelf in zoeken. Natuurlijk kunnen medewerkers wél altijd meedenken over de plek waar een document of informatie zich bevindt.
Waarom maakt AI veel fouten bij vragen over archiefonderzoek?
Heel simpel gezegd is een AI-tool een woordenvoorspeller. Als u een vraag stelt aan een AI-tool, dan analyseert de tool alle woorden in de vraag op verschillende niveaus. De tool kijkt bijvoorbeeld naar de plaats van een woord in een zin en naar de samenhang tussen de woorden. De tool weegt de woorden en geeft meer belang aan het ene woord dan aan het andere. Elk woord krijgt vervolgens een eigen cijfercode. Om een antwoord te kunnen geven op een vraag, berekent het AI-systeem op basis van de cijfercodes wat het meest logische volgende woord is in een antwoord. Om een goede berekening te maken kijkt de tool naar patronen die hij al eerder gezien heeft in de teksten, waarmee hij getraind is. Het checkt daarbij niet of zijn gegeven antwoord ook correct is.
Trainingsdata
De data waarmee AI-tools getraind worden variëren enorm in kwaliteit: het kan gaan om boeken en wetenschappelijke artikelen, maar ook om websites en social media-discussies. Een AI-tool zoekt alleen ‘live’ naar informatie op het internet, als het systeem dat nodig vindt (als er bijvoorbeeld naar recente informatie wordt gevraagd). Betaalde AI-tools zullen dat eerder doen dan gratis systemen.
Verzinsels
Een AI-tool kan dus ook foute antwoorden geven. Daarbij verzint de tool delen van een antwoord die hij niet uit zijn trainingsdata of van het internet kan halen. AI is namelijk wel getraind om volledige antwoorden te geven, maar niet om te erkennen dat het iets niet weet. Omdat AI zijn antwoord baseert op patronen, kan het minder goed antwoord geven op vragen waar het minder data over heeft. Heel specifieke informatie, zoals informatie over archiefstukken, herkent AI minder goed. Daarbij zijn veel data op websites van archieven niet goed toegankelijk voor AI-tools.
Toekomst
De ontwikkelingen op het gebied van AI gaan snel. Wellicht dat het mensen in de toekomst direct naar specifieke informatie in archieven kan leiden. Tot die tijd is het een hulpmiddel dat enige terughoudendheid vraagt. Gebruik het om ideeën te krijgen voor uw zoektocht, maar niet om een sluitend antwoord op uw vraag te krijgen.