Cataphora

Een taalkundig verschijnsel waarbij een woord vooruitwijst naar iets dat pas later in de tekst wordt genoemd, een uitdaging voor taalmodellen.

Wat is cataphora?

Cataphora is een taalkundig verschijnsel waarbij een woord vooruitwijst naar iets dat pas later in de zin of tekst wordt genoemd. Een voorbeeld: “Hoewel hij vaak koppig is, waardeert Jan een goed gesprek.” Het woord “hij” verwijst hier naar Jan, die pas daarna genoemd wordt. Het is het spiegelbeeld van anaphora, waarbij een woord juist terugverwijst naar iets dat al genoemd is.

Hoe werkt het in AI?

Taalmodellen moeten zulke verwijzingen correct oplossen om tekst echt te begrijpen. Dat heet coreference resolution: bepalen welke woorden naar dezelfde persoon of zaak verwijzen. Cataphora is daarbij lastiger dan terugverwijzen, omdat het systeem vooruit moet kijken: de betekenis van “hij” wordt pas duidelijk als de naam volgt. Moderne taalmodellen, gebouwd op de transformer-architectuur, kunnen dit goed omdat ze de hele zin tegelijk bekijken in plaats van woord voor woord.

Wat heb je eraan als bedrijf?

Voor de meeste bedrijven is dit achtergrondkennis. Maar het verklaart wel waarom AI-tools soms de mist ingaan bij lange of complexe teksten: wie “hij”, “zij” of “het” precies is, valt niet altijd eenduidig vast te stellen. Werk je met AI voor samenvatten, klantvragen of documentanalyse, dan helpt het om te weten dat heldere, ondubbelzinnige brontekst betere resultaten geeft.

Gerelateerde begrippen

Verwant zijn anaphora, disambiguation, parsing en computational linguistics.

Inbegrepen bij elke training

Je hele organisatie AI-geletterd?

Bij elke incompany training krijgt iedereen in je organisatie toegang tot de e-learning AI Geletterdheid. In 90 tot 120 minuten leert elke medewerker wat AI is, wat je ermee kunt en hoe je er veilig mee werkt. Per rol en sector, met certificaat, zoals de EU AI Act vraagt.

Bekijk de trainingen →