Part-of-Speech Tagging

Part-of-speech tagging is het automatisch labelen van elk woord in een zin met zijn woordsoort, zoals zelfstandig naamwoord of werkwoord. Een basisstap in taalverwerking.

Wat is part-of-speech tagging?

Part-of-speech tagging (POS-tagging) is het automatisch labelen van elk woord in een zin met zijn woordsoort: zelfstandig naamwoord, werkwoord, bijvoeglijk naamwoord, lidwoord, enzovoort. In de zin “De kat zit op de mat” krijgt “kat” het label zelfstandig naamwoord en “zit” het label werkwoord. Het is een van de basisstappen in natuurlijke taalverwerking (NLP).

Hoe werkt het?

De tekst wordt eerst opgeknipt in losse woorden. Daarna bepaalt het systeem per woord de woordsoort, waarbij de context doorslaggevend is: “vliegen” is in “de vliegen zoemen” een zelfstandig naamwoord, maar in “wij vliegen morgen” een werkwoord. Vroege taggers werkten met handgeschreven regels, latere met statistische modellen die zijn getraind op grote hoeveelheden gelabelde tekst. Moderne taalmodellen hebben deze kennis impliciet aan boord en hebben geen aparte POS-tagger meer nodig.

Wat heb je eraan als bedrijf?

POS-tagging is vooral achtergrondkennis: het zit verstopt in tools die je al gebruikt, zoals grammaticacontrole, zoekmachines en vertaalsoftware. Voor de meeste bedrijven is het geen techniek om zelf in te zetten, maar het verklaart wel hoe software taal kan analyseren in plaats van alleen letters vergelijken.

Gerelateerde begrippen

POS-tagging is een bouwsteen van parsing en werkt op het niveau van tokens. Verwante technieken zijn lemma-bepaling en morphological analysis.

Inbegrepen bij elke training

Je hele organisatie AI-geletterd?

Bij elke incompany training krijgt iedereen in je organisatie toegang tot de e-learning AI Geletterdheid. In 90 tot 120 minuten leert elke medewerker wat AI is, wat je ermee kunt en hoe je er veilig mee werkt. Per rol en sector, met certificaat, zoals de EU AI Act vraagt.

Bekijk de trainingen →