Wat is syntax tagging?
Syntax tagging is het automatisch toekennen van grammaticale labels aan woorden in een tekst. Het bekendste voorbeeld is part-of-speech tagging: elk woord krijgt een label als zelfstandig naamwoord, werkwoord of bijvoeglijk naamwoord. In de zin “De snelle kat rent” wordt dat: de (lidwoord), snelle (bijvoeglijk naamwoord), kat (zelfstandig naamwoord), rent (werkwoord). Zo leert een computer de grammaticale structuur van een zin kennen.
Hoe werkt het?
De tekst wordt eerst opgesplitst in losse woorden of tokens. Daarna bepaalt een algoritme per woord het juiste label, op basis van de context. Het woord “loop” is immers soms een werkwoord (“ik loop”) en soms een zelfstandig naamwoord (“de loop van een rivier”). Vroeger gebeurde dit met statistische modellen en handgemaakte regels; moderne systemen gebruiken neurale netwerken die context veel beter meewegen. Grote taalmodellen doen dit soort analyse impliciet, zonder aparte tagging-stap.
Wat heb je eraan als bedrijf?
Syntax tagging is een bouwsteen onder veel taaltechnologie die je dagelijks gebruikt: spellingcontrole, vertaalsoftware, zoekmachines en tekstanalyse-tools. Je past het zelden zelf toe, maar als je tools inzet voor sentimentanalyse of documentverwerking, draait er onder de motorkap vaak dit soort grammaticale analyse. Voor de meeste bedrijven is dit achtergrondkennis.
Gerelateerde begrippen
Syntax tagging is vrijwel synoniem aan part-of-speech tagging en is een onderdeel van parsing, het analyseren van de volledige zinsstructuur. De eerste stap is altijd tokenisatie, uitgelegd bij tokens.
Je hele organisatie AI-geletterd?
Bij elke incompany training krijgt iedereen in je organisatie toegang tot de e-learning AI Geletterdheid. In 90 tot 120 minuten leert elke medewerker wat AI is, wat je ermee kunt en hoe je er veilig mee werkt. Per rol en sector, met certificaat, zoals de EU AI Act vraagt.
Bekijk de trainingen →