Document-classificatie is een onzichtbare basis-functionaliteit: zonder goede classificatie geen retentiebeleid, geen findability, geen sensitivity-labels. AI maakt classificatie schaalbaar zonder dat een dossierbeheerder elk stuk leest.

Taxonomie eerst, model daarna

Een goede classifier hangt op een goede taxonomie. Wij valideren met u welke categorieen er zijn (factuur, contract, HR-dossier, projectdoc) voordat we het model trainen. Te veel categorieen geeft slechte precisie; te weinig geeft te grove indeling.

Few-shot vs fine-tune

Voor 5 tot 15 categorieen werkt few-shot prompting met een sterk LLM (GPT-4-class) goed genoeg. Voor 50+ categorieen of voor zeer specifieke domein-taal werkt fine-tuning beter (en goedkoper per call). De keuze hangt af van schaal en budget.

Sensitivity labels en AVG

Documenten met persoonsgegevens of vertrouwelijke business-data automatisch labelen via Microsoft Purview of een eigen layer. AI verlaagt de drempel voor labels-uitrol substantieel. AVG-compliance verbetert nadat classificatie kwantitatief de norm wordt.

Continuous learning

Per maand een steekproef labelen en het model bijscholen. Document-types verschuiven (nieuwe contractsoort, nieuwe leverancier-formats); een model dat niet bijleert verouderde drift binnen een jaar.

Hoe wij dit voor u realiseren

Wij richten de automatische classificatie in op uw eigen documentstromen, zodat inkomende post, mails en bestanden vanzelf op de juiste plek en bij het juiste proces terechtkomen. We zorgen dat twijfelgevallen naar een medewerker gaan in plaats van fout te worden weggezet, zodat u kunt vertrouwen op de uitkomst. Zo verdwijnt het handmatig sorteren en sneller doorzetten.

Aan de slag

Een werkende opzet op uw eigen documenten leveren we doorgaans binnen enkele weken. We werken met een vast dagtarief of een projectprijs. In een gesprek kijken we welke documentstroom de meeste tijd kost en zich het beste leent.

Verwant: Senior AI consultant, AI PDF extractie.