Le travail pourrait commencer par un échantillon représentatif et une définition des champs à extraire. Un prototype classerait les documents, proposerait les informations utiles et signalerait les cas à revoir. Les résultats seraient vérifiés avant toute connexion aux outils métier, avec une attention aux accès et aux données utilisées.