
Définir la sortie attendue avant de choisir l’outil
Un extracteur de factures peut produire un tableau impressionnant tout en confondant le sous-total, les taxes et le montant à payer. Avant même de lui fournir un document, définissez les champs dont votre processus a réellement besoin. Pour une PME québécoise, la fiche minimale pourrait contenir le fournisseur, le numéro de facture, la date, la devise, le numéro de commande, le sous-total, la TPS, la TVQ, le total, la mention de crédit et le numéro de page où chaque donnée apparaît. Fixez aussi le format. Les dates peuvent suivre la forme année-mois-jour, les montants conserver deux décimales et les champs absents recevoir la valeur « information absente ». Cette dernière règle est importante : une case vide doit signifier que l’outil n’a rien trouvé, et non qu’il a oublié de répondre. Demandez enfin une indication de provenance pour chaque valeur. Un montant sans page ni zone de référence sera plus difficile à vérifier lorsqu’une facture comporte plusieurs totaux, acomptes ou soldes antérieurs.
Composer un lot qui ressemble aux vrais documents
Un test constitué de cinq PDF impeccables mesure surtout la capacité de lire des PDF impeccables. Préparez plutôt un jeu étalon de 30 documents représentatifs. Par exemple : 10 factures numériques propres, 8 numérisations légèrement inclinées, 6 photos prises au téléphone, 4 notes de crédit et 2 doublons. Ajoutez des documents de plusieurs pages, des tableaux serrés, des caractères accentués, des numéros de commande incomplets et des montants affichés avec une virgule décimale. Le lot doit également reproduire vos difficultés locales : fournisseurs francophones et anglophones, présence séparée ou combinée de la TPS et de la TVQ, adresses québécoises, factures en dollars canadiens et américains. Si les véritables pièces sont confidentielles, fabriquez des exemples fictifs contenant les mêmes structures et défauts visuels, sans reprendre de noms, d’adresses ni de numéros réels. Conservez une copie intacte du lot. Tous les outils et toutes les nouvelles versions devront affronter exactement les mêmes fichiers.
Produire une feuille de réponses indépendante
L’IA ne doit pas créer elle-même la référence qui servira à la noter. Deux personnes devraient lire les 30 documents et remplir manuellement un tableau de réponses. Lorsqu’elles ne sont pas d’accord, elles retournent à l’image originale et consignent la décision. Ce tableau devient la référence officielle du test. Ajoutez une colonne par champ attendu, puis une colonne distincte pour la page ou la zone de provenance. Déterminez les règles de comparaison avant l’essai. Le numéro de facture doit généralement correspondre exactement. Une date doit représenter la bonne journée, même si son format est ensuite normalisé. Pour un montant, une différence de 0,01 dollar peut être tolérée si elle provient uniquement d’un arrondi défini. En revanche, inverser la TPS et la TVQ demeure une erreur, même si leur somme est correcte. Les notes de crédit doivent aussi conserver leur signe négatif ou un indicateur explicite empêchant leur traitement comme une facture ordinaire.
Mesurer plus qu’un pourcentage global
Exécutez l’extraction sans corriger les résultats pendant le traitement. Comparez ensuite chaque valeur à la feuille de réponses. Avec 30 factures et 10 champs par facture, vous obtenez 300 points de comparaison. Si 279 champs sont exacts, le taux global atteint 93 %. Ce chiffre reste toutefois incomplet : une faute dans une adresse n’a pas le même effet qu’un total transformé de 1 240,00 dollars en 12 400,00 dollars. Calculez donc trois résultats. Le premier est l’exactitude par champ. Le deuxième est le nombre de documents entièrement exacts : si seulement 24 factures sur 30 ne demandent aucune correction, ce taux est de 80 %. Le troisième est le nombre d’erreurs critiques, notamment un mauvais fournisseur, un doublon non détecté, une devise erronée, une taxe mal attribuée ou un total incorrect. Examinez enfin les résultats par type de fichier. Un score élevé sur les PDF peut masquer un échec systématique sur les photos de téléphone, précisément celles que votre équipe reçoit le plus souvent.
Décider du rôle de l’IA et refaire le test
Les seuils doivent venir du risque acceptable dans votre organisation, pas d’une promesse commerciale. Une équipe peut, par exemple, exiger au moins 95 % d’exactitude globale, aucune erreur critique et au moins 90 % de documents entièrement exacts avant d’autoriser un projet pilote. Si l’outil échoue, ne modifiez pas le jeu étalon pour améliorer son résultat. Corrigez plutôt la qualité de numérisation, les consignes, le format de sortie ou la méthode de validation. Même après un bon résultat, l’IA ne doit pas nécessairement transmettre seule les écritures au système comptable. Elle peut d’abord préremplir les champs, signaler les valeurs incertaines et envoyer les exceptions à une personne. Les totaux élevés, les nouveaux fournisseurs, les notes de crédit et les doublons possibles peuvent toujours exiger une vérification humaine. Relancez les mêmes 30 documents après chaque changement de modèle, de fournisseur, de consigne ou de chaîne de traitement. Ajoutez ensuite les cas réels ayant causé une erreur, après les avoir anonymisés. Le jeu étalon deviendra ainsi un contrôle de régression adapté à vos factures, à vos taxes et à votre façon de travailler au Québec.





