Passer au contenu
Français - France
  • Il n'y a aucune suggestion car le champ de recherche est vide.

Pourquoi mon PDF est mal lu

La lecture automatique des documents PDF (bons de livraison, bons de commande, etc.) permet d'extraire rapidement les informations essentielles pour le traitement de vos flux logistiques. Il arrive toutefois que le moteur de lecture renvoie des données erronées ou mal positionnées. Cet article vous aide à identifier ces anomalies et à les corriger efficacement.

Introduction

La lecture automatique des documents PDF (bons de livraison, bons de commande, etc.) permet d'extraire rapidement les informations essentielles pour le traitement de vos flux logistiques. Il arrive toutefois que le moteur de lecture renvoie des données erronées ou mal positionnées. Cet article vous aide à identifier ces anomalies et à les corriger efficacement.

Le problème rencontré

Plusieurs types d'erreurs peuvent survenir lors de l'extraction automatique des données d'un PDF :

  • Destinataire mal placé ou absent : le nom du destinataire existe bien dans le document, mais il n'est pas repris dans le bon champ.
  • Nom du destinataire dupliqué ou déformé : un nom peut être répété ou collé (par exemple, un nom composé qui se retrouve accolé sans espace, puis répété).
  • Adresses tronquées : une partie de l'adresse n'est pas reprise.
  • Numéro de document mal intégré : le numéro de bon de livraison lu ne correspond pas à celui figurant sur le document.
  • Mentions manquantes : certaines valeurs (contremarques, mentions particulières, champs « autres ») ne sont plus reprises.
  • Quantités incorrectes : les quantités sont multipliées de façon erronée (par exemple, la quantité multipliée deux fois par le nombre de colis par palette au lieu d'une seule).

Ces erreurs proviennent généralement d'une évolution de la mise en page du document, d'un modèle de lecture non adapté, ou d'un champ mal reconnu par le moteur.

La solution étape par étape

Suivez ces étapes pour signaler et faire corriger une erreur de lecture :

  1. Identifiez précisément l'anomalie. Notez le champ concerné (destinataire, adresse, numéro de document, quantité, mention…) et la nature de l'erreur.
  2. Comparez avec le document source. Vérifiez ce que contient réellement le PDF d'origine et ce que le système a extrait. Cela permet de confirmer s'il s'agit d'une erreur de lecture ou d'une donnée manquante dans le document.
  3. Conservez le PDF concerné. Gardez le fichier d'origine tel qu'il a été transmis, sans le modifier.
  4. Décrivez l'écart attendu / obtenu. Indiquez clairement la valeur correcte attendue et la valeur erronée obtenue.
  5. Transmettez la demande au support. Joignez le PDF concerné et votre description afin que le modèle de lecture puisse être analysé et ajusté.
  6. Validez la correction. Une fois l'ajustement effectué, contrôlez sur un nouveau document que les données sont désormais correctement extraites.
Conseils et bonnes pratiques
  • Signalez rapidement toute anomalie : si une erreur touche un type de champ, elle concerne souvent l'ensemble des documents du même format.
  • Fournissez toujours un exemple de PDF : un cas concret facilite grandement l'analyse et la correction.
  • Précisez si l'erreur est systématique ou ponctuelle (« cela concerne tous les documents » vs « un seul cas »).
  • Vérifiez la stabilité de vos modèles de documents : un changement de mise en page côté émetteur peut suffire à perturber la lecture.
  • Documentez la valeur attendue plutôt que de décrire uniquement le symptôme.
Exemples
  • Destinataire mal positionné : le nom du destinataire figure bien sur le document, mais apparaît dans le champ adresse au lieu du champ destinataire.
  • Nom dupliqué : un nom composé est lu en version accolée puis répété ; il convient de faire corriger la reconnaissance du champ.
  • Numéro de document erroné : la référence lue ne correspond pas à celle inscrite sur le bon ; le champ à lire doit être réajusté.
  • Quantité multipliée en trop : la quantité est calculée avec un multiplicateur appliqué deux fois ; la règle de calcul doit être corrigée pour n'appliquer le facteur qu'une seule fois.
FAQ

Pourquoi certaines mentions ne sont-elles plus reprises ?

Cela peut résulter d'un changement de format du document ou d'un champ non reconnu. Signalez le cas avec un exemple pour permettre l'ajustement du modèle.

L'erreur touche-t-elle tous mes documents ?

Si l'anomalie provient du modèle de lecture, elle concerne généralement tous les documents de même format. Précisez-le dans votre demande.

Dois-je modifier mon PDF ?

Non. Transmettez le fichier d'origine tel quel : c'est le modèle de lecture qui sera ajusté.

Conclusion

Les erreurs de lecture PDF sont généralement corrigibles en ajustant le modèle d'extraction. En identifiant précisément l'anomalie, en fournissant un exemple de document et en décrivant la valeur attendue, vous permettez une correction rapide et durable. N'hésitez pas à contacter le support en cas de doute.