Modules
Document Intelligence / OCR
Extraction de texte et champs depuis des documents.

À quoi sert Document Intelligence / OCR

Ces modules servent à extraire des informations depuis des documents (PDF, images) : texte, champs clés, tableaux, et parfois une structure exploitable.

Cas d’usage

  • Extraction de champs (factures, contrats, identifiants).
  • Numérisation et recherche plein texte.
  • Pré-remplissage de formulaires.

Workflow recommandé

  1. Importez un document.
  2. Lancez l’analyse (OCR / extraction).
  3. Vérifiez les champs extraits sur un échantillon.
  4. Exportez ou alimentez un dataset.

Bonnes pratiques

  • Utilisez des scans propres (bonne résolution, contraste).
  • Conservez le document original pour audit.

Dépannage

  • Mauvaise qualité OCR : améliorez la qualité d’image ou changez le format source.
  • Champs manquants : adaptez le modèle/les règles d’extraction si disponibles.