Lecture OCR des contrats — pipeline
Le pipeline générique de lecture des contrats : du PDF aux données structurées.
Brouillon
Page en cours de rédaction — squelette généré automatiquement.
À documenter
- Pipeline : PDF → OCR (Mistral) → Classify → Embed (Qdrant) → Extract → Pact
- Étapes
ContractProcessingStep/BdoProcessingStep - Jobs
Contract/Process* - Classification RAG (exemples similaires)
- Aperçu des 4 types (BDO, COED, CCOEM, PREF)
Sources à réutiliser
clartt-api/documentation/ImportContracts.md,refonte-pdf.md,clartt-kent-ai/app/core/constants.py