2026 · Lead Developer · organisme public (via Caisse des Dépôts)
Plateforme de traitement automatique de documents
Automatiser un processus d'instruction documentaire jusque-là entièrement manuel. Un projet du secteur public à grande échelle, piloté en position de lead.
Projet en cours, non encore annoncé publiquement : par confidentialité, le client et le contexte métier ne sont pas détaillés ici. Seuls les aspects techniques sont présentés.
Le contexte
Un traitement reposant sur une instruction manuelle, document par document : chronophage et difficile à mettre à l'échelle. L'objectif : le transformer en une chaîne automatisée capable de résorber un backlog important puis d'absorber, en continu, plusieurs millions de documents par an.
La chaîne de traitement IA
OCR / ICR
Reconnaissance de caractères y compris manuscrits, au-delà de l'OCR imprimé classique.
Classification documentaire
Détermination automatique de la nature et de la conformité des pièces reçues.
Matching des données
Rapprochement entre les valeurs extraites des documents et des données de référence, pour valider ou écarter chaque dossier.
Orchestration
Un orchestrateur séquence les étapes de chaque dossier et pilote plusieurs processus en parallèle, de bout en bout.
L'architecture : événementielle et généralisable
Passage à une architecture événementielle où chaque microservice agit de façon décorrélée du reste. Chaque service expose deux modes de transport : une API REST sécurisée par une façade d'authentification, et un consumer Kafka écoutant sur son propre topic. Un orchestrateur dirige les étapes de chaque dossier et gère plusieurs processus.
Le projet s'inscrit dans un socle documentaire : les microservices ont été conçus pour être adaptables et généralisables à d'autres processus, avec un soin particulier porté à la conception pour favoriser la réutilisation.
Mes réalisations
- Développement quasi from scratch de l'ensemble des microservices, et adaptation d'un orchestrateur existant pour déployer le POC au plus vite.
- Migration du legacy vers Docker et Kubernetes.
- Migration de la CI/CD de Bitbucket · Jenkins vers GitLab.
- Mise en place du BAM métier (Business Activity Monitoring) : d'abord via les flows de logging sur Kubernetes, puis bascule vers un sidecar Filebeat
- Documentation, mise en production, définition de la DoD / DoR.