Voie SQL
Les comptages, classements, entités connues et comparaisons structurées utilisent PostgreSQL. La réponse est reproductible et sa source explicite.
Étude de cas / Data civique + IA
Une interface publique vers l'activité parlementaire française, construite à partir d'archives statiques et conçue pour montrer l'origine de chaque réponse.


01 / Contrainte
L'Assemblée nationale publie ses données ouvertes sous forme d'archives ZIP statiques plutôt que via une API REST stable. MonÉlu transforme ces exports irréguliers en un produit reproductible : récupérer, parser, valider, charger, modéliser, servir et rafraîchir sans perdre la provenance.
02 / Moteur data
Le pipeline sépare acquisition, transformation, service et interface. Les reprises et upserts idempotents protègent l'ingestion ; dbt teste la couche analytique ; FastAPI reste sans état ; GitHub Actions maintient la production à jour.
03 / Moteur IA
MonÉlu ne demande pas à un modèle de langage d'improviser sur chaque question. Les questions déterministes passent par SQL. Les questions sémantiques récupèrent des preuves pertinentes via pgvector avant de générer une réponse en français.
Les comptages, classements, entités connues et comparaisons structurées utilisent PostgreSQL. La réponse est reproductible et sa source explicite.
Les questions ouvertes récupèrent des preuves indexées, exposent les passages disponibles et identifient le RAG comme source.
04 / Vision d'ingénierie
La confiance ne vient pas d'une prose soignée. Elle vient d'une recherche observable, de modèles testés, d'un routage explicite et d'un produit qui distingue les faits de la base des synthèses générées. Un score d'évaluation par mots-clés supérieur à 0,80 fournit une référence mesurable pour la qualité de recherche.
05 / Responsabilité
J'ai conçu et livré l'ingestion, les modèles dbt, la couche FastAPI, le routage SQL/RAG, la base d'évaluation et le produit web. L'objectif n'était pas une démo de chatbot, mais un système public dont le chemin de données reste inspectable.
Architecture produit, data engineering, recherche IA, conception API, déploiement et livraison de l'interface.
Le batch planifié correspond aux archives ZIP de l'Assemblée. Supabase et Railway réduisent l'exploitation tout en gardant des frontières de service claires.
Un produit bilingue en ligne, avec marts testés, routage explicite des réponses, rafraîchissement quotidien et qualité de recherche mesurable.