Données, Ingestion & Base de Données
La fiabilité de CLAIR repose sur une chaîne d'ingestion robuste qui transforme des flux hétérogènes (JSON, XML, CSV, dumps SQL, pages HTML, arrêtés ministériels) en un modèle unifié et cohérent stocké dans PostgreSQL.
📑 Sommaire de la Section
Sources Open Data
Inventaire des flux officiels : Assemblée nationale, Sénat, HATVP et ministère de l'Intérieur.
Orchestrateur d'Ingestion
Déroulement pas à pas du batch nocturne, du batch intraday et de la gestion de la fraîcheur (ETag).
Commandes CLI
Répertoire complet des commandes de synchronisation, d'audit, de rattachement et de calcul de statistiques.
Qualité des Données
Règles de cohérence, seuils de tolérance, contrôles d'intégrité et audits automatisés.
Enrichissement IA
Modèles souverains Mistral AI, prompts structurés, vulgarisation législative et garde-fous anti-hallucination.
Modèle Prisma
Catalogue des 39 tables relationnelles, conventions de nommage et cycle de vie des mandats.
Schémas ERD
Diagrammes Entité-Relation interactifs de la base de données PostgreSQL.