Cinq étapes, aucune sortie réseau. Sélectionnez votre rôle ci-dessous pour comprendre l'architecture selon vos priorités et vos contraintes opérationnelles.
Une même architecture souveraine, trois grilles de lecture ajustées à vos enjeux de conformité, d'infrastructure et d'intégration.
Vos actes, contrats et données de santé restent hébergés exclusivement sur votre réseau ou votre serveur privé souverain. Aucune donnée n'est envoyée vers des API tierces ni réutilisée pour entraîner des modèles.
Le module d'anonymisation remplace automatiquement les identifiants (noms, IBAN, numéros de sécurité sociale) avant indexation. Les clés de pseudonymisation sont chiffrées en AES-256-GCM et stockées uniquement en mémoire RAM volatile.
Chaque réponse générée indique la page, le paragraphe et le document exact d'où provient l'information. Un registre d'audit append-only garantit la traçabilité complète en cas de contrôle réglementaire.
Conteneurisation Docker / Podman déployable en mode air-gapped (100 % hors-ligne) ou sur hyperviseur souverain (OVHcloud, Scaleway, Outscale). Aucune dépendance externe ni appel réseau sortant.
Indexation ChromaDB combinant la recherche exacte par mots-clés (BM25) et la recherche sémantique vectorielle. La fusion RRF garantit une précision maximale sur les termes métiers et abréviations.
Le moteur d'anonymisation opère en mémoire volatile sans persistance des jetons PII sur disque. Optimisé pour tourner efficacement sur puces NPU/CPU multi-cœurs comme sur GPU Nvidia.
Intégration rapide via des routes REST prévisibles : /, /anonymize, /ingest, /query, /audit. Payloads JSON strictly typés et documentés sous norme OpenAPI.
Briques logicielles entièrement modulaires : basculez entre Ollama, Mistral, Qwen ou Gemma par simple variable d'environnement sans modifier une seule ligne de code applicatif.
Boucle de raisonnement-action ReAct autonome pour décomposer les requêtes complexes multi-documents. Support natif du découpage sémantique paramétrable (.pdf, .docx, .txt, .md).
Ce tableau décrit l'implémentation actuelle du dépôt Yevi. Les briques non encore écrites portent la mentionroadmap.
Extraction OCR et parsing des documents bruts locaux.
Masquage des PII (Noms, IBAN) avant indexation.
Embeddings stockés dans un Vector Store On-Premise.
Génération RAG avec des modèles Open Source locaux.
Réponse avec traçabilité garantie vers l'origine.
Roadmap :. Qdrant, vLLM et l'OCR d'ingestion figurent dans les intentions du projet mais ne sont pas dans le code aujourd'hui. Ils sont listés comme tels surCode & POC.
Trente minutes pour cadrer votre volume de données, votre cadre réglementaire et votre stade projet.
Réserver un audit