Demandez à un LLM grand public de citer un numéro de pourvoi de la Cour de cassation ou un article précis du Code civil. Une fois sur trois, le modèle vous répondra avec une assurance parfaite en inventant une jurisprudence fictive.
L’hallucination n’est pas un bug. C’est le mode de fonctionnement normal d’un LLM probabiliste sans garde-fou.
En droit, une fausse jurisprudence a exactement la même apparence textuelle qu’une vraie. Mais en audience ou lors de la rédaction d’un acte, l’erreur est fatale.
L’architecture RAG Hybride (Retrieval-Augmented Generation) de Yevi Core v1.0 résout ce problème en forçant l’inférence à s’appuyer exclusivement sur vos pièces de dossier réelles avec vérification d’ancrage mathématique (is_grounded: true).
1. Pourquoi la recherche vectorielle pure échoue en droit
Section intitulée « 1. Pourquoi la recherche vectorielle pure échoue en droit »La plupart des systèmes RAG basiques utilisent une recherche vectorielle dense (Dense Embeddings). Bien qu’efficace pour saisir le sens général d’une phrase, elle échoue sur la rigueur du vocabulaire juridique :
- Insensibilité aux numéros d’articles : Un modèle vectoriel traite
Article 1231-1etArticle 1231-2comme quasi identiques sémantiquement, alors qu’ils régissent des mécanismes juridiques totalement distincts. - Terminologie exacte indispensable : En droit civil comme en droit OHADA, l’absence d’un mot-clé exact (ex: “résolution” vs “résiliation”, “nullité relative” vs “nullité absolue”) modifie radicalement l’issue d’un litige.
2. La solution Yevi Core v1.0 : fusion hybride BM25 + Dense (RRF)
Section intitulée « 2. La solution Yevi Core v1.0 : fusion hybride BM25 + Dense (RRF) »Pour atteindre une fidélité de 100 % sur les corpus juridiques, Yevi Core v1.0 combine deux moteurs de recherche complémentaires via l’algorithme Reciprocal Rank Fusion (RRF) :
graph TD Query["Question Juridique (ex: Article 66-5 ou Jurisprudence CCJA)"] --> BM25["1. Recherche Lexicale BM25 (Mots-clés & Numéros d'articles)"] Query --> Dense["2. Recherche Vectorielle Dense (Concepts Sémantiques)"] BM25 --> RRF["Fusion Reciprocal Rank Fusion (RRF)"] Dense --> RRF RRF --> Context["ChromaDB Top-K Chunks Sourcés"] Context --> GroundedLLM["Yevi Core v1.0 -> Réponse Sourcée [doc#passage]"]- Recherche lexicale BM25 : Capture les numéros de textes de loi, les références de pourvoi de cour d’appel et les termes stricts.
- Recherche vectorielle dense : Interprète les concepts sémantiques contextuels (“faute lourde”, “caducité du bail commercial”).
- Fusion RRF & Privacy Vault : Le module Privacy Vault protège les données identifiables avant qu’elles ne soient vectorisées dans la base locale ChromaDB.
- Secret professionnel garanti : Respect absolu du secret notarial (Art. 226-13 du Code Pénal) et de l’article 66-5 pour les avocats.
- Découpage sémantique optimisé (512 tokens) : Découpage adapté au tokenizer français pour ne transmettre au LLM que les paragraphes les plus pertinents sans saturer la fenêtre de contexte.
[!NOTE] Grâce au statut
is_grounded: true, chaque affirmation rédigée est accompagnée de son lien direct vers le paragraphe source. Si une information est absente du corpus fourni, Yevi refuse d’extrapoler.
3. Démonstration CLI avec Yevi Core v1.0
Section intitulée « 3. Démonstration CLI avec Yevi Core v1.0 »Grâce au CLI Yevi Core v1.0, vous pouvez vérifier l’ancrage strict des réponses sur vos pièces :
# Ingestion avec découpage sémantique juridiqueyevi ingest ./jurisprudence_ohada.pdf --chunk-size 512
# Interrogation avec vérification d'ancrage sourceyevi query "Quelles sont les conditions de validité d'une caution bancaire sous le droit OHADA ?" --strict-citationRésultat de la console : “La caution doit comporter la mention manuscrite du montant maximal garanti (Doc #2, Paragraphe 18). Statut de vérification :
is_grounded: true.”
4. Questions fréquentes
Section intitulée « 4. Questions fréquentes »Le RAG élimine-t-il 100 % des hallucinations ?
Section intitulée « Le RAG élimine-t-il 100 % des hallucinations ? »L’ancrage strict de Yevi Core v1.0 contraint le LLM à ne répondre qu’à partir des extraits fournis. Si l’information ne figure pas dans le dossier, Yevi répond formellement “Information non trouvée dans le corpus fourni” au lieu d’inventer une réponse plausible.
Quelle est la vitesse d’indexation d’Yevi Core v1.0 ?
Section intitulée « Quelle est la vitesse d’indexation d’Yevi Core v1.0 ? »Sur une Appliance YEVI-BOX avec accélération NPU/GPU, l’ingestion traite plus de 500 pages PDF à la minute en réseau local étanche.