HeadlinesBriefing favicon HeadlinesBriefing.com

AI·rete·RAG : Moteur Rete + RAG pour IA auditable

Hacker News •
×

Salut HN, j'ai construit ai·rete·rag parce que je voyais sans cesse des équipes confier à un LLM des décisions qui doivent être auditables (prêts, fraude, triage clinique), puis ajouter des « garde-fous » après coup. Il exécute les deux en série : Un moteur Rete en Python pur évalue des règles YAML par rapport à vos faits. Le verdict provient uniquement de là. Mêmes faits, même verdict, à chaque fois, avec une résolution des conflits basée sur la saillance. 2. RAG récupère des passages de vos propres documents de politique, et un LLM rédige une explication en anglais simple de la décision déjà prise, en citant ces passages. Il ne peut pas changer le verdict.

Quelques choses qui sont allées plus loin que prévu : Les règles sont un graphe, pas des listes plates : all/any/not imbriqués, et les règles peuvent affirmer des faits que d'autres règles consomment (chaînage avant). La trace de décision montre la chaîne causale. Le mode audit enregistre chaque règle évaluée, y compris celles qui ne se sont pas déclenchées, condition par condition, avec un instantané de l'ensemble de règles pour la relecture. Les règles peuvent orienter la récupération (une règle déclenchée restreint les documents recherchés), et le texte récupéré peut être transformé en faits pour le moteur. Les auteurs non techniques peuvent construire des règles dans un éditeur visuel, ou coller un document de politique et obtenir des règles rédigées par LLM avec des citations. Les brouillons ne sont jamais enregistrés sans révision. YAML est toujours là pour les ingénieurs.

La page d'accueil propose une démo en direct sans inscription (8 domaines de démo : prêts, fraude, clinique, assurance, juridique, opérations, e-commerce, blockchain). Il y a aussi un serveur MCP, de sorte que Claude et d'autres agents peuvent appeler /decide comme un outil : uvx ai-rete-rag-mcp. Pour être transparent : c'est un produit hébergé avec un niveau gratuit. Le client MCP est open source (MIT, github.com/zaharajabeen13-create/ai-rete-rag-mcp) ; le moteur et la plateforme ne sont pas open source pour le moment. J'aimerais particulièrement entendre ceux qui ont dû expliquer une décision automatisée à un régulateur ou un auditeur : qu'ont-ils réellement demandé ?