Assistant RAG — recherche augmentée — POC IA
L'idée. Un LLM ne connaît pas mes documents. Le RAG lui donne accès à une base documentaire à jour, sans réentraînement, avec des réponses sourcées.
Ce que je prototype
- Ingestion & chunking de documents, génération d'embeddings.
- Recherche vectorielle avec pgvector (PostgreSQL), reranking.
- Orchestration LLM + contexte, citations et garde-fous anti-hallucination.
- API NestJS et intégration au socle auto-hébergé (voir LLM MLOps).
Stack
NestJS · pgvector · PostgreSQL · Embeddings · LLM · Docker
POC — prototype IA, non déployé en production.