Construire un RAG local pour des textes sémantiques complexes : quand l'IA cloud échoue et que MiniLM échoue sur la philosophie
Un développeur raconte la construction d'un pipeline RAG local pour des textes philosophiques de Jane Roberts, utilisant les embeddings multilingual-e5-large et Qwen2.5 via LM Studio. Le projet comprend la préparation des données, le balisage, le découpage en chunks et la récupération. L'auteur sollicite les retours de la communauté sur l'architecture de l'index Chroma, la gestion de l'état du dialogue et l'utilisation du reranker.
Sentence-Transformers (UKPLab)
LM Studio
Habr — хаб ИИ30.07 · 15:01
