Een lokale RAG bouwen voor complexe semantische teksten: wanneer cloud-AI faalt en MiniLM breekt op filosofie
Een ontwikkelaar vertelt over het bouwen van een lokale RAG-pijplijn voor filosofische teksten van Jane Roberts, met behulp van multilingual-e5-large embeddings en Qwen2.5 via LM Studio. Het project omvat gegevensvoorbereiding, mark-up, chunking en retrieval. De auteur zoekt gemeenschapsfeedback over Chroma-indexarchitectuur, dialoogstatusbeheer en het gebruik van rerankers.
Sentence-Transformers (UKPLab)
LM Studio
Habr — хаб ИИ30.07 · 15:01
