Membangun RAG Lokal untuk Teks Semantik Kompleks: Saat AI Cloud Gagal dan MiniLM Rusak pada Filsafat
Seorang pengembang menceritakan pengalamannya membangun pipeline RAG lokal untuk teks-teks filosofis karya Jane Roberts, menggunakan embedding multilingual-e5-large dan Qwen2.5 melalui LM Studio. Proyek ini mencakup persiapan data, penandaan, pemotongan, dan pengambilan. Penulis mencari masukan komunitas tentang arsitektur indeks Chroma, manajemen status dialog, dan penggunaan reranker.
Sentence-Transformers (UKPLab)
LM Studio
Habr — хаб ИИ30.07 · 15:01
