InvestigaciónHardware e Inferencia 🇷🇺 05.08.2026 18:01

RAG Agéntico, el Benchmark TRuST y Qué Tiene que Ver Nafanya con Ello

DeepSeekDeepSeek
Nafanya es un asistente RAG agéntico para documentación de construcción y precios. El autor adaptó el benchmark TRuST para probarlo, logrando una mejora en las métricas mediante cambios arquitectónicos.
Nafanya es un asistente RAG agéntico para documentación normativa y técnica en construcción y presupuestos, desarrollado por Nikolai. Utiliza una arquitectura multiagente con un planificador, recuperador, evaluador, generador y crítico. Para probar sus capacidades de búsqueda, el autor adaptó el benchmark TRuST, que contiene 324 preguntas complejas en ruso que requieren búsqueda en varios pasos. Inicialmente, el sistema obtuvo una puntuación baja, pero al introducir CoverageCritic y optimizar la arquitectura, Recall All mejoró de 0,25 a 0,45 y la corrección de respuestas del 34% al 56%. Posteriormente, se añadió un Final Critic, y el sistema utiliza APIs externas como Qwen y DeepSeek. El autor señala que TRuST se basa en la metodología BrowseComp-Plus e incluye un índice fijo y varios tipos de complejidad de búsqueda.
Fuente: Habr — хаб ИИ — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas