Модель не знает ваши документы — она их вспоминает по кусочкам. Если поиск находит не тот кусочек, ответ уверенно врёт.
Качество RAG — это на 80% качество нарезки и поиска, и на 20% модель. Начинайте с простого: полный текст одного документа часто работает лучше модных векторных баз.
Всегда показывайте источники: пользователь сам проверит, а вы увидите, где поиск промахивается.
Пока нет комментариев. Будьте первым!