Модель не знает ваши документы — она их вспоминает по кусочкам. Если поиск находит не тот кусочек, ответ уверенно врёт.

Качество RAG — это на 80% качество нарезки и поиска, и на 20% модель. Начинайте с простого: полный текст одного документа часто работает лучше модных векторных баз.

Всегда показывайте источники: пользователь сам проверит, а вы увидите, где поиск промахивается.