Если RAG находит вроде бы правильный документ, но отвечает неточно или обрывочно — в девяти случаях из десяти дело не в модели и не в эмбеддере, а в том, каким по размеру получился кусок текста, который система отдала модели как контекст. Слишком маленький чанк обрубает мысль на середине, слишком большой — топит нужную строчку в потоке постороннего текста. Разберём этот компромисс подробно: что именно ломается в каждом из двух случаев, какие приёмы реально помогают и как подобрать размер под свои документы, а не под чужой пример из туториала.
Подробнее →