RAG и поиск по знаниям
С поиском по знаниям ассистент отвечает по вашим документам, а не только по общим знаниям языковой модели (LLM). Перед генерацией ответа платформа находит в подключённых источниках подходящие фрагменты, кладёт их в контекст модели и показывает, откуда взят ответ. Источники вы подключаете в карточке ассистента, а поведение поиска задаёт общий для всей платформы профиль поиска, который создаёт администратор. Если источники не подключены, ассистент отвечает только знаниями модели.
Из чего ассистент берёт знания
У ассистента два вида источников: базы знаний рабочего пространства и файлы ассистента. Оба вида вы подключаете в карточке ассистента на вкладке Основное, в блоке Источники знаний.
Базы знаний вы выбираете в поле Базы знаний. Под полем платформа подсказывает, какой глобальный провайдер эмбеддингов будет использован, и предупреждает, если выбранные базы проиндексированы несовместимой моделью.
Файлы ассистента вы загружаете на вкладке Файлы ассистента. В поиске участвуют только файлы с ролью RAG-источник. Роль Материал означает другое: платформа передаёт такой файл ассистенту целиком как шаблон или образец. Поддерживаются PDF, DOC, DOCX, TXT и XLSX.
Как платформа находит фрагменты
Поиск идёт в два прохода по одному и тому же набору фрагментов: текстовый поиск по словам запроса и векторный поиск по смыслу. Платформа объединяет результаты обоих проходов в один список, отсекает слабые совпадения порогом релевантности и обрезает список до нужного числа фрагментов.
- Пользователь задаёт вопрос в чате.
- Платформа переформулирует вопрос с учётом предыдущих сообщений чата, если вопрос опирается на них.
- Платформа отправляет запрос в текстовый и векторный поиск по подключённым источникам.
- Платформа объединяет результаты выбранной стратегией и сортирует их.
- Платформа отсекает слабые совпадения порогом и обрезает остальные до лимита фрагментов и лимита контекста.
- Модель строит ответ по найденным фрагментам, а платформа прикладывает к ответу список источников.
Текстовый поиск учитывает не только тело фрагмента. Заголовок раздела, из которого взят фрагмент, весит больше, чем сам текст, а первое предложение — больше, чем остальная часть. Поэтому документы с осмысленными заголовками находятся заметно лучше: заголовок «Порядок возврата товара» поднимает свой фрагмент выше, чем то же словосочетание, упомянутое в середине абзаца.
Как работает порог релевантности
Платформа сравнивает порог Минимальная релевантность с нормализованной оценкой фрагмента по шкале от 0 до 1. Из двух оценок — текстовой и векторной — платформа берёт лучшую, поэтому фрагмент проходит порог, если лидирует хотя бы по одному из проходов. Шкала одна и та же при любой стратегии, так что значение порога не нужно пересчитывать при смене стратегии.
Если порог отсекает вообще все найденные фрагменты, платформа возвращает результаты без фильтрации: завышенный порог не оставляет пользователя без ответа, но и не улучшает ответ. Признак того, что порог задран, — ответы, собранные из явно посторонних фрагментов.
Примечание. Порог не меняет объём выборки: сколько кандидатов берут проходы, задают Top-K текстовых документов и Top-K векторных документов, а сколько фрагментов дойдёт до ответа — Top K.
Где задать поведение поиска
Откройте карточку ассистента, перейдите на вкладку Расширенные настройки и раскройте блок Расширенные настройки поиска. Поле Режим поиска предлагает два варианта.
| Режим | Что делает | Когда выбирать |
|---|---|---|
| Использовать активный профиль поиска | Ассистент наследует общий для платформы профиль целиком | Поведение по умолчанию, единые правила для всех ассистентов |
| Кастомный режим | Переопределяет параметры поиска, переформулирования и переранжирования для этого ассистента | Одному ассистенту нужна своя логика |
Профиль поиска — общая настройка платформы, а не рабочего пространства: его создаёт и активирует администратор. В режиме профиля платформа показывает название профиля и его сводку: стратегию, Top K, лимиты текстового и векторного поиска, состояние переформулирования и переранжирования.
В кастомном режиме пустое поле означает наследование: платформа берёт значение из активного профиля, а подсказка под полем показывает, какое именно. Заполняйте только то, что действительно отличается.
Какую embedding-модель использует ассистент
Блок Embedding-модель для запросов определяет, какой моделью платформа переводит вопрос в вектор. Вариант Глобальный режим берёт модель из глобальных RAG-настроек платформы и подходит почти всегда. Вариант Custom override нужен, только если подключённые базы знаний вручную переиндексированы другой моделью; при сохранении сервер проверяет, совместимы ли подключённые базы знаний с этой моделью.
Несовпадение модели вопроса и модели, которой проиндексирована база, — самая частая причина ситуации «поиск ничего не находит». Размерность вектора глобальной модели администратор задаёт полем Размерность вектора в настройках индексации платформы.
Какие параметры отвечают за полноту и точность
Все поля ниже доступны в кастомном режиме. Значение по умолчанию каждое поле наследует из активного профиля поиска и показывает его как подсказку.
| Параметр | Что делает | Диапазон | Когда менять |
|---|---|---|---|
| Top K | Сколько фрагментов попадёт в контекст ответа | 1–20 | Ассистент не находит нужный документ или в ответ попадает лишнее |
| Минимальная релевантность | Отсекает слабые совпадения | 0–1 | В ответы попадает посторонний текст |
| Лимит контекста | Верхняя граница объёма найденного текста в токенах | 500–20 000 | Ответы обрываются или растёт стоимость |
| Top-K текстовых документов | Сколько кандидатов берёт текстовый поиск | 1–20 | Точные формулировки теряются |
| Top-K векторных документов | Сколько кандидатов берёт векторный поиск | 1–20 | Теряются близкие по смыслу формулировки |
Вспомогательные механизмы вы настраиваете отдельно.
| Механизм | Поля | Что даёт |
|---|---|---|
| Переформулирование | Включить переформулирование, Модель для переформулирования | Уточняющие вопросы вида «а какие исключения?» переписываются с учётом предыдущих сообщений |
| Переранжирование | Включить rerank, Модель ранжирования, Rerank candidate count (1–50), Rerank prompt | Языковая модель пересортировывает кандидатов и оставляет самые полезные |
| История чата | Максимум сообщений (0–20), Максимум символов (0–50 000) | Ограничивает, сколько предыдущих сообщений уходит в поиск |
| Кэширование контекста | Включить кэширование, Время жизни кэша (секунды) (60–1800, по умолчанию 300) | Переиспользует найденные фрагменты в рамках одного чата |
Чем отличаются стратегии поиска
Стратегия определяет, как платформа объединяет результаты текстового и векторного поиска. Стратегию задаёт поле Стратегия: от выбранного значения зависит, какие поля появятся рядом.
| Стратегия | Как объединяет | Дополнительные поля | Когда подходит |
|---|---|---|---|
RRF | Складывает места кандидата в обоих списках | RRF k (1–500) | Универсальный вариант без ручной настройки |
Weighted Thresholded | Взвешивает оценки и отсекает каждый проход своим порогом | Вес BM25, Вес вектора, BM25 threshold, Vector threshold | Нужен жёсткий контроль шума |
Union | Объединяет оба списка без взвешивания | Нет | Важнее не потерять потенциально полезное |
Поля Вес BM25, Вес вектора, BM25 threshold и Vector threshold видны только при стратегии Weighted Thresholded, поле RRF k — только при RRF. Лимиты текстового и векторного поиска доступны всегда.
Где посмотреть источники ответа
Когда в ответе есть цитаты, под ним появляется кнопка Источники со счётчиком найденных документов и фрагментов. Кнопка открывает справа панель Источники со списком карточек: название документа, раздел и фрагмент текста, по которому построен ответ. Из карточки с привязкой к базе знаний можно перейти к документу целиком.
Отдельного переключателя показа источников у ассистента нет: цитаты появляются всегда, когда поиск вернул фрагменты. Полностью отключить цитаты можно только глобально — настройкой Показывать ссылки на источники в разделе Администрирование.
Как настроить поиск внутри сценария
Если у ассистента в поле Обработка выбран режим Сценарий, вкладка Расширенные настройки параметров поиска не показывает: платформа подсказывает, что эти параметры задаёт узел Поиск по знаниям в редакторе сценария (workflow).
У узла есть поле Источник с двумя вариантами. Вариант Базы знаний ассистента берёт то, что выбрано в карточке ассистента; вариант Конкретная база знаний фиксирует одну базу и делает узел независимым от настроек ассистента. Поле Поисковый запрос задаёт, что именно искать, а поле Отправить ответ пользователю в чат выбирает между вариантами После завершения и Потоково. Модель для ответа узел по умолчанию берёт из основной модели агента, а переопределить её можно в настройках узла.
Частые вопросы
Ассистент отвечает без опоры на документы
Источники не подключены или ещё не проиндексированы. Проверьте:
- в блоке Источники знаний выбрана хотя бы одна база и настройки сохранены;
- у файлов ассистента стоит роль RAG-источник, а не Материал;
- статус базы знаний —
Актуальна; - в сценарном режиме в сценарии есть узел Поиск по знаниям.
Поиск не находит вообще ничего
Чаще всего платформа переводит вопрос в вектор не той моделью, которой проиндексирована база. Проверьте:
- в блоке Embedding-модель для запросов выбран Глобальный режим;
- под полем Базы знаний нет предупреждения о несовместимой модели;
- база проиндексирована после последней смены глобальной модели.
В ответ попадает слишком много лишнего
Выборка шире, чем нужно. Попробуйте по одному шагу за раз:
- уменьшить Top K;
- поднять Минимальная релевантность;
- включить переключатель Включить rerank и указать модель ранжирования;
- сузить список баз знаний до профильных.
Нужный документ не попадает в ответ
Документ недоступен поиску или проигрывает конкурентам по релевантности. Проверьте:
- индексация документа завершена и его статус —
Актуален; - документ доступен пользователю, который задаёт вопрос;
- порог Минимальная релевантность не завышен;
- в списке источников ассистента выбрана та база, где лежит документ.
В настройках ассистента появился блок «Недоступные источники»
К одной из привязанных баз знаний закрыт доступ или база удалена. Нажмите Удалить недоступные, чтобы убрать ссылки, либо обратитесь к владельцу базы за возвратом доступа.
Что дальше
- Базы знаний — наполнить и проиндексировать источники, по которым идёт поиск.
- Ассистенты — подключить источники и выбрать режим обработки.
- Файлы, вложения и импорты — разобраться с ролями файлов ассистента.
- Чаты — посмотреть, как источники выглядят в переписке.
- Сценарии — настроить узел Поиск по знаниям в сценарии.