Администрирование знаний

Группа «Знания и поиск» в разделе «Администрирование» задаёт правила, по которым документы попадают в индекс и по которым платформа ищет по ним ответы. Здесь вы ограничиваете размер загружаемых файлов, описываете нарезку документов и стратегию поиска профилями, проверяете параметры на арене и управляете коллекциями векторного хранилища. Настройки действуют на всю инсталляцию платформы: отдельное рабочее пространство их не переопределяет. Сами базы знаний создают и наполняют участники пространств — из раздела «Администрирование» документы не загружаются.

Страница «Индексация и поиск»: три вкладки «Профили индексации», «Профили поиска», «Глобальные RAG-настройки», открыта первая вкладка со списком профилей слева и карточкой профиля справа
Правила индексации и параметры поиска. Профили индексации. Активный профиль помечен бейджем и применяется ко всем новым документам инсталляции.

Что вам понадобится

  • глобальная роль admin: группа «Знания и поиск» видна и открывается только администраторам инсталляции;
  • активный провайдер эмбеддингов с выбранной моделью — без него индексация и поиск не работают;
  • база знаний с загруженными документами, если планируете прогоны на арене;
  • доступное векторное хранилище Qdrant: при его недоступности разделы показывают предупреждение и неполные данные.

Как задать лимиты загрузки файлов и таймаут импорта

Откройте Администрирование → Знания и поиск → Импорт документов (/settings/administration/knowledge/import). Страница собрана из двух карточек: «Обработка файлов перед импортом» отвечает за то, сколько платформа ждёт полноценного разбора файла, а «Лимиты загрузки файлов» — за 13 ограничений на размер и количество файлов во всех контурах платформы. С версии 1.409 лимиты задаются в разделе Импорт документов, а не только переменными окружения.

В карточке «Обработка файлов перед импортом» одно поле — Таймаут, минут. Оно определяет, сколько платформа ждёт полноценную обработку файла, прежде чем переключиться на упрощённый импорт. Значение по умолчанию — 30 минут, допустимый диапазон — 5–120 минут. Кнопка «Сбросить по умолчанию» возвращает 30 минут, кнопка Сохранить применяет изменение. Полноценный разбор выполняет Docling, поэтому таймаут поднимают, когда в базы знаний регулярно попадают тяжёлые сканы.

Какие лимиты можно изменить

ЛимитЧто ограничиваетПо умолчаниюДиапазон
Чат · Размер обычного вложения (изображение/документ)Один файл-вложение в сообщении20 МБ1–2048
Чат · Размер медиафайла (аудио/видео)Один аудио- или видеофайл в сообщении200 МБ1–4096
Чат · Суммарный размер обычных вложений в сообщенииВсе обычные вложения одного сообщения20 МБ1–4096
Чат · Файлов в одном сообщенииКоличество вложений в сообщении251–1000
Файлы ассистента · Размер файла ассистентаОдин файл, прикреплённый к ассистенту20 МБ1–2048
Файлы ассистента · Файлов за одну загрузкуКоличество файлов в одной операции загрузки101–1000
Файлы ассистента · Материалов на ассистентаВсего файлов у одного ассистента201–1000
Вложения к отзыву · Размер вложения к отзывуОдин скриншот или файл в отзыве8 МБ1–2048
Вложения к отзыву · Вложений к одному отзывуКоличество файлов в отзыве51–1000
База знаний · Размер документа при импортеОдин документ базы знаний500 МБ1–8192
База знаний · Размер архива при импортеОдин загружаемый архив500 МБ1–8192
База знаний · Записей в архивеКоличество файлов внутри архива10 0001–1 000 000
База знаний · Страниц на файл при AI-OCR импортеГлубина распознавания одного файла2001–10 000

Размеры задаются в мегабайтах, счётчики — в штуках. Диапазон подписан под каждым полем, значение вне диапазона платформа не сохраняет и показывает подсказку Диапазон <min>–<max>.

Что означает пустое поле

Пустое поле — это режим «Авто»: платформа берёт значение по умолчанию для инсталляции, а в подсказке поля показывает его в виде Авто: 20. Порядок разрешения — значение администратора, затем переменная окружения, затем встроенное значение из таблицы выше. Переменные окружения заданы только для четырёх лимитов базы знаний: KNOWLEDGE_BASE_DOCUMENT_UPLOAD_LIMIT_BYTES, ARCHIVE_IMPORT_MAX_SIZE_BYTES, ARCHIVE_IMPORT_MAX_ENTRIES и KB_AI_OCR_MAX_PAGES_PER_FILE.

Кнопка «Сбросить всё в „Авто“» очищает все 13 полей сразу, но изменения вступают в силу только после нажатия Сохранить.

Как настроить нарезку документов профилем индексации

Откройте Администрирование → Знания и поиск → Индексация и поиск (/settings/administration/knowledge/indexing) и оставайтесь на вкладке Профили индексации. Профиль индексации описывает, как исходный текст делится на фрагменты перед векторизацией и с какой скоростью работает индексатор. Активным может быть только один профиль инсталляции, он применяется ко всем базам знаний.

  1. Нажмите Создать в карточке «Профили индексации».
  2. Заполните Название и Описание: по описанию потом видно, для каких документов профиль нужен.
  3. Задайте Размер фрагмента и Перекрытие в блоке «Нарезка документа».
  4. Если индексация упирается в лимиты провайдера, измените блок «Скорость индексации».
  5. Нажмите Сохранить на панели «Есть несохранённые изменения» внизу формы.

Новый профиль сохраняется неактивным. Чтобы он начал применяться, откройте его и нажмите «Сделать активным».

ПараметрЧто делаетПо умолчаниюКогда менять
Размер фрагментаСколько текста попадает в один фрагмент до наложения800Ответы обрывочные или, наоборот, слишком общие
ПерекрытиеСколько текста повторяется между соседними фрагментами200Смысл теряется на стыке фрагментов
Параллельные задачиСколько документов индексатор обрабатывает одновременно4Индексация идёт долго или перегружает провайдера
Размер пачкиСколько фрагментов уходит за один запрос на эмбеддинги8Провайдер отвечает ошибками на крупные запросы
Лимит пачки по токенамВерхняя граница объёма одной пачки эмбеддингов4000Модель отбивает запрос по длине
Лимит записи в Qdrant, байтМаксимальный размер одного запроса записи в хранилище5 000 000Запись падает на тяжёлых метаданных

Блок «Схема метаданных» свёрнут в отдельную секцию: в нём описано, какие поля попадают в payload точки вместе с текстом фрагмента. Меню ⋯ в шапке карточки содержит «Клонировать» и «Удалить»; удаление недоступно для активного профиля и для профилей с бейджем Системный.

Важно. Смена активного профиля не пересобирает готовый индекс: новые параметры применяются к новым документам и к документам, которые переиндексировали вручную.

Как настроить поиск профилем поиска

Перейдите на вкладку Профили поиска страницы «Индексация и поиск». Профиль поиска описывает, как платформа собирает кандидатов из текстового и векторного поиска и как их ранжирует. В отличие от профиля индексации, активный профиль поиска начинает применяться сразу после нажатия «Сделать активным» — переиндексация не нужна.

СтратегияКак объединяет результатыКогда выбирать
Сбалансированная выдача (RRF)Складывает ранги BM25 и векторного поиска, не сравнивая их шкалыВыбор по умолчанию, когда два поиска ведут себя по-разному
Гибрид с весами и порогамиОтсекает кандидатов по отдельным порогам, затем ранжирует по весамНужен явный контроль над вкладом каждого поиска
Объединение кандидатовБерёт кандидатов из обоих поисков и упорядочивает детерминированноВажна полнота выдачи, а не тонкое ранжирование
ПараметрЧто делаетПо умолчаниюДиапазон
Сколько фрагментов вернутьСколько фрагментов попадает в контекст ответа61–20
Лимит контекстаПредел размера собранного контекста для модели3000500–20 000
BM25: сколько кандидатовКандидаты текстового поиска до слияния и ранжирования61–50
Vector: сколько кандидатовКандидаты векторного поиска до слияния и ранжирования81–50
Параметр RRF kНасколько сильно верхние места влияют на итог601–500
Вес BM25 и Вес vectorВклад каждого поиска в порядок выдачи0,50–1
Порог BM25 и Порог vectorМинимальный нормализованный score для допуска кандидата0,20–1

Параметр RRF k появляется в форме только для стратегии Сбалансированная выдача (RRF), а веса и пороги — только для стратегии Гибрид с весами и порогами. Пустое поле Лимит контекста означает системное значение.

Вкладка «Профили поиска»: открыта карточка профиля, блок «Сбор кандидатов» с полем «Стратегия» и панелью пояснения справа, где показаны Top K и число кандидатов BM25 и vector
Вкладка «Профили поиска»: стратегия сбора кандидатов. Карточка профиля поиска. Панель справа показывает, как выбранная стратегия соберёт кандидатов.

Когда включать переписывание запроса

Включайте переключатель «Включить переписывание запроса», когда пользователи задают короткие вопросы, опирающиеся на предыдущие сообщения чата: «а что с исключениями», «подробнее». Перед поиском языковая модель (LLM) превращает такой вопрос в самодостаточный запрос. В блоке задаются «Модель для переписывания» и «Промпт для переписывания»; историю чата и текущий вопрос платформа подставляет сама, поэтому в промпте описывают только правила переформулирования.

Когда включать LLM-ранжирование

Включайте переключатель «Включить LLM-ранжирование», когда нужный документ находится, но стоит не на первых местах выдачи. После сбора кандидатов модель получает верхние результаты и переставляет их по смыслу. Поле «Сколько кандидатов дать LLM» по умолчанию равно 12 и ограничено значением 50: чем больше кандидатов, тем дольше и дороже ответ. Профиль с включённым ранжированием и незаполненным полем «Модель ранжирования» не сохраняется — платформа отвечает Укажите модель rerank при включённом rerank.

Как задать общие настройки поиска для всей инсталляции

Перейдите на вкладку Глобальные RAG-настройки страницы «Индексация и поиск». Вкладка содержит четыре параметра, общих и для ассистентов с поиском по базам знаний, и для индексации самих баз. Панель с кнопкой Сохранить появляется внизу формы только после правки полей.

ПолеЧто задаётЧто будет без значения
Глобальная embedding-модельМодель, которая строит векторы для всех фрагментовИндексация и поиск по базам знаний не работают
Размерность вектораРазмер эмбеддинга выбранной моделиМиграция коллекций не сможет создать коллекцию, если размер не определяется по ответу модели
Лимит входного контекстаСколько символов пользовательского контекста добавляется поверх найденногоДействует системное значение
Показывать ссылки на источникиПоказывать ли цитаты в ответах с поиском по базам знанийПереключатель включён по умолчанию

Список моделей в поле «Глобальная embedding-модель» платформа берёт из раздела Администрирование → Знания и поиск → Провайдеры эмбеддингов (/settings/administration/knowledge/embeddings): пока там нет активного провайдера с моделью, выбирать нечего. Как завести провайдера, проверить его и опубликовать модель, описано в главе Провайдеры эмбеддингов.

Если выбранная модель стала недоступна, вкладка показывает предупреждение «Выбранная модель эмбеддингов недоступна». Платформа не подменяет модель автоматически: выберите доступную пару «провайдер и модель» и сохраните настройки вручную.

Важно. Смена глобальной модели эмбеддингов делает ранее построенные векторы несовместимыми: базы знаний придётся переиндексировать.

Как проверить параметры на арене знаний

Откройте Администрирование → Знания и поиск → Арена (/settings/administration/knowledge/arena). Арена знаний — стенд для проверки параметров на реальных документах до того, как они станут активным профилем. Вкладка Индексация прогоняет тестовую индексацию базы знаний, вкладка RAG сравнивает конфигурации поиска на наборе подготовленных вопросов.

Как прогнать индексацию с новыми параметрами

  1. Выберите База знаний — прогон идёт по её документам.
  2. Выберите Исходный профиль или оставьте Пустой шаблон, чтобы задать параметры с нуля.
  3. Измените Модель эмбеддингов, Размер фрагмента, Перекрытие и параметры скорости.
  4. Нажмите «Запустить индексацию».

Арена индексирует документы во временную коллекцию и удаляет её после прогона, поэтому рабочий индекс базы знаний не меняется. Пока прогон идёт, кнопка запуска заблокирована, а над формой отображается блок «Текущий запуск» со счётчиками документов, фрагментов, токенов и ошибок.

СтатусЧто означаетЧто делать
В очередиПрогон принят и ждёт исполнителяДождаться старта
ВыполняетсяИдёт тестовая индексацияДождаться завершения, второй прогон не запускается
ГотовоВсе документы обработаныСравнить метрики с прошлыми прогонами
Готово с ошибкамиЧасть документов не обработанаОткрыть прогон и посмотреть блок «Ошибки»
ОшибкаПрогон прерванПроверить доступность провайдера эмбеддингов и хранилища

Все прогоны попадают в карточку «Журнал запусков»: строка показывает время и длительность прогона, базу знаний, исходный профиль, модель эмбеддингов, число фрагментов, связку «параллельные задачи и размер пачки», результат и статус. Нажатие на строку открывает окно прогона с блоками «Конфигурация запуска», «Временные затраты», «Итоги» и «Ошибки». Рядом со статусом стоит бейдж уборки временной коллекции: Очистка OK, Очистка в работе, Очистка пропущена или Очистка не удалась.

Удачную конфигурацию сохраняют тремя способами: кнопка «Создать профиль из конфигурации запуска» в окне прогона заводит профиль по параметрам уже выполненного запуска, кнопка «Сохранить как профиль» над формой создаёт профиль из текущих значений формы, кнопка Сохранить перезаписывает выбранный исходный профиль.

Окно прогона арены: заголовок с базой знаний и статусом, плитки метрик, блоки «Конфигурация запуска» и «Временные затраты», кнопка «Создать профиль из конфигурации запуска» внизу
Окно прогона арены: метрики, конфигурация запуска и временные затраты. Детали прогона арены. Из конфигурации завершённого прогона профиль индексации создаётся одной кнопкой.

Как сравнить конфигурации поиска

Перейдите на вкладку RAG страницы «Арена знаний». Работа идёт вокруг benchmark — набора проверочных вопросов к одной базе знаний. Заведите benchmark кнопкой создания, опишите его в блоке «Настройки benchmark» и наполните блок «Кейсы»: кейсы добавляются вручную, импортируются пунктом «Импорт кейсов» из JSON и выгружаются пунктом «Экспорт кейсов».

В блоке «Конфиг запуска» выберите «Модель ответа (LLM)» и Search profile. Если проверяете отклонение от профиля, переопределите Strategy, topK и веса. Затем нажмите «Запустить batch». Результат появляется в блоке «История запусков»; по каждому кейсу доступны панели «Ответ и citations», «Retrieved candidates», «Pipeline» и «Ручная оценка» с вердиктом, подтверждённым ответом и заметками. Конфигурацию удачного эксперимента сохраняют пунктом «Сохранить snapshot как search profile» — он создаёт полноценный профиль поиска на вкладке Профили поиска.

Как управлять коллекциями векторного хранилища

Откройте Администрирование → Знания и поиск → Векторное хранилище (/settings/administration/knowledge/vector-storage). Раздел показывает фактическое состояние коллекций Qdrant в инсталляции и содержит две вкладки: Коллекции и Миграция коллекций. Параметры подключения к хранилищу в интерфейсе не задаются — адрес и доступы приходят из конфигурации развёртывания. Если хранилище недоступно, вкладки показывают предупреждение «Qdrant недоступен», а списки остаются неполными.

Вкладка Коллекции начинается с четырёх плиток: «Всего коллекций», «Всего записей», «Оценка объёма» и «Без владельца». Переключатель над таблицей фильтрует строки: Все, Сироты (управляемые коллекции без пространства-владельца) и Вне управления. Таблица содержит колонки Пространство, Коллекция, Семейство, Статус, Точек и Объём.

СемействоЧто этоУдаление из интерфейса
KB · пространствоДействующая коллекция базы знаний пространстваДоступно
Файлы ассистентаВекторы файлов, прикреплённых к ассистентамДоступно
ПространствоПрочие коллекции пространстваДоступно
БЗ · стараяКоллекция базы знаний до перехода на коллекции пространствДоступно
АренаВременная коллекция прогона ареныДоступно
Вне управленияКоллекция, созданная вне платформыНедоступно

Чтобы удалить коллекцию, откройте меню строки и выберите «Удалить коллекцию», затем введите полное имя коллекции в поле подтверждения. Документы в базе данных при этом сохраняются. Для коллекций из семейства Вне управления пункт неактивен: такие коллекции платформа не трогает. Меню строки предназначено для точечных случаев, а массовую уборку сирот запускают политиками очистки — они описаны в главе Эксплуатация платформы.

Важно. ⚠️ Удаление коллекции необратимо: точки удаляются из Qdrant безвозвратно, и поиск по связанным базам знаний перестаёт работать до переиндексации.

Вкладка «Миграция коллекций» помечена как временный инструмент и нужна инсталляциям, которые переходят со старой схемы «коллекция на базу знаний» на коллекции пространств. Плитки показывают общее число баз знаний, сколько старых коллекций осталось, сколько уже перенесено и сколько завершилось ошибкой. Перенос запускается по каждой базе знаний отдельно и требует подтверждения; старая коллекция удаляется только после успешной сверки количества точек. Кнопка «Удалить legacy» убирает старую коллекцию без переноса — до переиндексации векторный поиск по этой базе знаний работать не будет.

Инвентарь коллекций Qdrant. Семейство коллекции определяется по шаблону её имени.

Частые вопросы

Почему новые параметры индексации не изменили ответы ассистента

Профиль индексации применяется в момент индексации, а готовый индекс не пересобирается сам. Проверьте:

  • профиль отмечен бейджем Активный на вкладке Профили индексации;
  • документы базы знаний переиндексированы после смены профиля;
  • для проверки качества поиска правится профиль поиска, а не профиль индексации.

Почему профиль поиска не сохраняется

Форма не проходит проверку, и панель сохранения остаётся на месте. Проверьте:

  • при включённом «Включить LLM-ранжирование» выбрана «Модель ранжирования»;
  • значения полей укладываются в диапазоны из таблицы параметров;
  • название профиля заполнено и не длиннее 120 символов.

Почему разделы показывают предупреждение «Qdrant недоступен»

Платформа не получила ответ от векторного хранилища, и списки коллекций собираются неполными. Проверьте:

  • хранилище запущено и доступно по адресу из конфигурации развёртывания;
  • в разделе Векторное хранилище нажата кнопка Обновить после восстановления связи;
  • индексация баз знаний не падает с той же ошибкой — иначе проблема на стороне хранилища, а не интерфейса.

Почему участник не может загрузить файл, который укладывается в лимит

В интерфейсе видно значение, заданное администратором, а действует эффективное значение: администратор, затем переменная окружения, затем встроенное значение по умолчанию. Проверьте:

  • в разделе Импорт документов нужное поле не пустое, иначе действует подсказка Авто;
  • лимит правится в той группе, к которой относится загрузка: вложение чата и документ базы знаний ограничены разными полями;
  • изменения сохранены кнопкой Сохранить, а не только введены в поле.

Что дальше