Администрирование знаний
Группа «Знания и поиск» в разделе «Администрирование» задаёт правила, по которым документы попадают в индекс и по которым платформа ищет по ним ответы. Здесь вы ограничиваете размер загружаемых файлов, описываете нарезку документов и стратегию поиска профилями, проверяете параметры на арене и управляете коллекциями векторного хранилища. Настройки действуют на всю инсталляцию платформы: отдельное рабочее пространство их не переопределяет. Сами базы знаний создают и наполняют участники пространств — из раздела «Администрирование» документы не загружаются.
Что вам понадобится
- глобальная роль
admin: группа «Знания и поиск» видна и открывается только администраторам инсталляции; - активный провайдер эмбеддингов с выбранной моделью — без него индексация и поиск не работают;
- база знаний с загруженными документами, если планируете прогоны на арене;
- доступное векторное хранилище Qdrant: при его недоступности разделы показывают предупреждение и неполные данные.
Как задать лимиты загрузки файлов и таймаут импорта
Откройте Администрирование → Знания и поиск → Импорт документов
(/settings/administration/knowledge/import). Страница собрана из двух карточек:
«Обработка файлов перед импортом» отвечает за то, сколько платформа ждёт полноценного разбора
файла, а «Лимиты загрузки файлов» — за 13 ограничений на размер и количество файлов во всех
контурах платформы. С версии 1.409 лимиты задаются в разделе Импорт документов, а не только
переменными окружения.
В карточке «Обработка файлов перед импортом» одно поле — Таймаут, минут. Оно определяет, сколько платформа ждёт полноценную обработку файла, прежде чем переключиться на упрощённый импорт. Значение по умолчанию — 30 минут, допустимый диапазон — 5–120 минут. Кнопка «Сбросить по умолчанию» возвращает 30 минут, кнопка Сохранить применяет изменение. Полноценный разбор выполняет Docling, поэтому таймаут поднимают, когда в базы знаний регулярно попадают тяжёлые сканы.
Какие лимиты можно изменить
| Лимит | Что ограничивает | По умолчанию | Диапазон |
|---|---|---|---|
| Чат · Размер обычного вложения (изображение/документ) | Один файл-вложение в сообщении | 20 МБ | 1–2048 |
| Чат · Размер медиафайла (аудио/видео) | Один аудио- или видеофайл в сообщении | 200 МБ | 1–4096 |
| Чат · Суммарный размер обычных вложений в сообщении | Все обычные вложения одного сообщения | 20 МБ | 1–4096 |
| Чат · Файлов в одном сообщении | Количество вложений в сообщении | 25 | 1–1000 |
| Файлы ассистента · Размер файла ассистента | Один файл, прикреплённый к ассистенту | 20 МБ | 1–2048 |
| Файлы ассистента · Файлов за одну загрузку | Количество файлов в одной операции загрузки | 10 | 1–1000 |
| Файлы ассистента · Материалов на ассистента | Всего файлов у одного ассистента | 20 | 1–1000 |
| Вложения к отзыву · Размер вложения к отзыву | Один скриншот или файл в отзыве | 8 МБ | 1–2048 |
| Вложения к отзыву · Вложений к одному отзыву | Количество файлов в отзыве | 5 | 1–1000 |
| База знаний · Размер документа при импорте | Один документ базы знаний | 500 МБ | 1–8192 |
| База знаний · Размер архива при импорте | Один загружаемый архив | 500 МБ | 1–8192 |
| База знаний · Записей в архиве | Количество файлов внутри архива | 10 000 | 1–1 000 000 |
| База знаний · Страниц на файл при AI-OCR импорте | Глубина распознавания одного файла | 200 | 1–10 000 |
Размеры задаются в мегабайтах, счётчики — в штуках. Диапазон подписан под каждым полем, значение
вне диапазона платформа не сохраняет и показывает подсказку Диапазон <min>–<max>.
Что означает пустое поле
Пустое поле — это режим «Авто»: платформа берёт значение по умолчанию для инсталляции, а в
подсказке поля показывает его в виде Авто: 20. Порядок разрешения — значение администратора,
затем переменная окружения, затем встроенное значение из таблицы выше. Переменные окружения заданы
только для четырёх лимитов базы знаний: KNOWLEDGE_BASE_DOCUMENT_UPLOAD_LIMIT_BYTES,
ARCHIVE_IMPORT_MAX_SIZE_BYTES, ARCHIVE_IMPORT_MAX_ENTRIES и KB_AI_OCR_MAX_PAGES_PER_FILE.
Кнопка «Сбросить всё в „Авто“» очищает все 13 полей сразу, но изменения вступают в силу только после нажатия Сохранить.
Как настроить нарезку документов профилем индексации
Откройте Администрирование → Знания и поиск → Индексация и поиск
(/settings/administration/knowledge/indexing) и оставайтесь на вкладке Профили индексации.
Профиль индексации описывает, как исходный текст делится на фрагменты перед векторизацией и с
какой скоростью работает индексатор. Активным может быть только один профиль инсталляции, он
применяется ко всем базам знаний.
- Нажмите Создать в карточке «Профили индексации».
- Заполните Название и Описание: по описанию потом видно, для каких документов профиль нужен.
- Задайте Размер фрагмента и Перекрытие в блоке «Нарезка документа».
- Если индексация упирается в лимиты провайдера, измените блок «Скорость индексации».
- Нажмите Сохранить на панели «Есть несохранённые изменения» внизу формы.
Новый профиль сохраняется неактивным. Чтобы он начал применяться, откройте его и нажмите «Сделать активным».
| Параметр | Что делает | По умолчанию | Когда менять |
|---|---|---|---|
| Размер фрагмента | Сколько текста попадает в один фрагмент до наложения | 800 | Ответы обрывочные или, наоборот, слишком общие |
| Перекрытие | Сколько текста повторяется между соседними фрагментами | 200 | Смысл теряется на стыке фрагментов |
| Параллельные задачи | Сколько документов индексатор обрабатывает одновременно | 4 | Индексация идёт долго или перегружает провайдера |
| Размер пачки | Сколько фрагментов уходит за один запрос на эмбеддинги | 8 | Провайдер отвечает ошибками на крупные запросы |
| Лимит пачки по токенам | Верхняя граница объёма одной пачки эмбеддингов | 4000 | Модель отбивает запрос по длине |
| Лимит записи в Qdrant, байт | Максимальный размер одного запроса записи в хранилище | 5 000 000 | Запись падает на тяжёлых метаданных |
Блок «Схема метаданных» свёрнут в отдельную секцию: в нём описано, какие поля попадают в
payload точки вместе с текстом фрагмента. Меню ⋯ в шапке карточки содержит «Клонировать» и
«Удалить»; удаление недоступно для активного профиля и для профилей с бейджем Системный.
Важно. Смена активного профиля не пересобирает готовый индекс: новые параметры применяются к новым документам и к документам, которые переиндексировали вручную.
Как настроить поиск профилем поиска
Перейдите на вкладку Профили поиска страницы «Индексация и поиск». Профиль поиска описывает, как платформа собирает кандидатов из текстового и векторного поиска и как их ранжирует. В отличие от профиля индексации, активный профиль поиска начинает применяться сразу после нажатия «Сделать активным» — переиндексация не нужна.
| Стратегия | Как объединяет результаты | Когда выбирать |
|---|---|---|
| Сбалансированная выдача (RRF) | Складывает ранги BM25 и векторного поиска, не сравнивая их шкалы | Выбор по умолчанию, когда два поиска ведут себя по-разному |
| Гибрид с весами и порогами | Отсекает кандидатов по отдельным порогам, затем ранжирует по весам | Нужен явный контроль над вкладом каждого поиска |
| Объединение кандидатов | Берёт кандидатов из обоих поисков и упорядочивает детерминированно | Важна полнота выдачи, а не тонкое ранжирование |
| Параметр | Что делает | По умолчанию | Диапазон |
|---|---|---|---|
| Сколько фрагментов вернуть | Сколько фрагментов попадает в контекст ответа | 6 | 1–20 |
| Лимит контекста | Предел размера собранного контекста для модели | 3000 | 500–20 000 |
| BM25: сколько кандидатов | Кандидаты текстового поиска до слияния и ранжирования | 6 | 1–50 |
| Vector: сколько кандидатов | Кандидаты векторного поиска до слияния и ранжирования | 8 | 1–50 |
| Параметр RRF k | Насколько сильно верхние места влияют на итог | 60 | 1–500 |
| Вес BM25 и Вес vector | Вклад каждого поиска в порядок выдачи | 0,5 | 0–1 |
| Порог BM25 и Порог vector | Минимальный нормализованный score для допуска кандидата | 0,2 | 0–1 |
Параметр RRF k появляется в форме только для стратегии Сбалансированная выдача (RRF), а веса
и пороги — только для стратегии Гибрид с весами и порогами. Пустое поле Лимит контекста
означает системное значение.
Когда включать переписывание запроса
Включайте переключатель «Включить переписывание запроса», когда пользователи задают короткие вопросы, опирающиеся на предыдущие сообщения чата: «а что с исключениями», «подробнее». Перед поиском языковая модель (LLM) превращает такой вопрос в самодостаточный запрос. В блоке задаются «Модель для переписывания» и «Промпт для переписывания»; историю чата и текущий вопрос платформа подставляет сама, поэтому в промпте описывают только правила переформулирования.
Когда включать LLM-ранжирование
Включайте переключатель «Включить LLM-ранжирование», когда нужный документ находится, но стоит
не на первых местах выдачи. После сбора кандидатов модель получает верхние результаты и
переставляет их по смыслу. Поле «Сколько кандидатов дать LLM» по умолчанию равно 12 и
ограничено значением 50: чем больше кандидатов, тем дольше и дороже ответ. Профиль с включённым
ранжированием и незаполненным полем «Модель ранжирования» не сохраняется — платформа отвечает
Укажите модель rerank при включённом rerank.
Как задать общие настройки поиска для всей инсталляции
Перейдите на вкладку Глобальные RAG-настройки страницы «Индексация и поиск». Вкладка содержит четыре параметра, общих и для ассистентов с поиском по базам знаний, и для индексации самих баз. Панель с кнопкой Сохранить появляется внизу формы только после правки полей.
| Поле | Что задаёт | Что будет без значения |
|---|---|---|
| Глобальная embedding-модель | Модель, которая строит векторы для всех фрагментов | Индексация и поиск по базам знаний не работают |
| Размерность вектора | Размер эмбеддинга выбранной модели | Миграция коллекций не сможет создать коллекцию, если размер не определяется по ответу модели |
| Лимит входного контекста | Сколько символов пользовательского контекста добавляется поверх найденного | Действует системное значение |
| Показывать ссылки на источники | Показывать ли цитаты в ответах с поиском по базам знаний | Переключатель включён по умолчанию |
Список моделей в поле «Глобальная embedding-модель» платформа берёт из раздела
Администрирование → Знания и поиск → Провайдеры эмбеддингов
(/settings/administration/knowledge/embeddings): пока там нет активного провайдера с моделью,
выбирать нечего. Как завести провайдера, проверить его и опубликовать модель, описано в главе
Провайдеры эмбеддингов.
Если выбранная модель стала недоступна, вкладка показывает предупреждение «Выбранная модель эмбеддингов недоступна». Платформа не подменяет модель автоматически: выберите доступную пару «провайдер и модель» и сохраните настройки вручную.
Важно. Смена глобальной модели эмбеддингов делает ранее построенные векторы несовместимыми: базы знаний придётся переиндексировать.
Как проверить параметры на арене знаний
Откройте Администрирование → Знания и поиск → Арена
(/settings/administration/knowledge/arena). Арена знаний — стенд для проверки параметров на
реальных документах до того, как они станут активным профилем. Вкладка Индексация прогоняет
тестовую индексацию базы знаний, вкладка RAG сравнивает конфигурации поиска на наборе
подготовленных вопросов.
Как прогнать индексацию с новыми параметрами
- Выберите База знаний — прогон идёт по её документам.
- Выберите Исходный профиль или оставьте
Пустой шаблон, чтобы задать параметры с нуля. - Измените Модель эмбеддингов, Размер фрагмента, Перекрытие и параметры скорости.
- Нажмите «Запустить индексацию».
Арена индексирует документы во временную коллекцию и удаляет её после прогона, поэтому рабочий индекс базы знаний не меняется. Пока прогон идёт, кнопка запуска заблокирована, а над формой отображается блок «Текущий запуск» со счётчиками документов, фрагментов, токенов и ошибок.
| Статус | Что означает | Что делать |
|---|---|---|
В очереди | Прогон принят и ждёт исполнителя | Дождаться старта |
Выполняется | Идёт тестовая индексация | Дождаться завершения, второй прогон не запускается |
Готово | Все документы обработаны | Сравнить метрики с прошлыми прогонами |
Готово с ошибками | Часть документов не обработана | Открыть прогон и посмотреть блок «Ошибки» |
Ошибка | Прогон прерван | Проверить доступность провайдера эмбеддингов и хранилища |
Все прогоны попадают в карточку «Журнал запусков»: строка показывает время и длительность
прогона, базу знаний, исходный профиль, модель эмбеддингов, число фрагментов, связку
«параллельные задачи и размер пачки», результат и статус. Нажатие на строку открывает окно прогона
с блоками «Конфигурация запуска», «Временные затраты»,
«Итоги» и «Ошибки». Рядом со статусом стоит бейдж уборки временной коллекции:
Очистка OK, Очистка в работе, Очистка пропущена или Очистка не удалась.
Удачную конфигурацию сохраняют тремя способами: кнопка «Создать профиль из конфигурации запуска» в окне прогона заводит профиль по параметрам уже выполненного запуска, кнопка «Сохранить как профиль» над формой создаёт профиль из текущих значений формы, кнопка Сохранить перезаписывает выбранный исходный профиль.
Как сравнить конфигурации поиска
Перейдите на вкладку RAG страницы «Арена знаний». Работа идёт вокруг benchmark — набора проверочных вопросов к одной базе знаний. Заведите benchmark кнопкой создания, опишите его в блоке «Настройки benchmark» и наполните блок «Кейсы»: кейсы добавляются вручную, импортируются пунктом «Импорт кейсов» из JSON и выгружаются пунктом «Экспорт кейсов».
В блоке «Конфиг запуска» выберите «Модель ответа (LLM)» и Search profile. Если
проверяете отклонение от профиля, переопределите Strategy, topK и веса. Затем нажмите
«Запустить batch». Результат появляется в блоке «История запусков»; по каждому кейсу
доступны панели «Ответ и citations», «Retrieved candidates», «Pipeline» и «Ручная оценка» с
вердиктом, подтверждённым ответом и заметками. Конфигурацию удачного эксперимента сохраняют
пунктом «Сохранить snapshot как search profile» — он создаёт полноценный профиль поиска на
вкладке Профили поиска.
Как управлять коллекциями векторного хранилища
Откройте Администрирование → Знания и поиск → Векторное хранилище
(/settings/administration/knowledge/vector-storage). Раздел показывает фактическое состояние
коллекций Qdrant в инсталляции и содержит две вкладки: Коллекции и Миграция коллекций.
Параметры подключения к хранилищу в интерфейсе не задаются — адрес и доступы приходят из
конфигурации развёртывания. Если хранилище недоступно, вкладки показывают предупреждение
«Qdrant недоступен», а списки остаются неполными.
Вкладка Коллекции начинается с четырёх плиток: «Всего коллекций», «Всего записей», «Оценка объёма» и «Без владельца». Переключатель над таблицей фильтрует строки: Все, Сироты (управляемые коллекции без пространства-владельца) и Вне управления. Таблица содержит колонки Пространство, Коллекция, Семейство, Статус, Точек и Объём.
| Семейство | Что это | Удаление из интерфейса |
|---|---|---|
KB · пространство | Действующая коллекция базы знаний пространства | Доступно |
Файлы ассистента | Векторы файлов, прикреплённых к ассистентам | Доступно |
Пространство | Прочие коллекции пространства | Доступно |
БЗ · старая | Коллекция базы знаний до перехода на коллекции пространств | Доступно |
Арена | Временная коллекция прогона арены | Доступно |
Вне управления | Коллекция, созданная вне платформы | Недоступно |
Чтобы удалить коллекцию, откройте меню строки и выберите «Удалить коллекцию», затем введите
полное имя коллекции в поле подтверждения. Документы в базе данных при этом сохраняются. Для
коллекций из семейства Вне управления пункт неактивен: такие коллекции платформа не трогает.
Меню строки предназначено для точечных случаев, а массовую уборку сирот запускают
политиками очистки — они описаны в главе
Эксплуатация платформы.
Важно. ⚠️ Удаление коллекции необратимо: точки удаляются из Qdrant безвозвратно, и поиск по связанным базам знаний перестаёт работать до переиндексации.
Вкладка «Миграция коллекций» помечена как временный инструмент и нужна инсталляциям, которые переходят со старой схемы «коллекция на базу знаний» на коллекции пространств. Плитки показывают общее число баз знаний, сколько старых коллекций осталось, сколько уже перенесено и сколько завершилось ошибкой. Перенос запускается по каждой базе знаний отдельно и требует подтверждения; старая коллекция удаляется только после успешной сверки количества точек. Кнопка «Удалить legacy» убирает старую коллекцию без переноса — до переиндексации векторный поиск по этой базе знаний работать не будет.
Инвентарь коллекций Qdrant. Семейство коллекции определяется по шаблону её имени.
Частые вопросы
Почему новые параметры индексации не изменили ответы ассистента
Профиль индексации применяется в момент индексации, а готовый индекс не пересобирается сам. Проверьте:
- профиль отмечен бейджем
Активныйна вкладке Профили индексации; - документы базы знаний переиндексированы после смены профиля;
- для проверки качества поиска правится профиль поиска, а не профиль индексации.
Почему профиль поиска не сохраняется
Форма не проходит проверку, и панель сохранения остаётся на месте. Проверьте:
- при включённом «Включить LLM-ранжирование» выбрана «Модель ранжирования»;
- значения полей укладываются в диапазоны из таблицы параметров;
- название профиля заполнено и не длиннее 120 символов.
Почему разделы показывают предупреждение «Qdrant недоступен»
Платформа не получила ответ от векторного хранилища, и списки коллекций собираются неполными. Проверьте:
- хранилище запущено и доступно по адресу из конфигурации развёртывания;
- в разделе Векторное хранилище нажата кнопка Обновить после восстановления связи;
- индексация баз знаний не падает с той же ошибкой — иначе проблема на стороне хранилища, а не интерфейса.
Почему участник не может загрузить файл, который укладывается в лимит
В интерфейсе видно значение, заданное администратором, а действует эффективное значение: администратор, затем переменная окружения, затем встроенное значение по умолчанию. Проверьте:
- в разделе Импорт документов нужное поле не пустое, иначе действует подсказка
Авто; - лимит правится в той группе, к которой относится загрузка: вложение чата и документ базы знаний ограничены разными полями;
- изменения сохранены кнопкой Сохранить, а не только введены в поле.
Что дальше
- Провайдеры эмбеддингов — подключить провайдера, из которого выбирается глобальная модель.
- Docling: структурный импорт документов — разобраться, как устроен полноценный разбор файлов перед импортом.
- RAG и поиск по знаниям — увидеть, как настройки поиска выглядят со стороны пользователя.
- Базы знаний — понять, как участники загружают документы и запускают индексацию.
- Раздел администрирования — перейти к остальным группам настроек инсталляции.