Администрирование знаний

Группа «Знания и поиск» в разделе «Администрирование» задаёт правила, по которым документы попадают в индекс и по которым платформа ищет по ним ответы. Здесь вы ограничиваете размер загружаемых файлов, описываете нарезку документов и стратегию поиска профилями, проверяете параметры на арене и управляете коллекциями векторного хранилища. Настройки действуют на всю инсталляцию платформы: отдельное рабочее пространство их не переопределяет. Сами базы знаний создают и наполняют участники пространств — из раздела «Администрирование» документы не загружаются. Базы инсталляции, по которым Уника AI отвечает всем пользователям, администратор ведёт тем же экраном «Базы знаний» в служебном пространстве «Системные базы знаний», см. главу Системные базы знаний.

Правила индексации и параметры поиска
Правила индексации и параметры поиска. Профили индексации. Активный профиль помечен бейджем и применяется ко всем новым документам инсталляции.

Что вам понадобится

  • глобальная роль admin: группа «Знания и поиск» видна и открывается только администраторам инсталляции;
  • активный провайдер эмбеддингов с выбранной моделью — без него индексация и поиск не работают;
  • база знаний с загруженными документами, если планируете прогоны на арене;
  • доступное векторное хранилище Qdrant: при его недоступности разделы показывают предупреждение и неполные данные.

Как задать лимиты загрузки файлов и таймаут импорта

Откройте Администрирование → Знания и поиск → Импорт документов (/settings/administration/knowledge/import). В форме раздел «Обработка файлов перед импортом» задаёт время ожидания полноценного разбора файла, «Улучшение структуры документа» управляет восстановлением структуры, а отдельный блок «Лимиты загрузки файлов» задаёт 16 ограничений на размер и количество файлов во всех контурах платформы. Лимиты задаются в разделе Импорт документов, а не только переменными окружения.

В разделе «Обработка файлов перед импортом» одно поле — Таймаут, минут. Оно определяет, сколько платформа ждёт полноценную обработку файла; после истечения срока обработка повторяется с нарастающей паузой. Значение по умолчанию — 30 минут, допустимый диапазон — 5–120 минут. Кнопка «Сбросить по умолчанию» возвращает таймаут и настройки структуры к исходным значениям. Кнопка Сохранить появляется после изменения формы и применяет его. Полноценный разбор выполняет Docling, поэтому таймаут поднимают, когда в базы знаний регулярно попадают тяжёлые сканы.

Раздел «Улучшение структуры документа» содержит переключатель «Восстанавливать структуру при импорте», включённый по умолчанию. При импорте платформа распознаёт заголовки по повторяющейся нумерации, склеивает разорванные абзацы и разворачивает таблицы-обёртки; если регулярная структура не найдена, документ сохраняется без изменений. Независимо от переключателя платформа собирает слова, разорванные переносом строки, которые оставляет распознавание сканов и PDF: «аг- рессии» становится «агрессии», мягкие переносы исчезают. Составное слово вроде «генерал-майор» сохраняет дефис, а висячий дефис перед союзом в «северо- или юго-западный» остаётся как есть. Книги Excel и расшифровки речи склейку не проходят. Её получают документы, загруженные после обновления платформы. Переиндексация базы текст уже загруженных документов не меняет, поэтому им нужна повторная загрузка файла, а отдельный документ можно поправить действием «Улучшить структуру» в меню документа — оно создаёт новую версию. У блока «Лимиты загрузки файлов» своя кнопка Сохранить.

Какие лимиты можно изменить

ЛимитЧто ограничиваетПо умолчаниюДиапазон
Чат · Размер обычного вложения (изображение/документ)Один файл-вложение в сообщении20 МБ1–2048
Чат · Размер медиафайла (аудио/видео)Один аудио- или видеофайл в сообщении200 МБ1–4096
Чат · Суммарный размер обычных вложений в сообщенииВсе обычные вложения одного сообщения20 МБ1–4096
Чат · Файлов в одном сообщенииКоличество вложений в сообщении251–1000
Файлы ассистента · Размер файла ассистентаОдин файл, прикреплённый к ассистенту20 МБ1–2048
Файлы ассистента · Файлов за одну загрузкуКоличество файлов в одной операции загрузки101–1000
Файлы ассистента · Материалов на ассистентаВсего файлов у одного ассистента201–1000
Вложения к отзыву · Размер вложения к отзывуОдин скриншот или файл в отзыве8 МБ1–2048
Вложения к отзыву · Вложений к одному отзывуКоличество файлов в отзыве51–1000
База знаний · Размер документа при импортеОдин документ базы знаний — при загрузке и при обработке500 МБ1–8192
База знаний · Размер архива при импортеОдин загружаемый архив500 МБ1–8192
База знаний · Записей в архивеКоличество файлов внутри архива10 0001–1 000 000
База знаний · Страниц на файл при AI-OCR импортеГлубина распознавания одного файла2001–10 000
База знаний · Страниц сканов в пакете до запроса подтвержденияСколько страниц сканов платформа распознаёт в пакете, прежде чем запросить подтверждение1001–100 000
База знаний · Размер медиафайла при импортеОдин аудио- или видеофайл, загружаемый в базу знаний2048 МБ1–8192
База знаний · Длительность медиафайла при импорте, минутДлительность одного аудио- или видеофайла базы знаний2401–1440

Размеры задаются в мегабайтах, счётчики — в штуках. Диапазон подписан под каждым полем, значение вне диапазона платформа не сохраняет и показывает подсказку Диапазон <min>–<max>.

Что означает пустое поле

Пустое поле — это режим «Авто»: платформа берёт значение по умолчанию для инсталляции, а в подсказке поля показывает его в виде Авто: 20. Порядок разрешения — значение администратора, затем переменная окружения, затем встроенное значение из таблицы выше. Переменные окружения заданы только для пяти лимитов базы знаний: KNOWLEDGE_BASE_DOCUMENT_UPLOAD_LIMIT_BYTES, ARCHIVE_IMPORT_MAX_SIZE_BYTES, ARCHIVE_IMPORT_MAX_ENTRIES, KB_AI_OCR_MAX_PAGES_PER_FILE и KB_INGEST_OCR_CONFIRM_PAGES. Для размера документа действует ещё UNICA_MAX_DOCUMENT_BYTES: если заданы обе переменные, платформа берёт меньшее значение.

Кнопка «Сбросить всё в „Авто“» очищает все 16 полей сразу, но изменения вступают в силу только после нажатия Сохранить.

Как выбрать режим журнала приёма

Журнал приёма — это история обработки документов, которую показывает раздел Центр активности → Обработка документов: какие стадии прошёл каждый документ, сколько раз стадия запускалась повторно и чем закончилась каждая попытка. Режим записи задаётся на той же странице Импорт документов, в блоке Журнал приёма:

РежимЧто записывается
Полный (по умолчанию)Все попытки стадий обработки каждого документа
Только попыткиПопытки стадий без постраничной детализации — журнал занимает меньше места
ВыключенНичего. Документы обрабатываются как обычно, но в журнале не видно, что с ними происходит

Переключатель «Разрешить администратору открывать распознанный текст страницы» в том же блоке добавляет в карту страниц журнала кнопку чтения текста. По умолчанию он выключен: администратор видит только числа и коды. Каждое открытие текста фиксируется в журнале событий сервера (событие admin.ingest_journal.unit_text_read: кто, когда, какой документ и страница), сам текст в журнале приёма не хранится. В облачной поставке переключателя нет — там платформенный администратор распознанный текст пользователей не читает ни при какой настройке.

Новый режим начинает действовать на всех серверах платформы не позже чем через 30 секунд после нажатия Сохранить, перезапуск не нужен. Если журнал выключен, раздел Обработка документов предупреждает об этом над списком и показывает только записи, сделанные раньше. Сколько хранится история попыток, задаёт политика очистки «Журнал приёма: попытки стадий» (см. Эксплуатация платформы).

Как настроить нарезку документов профилем индексации

Откройте Администрирование → Знания и поиск → Индексация и поиск (/settings/administration/knowledge/indexing) и оставайтесь на вкладке Профили индексации. Профиль индексации описывает, как исходный текст делится на фрагменты перед векторизацией и с какой скоростью работает индексатор. Активным может быть только один профиль инсталляции, он применяется ко всем базам знаний.

  1. Нажмите Создать в карточке «Профили индексации».
  2. Заполните Название и Описание: по описанию потом видно, для каких документов профиль нужен.
  3. Задайте Размер фрагмента и Перекрытие в блоке «Нарезка документа».
  4. Если индексация упирается в лимиты провайдера, измените блок «Скорость индексации».
  5. Нажмите Сохранить на панели «Есть несохранённые изменения» внизу формы.

Новый профиль сохраняется неактивным. Чтобы он начал применяться, откройте его и нажмите «Сделать активным».

ПараметрЧто делаетПо умолчаниюКогда менять
Размер фрагмента, символовСколько символов текста входит в один фрагмент800Ответы обрывочные или, наоборот, слишком общие
Перекрытие, символовСколько текста повторяется в соседних фрагментах200Смысл теряется на стыке фрагментов
Параллельные задачиСколько документов или пакетов индексатор обрабатывает одновременно4Индексация идёт долго или перегружает провайдера
Размер пакета, фрагментовСколько фрагментов уходит модели эмбеддингов одним запросом24Индексация идёт долго — увеличьте; провайдер отвечает ошибками на крупные запросы — уменьшите
Лимит пакета, токеновВерхняя граница объёма одного пакета: длиннее — пакет делится на части4000Модель отбивает запрос по длине
Лимит записи в Qdrant, байтМаксимальный размер одного запроса записи в хранилище5 000 000Запись падает на тяжёлых метаданных

Блок «Схема метаданных» свёрнут в отдельную секцию: в нём описано, какие поля попадают в payload точки вместе с текстом фрагмента. Меню ⋯ в шапке карточки содержит «Клонировать» и «Удалить»; удаление недоступно для активного профиля и для профилей с бейджем Системный.

Колонка «По умолчанию» описывает значения, которые подставляются в форму нового профиля. Профили, созданные раньше, сохраняют записанные в них значения: если на установке уже есть профиль с размером пакета 8, поменять его на 24 нужно вручную.

Важно. Смена активного профиля не пересобирает готовый индекс: новые параметры применяются к новым документам и к документам, которые переиндексировали вручную.

Фрагменты документа записывает индексация. Загруженный документ находится поиском, когда его индексация завершилась; если автоиндексация в пространстве выключена — после запуска индексации вручную. Когда переиндексация документа завершилась, его прежние фрагменты удаляются, и поиск читает только актуальные.

Как настроить поиск профилем поиска

Перейдите на вкладку Профили поиска страницы «Индексация и поиск». Профиль поиска описывает, как платформа собирает кандидатов из текстового и векторного поиска и как их ранжирует. В отличие от профиля индексации, активный профиль поиска начинает применяться сразу после нажатия «Сделать активным» — переиндексация не нужна.

СтратегияКак объединяет результатыКогда выбирать
Сбалансированная выдача (RRF)Складывает ранги BM25 и векторного поиска, не сравнивая их шкалыВыбор по умолчанию, когда два поиска ведут себя по-разному
Гибрид с весами и порогамиОтсекает кандидатов по отдельным порогам, затем ранжирует по весамНужен явный контроль над вкладом каждого поиска
Объединение кандидатовБерёт кандидатов из обоих поисков и упорядочивает детерминированноВажна полнота выдачи, а не тонкое ранжирование
ПараметрЧто делаетПо умолчаниюДиапазон
Сколько фрагментов вернутьСколько фрагментов попадает в контекст ответа61–20
Лимит контекстаПредел размера собранного контекста для модели3000500–100 000
BM25: сколько кандидатовКандидаты текстового поиска до слияния и ранжирования61–50
Vector: сколько кандидатовКандидаты векторного поиска до слияния и ранжирования301–50
BM25: лимит времени, мсСколько времени текстовый поиск тратит на один вопрос20 000500–20 000
Параметр RRF kНасколько сильно верхние места влияют на итог601–500
Вес BM25 и Вес vectorВклад каждого поиска в порядок выдачи0,50–1
Порог BM25 и Порог vectorМинимальный нормализованный score для допуска кандидата0,20–1

Параметр RRF k появляется в форме только для стратегии Сбалансированная выдача (RRF), а веса и пороги — только для стратегии Гибрид с весами и порогами. Пустое поле Лимит контекста означает системное значение.

Значения по умолчанию 30 для Vector: сколько кандидатов и Сколько кандидатов дать LLM получает новая установка. На установке, обновлённой с прежней версии, профили сохраняют свои значения — их меняет администратор. Векторный поиск при 30 кандидатах заметно чаще держит нужный фрагмент среди кандидатов, чем при 15. Лимиты кандидатов действуют одинаково в чатах ассистентов, в узле «База знаний» сценария, в публичном API и в ответах агента по базе знаний.

Вкладка «Профили поиска»: стратегия сбора кандидатов
Вкладка «Профили поиска»: стратегия сбора кандидатов. Карточка профиля поиска. Панель справа показывает, как выбранная стратегия соберёт кандидатов.

Что происходит, когда текстовый поиск не укладывается в лимит времени

Текстовый поиск проходит по вопросу несколькими проходами: точные номера, цитаты в кавычках и слова вопроса. Проходы делят между собой «BM25: лимит времени, мс»: проход точных номеров или цитат занимает не больше трети лимита, проход слов вопроса берёт остаток. Если проход не уложился, платформа его останавливает и собирает ответ из уже найденного: находки предыдущих проходов и векторного поиска остаются в выдаче.

Проход слов вопроса оценивает фрагмент по редкости слов вопроса в базе: чем в меньшей доле фрагментов базы встречается слово, тем больше оно весит, а повторы слова внутри фрагмента оценку не меняют. Поэтому фрагмент с несколькими редкими словами вопроса — фамилией, названием, термином — стоит выше фрагмента, где много раз повторено общее слово. Слово вопроса в заголовке фрагмента весит вдвое, если заголовок не общий для большей части документа, как название тома. Число рядом со словом — «статья 60», «делу № 5» — ещё одно слово со своим весом: фрагмент, где они стоят рядом, получает прибавку, но всю выдачу такие фрагменты не занимают. Проход берёт первые 24 слова вопроса.

Слова, которые есть в каждом пятом фрагменте базы и чаще, — в базе судебных документов это, например, «суд» или «дело», — проход не использует для отбора фрагментов: поиск по ним дольше всего. В оценке фрагмента они участвуют с малым весом. Если редких слов в вопросе меньше двух, проход добирает самые редкие из частых. Частоты слов платформа считает по выборке из двух тысяч фрагментов базы, хранит в общем кэше и считает заново после индексации базы, при заметном изменении числа фрагментов и не реже раза в шесть часов. Первый поиск по базе после этого длится дольше, до трёх секунд.

Цитату в кавычках, которую не нашёл точный поиск фразы, проход цитат ищет ещё раз — по словам цитаты — и сверяет найденное с текстом. Так находится цитата в распознанном скане, где слово разорвано переносом: «аг- рессии» совпадает с «агрессии».

Остановленный поиск виден в журнале «Запуски LLM»: откройте запуск с бейджем RAG, в блоке «Связанный RAG run» разверните шаг Технический шаг: BM25_SEARCH. Шаг получает статус «Лимит времени», если проход упёрся в лимит, или «Частично», если проход завершился ошибкой. В выходных данных шага поле layers перечисляет проходы с числом найденных фрагментов и длительностью, а текст предупреждения называет остановленный проход. Проход слов вопроса называется any_word, его поле omittedTerms перечисляет частые слова базы, по которым проход не отбирал фрагменты. Проходы all_words и number_phrases встречаются только в журналах прежних версий. Если шаг часто получает статус «Лимит времени», передайте DevOps время и базу из журнала: медленный проход разбирают по плану запроса в базе данных. Значение по умолчанию — наибольшее допустимое. Снижайте его по данным журнала: если проходы почти всегда укладываются в несколько секунд, меньший лимит сократит ожидание ответа на редких тяжёлых вопросах.

Тот же лимит действует на поиск по базам знаний, который агент выполняет сам.

Когда включать переписывание запроса

Включайте переключатель «Включить переписывание запроса», когда пользователи задают короткие вопросы, опирающиеся на предыдущие сообщения чата: «а что с исключениями», «подробнее». Перед поиском языковая модель (LLM) превращает такой вопрос в самодостаточный запрос. В блоке задаются «Модель для переписывания» и «Промпт для переписывания»; историю чата и текущий вопрос платформа подставляет сама, поэтому в промпте описывают только правила переформулирования.

Промпт по умолчанию требует переносить цитаты, номера, даты и названия из вопроса дословно, а цитаты — вместе с кавычками. При обновлении платформы новый промпт получают только профили, где стоял прежний промпт по умолчанию. Если вы меняли промпт сами и в нём есть правило отвечать «без кавычек», замените его правилом переносить цитаты вместе с кавычками. Цитату в кавычках текстовый поиск берёт из исходного сообщения пользователя, но по переписанному запросу идут остальные проходы и векторный поиск, и пересказанную моделью цитату они находят хуже.

Когда включать LLM-ранжирование

Включайте переключатель «Включить LLM-ранжирование», когда нужный документ находится, но стоит не на первых местах выдачи. После сбора кандидатов модель получает верхние результаты и переставляет их по смыслу. Поле «Сколько кандидатов дать LLM» по умолчанию равно 30 и ограничено значением 50: чем больше кандидатов, тем дольше и дороже ответ. Держите его не меньше значения Vector: сколько кандидатов — иначе кандидаты векторного поиска из конца списка до ранжирования не дойдут. Профиль с включённым ранжированием и незаполненным полем «Модель ранжирования» не сохраняется — платформа отвечает Укажите модель rerank при включённом rerank.

Модель ранжирования получает фрагменты целиком и тот же запрос, с которым шёл поиск. Поэтому размер служебного вызова определяют значение поля «Сколько кандидатов дать LLM» и размер фрагмента из активного профиля индексации. Выбирайте в поле «Модель ранжирования» модель с запасом по длине контекста, а большое число кандидатов поднимайте постепенно и сверяйте со временем ответа. Для ориентира: при фрагменте около 350 токенов 20 кандидатов дают служебный вызов примерно на 7 600 токенов, 30 кандидатов — примерно на 11 400; на локальной модели это добавляет около секунды к ответу.

Если модель ранжирования ответила не в том формате, платформа оставляет порядок, собранный поиском, и пользователь всё равно получает ответ с цитатами. Проверить это можно в журнале «Запуски LLM»: откройте запуск с бейджем RAG, в блоке «Связанный RAG run» разверните в таймлайне «Пайплайн выполнения» шаг Технический шаг: RERANK_RESULTS. Как устроен журнал, описано в главе Центр активности.

Как настроить выбор баз знаний

Секция «Выбор баз знаний» нужна инсталляциям с десятками и сотнями баз: когда баз в поиске больше потолка, система сначала выбирает под вопрос подходящие базы по их портретам (портрет строится сам после индексации, см. руководство по системным базам знаний) и только потом ищет фрагменты.

ПараметрЧто делаетДиапазон, по умолчанию
Сужать поиск до выбранных базВыключено — выбор считается и пишется в журнал ответа, но поиск идёт по всем базам. Удобно, чтобы сверить выбор с цитатами перед включением.включено
Потолок баз без выбораЕсли баз в поиске не больше этого числа, выбор не нужен. Столько же баз сужённый поиск получает максимум: сначала базы, которые назвала модель, свободные места — ближайшие по портретам.1–20, 8
Кандидатов для моделиСколько баз-кандидатов по портретам получает служебная модель, чтобы выбрать, где искать. Больше — точнее, но длиннее служебный вызов.5–30, 15
Страховочный потолокСколько баз берётся по близости портретов, если модель ничего не выбрала, и сколько баз без портрета включается в поиск принудительно. Этим же числом ограничено, из скольких баз векторный поиск возвращает фрагменты, когда набор баз не сузился.1–50, 20
Тематических центров на базуСколько тематических центров хранит портрет базы кроме описания. Ноль — только описание. Действует на портреты, которые строятся после сохранения.0–32, 16
Выбор баз знаний в профиле поиска: сужение области поиска и лимиты
Выбор баз знаний в профиле поиска: сужение области поиска и лимиты

Страховочный потолок удерживает время ответа на инсталляциях с сотнями баз. Если после выбора баз в наборе остаётся больше баз, чем задано в поле «Потолок баз без выбора», векторный поиск возвращает фрагменты не больше чем из такого числа баз и берёт базы с лучшими совпадениями. Так происходит, когда переключатель «Сужать поиск до выбранных баз» выключен, каталог портретов недоступен или выбор не сузил набор. Текстовый поиск страховочный потолок не ограничивает.

Как задать общие настройки поиска для всей инсталляции

Перейдите на вкладку Глобальные RAG-настройки страницы «Индексация и поиск». Вкладка содержит восемь параметров, общих и для ассистентов с поиском по базам знаний, и для индексации самих баз. Для документов без структуры в режимах Родитель и Авто платформа берёт окно соседних фрагментов, а в режиме Авто — и для крупных разделов. Панель с кнопкой Сохранить появляется внизу формы только после правки полей.

ПолеЧто задаётЧто будет без значения
Глобальная embedding-модельМодель, которая строит векторы для всех фрагментовИндексация и поиск по базам знаний не работают
Размерность вектораРазмер эмбеддинга выбранной моделиМиграция коллекций не сможет создать коллекцию, если размер не определяется по ответу модели
Инструкция к вопросу для модели эмбеддинговТекст, который добавляется к вопросу перед поиском по смыслуВопрос уходит модели как есть
Лимит входного контекстаСколько символов пользовательского контекста добавляется поверх найденногоДействует системное значение
Показывать ссылки на источникиПоказывать ли цитаты в ответах с поиском по базам знанийПереключатель включён по умолчанию
Режим ретривалаЧто уходит в контекст модели: найденный фрагмент или смысловая единица целиком. Варианты — Чанк — как найден, Родитель — секция целиком, Авто — секция, если влезает в лимит. В режиме Авто контекст собирается из нескольких документов: лучшие места трёх первых документов выдачи попадают в него, даже если первый документ совпал многими местамиДействует Авто — секция, если влезает в лимит
Максимальный размер родителя, токеновВерхний предел раздела, который уходит в контекст целиком. В режиме Авто раздел идёт целиком, если он не больше этого предела и четверти значения Лимит контекста профиля поиска, а крупный раздел отдаётся окнами вокруг найденных мест32 000, диапазон 500–100 000
Окно соседних фрагментовСколько соседних фрагментов добавлять слева и справа от найденного, когда у документа нет структуры или раздел крупнее предела. Перед окном внутри подраздела платформа ставит начало подраздела: заголовок и первые строки1, диапазон 0–5

Список моделей в поле «Глобальная embedding-модель» платформа берёт из раздела Администрирование → Знания и поиск → Провайдеры эмбеддингов (/settings/administration/knowledge/embeddings): пока там нет активного провайдера с моделью, выбирать нечего. Как завести провайдера, проверить его и опубликовать модель, описано в главе Провайдеры эмбеддингов.

Если выбранная модель стала недоступна, вкладка показывает предупреждение «Выбранная модель эмбеддингов недоступна». Платформа не подменяет модель автоматически: выберите доступную пару «провайдер и модель» и сохраните настройки вручную.

Важно. Смена глобальной модели эмбеддингов делает ранее построенные векторы несовместимыми: базы знаний придётся переиндексировать.

Когда задавать инструкцию к вопросу

Многие модели эмбеддингов строят вектор вопроса точнее, если перед вопросом стоит короткая инструкция в формате, который ждёт модель. Документы при этом не меняются, поэтому переиндексация не нужна: инструкция действует со следующего вопроса. Формат задаёт производитель модели:

МодельПример инструкции
Qwen3-EmbeddingInstruct: Given a question, retrieve passages that answer the question и на новой строке Query:
e5query:

Вопрос дописывается в конец текста. Если вопрос нужен в середине, поставьте на его место {query}. Пробел в конце инструкции значим: без него вопрос склеится с последним словом. Инструкция не должна описывать предметную область — она действует для всех баз знаний установки.

Инструкция относится к глобальной модели эмбеддингов. Базы знаний, проиндексированные другой моделью, ищутся без неё. Чтобы сравнить поиск с инструкцией и без неё, запустите эксперимент на арене знаний до и после сохранения инструкции: эксперимент запоминает инструкцию, с которой шёл.

Как проверить параметры на арене знаний

Откройте Администрирование → Знания и поиск → Арена (/settings/administration/knowledge/arena). Арена знаний — стенд для проверки параметров на реальных документах до того, как они станут активным профилем. Вкладка Индексация прогоняет тестовую индексацию базы знаний, вкладка RAG сравнивает конфигурации поиска на наборе подготовленных вопросов.

Как прогнать индексацию с новыми параметрами

  1. Выберите База знаний — прогон идёт по её документам.
  2. Выберите Исходный профиль или оставьте Пустой шаблон, чтобы задать параметры с нуля.
  3. Измените Модель эмбеддингов, Размер фрагмента, Перекрытие и параметры скорости.
  4. Нажмите «Запустить индексацию».

Арена индексирует документы во временную коллекцию и удаляет её после прогона, поэтому рабочий индекс базы знаний не меняется. Пока прогон идёт, кнопка запуска заблокирована, а над формой отображается блок «Текущий запуск» со счётчиками документов, фрагментов, токенов и ошибок.

СтатусЧто означаетЧто делать
В очередиПрогон принят и ждёт исполнителяДождаться старта
ВыполняетсяИдёт тестовая индексацияДождаться завершения, второй прогон не запускается
ГотовоВсе документы обработаныСравнить метрики с прошлыми прогонами
Готово с ошибкамиЧасть документов не обработанаОткрыть прогон и посмотреть блок «Ошибки»
ОшибкаПрогон прерванПроверить доступность провайдера эмбеддингов и хранилища

Все прогоны попадают в карточку «Журнал запусков»: строка показывает время и длительность прогона, базу знаний, исходный профиль, модель эмбеддингов, нарезку (размер фрагмента и перекрытие), связку «параллельные задачи и размер пакета», результат и статус. Нажатие на строку открывает окно прогона с блоками «Конфигурация запуска», «Временные затраты», «Итоги» и «Ошибки». Рядом со статусом стоит бейдж уборки временной коллекции: Очистка OK, Очистка в работе, Очистка пропущена или Очистка не удалась.

Удачную конфигурацию сохраняют тремя способами: кнопка «Создать профиль из конфигурации запуска» в окне прогона заводит профиль по параметрам уже выполненного запуска, кнопка «Сохранить как профиль» над формой создаёт профиль из текущих значений формы, кнопка Сохранить перезаписывает выбранный исходный профиль.

Окно прогона арены: метрики, конфигурация запуска и временные затраты
Окно прогона арены: метрики, конфигурация запуска и временные затраты. Детали прогона арены. Из конфигурации завершённого прогона профиль индексации создаётся одной кнопкой.

Как сравнить конфигурации поиска

Перейдите на вкладку RAG страницы «Арена знаний». Работа идёт вокруг набора вопросов — проверочных вопросов с эталонными ссылками к одной базе знаний. Создайте набор кнопкой «Новый набор», укажите базу знаний и версию источника в блоке «Настройки набора» и наполните блок Кейсы: кейсы добавляются кнопкой «Новый кейс», импортируются из JSON кнопкой Импорт и выгружаются кнопкой Экспорт.

В блоке «Параметры запуска» выберите «Модель ответа» и «Профиль поиска». Если модель не выбрана, эксперимент берёт модель из настроек базы знаний. Чтобы проверить отклонение от профиля, переопределите Стратегия, «Сколько фрагментов вернуть», веса текстового и векторного поиска и переключатели «Переформулировка запроса», Реранкер и Мультизапрос. Затем нажмите «Запустить эксперимент». Параметры действуют только внутри эксперимента: настройки базы знаний и профили поиска не меняются.

Эксперимент появляется в блоке «История запусков» со статусом В очереди, Выполняется, Завершён, Завершён с ошибками или Ошибка. Выберите эксперимент в таблице — ниже откроются результаты по кейсам. Метрики поиска считаются по эталонным ссылкам кейса, у названия каждой метрики в интерфейсе есть подсказка:

МетрикаЧто показывает
Попадание в топ-5Есть ли эталон в тексте первых пяти фрагментов, которые получила модель; для эксперимента — доля таких кейсов
Эталон в контекстеЕсть ли эталон во всём тексте, который получила модель, — во всех фрагментах, окнах и разделах; для эксперимента — доля таких кейсов
Все доказательстваДля кейса с несколькими эталонами: попали ли в контекст модели все доказательства, например оба документа в вопросе по двум документам
РанжированиеНасколько высоко эталонные фрагменты стоят среди первых десяти результатов (nDCG@10)
Точность топ-5Доля эталонных фрагментов среди первых пяти результатов поиска
Время ответаПолное время обработки вопроса: поиск фрагментов и генерация ответа

Кнопка Открыть в строке кейса показывает панели «Ответ и источники», «Найденные фрагменты», «Этапы обработки» и «Ручная оценка» с вердиктом (Верно, Частично верно, Неполно, Опасная ошибка), подтверждённым ответом, критической ошибкой и заметками. Панель «Найденные фрагменты» показывает фрагменты, которые ушли в контекст модели, и по их полному тексту — вместе с окнами и разделами — считаются метрики кейса. Если поиск собрал раздел документа целиком, раздел занимает одну строку с тем найденным фрагментом, который стоит в выдаче выше остальных. Конфигурацию удачного эксперимента сохраняют кнопкой «Сохранить как профиль» — она создаёт полноценный профиль поиска на вкладке Профили поиска.

Судья достоверности в эксперименте

В блоке «Параметры запуска» поле Судья достоверности включает оценку каждого ответа судьёй-моделью (по умолчанию — как в настройках агента, блок «Проверка достоверности после ответа»). По каждому кейсу считаются Достоверность (доля утверждений ответа, подтверждённых фрагментами), Уместность (отвечает ли ответ на вопрос), Полнота (доля обязательных фактов кейса в ответе) и косинусная близость ответа к фрагментам; в «Истории запусков» появляются средние по эксперименту, а в окне кейса — список утверждений с доказательствами, обязательные факты, модель судьи, токены и длительность. Там, где заполнена «Ручная оценка», сводка показывает согласие судьи с экспертом — долю совпавших вердиктов: ниже 0,8 — судья или промпт требуют калибровки. Завершённый эксперимент без судьи дооценивают кнопкой «Оценить судьёй».

Перед сохранением профиля платформа сравнивает достоверность эксперимента с базовой линией — последним завершённым экспериментом того же набора вопросов с оценкой судьи: если нижняя граница 95 % доверительного интервала парной дельты ниже −0,02, диалог предупреждает о падении достоверности. Гейт мягкий: сохранить профиль можно, но сначала стоит просмотреть кейсы без опоры.

Как оценить достоверность ответов

Откройте Администрирование → Знания и поиск → Качество (/settings/administration/knowledge/quality). Страница собирает итоги проверки достоверности ответов ассистентов за период (по умолчанию — последние 30 дней): проверка идёт после каждого ответа с подключёнными источниками, когда для пространства включена функция Проверка достоверности ответов (Доступ → Функции), и не влияет на время ответа.

  • Плитки Ответов с источниками, Подтверждено, Без опоры и Средняя достоверность показывают состояние за период и изменение к предыдущему периоду; график — вердикты по дням. Серия Пропущено и сбои показывает проверки, для которых вердикт не получен.
  • Таблица разрезов переключается между ассистентами, пространствами и моделями: где доля ответов без опоры выше — там стоит проверить базы знаний и профиль поиска.
  • Список Последние проверки фильтруется по вердикту, источнику ответа и статусу; строка открывает панель с вопросом, ответом, утверждениями и фрагментами-доказательствами, стоимостью судьи и переходом в карточку запуска LLM. В колонке Вопрос — реплика пользователя, на которую отвечал ассистент, без истории диалога (для ответов через публичный API — запрос из журнала прогона); длинный вопрос в списке обрезается, целиком он показан в панели. Кнопка «Экспорт CSV» выгружает список по тем же фильтрам.
ВердиктЧто означает
Подтверждено источникамиДоля подтверждённых утверждений не ниже порога «подтверждено», противоречий нет
Подтверждено частичноДоля между порогами либо одно утверждение противоречит фрагментам
Без опоры на источникиДоля ниже порога «частично» или противоречий большинство
Ответ без утвержденийАссистент честно сообщил, что сведений в источниках нет
Источники не подключалисьВ вызов модели фрагменты не попали — судья не вызывался

Пропущенные проверки показываются с причиной: очередь переполнена, модель судьи недоступна, функция выключена для пространства. Детализация утверждений хранится 90 дней (политика Утверждения проверок достоверности в Политиках очистки), строки проверок — 400 дней, суточные срезы для плиток не удаляются вместе с ними. Та же проверка доступна в карточке запуска в Запуски LLM (блок Проверка достоверности) и в метриках Prometheus rag_answer_*.

Как управлять коллекциями векторного хранилища

Откройте Администрирование → Знания и поиск → Векторное хранилище (/settings/administration/knowledge/vector-storage). Раздел показывает фактическое состояние коллекций Qdrant в инсталляции и содержит две вкладки: Коллекции и Миграция коллекций. Параметры подключения к хранилищу в интерфейсе не задаются — адрес и доступы приходят из конфигурации развёртывания. Если хранилище недоступно, вкладки показывают предупреждение «Qdrant недоступен», а списки остаются неполными.

Вкладка Коллекции начинается с четырёх плиток: «Всего коллекций», «Всего записей», «Оценка объёма» и «Без владельца». Переключатель над таблицей фильтрует строки: Все, Сироты (управляемые коллекции без пространства-владельца) и Вне управления. Таблица содержит колонки Пространство, Коллекция, Семейство, Статус, Точек и Объём.

СемействоЧто этоУдаление из интерфейса
KB · пространствоДействующая коллекция базы знаний пространстваДоступно
Портреты базОписания баз знаний пространства и их тематические центры, по которым платформа выбирает базы под вопросДоступно
Файлы ассистентаВекторы файлов, прикреплённых к ассистентамДоступно
ПространствоПрочие коллекции пространстваДоступно
БЗ · стараяКоллекция базы знаний до перехода на коллекции пространствДоступно
АренаВременная коллекция прогона ареныДоступно
Вне управленияКоллекция, созданная вне платформыНедоступно

Чтобы удалить коллекцию, откройте меню строки и выберите «Удалить коллекцию», затем введите полное имя коллекции в поле подтверждения. Документы в базе данных при этом сохраняются. Для коллекций из семейства Вне управления пункт неактивен: такие коллекции платформа не трогает. Меню строки предназначено для точечных случаев, а массовую уборку сирот запускают политиками очистки — они описаны в главе Эксплуатация платформы.

Важно. ⚠️ Удаление коллекции необратимо: точки удаляются из Qdrant безвозвратно, и поиск по связанным базам знаний перестаёт работать до переиндексации.

Удаление коллекции семейства Портреты баз не ломает поиск по документам: фрагменты баз лежат в коллекциях семейства KB · пространство. Перестаёт работать только выбор баз под вопрос, и пока портретов нет, поиск идёт сразу по всем базам пространства, сохраняя ответы с цитатами. Портреты собираются заново после переиндексации базы или изменения её документов, названия либо описания; удалённая коллекция сама не восстанавливается. Параметры выбора описаны выше, в разделе «Как настроить выбор баз знаний».

Вкладка «Миграция коллекций» помечена как временный инструмент и нужна инсталляциям, которые переходят со старой схемы «коллекция на базу знаний» на коллекции пространств. Плитки показывают «Баз знаний» — общее число баз во всех пространствах — и «Старых осталось» — базы, у которых ещё есть старая коллекция для переноса. Статус переноса виден бейджем в строке каждой базы знаний. Перенос запускается по каждой базе знаний отдельно и требует подтверждения; старая коллекция удаляется только после успешной сверки количества точек. Кнопка «Удалить legacy» убирает старую коллекцию без переноса — до переиндексации векторный поиск по этой базе знаний работать не будет.

База, чья старая коллекция построена не на текущем глобальном сервисе эмбеддингов, перенесена быть не может: точки несовместимы, поэтому вместо копирования запускается переиндексация. Это инициатива администратора, поэтому кредиты пространства за неё не списываются, а нулевой баланс пространства такую переиндексацию не блокирует. Расход токенов остаётся виден в журнале потребления с нулевой стоимостью.

Вкладка «Коллекции»: объём хранилища, количество записей и коллекций без владельца
Вкладка «Коллекции»: объём хранилища, количество записей и коллекций без владельца. Инвентарь коллекций Qdrant. Семейство коллекции определяется по шаблону её имени.

Частые вопросы

Почему новые параметры индексации не изменили ответы ассистента

Профиль индексации применяется в момент индексации, а готовый индекс не пересобирается сам. Проверьте:

  • профиль отмечен бейджем Активный на вкладке Профили индексации;
  • документы базы знаний переиндексированы после смены профиля;
  • для проверки качества поиска правится профиль поиска, а не профиль индексации.

Почему профиль поиска не сохраняется

Форма не проходит проверку, и панель сохранения остаётся на месте. Проверьте:

  • при включённом «Включить LLM-ранжирование» выбрана «Модель ранжирования»;
  • значения полей укладываются в диапазоны из таблицы параметров;
  • название профиля заполнено и не длиннее 120 символов.

Почему разделы показывают предупреждение «Qdrant недоступен»

Платформа не получила ответ от векторного хранилища, и списки коллекций собираются неполными. Проверьте:

  • хранилище запущено и доступно по адресу из конфигурации развёртывания;
  • в разделе Векторное хранилище нажата кнопка Обновить после восстановления связи;
  • индексация баз знаний не падает с той же ошибкой — иначе проблема на стороне хранилища, а не интерфейса.

Почему участник не может загрузить файл, который укладывается в лимит

В интерфейсе видно значение, заданное администратором, а действует эффективное значение: администратор, затем переменная окружения, затем встроенное значение по умолчанию. Проверьте:

  • в разделе Импорт документов нужное поле не пустое, иначе действует подсказка Авто;
  • лимит правится в той группе, к которой относится загрузка: вложение чата и документ базы знаний ограничены разными полями;
  • изменения сохранены кнопкой Сохранить, а не только введены в поле.

Почему участник не может импортировать страницу по внутреннему адресу

Правило встроено в платформу, в группе «Знания и поиск» не настраивается и переменной не отключается. Проверка проходит при отправке формы, поэтому документ в базе не создаётся и чистить после отказа нечего. Платформа сообщает: Адрес недоступен для загрузки: разрешены только внешние адреса, служебные и петлевые закрыты.

Проверьте:

  • адрес не является петлевым или служебным адресом самой машины;
  • в коробочной поставке для адреса внутренней сети доступен маршрут из контура платформы;
  • страницу добавляют через панель «Импорт с сайта».

Сам отказ и работу с панелью описывает глава Файлы, вложения и импорты.

Что дальше