Администрирование знаний
Группа «Знания и поиск» в разделе «Администрирование» задаёт правила, по которым документы попадают в индекс и по которым платформа ищет по ним ответы. Здесь вы ограничиваете размер загружаемых файлов, описываете нарезку документов и стратегию поиска профилями, проверяете параметры на арене и управляете коллекциями векторного хранилища. Настройки действуют на всю инсталляцию платформы: отдельное рабочее пространство их не переопределяет. Сами базы знаний создают и наполняют участники пространств — из раздела «Администрирование» документы не загружаются. Базы инсталляции, по которым Уника AI отвечает всем пользователям, администратор ведёт тем же экраном «Базы знаний» в служебном пространстве «Системные базы знаний», см. главу Системные базы знаний.
Что вам понадобится
- глобальная роль
admin: группа «Знания и поиск» видна и открывается только администраторам инсталляции; - активный провайдер эмбеддингов с выбранной моделью — без него индексация и поиск не работают;
- база знаний с загруженными документами, если планируете прогоны на арене;
- доступное векторное хранилище Qdrant: при его недоступности разделы показывают предупреждение и неполные данные.
Как задать лимиты загрузки файлов и таймаут импорта
Откройте Администрирование → Знания и поиск → Импорт документов
(/settings/administration/knowledge/import). В форме раздел «Обработка файлов перед импортом»
задаёт время ожидания полноценного разбора файла, «Улучшение структуры документа» управляет
восстановлением структуры, а отдельный блок «Лимиты загрузки файлов» задаёт 16 ограничений на размер и количество файлов во всех
контурах платформы. Лимиты задаются в разделе Импорт документов, а не только переменными окружения.
В разделе «Обработка файлов перед импортом» одно поле — Таймаут, минут. Оно определяет, сколько платформа ждёт полноценную обработку файла; после истечения срока обработка повторяется с нарастающей паузой. Значение по умолчанию — 30 минут, допустимый диапазон — 5–120 минут. Кнопка «Сбросить по умолчанию» возвращает таймаут и настройки структуры к исходным значениям. Кнопка Сохранить появляется после изменения формы и применяет его. Полноценный разбор выполняет Docling, поэтому таймаут поднимают, когда в базы знаний регулярно попадают тяжёлые сканы.
Раздел «Улучшение структуры документа» содержит переключатель «Восстанавливать структуру при импорте», включённый по умолчанию. При импорте платформа распознаёт заголовки по повторяющейся нумерации, склеивает разорванные абзацы и разворачивает таблицы-обёртки; если регулярная структура не найдена, документ сохраняется без изменений. Независимо от переключателя платформа собирает слова, разорванные переносом строки, которые оставляет распознавание сканов и PDF: «аг- рессии» становится «агрессии», мягкие переносы исчезают. Составное слово вроде «генерал-майор» сохраняет дефис, а висячий дефис перед союзом в «северо- или юго-западный» остаётся как есть. Книги Excel и расшифровки речи склейку не проходят. Её получают документы, загруженные после обновления платформы. Переиндексация базы текст уже загруженных документов не меняет, поэтому им нужна повторная загрузка файла, а отдельный документ можно поправить действием «Улучшить структуру» в меню документа — оно создаёт новую версию. У блока «Лимиты загрузки файлов» своя кнопка Сохранить.
Какие лимиты можно изменить
| Лимит | Что ограничивает | По умолчанию | Диапазон |
|---|---|---|---|
| Чат · Размер обычного вложения (изображение/документ) | Один файл-вложение в сообщении | 20 МБ | 1–2048 |
| Чат · Размер медиафайла (аудио/видео) | Один аудио- или видеофайл в сообщении | 200 МБ | 1–4096 |
| Чат · Суммарный размер обычных вложений в сообщении | Все обычные вложения одного сообщения | 20 МБ | 1–4096 |
| Чат · Файлов в одном сообщении | Количество вложений в сообщении | 25 | 1–1000 |
| Файлы ассистента · Размер файла ассистента | Один файл, прикреплённый к ассистенту | 20 МБ | 1–2048 |
| Файлы ассистента · Файлов за одну загрузку | Количество файлов в одной операции загрузки | 10 | 1–1000 |
| Файлы ассистента · Материалов на ассистента | Всего файлов у одного ассистента | 20 | 1–1000 |
| Вложения к отзыву · Размер вложения к отзыву | Один скриншот или файл в отзыве | 8 МБ | 1–2048 |
| Вложения к отзыву · Вложений к одному отзыву | Количество файлов в отзыве | 5 | 1–1000 |
| База знаний · Размер документа при импорте | Один документ базы знаний — при загрузке и при обработке | 500 МБ | 1–8192 |
| База знаний · Размер архива при импорте | Один загружаемый архив | 500 МБ | 1–8192 |
| База знаний · Записей в архиве | Количество файлов внутри архива | 10 000 | 1–1 000 000 |
| База знаний · Страниц на файл при AI-OCR импорте | Глубина распознавания одного файла | 200 | 1–10 000 |
| База знаний · Страниц сканов в пакете до запроса подтверждения | Сколько страниц сканов платформа распознаёт в пакете, прежде чем запросить подтверждение | 100 | 1–100 000 |
| База знаний · Размер медиафайла при импорте | Один аудио- или видеофайл, загружаемый в базу знаний | 2048 МБ | 1–8192 |
| База знаний · Длительность медиафайла при импорте, минут | Длительность одного аудио- или видеофайла базы знаний | 240 | 1–1440 |
Размеры задаются в мегабайтах, счётчики — в штуках. Диапазон подписан под каждым полем, значение
вне диапазона платформа не сохраняет и показывает подсказку Диапазон <min>–<max>.
Что означает пустое поле
Пустое поле — это режим «Авто»: платформа берёт значение по умолчанию для инсталляции, а в
подсказке поля показывает его в виде Авто: 20. Порядок разрешения — значение администратора,
затем переменная окружения, затем встроенное значение из таблицы выше. Переменные окружения заданы
только для пяти лимитов базы знаний: KNOWLEDGE_BASE_DOCUMENT_UPLOAD_LIMIT_BYTES,
ARCHIVE_IMPORT_MAX_SIZE_BYTES, ARCHIVE_IMPORT_MAX_ENTRIES, KB_AI_OCR_MAX_PAGES_PER_FILE и KB_INGEST_OCR_CONFIRM_PAGES.
Для размера документа действует ещё UNICA_MAX_DOCUMENT_BYTES: если заданы обе переменные,
платформа берёт меньшее значение.
Кнопка «Сбросить всё в „Авто“» очищает все 16 полей сразу, но изменения вступают в силу только после нажатия Сохранить.
Как выбрать режим журнала приёма
Журнал приёма — это история обработки документов, которую показывает раздел Центр активности → Обработка документов: какие стадии прошёл каждый документ, сколько раз стадия запускалась повторно и чем закончилась каждая попытка. Режим записи задаётся на той же странице Импорт документов, в блоке Журнал приёма:
| Режим | Что записывается |
|---|---|
| Полный (по умолчанию) | Все попытки стадий обработки каждого документа |
| Только попытки | Попытки стадий без постраничной детализации — журнал занимает меньше места |
| Выключен | Ничего. Документы обрабатываются как обычно, но в журнале не видно, что с ними происходит |
Переключатель «Разрешить администратору открывать распознанный текст страницы» в том же блоке добавляет в карту страниц журнала кнопку чтения текста. По умолчанию он выключен: администратор видит только числа и коды. Каждое открытие текста фиксируется в журнале событий сервера (событие admin.ingest_journal.unit_text_read: кто, когда, какой документ и страница), сам текст в журнале приёма не хранится. В облачной поставке переключателя нет — там платформенный администратор распознанный текст пользователей не читает ни при какой настройке.
Новый режим начинает действовать на всех серверах платформы не позже чем через 30 секунд после нажатия Сохранить, перезапуск не нужен. Если журнал выключен, раздел Обработка документов предупреждает об этом над списком и показывает только записи, сделанные раньше. Сколько хранится история попыток, задаёт политика очистки «Журнал приёма: попытки стадий» (см. Эксплуатация платформы).
Как настроить нарезку документов профилем индексации
Откройте Администрирование → Знания и поиск → Индексация и поиск
(/settings/administration/knowledge/indexing) и оставайтесь на вкладке Профили индексации.
Профиль индексации описывает, как исходный текст делится на фрагменты перед векторизацией и с
какой скоростью работает индексатор. Активным может быть только один профиль инсталляции, он
применяется ко всем базам знаний.
- Нажмите Создать в карточке «Профили индексации».
- Заполните Название и Описание: по описанию потом видно, для каких документов профиль нужен.
- Задайте Размер фрагмента и Перекрытие в блоке «Нарезка документа».
- Если индексация упирается в лимиты провайдера, измените блок «Скорость индексации».
- Нажмите Сохранить на панели «Есть несохранённые изменения» внизу формы.
Новый профиль сохраняется неактивным. Чтобы он начал применяться, откройте его и нажмите «Сделать активным».
| Параметр | Что делает | По умолчанию | Когда менять |
|---|---|---|---|
| Размер фрагмента, символов | Сколько символов текста входит в один фрагмент | 800 | Ответы обрывочные или, наоборот, слишком общие |
| Перекрытие, символов | Сколько текста повторяется в соседних фрагментах | 200 | Смысл теряется на стыке фрагментов |
| Параллельные задачи | Сколько документов или пакетов индексатор обрабатывает одновременно | 4 | Индексация идёт долго или перегружает провайдера |
| Размер пакета, фрагментов | Сколько фрагментов уходит модели эмбеддингов одним запросом | 24 | Индексация идёт долго — увеличьте; провайдер отвечает ошибками на крупные запросы — уменьшите |
| Лимит пакета, токенов | Верхняя граница объёма одного пакета: длиннее — пакет делится на части | 4000 | Модель отбивает запрос по длине |
| Лимит записи в Qdrant, байт | Максимальный размер одного запроса записи в хранилище | 5 000 000 | Запись падает на тяжёлых метаданных |
Блок «Схема метаданных» свёрнут в отдельную секцию: в нём описано, какие поля попадают в
payload точки вместе с текстом фрагмента. Меню ⋯ в шапке карточки содержит «Клонировать» и
«Удалить»; удаление недоступно для активного профиля и для профилей с бейджем Системный.
Колонка «По умолчанию» описывает значения, которые подставляются в форму нового профиля. Профили, созданные раньше, сохраняют записанные в них значения: если на установке уже есть профиль с размером пакета 8, поменять его на 24 нужно вручную.
Важно. Смена активного профиля не пересобирает готовый индекс: новые параметры применяются к новым документам и к документам, которые переиндексировали вручную.
Фрагменты документа записывает индексация. Загруженный документ находится поиском, когда его индексация завершилась; если автоиндексация в пространстве выключена — после запуска индексации вручную. Когда переиндексация документа завершилась, его прежние фрагменты удаляются, и поиск читает только актуальные.
Как настроить поиск профилем поиска
Перейдите на вкладку Профили поиска страницы «Индексация и поиск». Профиль поиска описывает, как платформа собирает кандидатов из текстового и векторного поиска и как их ранжирует. В отличие от профиля индексации, активный профиль поиска начинает применяться сразу после нажатия «Сделать активным» — переиндексация не нужна.
| Стратегия | Как объединяет результаты | Когда выбирать |
|---|---|---|
| Сбалансированная выдача (RRF) | Складывает ранги BM25 и векторного поиска, не сравнивая их шкалы | Выбор по умолчанию, когда два поиска ведут себя по-разному |
| Гибрид с весами и порогами | Отсекает кандидатов по отдельным порогам, затем ранжирует по весам | Нужен явный контроль над вкладом каждого поиска |
| Объединение кандидатов | Берёт кандидатов из обоих поисков и упорядочивает детерминированно | Важна полнота выдачи, а не тонкое ранжирование |
| Параметр | Что делает | По умолчанию | Диапазон |
|---|---|---|---|
| Сколько фрагментов вернуть | Сколько фрагментов попадает в контекст ответа | 6 | 1–20 |
| Лимит контекста | Предел размера собранного контекста для модели | 3000 | 500–100 000 |
| BM25: сколько кандидатов | Кандидаты текстового поиска до слияния и ранжирования | 6 | 1–50 |
| Vector: сколько кандидатов | Кандидаты векторного поиска до слияния и ранжирования | 30 | 1–50 |
| BM25: лимит времени, мс | Сколько времени текстовый поиск тратит на один вопрос | 20 000 | 500–20 000 |
| Параметр RRF k | Насколько сильно верхние места влияют на итог | 60 | 1–500 |
| Вес BM25 и Вес vector | Вклад каждого поиска в порядок выдачи | 0,5 | 0–1 |
| Порог BM25 и Порог vector | Минимальный нормализованный score для допуска кандидата | 0,2 | 0–1 |
Параметр RRF k появляется в форме только для стратегии Сбалансированная выдача (RRF), а веса
и пороги — только для стратегии Гибрид с весами и порогами. Пустое поле Лимит контекста
означает системное значение.
Значения по умолчанию 30 для Vector: сколько кандидатов и Сколько кандидатов дать LLM получает новая установка. На установке, обновлённой с прежней версии, профили сохраняют свои значения — их меняет администратор. Векторный поиск при 30 кандидатах заметно чаще держит нужный фрагмент среди кандидатов, чем при 15. Лимиты кандидатов действуют одинаково в чатах ассистентов, в узле «База знаний» сценария, в публичном API и в ответах агента по базе знаний.
Что происходит, когда текстовый поиск не укладывается в лимит времени
Текстовый поиск проходит по вопросу несколькими проходами: точные номера, цитаты в кавычках и слова вопроса. Проходы делят между собой «BM25: лимит времени, мс»: проход точных номеров или цитат занимает не больше трети лимита, проход слов вопроса берёт остаток. Если проход не уложился, платформа его останавливает и собирает ответ из уже найденного: находки предыдущих проходов и векторного поиска остаются в выдаче.
Проход слов вопроса оценивает фрагмент по редкости слов вопроса в базе: чем в меньшей доле фрагментов базы встречается слово, тем больше оно весит, а повторы слова внутри фрагмента оценку не меняют. Поэтому фрагмент с несколькими редкими словами вопроса — фамилией, названием, термином — стоит выше фрагмента, где много раз повторено общее слово. Слово вопроса в заголовке фрагмента весит вдвое, если заголовок не общий для большей части документа, как название тома. Число рядом со словом — «статья 60», «делу № 5» — ещё одно слово со своим весом: фрагмент, где они стоят рядом, получает прибавку, но всю выдачу такие фрагменты не занимают. Проход берёт первые 24 слова вопроса.
Слова, которые есть в каждом пятом фрагменте базы и чаще, — в базе судебных документов это, например, «суд» или «дело», — проход не использует для отбора фрагментов: поиск по ним дольше всего. В оценке фрагмента они участвуют с малым весом. Если редких слов в вопросе меньше двух, проход добирает самые редкие из частых. Частоты слов платформа считает по выборке из двух тысяч фрагментов базы, хранит в общем кэше и считает заново после индексации базы, при заметном изменении числа фрагментов и не реже раза в шесть часов. Первый поиск по базе после этого длится дольше, до трёх секунд.
Цитату в кавычках, которую не нашёл точный поиск фразы, проход цитат ищет ещё раз — по словам цитаты — и сверяет найденное с текстом. Так находится цитата в распознанном скане, где слово разорвано переносом: «аг- рессии» совпадает с «агрессии».
Остановленный поиск виден в журнале «Запуски LLM»: откройте запуск с бейджем RAG, в блоке
«Связанный RAG run» разверните шаг Технический шаг: BM25_SEARCH. Шаг получает статус
«Лимит времени», если проход упёрся в лимит, или «Частично», если проход завершился
ошибкой. В выходных данных шага поле layers перечисляет проходы с числом найденных фрагментов и
длительностью, а текст предупреждения называет остановленный проход. Проход слов вопроса называется
any_word, его поле omittedTerms перечисляет частые слова базы, по которым проход не отбирал
фрагменты. Проходы all_words и number_phrases встречаются только в журналах прежних версий. Если
шаг часто получает статус «Лимит времени», передайте DevOps время и базу из журнала: медленный
проход разбирают по плану запроса в базе данных. Значение по умолчанию — наибольшее допустимое. Снижайте его по данным
журнала: если проходы почти всегда укладываются в несколько секунд, меньший лимит сократит
ожидание ответа на редких тяжёлых вопросах.
Тот же лимит действует на поиск по базам знаний, который агент выполняет сам.
Когда включать переписывание запроса
Включайте переключатель «Включить переписывание запроса», когда пользователи задают короткие вопросы, опирающиеся на предыдущие сообщения чата: «а что с исключениями», «подробнее». Перед поиском языковая модель (LLM) превращает такой вопрос в самодостаточный запрос. В блоке задаются «Модель для переписывания» и «Промпт для переписывания»; историю чата и текущий вопрос платформа подставляет сама, поэтому в промпте описывают только правила переформулирования.
Промпт по умолчанию требует переносить цитаты, номера, даты и названия из вопроса дословно, а цитаты — вместе с кавычками. При обновлении платформы новый промпт получают только профили, где стоял прежний промпт по умолчанию. Если вы меняли промпт сами и в нём есть правило отвечать «без кавычек», замените его правилом переносить цитаты вместе с кавычками. Цитату в кавычках текстовый поиск берёт из исходного сообщения пользователя, но по переписанному запросу идут остальные проходы и векторный поиск, и пересказанную моделью цитату они находят хуже.
Когда включать LLM-ранжирование
Включайте переключатель «Включить LLM-ранжирование», когда нужный документ находится, но стоит
не на первых местах выдачи. После сбора кандидатов модель получает верхние результаты и
переставляет их по смыслу. Поле «Сколько кандидатов дать LLM» по умолчанию равно 30 и
ограничено значением 50: чем больше кандидатов, тем дольше и дороже ответ. Держите его не меньше
значения Vector: сколько кандидатов — иначе кандидаты векторного поиска из конца списка до
ранжирования не дойдут. Профиль с включённым
ранжированием и незаполненным полем «Модель ранжирования» не сохраняется — платформа отвечает
Укажите модель rerank при включённом rerank.
Модель ранжирования получает фрагменты целиком и тот же запрос, с которым шёл поиск. Поэтому размер служебного вызова определяют значение поля «Сколько кандидатов дать LLM» и размер фрагмента из активного профиля индексации. Выбирайте в поле «Модель ранжирования» модель с запасом по длине контекста, а большое число кандидатов поднимайте постепенно и сверяйте со временем ответа. Для ориентира: при фрагменте около 350 токенов 20 кандидатов дают служебный вызов примерно на 7 600 токенов, 30 кандидатов — примерно на 11 400; на локальной модели это добавляет около секунды к ответу.
Если модель ранжирования ответила не в том формате, платформа оставляет порядок, собранный поиском, и пользователь всё равно получает ответ с цитатами. Проверить это можно в журнале «Запуски LLM»: откройте запуск с бейджем RAG, в блоке «Связанный RAG run» разверните в таймлайне «Пайплайн выполнения» шаг Технический шаг: RERANK_RESULTS. Как устроен журнал, описано в главе Центр активности.
Как настроить выбор баз знаний
Секция «Выбор баз знаний» нужна инсталляциям с десятками и сотнями баз: когда баз в поиске больше потолка, система сначала выбирает под вопрос подходящие базы по их портретам (портрет строится сам после индексации, см. руководство по системным базам знаний) и только потом ищет фрагменты.
| Параметр | Что делает | Диапазон, по умолчанию |
|---|---|---|
| Сужать поиск до выбранных баз | Выключено — выбор считается и пишется в журнал ответа, но поиск идёт по всем базам. Удобно, чтобы сверить выбор с цитатами перед включением. | включено |
| Потолок баз без выбора | Если баз в поиске не больше этого числа, выбор не нужен. Столько же баз сужённый поиск получает максимум: сначала базы, которые назвала модель, свободные места — ближайшие по портретам. | 1–20, 8 |
| Кандидатов для модели | Сколько баз-кандидатов по портретам получает служебная модель, чтобы выбрать, где искать. Больше — точнее, но длиннее служебный вызов. | 5–30, 15 |
| Страховочный потолок | Сколько баз берётся по близости портретов, если модель ничего не выбрала, и сколько баз без портрета включается в поиск принудительно. Этим же числом ограничено, из скольких баз векторный поиск возвращает фрагменты, когда набор баз не сузился. | 1–50, 20 |
| Тематических центров на базу | Сколько тематических центров хранит портрет базы кроме описания. Ноль — только описание. Действует на портреты, которые строятся после сохранения. | 0–32, 16 |
Страховочный потолок удерживает время ответа на инсталляциях с сотнями баз. Если после выбора баз в наборе остаётся больше баз, чем задано в поле «Потолок баз без выбора», векторный поиск возвращает фрагменты не больше чем из такого числа баз и берёт базы с лучшими совпадениями. Так происходит, когда переключатель «Сужать поиск до выбранных баз» выключен, каталог портретов недоступен или выбор не сузил набор. Текстовый поиск страховочный потолок не ограничивает.
Как задать общие настройки поиска для всей инсталляции
Перейдите на вкладку Глобальные RAG-настройки страницы «Индексация и поиск». Вкладка содержит восемь параметров, общих и для ассистентов с поиском по базам знаний, и для индексации самих баз. Для документов без структуры в режимах Родитель и Авто платформа берёт окно соседних фрагментов, а в режиме Авто — и для крупных разделов. Панель с кнопкой Сохранить появляется внизу формы только после правки полей.
| Поле | Что задаёт | Что будет без значения |
|---|---|---|
| Глобальная embedding-модель | Модель, которая строит векторы для всех фрагментов | Индексация и поиск по базам знаний не работают |
| Размерность вектора | Размер эмбеддинга выбранной модели | Миграция коллекций не сможет создать коллекцию, если размер не определяется по ответу модели |
| Инструкция к вопросу для модели эмбеддингов | Текст, который добавляется к вопросу перед поиском по смыслу | Вопрос уходит модели как есть |
| Лимит входного контекста | Сколько символов пользовательского контекста добавляется поверх найденного | Действует системное значение |
| Показывать ссылки на источники | Показывать ли цитаты в ответах с поиском по базам знаний | Переключатель включён по умолчанию |
| Режим ретривала | Что уходит в контекст модели: найденный фрагмент или смысловая единица целиком. Варианты — Чанк — как найден, Родитель — секция целиком, Авто — секция, если влезает в лимит. В режиме Авто контекст собирается из нескольких документов: лучшие места трёх первых документов выдачи попадают в него, даже если первый документ совпал многими местами | Действует Авто — секция, если влезает в лимит |
| Максимальный размер родителя, токенов | Верхний предел раздела, который уходит в контекст целиком. В режиме Авто раздел идёт целиком, если он не больше этого предела и четверти значения Лимит контекста профиля поиска, а крупный раздел отдаётся окнами вокруг найденных мест | 32 000, диапазон 500–100 000 |
| Окно соседних фрагментов | Сколько соседних фрагментов добавлять слева и справа от найденного, когда у документа нет структуры или раздел крупнее предела. Перед окном внутри подраздела платформа ставит начало подраздела: заголовок и первые строки | 1, диапазон 0–5 |
Список моделей в поле «Глобальная embedding-модель» платформа берёт из раздела
Администрирование → Знания и поиск → Провайдеры эмбеддингов
(/settings/administration/knowledge/embeddings): пока там нет активного провайдера с моделью,
выбирать нечего. Как завести провайдера, проверить его и опубликовать модель, описано в главе
Провайдеры эмбеддингов.
Если выбранная модель стала недоступна, вкладка показывает предупреждение «Выбранная модель эмбеддингов недоступна». Платформа не подменяет модель автоматически: выберите доступную пару «провайдер и модель» и сохраните настройки вручную.
Важно. Смена глобальной модели эмбеддингов делает ранее построенные векторы несовместимыми: базы знаний придётся переиндексировать.
Когда задавать инструкцию к вопросу
Многие модели эмбеддингов строят вектор вопроса точнее, если перед вопросом стоит короткая инструкция в формате, который ждёт модель. Документы при этом не меняются, поэтому переиндексация не нужна: инструкция действует со следующего вопроса. Формат задаёт производитель модели:
| Модель | Пример инструкции |
|---|---|
| Qwen3-Embedding | Instruct: Given a question, retrieve passages that answer the question и на новой строке Query: |
| e5 | query: |
Вопрос дописывается в конец текста. Если вопрос нужен в середине, поставьте на его место {query}.
Пробел в конце инструкции значим: без него вопрос склеится с последним словом. Инструкция не должна
описывать предметную область — она действует для всех баз знаний установки.
Инструкция относится к глобальной модели эмбеддингов. Базы знаний, проиндексированные другой моделью, ищутся без неё. Чтобы сравнить поиск с инструкцией и без неё, запустите эксперимент на арене знаний до и после сохранения инструкции: эксперимент запоминает инструкцию, с которой шёл.
Как проверить параметры на арене знаний
Откройте Администрирование → Знания и поиск → Арена
(/settings/administration/knowledge/arena). Арена знаний — стенд для проверки параметров на
реальных документах до того, как они станут активным профилем. Вкладка Индексация прогоняет
тестовую индексацию базы знаний, вкладка RAG сравнивает конфигурации поиска на наборе
подготовленных вопросов.
Как прогнать индексацию с новыми параметрами
- Выберите База знаний — прогон идёт по её документам.
- Выберите Исходный профиль или оставьте
Пустой шаблон, чтобы задать параметры с нуля. - Измените Модель эмбеддингов, Размер фрагмента, Перекрытие и параметры скорости.
- Нажмите «Запустить индексацию».
Арена индексирует документы во временную коллекцию и удаляет её после прогона, поэтому рабочий индекс базы знаний не меняется. Пока прогон идёт, кнопка запуска заблокирована, а над формой отображается блок «Текущий запуск» со счётчиками документов, фрагментов, токенов и ошибок.
| Статус | Что означает | Что делать |
|---|---|---|
В очереди | Прогон принят и ждёт исполнителя | Дождаться старта |
Выполняется | Идёт тестовая индексация | Дождаться завершения, второй прогон не запускается |
Готово | Все документы обработаны | Сравнить метрики с прошлыми прогонами |
Готово с ошибками | Часть документов не обработана | Открыть прогон и посмотреть блок «Ошибки» |
Ошибка | Прогон прерван | Проверить доступность провайдера эмбеддингов и хранилища |
Все прогоны попадают в карточку «Журнал запусков»: строка показывает время и длительность
прогона, базу знаний, исходный профиль, модель эмбеддингов, нарезку (размер фрагмента и
перекрытие), связку «параллельные задачи и размер пакета», результат и статус. Нажатие на строку открывает окно прогона
с блоками «Конфигурация запуска», «Временные затраты»,
«Итоги» и «Ошибки». Рядом со статусом стоит бейдж уборки временной коллекции:
Очистка OK, Очистка в работе, Очистка пропущена или Очистка не удалась.
Удачную конфигурацию сохраняют тремя способами: кнопка «Создать профиль из конфигурации запуска» в окне прогона заводит профиль по параметрам уже выполненного запуска, кнопка «Сохранить как профиль» над формой создаёт профиль из текущих значений формы, кнопка Сохранить перезаписывает выбранный исходный профиль.
Как сравнить конфигурации поиска
Перейдите на вкладку RAG страницы «Арена знаний». Работа идёт вокруг набора вопросов — проверочных вопросов с эталонными ссылками к одной базе знаний. Создайте набор кнопкой «Новый набор», укажите базу знаний и версию источника в блоке «Настройки набора» и наполните блок Кейсы: кейсы добавляются кнопкой «Новый кейс», импортируются из JSON кнопкой Импорт и выгружаются кнопкой Экспорт.
В блоке «Параметры запуска» выберите «Модель ответа» и «Профиль поиска». Если модель не выбрана, эксперимент берёт модель из настроек базы знаний. Чтобы проверить отклонение от профиля, переопределите Стратегия, «Сколько фрагментов вернуть», веса текстового и векторного поиска и переключатели «Переформулировка запроса», Реранкер и Мультизапрос. Затем нажмите «Запустить эксперимент». Параметры действуют только внутри эксперимента: настройки базы знаний и профили поиска не меняются.
Эксперимент появляется в блоке «История запусков» со статусом В очереди, Выполняется,
Завершён, Завершён с ошибками или Ошибка. Выберите эксперимент в таблице — ниже откроются
результаты по кейсам. Метрики поиска считаются по эталонным ссылкам кейса, у названия каждой метрики
в интерфейсе есть подсказка:
| Метрика | Что показывает |
|---|---|
| Попадание в топ-5 | Есть ли эталон в тексте первых пяти фрагментов, которые получила модель; для эксперимента — доля таких кейсов |
| Эталон в контексте | Есть ли эталон во всём тексте, который получила модель, — во всех фрагментах, окнах и разделах; для эксперимента — доля таких кейсов |
| Все доказательства | Для кейса с несколькими эталонами: попали ли в контекст модели все доказательства, например оба документа в вопросе по двум документам |
| Ранжирование | Насколько высоко эталонные фрагменты стоят среди первых десяти результатов (nDCG@10) |
| Точность топ-5 | Доля эталонных фрагментов среди первых пяти результатов поиска |
| Время ответа | Полное время обработки вопроса: поиск фрагментов и генерация ответа |
Кнопка Открыть в строке кейса показывает панели «Ответ и источники»,
«Найденные фрагменты», «Этапы обработки» и «Ручная оценка» с вердиктом (Верно,
Частично верно, Неполно, Опасная ошибка), подтверждённым ответом, критической ошибкой и
заметками. Панель «Найденные фрагменты» показывает фрагменты, которые ушли в контекст модели, и
по их полному тексту — вместе с окнами и разделами — считаются метрики кейса. Если поиск собрал раздел документа целиком, раздел занимает одну
строку с тем найденным фрагментом, который стоит в выдаче выше остальных. Конфигурацию удачного
эксперимента сохраняют кнопкой «Сохранить как профиль» — она создаёт полноценный профиль поиска
на вкладке Профили поиска.
Судья достоверности в эксперименте
В блоке «Параметры запуска» поле Судья достоверности включает оценку каждого ответа судьёй-моделью (по умолчанию — как в настройках агента, блок «Проверка достоверности после ответа»). По каждому кейсу считаются Достоверность (доля утверждений ответа, подтверждённых фрагментами), Уместность (отвечает ли ответ на вопрос), Полнота (доля обязательных фактов кейса в ответе) и косинусная близость ответа к фрагментам; в «Истории запусков» появляются средние по эксперименту, а в окне кейса — список утверждений с доказательствами, обязательные факты, модель судьи, токены и длительность. Там, где заполнена «Ручная оценка», сводка показывает согласие судьи с экспертом — долю совпавших вердиктов: ниже 0,8 — судья или промпт требуют калибровки. Завершённый эксперимент без судьи дооценивают кнопкой «Оценить судьёй».
Перед сохранением профиля платформа сравнивает достоверность эксперимента с базовой линией — последним завершённым экспериментом того же набора вопросов с оценкой судьи: если нижняя граница 95 % доверительного интервала парной дельты ниже −0,02, диалог предупреждает о падении достоверности. Гейт мягкий: сохранить профиль можно, но сначала стоит просмотреть кейсы без опоры.
Как оценить достоверность ответов
Откройте Администрирование → Знания и поиск → Качество
(/settings/administration/knowledge/quality). Страница собирает итоги проверки достоверности
ответов ассистентов за период (по умолчанию — последние 30 дней): проверка идёт после каждого
ответа с подключёнными источниками, когда для пространства включена функция Проверка
достоверности ответов (Доступ → Функции), и не влияет на время ответа.
- Плитки Ответов с источниками, Подтверждено, Без опоры и Средняя достоверность показывают состояние за период и изменение к предыдущему периоду; график — вердикты по дням. Серия Пропущено и сбои показывает проверки, для которых вердикт не получен.
- Таблица разрезов переключается между ассистентами, пространствами и моделями: где доля ответов без опоры выше — там стоит проверить базы знаний и профиль поиска.
- Список Последние проверки фильтруется по вердикту, источнику ответа и статусу; строка открывает панель с вопросом, ответом, утверждениями и фрагментами-доказательствами, стоимостью судьи и переходом в карточку запуска LLM. В колонке Вопрос — реплика пользователя, на которую отвечал ассистент, без истории диалога (для ответов через публичный API — запрос из журнала прогона); длинный вопрос в списке обрезается, целиком он показан в панели. Кнопка «Экспорт CSV» выгружает список по тем же фильтрам.
| Вердикт | Что означает |
|---|---|
Подтверждено источниками | Доля подтверждённых утверждений не ниже порога «подтверждено», противоречий нет |
Подтверждено частично | Доля между порогами либо одно утверждение противоречит фрагментам |
Без опоры на источники | Доля ниже порога «частично» или противоречий большинство |
Ответ без утверждений | Ассистент честно сообщил, что сведений в источниках нет |
Источники не подключались | В вызов модели фрагменты не попали — судья не вызывался |
Пропущенные проверки показываются с причиной: очередь переполнена, модель судьи недоступна,
функция выключена для пространства. Детализация утверждений хранится 90 дней (политика
Утверждения проверок достоверности в Политиках очистки), строки проверок — 400 дней,
суточные срезы для плиток не удаляются вместе с ними. Та же проверка доступна в карточке запуска
в Запуски LLM (блок Проверка достоверности) и в метриках Prometheus rag_answer_*.
Как управлять коллекциями векторного хранилища
Откройте Администрирование → Знания и поиск → Векторное хранилище
(/settings/administration/knowledge/vector-storage). Раздел показывает фактическое состояние
коллекций Qdrant в инсталляции и содержит две вкладки: Коллекции и Миграция коллекций.
Параметры подключения к хранилищу в интерфейсе не задаются — адрес и доступы приходят из
конфигурации развёртывания. Если хранилище недоступно, вкладки показывают предупреждение
«Qdrant недоступен», а списки остаются неполными.
Вкладка Коллекции начинается с четырёх плиток: «Всего коллекций», «Всего записей», «Оценка объёма» и «Без владельца». Переключатель над таблицей фильтрует строки: Все, Сироты (управляемые коллекции без пространства-владельца) и Вне управления. Таблица содержит колонки Пространство, Коллекция, Семейство, Статус, Точек и Объём.
| Семейство | Что это | Удаление из интерфейса |
|---|---|---|
KB · пространство | Действующая коллекция базы знаний пространства | Доступно |
Портреты баз | Описания баз знаний пространства и их тематические центры, по которым платформа выбирает базы под вопрос | Доступно |
Файлы ассистента | Векторы файлов, прикреплённых к ассистентам | Доступно |
Пространство | Прочие коллекции пространства | Доступно |
БЗ · старая | Коллекция базы знаний до перехода на коллекции пространств | Доступно |
Арена | Временная коллекция прогона арены | Доступно |
Вне управления | Коллекция, созданная вне платформы | Недоступно |
Чтобы удалить коллекцию, откройте меню строки и выберите «Удалить коллекцию», затем введите
полное имя коллекции в поле подтверждения. Документы в базе данных при этом сохраняются. Для
коллекций из семейства Вне управления пункт неактивен: такие коллекции платформа не трогает.
Меню строки предназначено для точечных случаев, а массовую уборку сирот запускают
политиками очистки — они описаны в главе
Эксплуатация платформы.
Важно. ⚠️ Удаление коллекции необратимо: точки удаляются из Qdrant безвозвратно, и поиск по связанным базам знаний перестаёт работать до переиндексации.
Удаление коллекции семейства Портреты баз не ломает поиск по документам: фрагменты баз лежат в коллекциях семейства KB · пространство. Перестаёт работать только выбор баз под вопрос, и пока портретов нет, поиск идёт сразу по всем базам пространства, сохраняя ответы с цитатами. Портреты собираются заново после переиндексации базы или изменения её документов, названия либо описания; удалённая коллекция сама не восстанавливается. Параметры выбора описаны выше, в разделе «Как настроить выбор баз знаний».
Вкладка «Миграция коллекций» помечена как временный инструмент и нужна инсталляциям, которые переходят со старой схемы «коллекция на базу знаний» на коллекции пространств. Плитки показывают «Баз знаний» — общее число баз во всех пространствах — и «Старых осталось» — базы, у которых ещё есть старая коллекция для переноса. Статус переноса виден бейджем в строке каждой базы знаний. Перенос запускается по каждой базе знаний отдельно и требует подтверждения; старая коллекция удаляется только после успешной сверки количества точек. Кнопка «Удалить legacy» убирает старую коллекцию без переноса — до переиндексации векторный поиск по этой базе знаний работать не будет.
База, чья старая коллекция построена не на текущем глобальном сервисе эмбеддингов, перенесена быть не может: точки несовместимы, поэтому вместо копирования запускается переиндексация. Это инициатива администратора, поэтому кредиты пространства за неё не списываются, а нулевой баланс пространства такую переиндексацию не блокирует. Расход токенов остаётся виден в журнале потребления с нулевой стоимостью.
Частые вопросы
Почему новые параметры индексации не изменили ответы ассистента
Профиль индексации применяется в момент индексации, а готовый индекс не пересобирается сам. Проверьте:
- профиль отмечен бейджем
Активныйна вкладке Профили индексации; - документы базы знаний переиндексированы после смены профиля;
- для проверки качества поиска правится профиль поиска, а не профиль индексации.
Почему профиль поиска не сохраняется
Форма не проходит проверку, и панель сохранения остаётся на месте. Проверьте:
- при включённом «Включить LLM-ранжирование» выбрана «Модель ранжирования»;
- значения полей укладываются в диапазоны из таблицы параметров;
- название профиля заполнено и не длиннее 120 символов.
Почему разделы показывают предупреждение «Qdrant недоступен»
Платформа не получила ответ от векторного хранилища, и списки коллекций собираются неполными. Проверьте:
- хранилище запущено и доступно по адресу из конфигурации развёртывания;
- в разделе Векторное хранилище нажата кнопка Обновить после восстановления связи;
- индексация баз знаний не падает с той же ошибкой — иначе проблема на стороне хранилища, а не интерфейса.
Почему участник не может загрузить файл, который укладывается в лимит
В интерфейсе видно значение, заданное администратором, а действует эффективное значение: администратор, затем переменная окружения, затем встроенное значение по умолчанию. Проверьте:
- в разделе Импорт документов нужное поле не пустое, иначе действует подсказка
Авто; - лимит правится в той группе, к которой относится загрузка: вложение чата и документ базы знаний ограничены разными полями;
- изменения сохранены кнопкой Сохранить, а не только введены в поле.
Почему участник не может импортировать страницу по внутреннему адресу
Правило встроено в платформу, в группе «Знания и поиск» не настраивается и переменной не отключается. Проверка проходит при отправке формы, поэтому документ в базе не создаётся и чистить после отказа нечего. Платформа сообщает: Адрес недоступен для загрузки: разрешены только внешние адреса, служебные и петлевые закрыты.
Проверьте:
- адрес не является петлевым или служебным адресом самой машины;
- в коробочной поставке для адреса внутренней сети доступен маршрут из контура платформы;
- страницу добавляют через панель «Импорт с сайта».
Сам отказ и работу с панелью описывает глава Файлы, вложения и импорты.
Что дальше
- Провайдеры эмбеддингов — подключить провайдера, из которого выбирается глобальная модель.
- Docling: структурный импорт документов — разобраться, как устроен полноценный разбор файлов перед импортом.
- RAG и поиск по знаниям — увидеть, как настройки поиска выглядят со стороны пользователя.
- Базы знаний — понять, как участники загружают документы и запускают индексацию.
- Раздел администрирования — перейти к остальным группам настроек инсталляции.