Провайдеры эмбеддингов
Провайдер эмбеддингов — сохранённое в платформе подключение к сервису, который превращает текст
в числовой вектор. По этим векторам платформа индексирует документы баз знаний и ищет по ним ответы.
Провайдеров вы ведёте в разделе Администрирование → Знания и поиск → Провайдеры эмбеддингов
(/settings/administration/knowledge/embeddings). Провайдеров может быть несколько, но рабочая пара
«провайдер + модель» в инсталляции платформы одна: её задают глобальные RAG-настройки.
Из коробки платформа работает с сервисом эмбеддингов Unica AI из поставки; если в периметре
компании уже есть централизованный OpenAI-совместимый API векторизации, подключите его
кастомным провайдером.
Что вам понадобится
- глобальная роль
admin: раздел Администрирование открыт только ей; - адрес эндпоинта векторизации у выбранного сервиса;
- ключ авторизации или пара
client_id:client_secretдля OAuth; - известная размерность вектора модели — это же число вы указываете в глобальных RAG-настройках.
Как подключить провайдера эмбеддингов
Нажмите Создать провайдер: платформа откроет окно Новый провайдер эмбеддингов. Начните с поля Шаблон провайдера — Unica AI или кастомный провайдер: шаблон подставит адреса и режим авторизации. Заполните секции Основные настройки, Подключение и Модель и доступ и нажмите Создать.
Для кастомного провайдера в секции Основные настройки добавляются поля Контракт API
со значениями OpenAI-compatible и Generic HTTP и Авторизация со значениями
Bearer / API key, OAuth и Без авторизации.
| Поле секции Подключение | Что указать |
|---|---|
| Endpoint для Access Token | Адрес выдачи access-токена; только при авторизации через OAuth |
| Endpoint эмбеддингов | Адрес векторизации: https://<хост>/v1/embeddings |
| Authorization key | Секрет авторизации: Bearer-токен или ключ API |
| OAuth scope | Область доступа; только при авторизации через OAuth |
| WorkSpace ID (Unica AI) | Идентификатор пространства во внешнем сервисе; только для шаблона Unica AI |
Сохранённый ключ платформа обратно не отдаёт: в таблице показан признак Ключ сохранён или Без ключа, а в форме поле остаётся пустым. Пустое поле при сохранении означает «оставить прежний ключ». Переход в режим без авторизации удаляет сохранённый ключ, адрес токена и scope.
Как задать каталог моделей и расширенные параметры
Секция Модель и доступ в форме провайдера эмбеддингов задаёт каталог моделей и доступность провайдера. Переключатели Провайдер активен, Глобальный провайдер — доступен во всех рабочих пространствах и Отключить проверку сертификата (для самоподписанных) отвечают за доступность, а поле Максимум токенов на элемент ограничивает один текст в запросе числом не больше 100 000.
Таблица Доступные модели хранит пары «название + идентификатор». Строки таблицы Доступные модели синхронизируются с общим реестром AI-модели.
Примечание. Отдельного поля «Модель по умолчанию» у провайдера эмбеддингов нет: рабочую модель вы выбираете в глобальных RAG-настройках.
Секция Расширенные параметры нужна для нестандартных сервисов: Дополнительные заголовки
и Дополнительные поля тела запроса принимают JSON-объекты, а для контракта Generic HTTP
секция добавляет поля Ключ input, Ключ модели, JSON-path вектора
и JSON-path токенов.
Значения заголовков с секретами платформа в браузер не возвращает: имя заголовка остаётся, а значение приходит пустым. Пустое значение при сохранении оставляет прежний секрет.
Как проверить подключение
Откройте сохранённого провайдера: платформа покажет настройки в правой панели. В секции Проверка подключения введите Тестовый текст и нажмите Проверить. Платформа получит access-токен, отправит текст на векторизацию и разберёт ответ.
Результат остаётся в той же секции: статус, строка Размерность с числом измерений вектора, строка Токенов с расходом и список диагностических шагов. Запомните размерность: это же число вы указываете в глобальных RAG-настройках.
Кнопка Проверить недоступна, пока форма изменена: проверка намеренно работает только с сохранённой конфигурацией. Сохраните правки и повторите. Если у записи не заполнено устаревшее поле модели, проверка берёт первую модель из таблицы Доступные модели.
Какая модель эмбеддингов работает в инсталляции
Рабочую пару «провайдер + модель» задаёт одно поле — Глобальная embedding-модель на вкладке
Глобальные RAG-настройки страницы Администрирование → Знания и поиск → Индексация и поиск
(/settings/administration/knowledge/indexing). Поле Глобальная embedding-модель возвращает пару
целиком, поэтому отдельного выбора провайдера на вкладке нет. Поле Размерность вектора платформа
использует для создания и миграции коллекций, когда размер нельзя определить по ответу модели.
Платформа применяет эту пару одинаково и для индексации документов баз знаний, и для векторизации запросов при поиске, и для файлов ассистента. Каскада «ассистент — пространство — инсталляция» нет: настройка одна на всю инсталляцию платформы.
- Создайте провайдера.
- Включите переключатель Провайдер активен.
- Проверьте подключение и запишите размерность вектора из результата.
- Откройте вкладку Глобальные RAG-настройки.
- Выберите значение поля Глобальная embedding-модель.
- Укажите Размерность вектора.
- Сохраните настройки.
- Запустите индексацию базы знаний.
Если выбранная пара стала недоступна, страница показывает предупреждение «Выбранная модель эмбеддингов недоступна». Платформа не подменяет ваш выбор автоматически: выберите доступную пару и сохраните. Пока глобальная пара не выбрана, индексация не запускается.
Единственное исключение — настройки ассистента. Блок Embedding-модель для запросов предлагает режимы Глобальный режим и Custom override, а при выборе Custom override появляется поле Custom embedding-модель. Режим Custom override предназначен для баз знаний, вручную переиндексированных другой моделью, и для проверок; в остальных случаях оставляйте Глобальный режим.
Что происходит при смене модели эмбеддингов
Смена глобальной модели обесценивает уже посчитанные векторы: документы проиндексированы одной моделью, а запрос считается другой, и поиск перестаёт находить релевантные фрагменты. Поэтому после смены модели переиндексируйте базы знаний и заново загрузите файлы ассистентов.
Важно. ⚠️ Переиндексация удаляет прежние точки из векторного хранилища и считает векторы заново.
Если размерность новой модели отличается от размерности коллекции, платформа отдаёт явную ошибку, а не пустой результат поиска. Перенести коллекции на новую модель помогает страница Администрирование → Знания и поиск → Векторное хранилище с действиями Перенести, Повторить перенос, Завершить перенос и Переиндексировать.
Как отключить или удалить провайдера
Отключить провайдера можно переключателем в колонке Статус прямо из списка. Платформа спросит подтверждение и предупредит, что новые операции векторизации перестанут использовать этот провайдер, а уже созданные векторы не изменятся. Платформа сохраняет изменение сразу. Неполную старую конфигурацию вы отключаете без исправления остальных полей, а повторное включение потребует корректных настроек.
Удаление доступно из меню строки списка и кнопкой Удалить провайдер внизу формы. Платформа блокирует удаление, пока на провайдера ссылаются записи реестра AI-модели, глобальные RAG-настройки, правила и профили индексации, политика баз знаний, ассистенты или сохранённое состояние индексации, и показывает список зависимостей. Перенесите зависимости на другого провайдера и повторите удаление.
Частые вопросы
Почему индексация базы знаний не запускается
Платформа не нашла рабочую пару «провайдер + модель». Проверьте:
- на вкладке Глобальные RAG-настройки заполнено поле Глобальная embedding-модель;
- у провайдера этой пары включён переключатель Провайдер активен;
- модель из пары есть в таблице Доступные модели провайдера.
Почему поиск перестал находить документы после смены модели
Документы проиндексированы прежней моделью, а запрос считается новой. Проверьте:
- базы знаний переиндексированы после смены глобальной модели;
- файлы ассистентов загружены заново;
- поле Размерность вектора соответствует новой модели.
Почему проверка подключения недоступна
Кнопка Проверить работает только с сохранённой конфигурацией. Проверьте:
- провайдер сохранён, а не создаётся в первый раз;
- в форме нет несохранённых изменений;
- поле Тестовый текст заполнено.
Почему векторизация идёт медленно
Скорость определяют размер запроса и ограничения сервиса. Проверьте:
- значение поля Максимум токенов на элемент не завышено;
- размер фрагмента в профиле индексации соответствует модели;
- сервис не отвечает ошибками ограничения частоты запросов.
Что дальше
- Провайдеры языковых моделей — подключить сервис генерации ответов.
- Модели и политики — завести модель эмбеддингов в реестре инсталляции.
- RAG и поиск по знаниям — настроить качество поиска по базам знаний.
- Базы знаний — загрузить документы и запустить индексацию.
- Первый запуск платформы — порядок настройки инсталляции с нуля.