Провайдеры эмбеддингов

Провайдер эмбеддингов — сохранённое в платформе подключение к сервису, который превращает текст в числовой вектор. По этим векторам платформа индексирует документы баз знаний и ищет по ним ответы. Провайдеров вы ведёте в разделе Администрирование → Знания и поиск → Провайдеры эмбеддингов (/settings/administration/knowledge/embeddings). Провайдеров может быть несколько, но рабочая пара «провайдер + модель» в инсталляции платформы одна: её задают глобальные RAG-настройки. Из коробки платформа работает с сервисом эмбеддингов Unica AI из поставки; если в периметре компании уже есть централизованный OpenAI-совместимый API векторизации, подключите его кастомным провайдером.

Что вам понадобится

  • глобальная роль admin: раздел Администрирование открыт только ей;
  • адрес эндпоинта векторизации у выбранного сервиса;
  • ключ авторизации или пара client_id:client_secret для OAuth;
  • известная размерность вектора модели — это же число вы указываете в глобальных RAG-настройках.

Как подключить провайдера эмбеддингов

Нажмите Создать провайдер: платформа откроет окно Новый провайдер эмбеддингов. Начните с поля Шаблон провайдера — Unica AI или кастомный провайдер: шаблон подставит адреса и режим авторизации. Заполните секции Основные настройки, Подключение и Модель и доступ и нажмите Создать.

Для кастомного провайдера в секции Основные настройки добавляются поля Контракт API со значениями OpenAI-compatible и Generic HTTP и Авторизация со значениями Bearer / API key, OAuth и Без авторизации.

Поле секции ПодключениеЧто указать
Endpoint для Access TokenАдрес выдачи access-токена; только при авторизации через OAuth
Endpoint эмбеддинговАдрес векторизации: https://<хост>/v1/embeddings
Authorization keyСекрет авторизации: Bearer-токен или ключ API
OAuth scopeОбласть доступа; только при авторизации через OAuth
WorkSpace ID (Unica AI)Идентификатор пространства во внешнем сервисе; только для шаблона Unica AI

Сохранённый ключ платформа обратно не отдаёт: в таблице показан признак Ключ сохранён или Без ключа, а в форме поле остаётся пустым. Пустое поле при сохранении означает «оставить прежний ключ». Переход в режим без авторизации удаляет сохранённый ключ, адрес токена и scope.

Как задать каталог моделей и расширенные параметры

Секция Модель и доступ в форме провайдера эмбеддингов задаёт каталог моделей и доступность провайдера. Переключатели Провайдер активен, Глобальный провайдер — доступен во всех рабочих пространствах и Отключить проверку сертификата (для самоподписанных) отвечают за доступность, а поле Максимум токенов на элемент ограничивает один текст в запросе числом не больше 100 000.

Таблица Доступные модели хранит пары «название + идентификатор». Строки таблицы Доступные модели синхронизируются с общим реестром AI-модели.

Примечание. Отдельного поля «Модель по умолчанию» у провайдера эмбеддингов нет: рабочую модель вы выбираете в глобальных RAG-настройках.

Секция Расширенные параметры нужна для нестандартных сервисов: Дополнительные заголовки и Дополнительные поля тела запроса принимают JSON-объекты, а для контракта Generic HTTP секция добавляет поля Ключ input, Ключ модели, JSON-path вектора и JSON-path токенов.

Значения заголовков с секретами платформа в браузер не возвращает: имя заголовка остаётся, а значение приходит пустым. Пустое значение при сохранении оставляет прежний секрет.

Как проверить подключение

Откройте сохранённого провайдера: платформа покажет настройки в правой панели. В секции Проверка подключения введите Тестовый текст и нажмите Проверить. Платформа получит access-токен, отправит текст на векторизацию и разберёт ответ.

Результат остаётся в той же секции: статус, строка Размерность с числом измерений вектора, строка Токенов с расходом и список диагностических шагов. Запомните размерность: это же число вы указываете в глобальных RAG-настройках.

Кнопка Проверить недоступна, пока форма изменена: проверка намеренно работает только с сохранённой конфигурацией. Сохраните правки и повторите. Если у записи не заполнено устаревшее поле модели, проверка берёт первую модель из таблицы Доступные модели.

Какая модель эмбеддингов работает в инсталляции

Рабочую пару «провайдер + модель» задаёт одно поле — Глобальная embedding-модель на вкладке Глобальные RAG-настройки страницы Администрирование → Знания и поиск → Индексация и поиск (/settings/administration/knowledge/indexing). Поле Глобальная embedding-модель возвращает пару целиком, поэтому отдельного выбора провайдера на вкладке нет. Поле Размерность вектора платформа использует для создания и миграции коллекций, когда размер нельзя определить по ответу модели.

Платформа применяет эту пару одинаково и для индексации документов баз знаний, и для векторизации запросов при поиске, и для файлов ассистента. Каскада «ассистент — пространство — инсталляция» нет: настройка одна на всю инсталляцию платформы.

  1. Создайте провайдера.
  2. Включите переключатель Провайдер активен.
  3. Проверьте подключение и запишите размерность вектора из результата.
  4. Откройте вкладку Глобальные RAG-настройки.
  5. Выберите значение поля Глобальная embedding-модель.
  6. Укажите Размерность вектора.
  7. Сохраните настройки.
  8. Запустите индексацию базы знаний.

Если выбранная пара стала недоступна, страница показывает предупреждение «Выбранная модель эмбеддингов недоступна». Платформа не подменяет ваш выбор автоматически: выберите доступную пару и сохраните. Пока глобальная пара не выбрана, индексация не запускается.

Единственное исключение — настройки ассистента. Блок Embedding-модель для запросов предлагает режимы Глобальный режим и Custom override, а при выборе Custom override появляется поле Custom embedding-модель. Режим Custom override предназначен для баз знаний, вручную переиндексированных другой моделью, и для проверок; в остальных случаях оставляйте Глобальный режим.

Вкладка «Глобальные RAG-настройки»: поля «Глобальная embedding-модель» и «Размерность вектора»
Глобальные RAG-настройки: модель эмбеддингов и размерность вектора

Что происходит при смене модели эмбеддингов

Смена глобальной модели обесценивает уже посчитанные векторы: документы проиндексированы одной моделью, а запрос считается другой, и поиск перестаёт находить релевантные фрагменты. Поэтому после смены модели переиндексируйте базы знаний и заново загрузите файлы ассистентов.

Важно. ⚠️ Переиндексация удаляет прежние точки из векторного хранилища и считает векторы заново.

Если размерность новой модели отличается от размерности коллекции, платформа отдаёт явную ошибку, а не пустой результат поиска. Перенести коллекции на новую модель помогает страница Администрирование → Знания и поиск → Векторное хранилище с действиями Перенести, Повторить перенос, Завершить перенос и Переиндексировать.

Как отключить или удалить провайдера

Отключить провайдера можно переключателем в колонке Статус прямо из списка. Платформа спросит подтверждение и предупредит, что новые операции векторизации перестанут использовать этот провайдер, а уже созданные векторы не изменятся. Платформа сохраняет изменение сразу. Неполную старую конфигурацию вы отключаете без исправления остальных полей, а повторное включение потребует корректных настроек.

Удаление доступно из меню строки списка и кнопкой Удалить провайдер внизу формы. Платформа блокирует удаление, пока на провайдера ссылаются записи реестра AI-модели, глобальные RAG-настройки, правила и профили индексации, политика баз знаний, ассистенты или сохранённое состояние индексации, и показывает список зависимостей. Перенесите зависимости на другого провайдера и повторите удаление.

Частые вопросы

Почему индексация базы знаний не запускается

Платформа не нашла рабочую пару «провайдер + модель». Проверьте:

  • на вкладке Глобальные RAG-настройки заполнено поле Глобальная embedding-модель;
  • у провайдера этой пары включён переключатель Провайдер активен;
  • модель из пары есть в таблице Доступные модели провайдера.

Почему поиск перестал находить документы после смены модели

Документы проиндексированы прежней моделью, а запрос считается новой. Проверьте:

  • базы знаний переиндексированы после смены глобальной модели;
  • файлы ассистентов загружены заново;
  • поле Размерность вектора соответствует новой модели.

Почему проверка подключения недоступна

Кнопка Проверить работает только с сохранённой конфигурацией. Проверьте:

  • провайдер сохранён, а не создаётся в первый раз;
  • в форме нет несохранённых изменений;
  • поле Тестовый текст заполнено.

Почему векторизация идёт медленно

Скорость определяют размер запроса и ограничения сервиса. Проверьте:

  • значение поля Максимум токенов на элемент не завышено;
  • размер фрагмента в профиле индексации соответствует модели;
  • сервис не отвечает ошибками ограничения частоты запросов.

Что дальше