Глоссарий

Глоссарий RouterAI

Справочник терминов и понятий, используемых в системе RouterAI.

Основные возможности

  • Единый словарь терминов для администраторов и пользователей системы
  • Ссылки на соответствующие разделы документации

А

Активация лицензии — процедура привязки лицензионного ключа к конкретному экземпляру RouterAI. Поддерживается онлайн-активация (через интернет) и оффлайн-активация (через файл запроса). См. Лицензия.

Алиас модели — псевдоним, позволяющий обращаться к модели по произвольному имени вместо реального идентификатора. Например, алиас gpt-4 может указывать на local/Qwen/Qwen3-0.6B. Алиасы не могут начинаться с зарезервированных префиксов (local/, api/, cloud/). См. Алиасы моделей.

API-запрос — зафиксированный в системе запрос к языковой модели через OpenAI-совместимый API. Содержит информацию о пользователе, модели, количестве токенов и статусе выполнения. См. API запросы.

API-ключ — токен аутентификации для доступа к API RouterAI. Каждый пользователь имеет системный API-ключ, создаваемый автоматически при регистрации. Дополнительные ключи можно создавать вручную.


В

Воркер-нода — сервер с запущенным vLLM, подключённый к RouterAI для выполнения запросов к локальным языковым моделям. Нода регистрируется в системе автоматически при подключении. Статусы: idle (ожидание), busy (запуск модели), ready (готова), error (ошибка), offline (недоступна). Модели воркер-нод доступны с префиксом local/. См. Воркер-ноды.


Г

Группа доступа — набор правил, определяющий, какие языковые модели доступны пользователям команды. Группа назначается команде и наследуется всеми её участниками. Поддерживает два режима: flags (по категориям) и custom (конкретный список моделей). См. Группы доступа.


Ж

Журнал действий — лог административных операций в системе: создание/изменение/удаление сущностей, действия пользователей. Используется для аудита и отладки. См. Журнал действий.


К

Команда — группа пользователей, объединённых для совместной работы. Каждая команда привязана к одной группе доступа, которая определяет доступные модели. Команда имеет лимит токенов в месяц. Пользователь может состоять только в одной команде. См. Команды.

Контекстное окно — максимальное количество токенов, которое модель может обработать за один запрос (входные данные + ответ). Значение зависит от конкретной модели и отображается в параметре context_length воркер-ноды.


Л

Лицензионный ключ — уникальный ключ, выдаваемый поставщиком для активации RouterAI. Определяет план, срок действия и максимальное количество пользователей. Без действующей лицензии система недоступна. См. Лицензия.

Лимит токенов — ограничение на количество токенов, которое команда или пользователь может использовать за месяц. Задаётся на уровне команды (monthly_token_limit) и на уровне участника команды.


М

Модель — языковая модель (LLM), доступная через RouterAI. Идентифицируется строкой с префиксом:
- local/ — модель на воркер-ноде (vLLM)
- api/ — модель на OpenAI-совместимой ноде
- cloud/ — облачная модель

Членство (Membership) — запись о принадлежности пользователя к команде. Содержит роль (member, admin, owner) и индивидуальный лимит токенов. Пользователь может состоять только в одной команде одновременно.


О

OpenAI-нода — внешний сервис с OpenAI-совместимым API (например, другой экземпляр vLLM, LM Studio, Ollama или облачный провайдер), подключённый к RouterAI. Модели OpenAI-нод доступны с префиксом api/. Статусы: idle, ready, error, offline. См. OpenAI ноды.


П

Пользователь — учётная запись в системе RouterAI. Пользователь может быть создан вручную администратором или импортирован из LDAP. Для выполнения API-запросов пользователь должен состоять в команде с назначенной группой доступа. См. Пользователи.

Префикс модели — часть идентификатора модели, определяющая её источник: local/ (воркер-нода), api/ (OpenAI-нода), cloud/ (облачный провайдер). Зарезервированные префиксы нельзя использовать в алиасах.


Р

Роль в команде — уровень прав участника команды:
- member — обычный участник
- admin — администратор команды
- owner — владелец команды

RouterAI — система маршрутизации запросов к языковым моделям. Предоставляет OpenAI-совместимый API и позволяет управлять доступом к локальным и облачным LLM. См. Начало работы.


С

Стриминг — режим передачи ответа модели по частям (токен за токеном) в реальном времени, вместо ожидания полного ответа. Поддерживается через параметр stream: true в API-запросе.

Статистика — агрегированные данные об использовании системы: количество запросов, токены, активные пользователи, нагрузка на модели. Доступна в разделе Статистика.


Т

Токен — минимальная единица текста, обрабатываемая языковой моделью. Примерно соответствует 3/4 слова в английском языке. Используется для подсчёта объёма обработанных данных и применения лимитов.


Ф

Фоновая задача — асинхронная операция, выполняемая в фоне: проверка здоровья нод, синхронизация моделей, очистка старых данных, импорт пользователей из LDAP. Управляется через Solid Queue. См. Фоновые задачи.


Э

Экземпляр (Instance UID) — уникальный идентификатор установки RouterAI, генерируемый при первой активации лицензии. Используется для привязки лицензии к конкретному серверу.


Связанные разделы