Глоссарий
Глоссарий RouterAI
Справочник терминов и понятий, используемых в системе RouterAI.
Основные возможности
- Единый словарь терминов для администраторов и пользователей системы
- Ссылки на соответствующие разделы документации
А
Активация лицензии — процедура привязки лицензионного ключа к конкретному экземпляру RouterAI. Поддерживается онлайн-активация (через интернет) и оффлайн-активация (через файл запроса). См. Лицензия.
Алиас модели — псевдоним, позволяющий обращаться к модели по произвольному имени вместо реального идентификатора. Например, алиас gpt-4 может указывать на local/Qwen/Qwen3-0.6B. Алиасы не могут начинаться с зарезервированных префиксов (local/, api/, cloud/). См. Алиасы моделей.
API-запрос — зафиксированный в системе запрос к языковой модели через OpenAI-совместимый API. Содержит информацию о пользователе, модели, количестве токенов и статусе выполнения. См. API запросы.
API-ключ — токен аутентификации для доступа к API RouterAI. Каждый пользователь имеет системный API-ключ, создаваемый автоматически при регистрации. Дополнительные ключи можно создавать вручную.
В
Воркер-нода — сервер с запущенным vLLM, подключённый к RouterAI для выполнения запросов к локальным языковым моделям. Нода регистрируется в системе автоматически при подключении. Статусы: idle (ожидание), busy (запуск модели), ready (готова), error (ошибка), offline (недоступна). Модели воркер-нод доступны с префиксом local/. См. Воркер-ноды.
Г
Группа доступа — набор правил, определяющий, какие языковые модели доступны пользователям команды. Группа назначается команде и наследуется всеми её участниками. Поддерживает два режима: flags (по категориям) и custom (конкретный список моделей). См. Группы доступа.
Ж
Журнал действий — лог административных операций в системе: создание/изменение/удаление сущностей, действия пользователей. Используется для аудита и отладки. См. Журнал действий.
К
Команда — группа пользователей, объединённых для совместной работы. Каждая команда привязана к одной группе доступа, которая определяет доступные модели. Команда имеет лимит токенов в месяц. Пользователь может состоять только в одной команде. См. Команды.
Контекстное окно — максимальное количество токенов, которое модель может обработать за один запрос (входные данные + ответ). Значение зависит от конкретной модели и отображается в параметре context_length воркер-ноды.
Л
Лицензионный ключ — уникальный ключ, выдаваемый поставщиком для активации RouterAI. Определяет план, срок действия и максимальное количество пользователей. Без действующей лицензии система недоступна. См. Лицензия.
Лимит токенов — ограничение на количество токенов, которое команда или пользователь может использовать за месяц. Задаётся на уровне команды (monthly_token_limit) и на уровне участника команды.
М
Модель — языковая модель (LLM), доступная через RouterAI. Идентифицируется строкой с префиксом:
- local/ — модель на воркер-ноде (vLLM)
- api/ — модель на OpenAI-совместимой ноде
- cloud/ — облачная модель
Членство (Membership) — запись о принадлежности пользователя к команде. Содержит роль (member, admin, owner) и индивидуальный лимит токенов. Пользователь может состоять только в одной команде одновременно.
О
OpenAI-нода — внешний сервис с OpenAI-совместимым API (например, другой экземпляр vLLM, LM Studio, Ollama или облачный провайдер), подключённый к RouterAI. Модели OpenAI-нод доступны с префиксом api/. Статусы: idle, ready, error, offline. См. OpenAI ноды.
П
Пользователь — учётная запись в системе RouterAI. Пользователь может быть создан вручную администратором или импортирован из LDAP. Для выполнения API-запросов пользователь должен состоять в команде с назначенной группой доступа. См. Пользователи.
Префикс модели — часть идентификатора модели, определяющая её источник: local/ (воркер-нода), api/ (OpenAI-нода), cloud/ (облачный провайдер). Зарезервированные префиксы нельзя использовать в алиасах.
Р
Роль в команде — уровень прав участника команды:
- member — обычный участник
- admin — администратор команды
- owner — владелец команды
RouterAI — система маршрутизации запросов к языковым моделям. Предоставляет OpenAI-совместимый API и позволяет управлять доступом к локальным и облачным LLM. См. Начало работы.
С
Стриминг — режим передачи ответа модели по частям (токен за токеном) в реальном времени, вместо ожидания полного ответа. Поддерживается через параметр stream: true в API-запросе.
Статистика — агрегированные данные об использовании системы: количество запросов, токены, активные пользователи, нагрузка на модели. Доступна в разделе Статистика.
Т
Токен — минимальная единица текста, обрабатываемая языковой моделью. Примерно соответствует 3/4 слова в английском языке. Используется для подсчёта объёма обработанных данных и применения лимитов.
Ф
Фоновая задача — асинхронная операция, выполняемая в фоне: проверка здоровья нод, синхронизация моделей, очистка старых данных, импорт пользователей из LDAP. Управляется через Solid Queue. См. Фоновые задачи.
Э
Экземпляр (Instance UID) — уникальный идентификатор установки RouterAI, генерируемый при первой активации лицензии. Используется для привязки лицензии к конкретному серверу.
Связанные разделы
- Начало работы — первоначальная настройка системы
- Dashboard — обзор состояния системы
- Пользователи — управление учётными записями
- Команды — управление командами
- Группы доступа — настройка прав доступа к моделям
- Алиасы моделей — псевдонимы для моделей
- Воркер-ноды — локальные vLLM-серверы
- OpenAI ноды — внешние OpenAI-совместимые сервисы
- Лицензия — управление лицензией
- API запросы — мониторинг запросов
- Журнал действий — аудит операций
- Фоновые задачи — фоновые процессы