Переключение активной модели¶
Фактический модельный маршрут — централизованный ресурс ИИ Студии. Его переключает администратор через Центр управления моделями.
Это не косметическая настройка: операция может остановить один среда выполнения GPU, запустить другой, изменить скорость, стоимость и даже границу обработки данных.
USER и ADMIN¶
Обычный пользователь¶
- работает с чатами;
- использует разрешённых помощников;
- видит фактическую модель ответа;
- не устанавливает вариант весов;
- не меняет глобальный provider;
- не запускает/останавливает среда выполнения GPU.
Администратор¶
- устанавливает локальные модели;
- активирует установленную модель;
- подключает Yandex AI;
- выбирает managed-модель Яндекса;
- удаляет вариант весов;
- контролирует соответствие и среда выполнения.
Что не теряется при смене модели¶
Переключение не удаляет:
- пользователей;
- историю;
- проекты;
- документы;
- базы знаний;
- права.
Меняется модельный маршрут, который обрабатывает новые запросы.
Историческая атрибуция сохраняется¶
Пример:
Ответ A остаётся помеченным Qwen3 8B AWQ. Смена глобального route не переписывает историю.
Локальная → другая установленная локальная¶
Перед началом проверьте:
- новая модель совместима;
- статус установлена;
- нет критичной генерации;
- нет другой подготовка модели operation.
Шаги¶
- Откройте Модели → Каталог.
- Найдите модель.
- Проверьте соответствие.
- Нажмите Активировать.
- Дождитесь смены среда выполнения.
- Откройте Обзор.
- Проверьте конкретное имя модели.
- Выполните новый smoke-test.
Что происходит внутри¶
Model Manager:
- сохраняет желаемую модель как pending;
- определяет среда выполнения;
- останавливает конфликтующий среда выполнения;
- запускает выбранный artifact;
- ждёт
inference_ready; - проверяет совпадение идентификатора модели в среде выполнения;
- переводит модель в active.
Это защищает от ситуации, когда интерфейс уже показывает новую модель, а среда выполнения ещё отвечает старой.
Установка новой модели = установка и последующая активация¶
При штатной установке из каталога Model Manager запоминает выбранную модель как желаемую. После verified install reconciler запускает её и переводит маршрут автоматически.
Не запускайте вторую модель параллельно: server-side lock защищает от конфликтующих подготовка модели-операций.
Локальная → Yandex AI¶
Это изменение границы данных.
Перед началом:
- Yandex AI подключён;
- probe успешен;
- политика разрешает облачную обработку;
- понятна тарификация;
- выбрана конкретная curated-модель.
Шаги¶
- Откройте Модели → Yandex AI.
- Проверьте интеграцию.
- Выполните Проверить доступ.
- Выберите модель.
- Подтвердите активацию.
- Дождитесь READY.
- Проверьте Обзор.
- Создайте новый тестовый чат.
- Проверьте подпись модели Яндекса.
Danger
После переключения новый модельный контекст обрабатывается Yandex AI Studio.
Почему лучше создать новый чат после local → cloud¶
Продолжение старого чата может передать облачной модели часть старого контекста.
Безопаснее:
- завершить локальный разговор;
- открыть новый чат;
- передать только данные, разрешённые для облачной обработки.
Yandex AI → локальная¶
- Откройте Каталог.
- Найдите установленную локальную модель.
- Проверьте соответствие.
- Нажмите Активировать.
- Дождитесь готовность.
- Проверьте источник Локальная модель.
- Начните новый конфиденциальный чат.
Возврат локально не отменяет факт предыдущей облачной обработки; он влияет на последующие запросы.
Удаление активной модели¶
Студия поддерживает безопасное удаление даже выбранной локальной модели.
Порядок:
- удаляемая модель выводится из маршрута;
- среда выполнения останавливается;
- файлы удаляются;
- ищется другая уже установленная совместимая локальная рабочая модель;
- если она есть — активируется;
- при отсутствии локальной может использоваться только заранее явно настроенный внешний модельный сервер;
- без резервной модели остаётся состояние модель не выбрана.
Bootstrap/test-модель не должна автоматически становиться рабочей резервной моделью.
Резервный маршрут с приоритетом локальной модели¶
Если доступны:
- другая установленная локальная модель;
- ранее настроенный внешний провайдер,
Model Manager предпочитает локальную рабочую модель. Это помогает не менять границу обработки данных неожиданно.
После перезапуска сервера¶
Выбор хранится серверно. После restart Model Manager:
- читает desired state;
- проверяет файлы;
- проверяет среда выполнения;
- запускает выбранную локальную модель при необходимости;
- ждёт готовность;
- восстанавливает маршрут.
Ручная активация после каждого обычного reboot не требуется.
Активна, но чат не отвечает¶
Проверьте:
- готовность среды выполнения;
- совпадает ли model ID;
- OOM;
- состояние pending activation;
- Model Router;
- логи Model Manager.
См. Ошибки моделей.
Smoke-test после каждой административной смены¶
- Создайте новый чат.
- Отправьте короткий вопрос.
- Дождитесь полного ответа.
- Проверьте фактическую модель.
- Сделайте второй запрос в том же чате.
- При локальном режиме убедитесь, что нет неожиданного Yandex provider.
- При Yandex AI убедитесь, что источник явно облачный.
Не переключайте крупные модели слишком часто¶
Частая смена:
- выгружает/загружает десятки гигабайт VRAM;
- создаёт окна недоступности;
- путает пользователей;
- осложняет сравнение качества;
- ухудшает воспроизводимость.
Лучше закрепить понятную модельную политику организации.
Коммуникация сотрудникам¶
При значимой смене модели сообщите:
- дату;
- новое название;
- локальная или облачная;
- изменились ли правила по конфиденциальным данным;
- для каких задач выбрана;
- куда сообщать о регрессиях.