Перейти к содержанию

Активная модель и её выбор

ИИ Студия отделяет пользовательскую работу в чате от административного управления модельной инфраструктурой. Сотрудник не должен вручную запускать GPU-модель или решать, куда направить весь корпоративный поток запросов.

В текущей архитектуре фактическую локальную модель либо Yandex AI как модельный маршрут выбирает администратор через Центр управления моделями. Пользователь видит, какая модель реально сформировала ответ, и выбирает разрешённых ИИ-помощников/режимы работы.


Что важно понимать пользователю

Модель влияет на:

  • качество ответа;
  • скорость;
  • специализацию;
  • доступный контекст;
  • стоимость облачного режима;
  • границу обработки данных.

Но изменение рабочего модельного маршрута — инфраструктурная операция, поэтому оно централизовано.


Студия и модель — разные уровни

ИИ Студия хранит пользователей, историю, проекты, файлы, права и сервисы.

Модель формирует конкретный ответ.

Администратор может модернизировать модель, а пользователь продолжит работать в том же интерфейсе и со своими чатами.


Где увидеть фактическую модель

В интерфейсе чата Студия показывает название фактической модели/источника для ответа или текущего активного маршрута.

Это может быть:

  • локальная Qwen;
  • другая локальная рабочая модель;
  • Alice AI LLM;
  • YandexGPT;
  • заранее настроенный внешний модельный сервер.

Исторический ответ сохраняет собственную атрибуцию: если администратор позже сменил модель, старое сообщение не переименовывается.


Что может выбирать обычный пользователь

В зависимости от политики организации пользователь может выбирать:

  • ИИ-помощника;
  • проект;
  • разрешённые инструменты;
  • временный чат;
  • режимы поиска/работы с файлами.

Но выбор локального или Yandex AI маршрута и конкретной рабочей модели управляется администратором.

Если интерфейс показывает логическое название модели Студии, под ним может находиться стабильный корпоративный маршрут, фактическая модель которого меняется централизованно.


Локальная модель

Работает на вычислительных ресурсах организации.

Подходит, когда:

  • модельный запрос должен оставаться внутри инфраструктуры;
  • используются внутренние документы и код;
  • есть подходящий GPU;
  • важен контроль над вычислительным контуром.

При этом отдельно включённый интернет-поиск или внешний сервис всё равно может выполнять разрешённые сетевые обращения.


Yandex AI Studio

Если ADMIN активировал Yandex AI, модельный контекст передаётся в Яндекс Облако.

Граница данных меняется

YandexGPT/Alice AI — облачная обработка. То, что сама Студия установлена на вашей VM, не делает вызов Yandex AI локальным.


Почему Студия не использует одну Qwen для всех

Разные GPU и типы нагрузок требуют разных вариантов развёртывания модели. Центр управления моделями содержит квалифицированный мультивендорный каталог и рекомендует модели по реальному оборудованию.

В нём есть:

  • компактные универсальные модели;
  • кодовые модели;
  • варианты для большого GPU;
  • long-context и agentic профили;
  • управляемые модели Яндекса.

Подробнее: Модели ИИ.


Как пользователь действует, если качество текущей модели не подходит

Не пытайтесь «переключить GPU» самостоятельно.

  1. Зафиксируйте конкретный пример задачи.
  2. Сохраните неудачный ответ.
  3. Укажите, что именно неверно: факт, формат, код, полнота, скорость.
  4. Передайте пример администратору/владельцу Студии.
  5. Администратор может сравнить квалифицированные модели на том же наборе задач.

Так решение о рабочей модели принимается на данных, а не по впечатлению от одного запроса.


Что происходит, когда ADMIN меняет модель

Новые запросы идут в новый модельный маршрут после подтверждения его готовности.

При этом:

  • старые чаты не удаляются;
  • документы остаются;
  • проекты остаются;
  • исторические ответы сохраняют прежнюю модель;
  • новые ответы получают новую атрибуцию.

Если произошёл переход local → Yandex AI

Для конфиденциальной работы безопаснее создать новый чат. Продолжение старого диалога может включить часть его истории в контекст облачного запроса.

Если облачная обработка старого контекста запрещена, не продолжайте тот же чат после такого переключения.


Нет скрытого перехода в Яндекс

Студия не должна молча отправить запрос в Yandex AI из-за отказа локальной модели.

Переход на облачную модель — явное административное действие.


Как узнать больше