Перейти к содержанию

YandexGPT и Alice AI

ИИ Студия может использовать управляемые текстовые модели Yandex AI Studio вместо локального inference.

Это отдельный режим обработки данных и отдельная административная операция.

Граница приватности

При активной Yandex AI модели содержимое запроса, используемый контекст разговора, необходимые фрагменты документов и результаты сервисов, включённые в запрос, передаются из VM в Yandex AI Studio. Это не локальный приватный inference.


1. Yandex AI не включается автоматически

Подключение авторизованного ключа и рабочего каталога не переводит Студию на YandexGPT.

Схема:

YC integration connected
infrastructure tools available
local model can remain active

Для Yandex AI администратор отдельно:

  1. проверяет каталог AI Studio;
  2. выдаёт роль;
  3. нажимает Проверить доступ;
  4. выбирает конкретную модель;
  5. явно активирует managed поставщик.

2. Какие модели показывает curated-каталог Студии

Для текущего text-only профиля основными управляемыми моделями являются:

Модель Роль в каталоге Контекст
Alice AI LLM flagship 131 072
Alice AI LLM Flash быстрые массовые задачи 65 536
YandexGPT Pro 5.1 актуальная Pro 32 768
YandexGPT Pro 5 compatibility 32 768
YandexGPT Lite 5 economy 32 768

Официальный каталог Yandex AI Studio сейчас шире, чем curated text-каталог Студии 0.3.66. Помимо пяти квалифицированных моделей, в базовом инстансе Яндекса доступны, в частности:

Модель в Yandex AI Studio Контекст Статус относительно 0.3.66
DeepSeek V4 Flash 1 048 576 не опубликована в curated text-каталоге Студии
Qwen3 235B 262 144 не опубликована; Яндекс указывает доступность до 30.09.2026
gpt-oss-120b 131 072 не опубликована; доступность до 30.10.2026
gpt-oss-20b 131 072 не опубликована; доступность до 30.10.2026
Qwen3.6 35B 262 144 не опубликована; upstream Yandex поддерживает также image input через Base64

Это не ошибка автоматического обнаружения: config/models/yandex-ai-studio.json выпуска 0.3.66 намеренно публикует только пять квалифицированных текстовых моделей. Новые модели следует добавлять в продукт после проверки API, function calling, reasoning, стоимости, privacy boundary и регрессионных сценариев.

Рекомендация для следующего релиза

Отдельно квалифицировать DeepSeek V4 Flash и Qwen3.6 35B. Qwen3 235B и семейство gpt-oss имеют близкие сроки вывода из текущего базового каталога, поэтому включать их в долговременный curated-каталог без lifecycle-плана нецелесообразно.

В самом Yandex AI Studio Model Gallery могут быть и другие модели.

Это не означает, что ИИ Студия автоматически публикует любую модель из Gallery как рабочий choice.

NiceSoft использует curated-набор, который проверен с текущим шлюз и интерфейсом.


3. каталог AI Studio

Важнейшее понятие.

Yandex AI Studio использует идентификатор каталога в model URI и authentication context.

В текущей архитектуре Студия показывает каталог AI Studio, определённый по parent/home каталог служебной учётной записи.

Он может отличаться от рабочего инфраструктурного каталог.

Пример:

Working Folder: app-prod
AI Studio Folder: platform-ai

Тогда ai.languageModels.user должен быть действителен на platform-ai.


4. Необходимая роль

Для текстовых моделей минимальная роль:

ai.languageModels.user

Назначьте её:

  • на каталог AI Studio;
  • либо на облако/organization выше, если это осознанная политика и наследование подходит.

Не назначайте роль на объект служебной учётной записи вместо целевого каталога.


5. Подключение пошагово

Шаг 1. Загрузите авторизованный ключ

Используется тот же служебная учётная запись учётные данные, что и для YC-интеграции.

Отдельный API-ключ для текущего NiceSoft шлюз не требуется.

Шаг 2. Выполните привязку рабочего каталога

Это нужно общему YC шлюз и пользовательскому область доступа.

Шаг 3. Откройте Модели → Yandex AI

Найдите поле каталог AI Studio.

Шаг 4. Выдайте роль

Назначьте служебная учётная запись:

ai.languageModels.user

на показанный каталог AI Studio.

Шаг 5. Нажмите Проверить доступ

Шлюз выполняет на стороне сервера probe Yandex AI Studio и проверяет фактическую доступность curated models.

Шаг 6. Проверьте результат

Интерфейс должен показать доступные модели и отсутствие 403.

Шаг 7. Активируйте нужную модель

Это административное действие.

Обычный USER не должен сам менять глобальный серверная часть экземпляра.


6. Как проходит запрос

Упрощённо:

Пользователь
ИИ Студия
стабильный NiceSoft model route
Yandex Gateway
IAM token service account
Yandex AI Studio
ответ

Браузер пользователя не получает:

  • закрытый ключ служебной учётной записи;
  • IAM token;
  • шлюз учётные данные.

7. Отключение на стороне сервера logging

NiceSoft Шлюз по умолчанию передаёт:

x-data-logging-enabled: false

Официальный Yandex AI Studio документирует этот header как способ отключить сохранение данные запроса на стороне сервиса.

Warning

Отключение на стороне сервера logging не делает inference локальным. Данные всё равно передаются в Yandex AI Studio для обработки запроса.


8. Что именно может уйти в Yandex AI

Зависит от конкретного запроса.

Потенциально:

  • текст пользователя;
  • системные инструкции помощника;
  • история/контекст текущего разговора;
  • фрагменты загруженного документа;
  • RAG chunks;
  • результат web search;
  • результат операций инфраструктуры YC;
  • финансовые агрегаты FinOps;
  • memory, если она включена в текущий контекст.

Поэтому перед активацией managed model организация должна определить допустимую категорию данных.


9. Alice AI LLM

Предназначена для сильных универсальных корпоративных задач, диалогов, документов и извлечения информации из длинного контекста.

Полезные сценарии:

  • сложная редактура;
  • анализ документов;
  • RAG;
  • длинные диалоги;
  • структурирование;
  • универсальный корпоративный ассистент.

Больший context window не означает, что в каждый запрос нужно загружать максимум данных.


10. Alice AI LLM Flash

Оптимизирована для быстрого/экономичного потока запросов.

Подходит для:

  • классификации;
  • суммаризации;
  • коротких массовых запросов;
  • извлечения полей;
  • высокочастотных assistant flows.

Если качество задачи удовлетворительно, более дешёвая/быстрая модель может быть экономически выгоднее flagship.


11. YandexGPT Pro 5.1

Актуальная Pro-ветка curated-каталога.

Подходит для корпоративных текстовых задач, извлечения данных и интеграционных сценариев.

Для новых внедрений она предпочтительнее старого compatibility-профиля Pro 5, если нет причин сохранять старое поведение.


12. YandexGPT Pro 5

В Студии рассматривается прежде всего как compatibility model.

Не выбирайте старую модель только потому, что название привычнее.

Перед миграцией существующего помощника сравните:

  • качество;
  • формат ответа;
  • поведение функций и операций;
  • стоимость;
  • regression set.

13. YandexGPT Lite 5

Экономичный вариант для простых текстовых задач.

Например:

  • короткие ответы;
  • классификация;
  • нормализация;
  • массовая обработка небольших текстов.

Не стоит ожидать от economy-профиля того же качества сложного reasoning, что от более сильной модели.


14. Цена

Все пять моделей являются платными managed services.

Не фиксируйте цену из этой документации как договорную константу.

Перед расчётом бюджета откройте текущую страницу Yandex AI Studio → Правила тарификации.

Всегда записывайте:

  • модель;
  • дату проверки;
  • валюту;
  • цену input tokens;
  • cached tokens;
  • токены операций;
  • output tokens.

15. Как оценить стоимость запроса

Упрощённо:

input cost
+
output cost
+
tool/context-related тарификация, если применима
=
стоимость вызова

Длинный корпоративный чат может быть значительно дороже короткого запроса даже при одинаковой модели.

RAG помогает сокращать передаваемый объём по сравнению с помещением всей базы знаний в запрос.


16. Нет автоматического failover local → Yandex

Это принцип безопасности.

Если локальная модель перестала работать, Студия не должна молча отправить тот же запрос во внешний managed поставщик.

Иначе данные неожиданно покинут локальный контур.

Правильное поведение:

local unavailable
безопасный local fallback, если он есть
иначе явная ошибка/решение администратора

17. Фактическая модель каждого ответа

При расследовании важно знать не только текущую активную модель, но и какая модель сформировала конкретный старый ответ.

Поэтому Студия сохраняет/показывает фактическую model attribution на сообщении.

Это полезно для:

  • аудита;
  • сравнения качества;
  • проверки privacy boundary;
  • regression analysis;
  • разбора затрат.

18. Проверить доступ

Если probe успешен:

  • IAM token получен;
  • адрес AI Studio доступен;
  • каталог соответствует запросу;
  • нужная роль работает;
  • список доступных моделей получен.

Если одна конкретная модель не отображается, это может быть lifecycle/availability, а не проблема всего подключения.


19. Ошибка 403

Проверяйте по порядку:

  1. авторизованный ключ принят;
  2. ID служебной учётной записи указан правильно;
  3. каталог AI Studio правильный;
  4. ai.languageModels.user выдана на этот каталог или его родительский ресурс;
  5. роль успела распространиться;
  6. organizational policy не блокирует вызов;
  7. нажмите Проверить доступ повторно.

интерфейс сохраняет безопасные diagnostic IDs, включая x-request-id/x-server-trace-id, когда они доступны.


20. Контрольный тест Yandex AI

До рабочий-переключения используйте тест без секретов:

Ответь одним предложением: «Yandex AI Studio подключён к НайсСофт — ИИ Студии».

Затем проверьте badge фактической модели.

После этого тестируйте:

  • файл;
  • RAG;
  • web search;
  • YC infrastructure;
  • FinOps;
  • assistant.

Каждый сценарий может передавать разный объём контекста.


21. Что не входит в текущий text-only профиль

Yandex AI Studio предлагает также другие типы моделей и API.

Но текущая пользовательская поставка Студии не обещает:

  • генерацию изображений через Alice AI ART;
  • voice/realtime audio;
  • произвольный доступ ко всем моделям Model Gallery;
  • автоматическое включение новой модели в рабочий-каталог сразу после её появления у Яндекса.

Сначала модель должна пройти продуктовую квалификацию NiceSoft.


Что дальше