Перейти к содержанию

Частые вопросы

Здесь собраны короткие ответы по НайсСофт — ИИ Студии 0.3.66.

Если нужен не короткий ответ, а пошаговая инструкция, переходите по ссылке в соответствующий раздел документации.


Что вообще представляет собой ИИ Студия?

Это корпоративная среда для работы с искусственным интеллектом, которая объединяет:

  • обычные диалоги;
  • локальные модели;
  • Yandex AI;
  • работу с файлами;
  • поиск по документам;
  • интернет-поиск;
  • проекты;
  • ИИ-помощников;
  • навыки;
  • память;
  • плановые задания;
  • интеграцию с Яндекс Облаком;
  • финансовый анализ облака;
  • централизованные права и политики.

Это не «одна установленная Qwen» и не просто окно чата.

Подробнее: «Что такое ИИ Студия».


Студия обязательно отправляет данные во внешний ИИ?

Нет.

При активной локальной модели генерация может выполняться на GPU внутри вашего инфраструктурного контура.

Но важно учитывать дополнительные функции.

Например:

  • интернет-поиск обращается во внешнюю сеть;
  • внешний корпоративный сервис может получать часть запроса;
  • Yandex AI получает запрос и необходимый контекст для генерации.

Поэтому «локальная модель» и «полностью изолированный запрос» — не одно и то же.

Подробнее: «Границы данных».


Можно ли работать вообще без Интернета?

Да, но только при специально подготовленном изолированном развёртывании.

Нужно заранее предоставить внутри контура:

  • контейнерные образы;
  • локальные веса модели;
  • зависимости;
  • DNS/NTP или их локальные аналоги;
  • нужные документы;
  • собственные зеркала обновлений, если они предусмотрены.

В таком режиме недоступны функции, которым объективно нужен внешний Интернет, например обычный веб-поиск или облачный Yandex AI.

Подробнее: «Изолированный контур».


Можно ли использовать YandexGPT и Alice AI?

Да.

Текущий проверенный каталог Студии включает, в частности:

  • Alice AI LLM;
  • Alice AI LLM Flash;
  • YandexGPT Pro 5.1;
  • YandexGPT Pro 5;
  • YandexGPT Lite 5.

Активация облачной модели выполняется администратором явно.

Локальная модель не должна незаметно переключаться в Yandex AI при ошибке.

Подробнее: «Модели Яндекса».


Может ли обычный пользователь сам переключить всю Студию на Yandex AI?

Нет.

Рабочий маршрут модели управляется централизованно администратором.

Обычный пользователь работает в пределах опубликованной конфигурации и разрешённых помощников.

Это позволяет организации контролировать:

  • границу данных;
  • расходы;
  • доступность моделей;
  • требования к безопасности.

Как Студия выбирает локальную модель?

Мастер первого запуска определяет реальное оборудование:

  • модель GPU;
  • число GPU;
  • видеопамять;
  • вычислительную совместимость;
  • оперативную память;
  • vCPU;
  • свободное место на диске;
  • доступность среды выполнения.

После этого рекомендации строятся не только по числу параметров модели, а по конкретному артефакту, формату весов, контексту и эксплуатационному запасу.

Подробнее: «Мастер подбора».


Нужна ли видеокарта?

Для штатной локальной рабочей модели текущего профиля — да, требуется совместимый NVIDIA GPU.

Без подходящего GPU можно:

  • использовать начальную диагностическую модель только для проверки;
  • подключить внешний совместимый сервис модели;
  • использовать разрешённую облачную модель Yandex AI.

Начальная Qwen3 0.6B не является рекомендуемой рабочей моделью для производственной эксплуатации.


Какую GPU выбирать в Яндекс Облаке?

В упрощённом виде:

GPU Базовая рекомендация
T4 16 ГБ Qwen3 8B AWQ / Qwen2.5 Coder 7B AWQ
T4i 24 ГБ тот же класс плюс некоторые более тяжёлые профили
V100 32 ГБ не использовать для рабочей среды 0.3.66
A100 80 ГБ Qwen3.8 27B и модели аналогичного класса
несколько A100 / современные большие профили более тяжёлые специализированные модели после проверки fit

Полная матрица всех 27 профилей Яндекс Облака находится в инструкции развёртывания.


Почему V100 не подходит, хотя у неё 32 ГБ памяти?

Потому что проблема не в объёме памяти.

V100 имеет вычислительную совместимость 7.0, а текущая рабочая среда vLLM требует минимум 7.5.

Четыре V100 не исправляют это ограничение: сумма памяти увеличивается, архитектура GPU — нет.


Почему на A100 не выбирается Qwen3.8 27B FP8?

Потому что квалифицированный FP8-профиль этой модели в Студии требует вычислительную совместимость не ниже 8.9.

A100 имеет 8.0.

Поэтому для A100 основным проверенным вариантом является Qwen3.8 27B в обычном рабочем формате, а не этот FP8-артефакт.


Можно ли установить любую модель с Hugging Face?

Не как автоматически поддерживаемую рабочую модель.

Студия использует квалифицированный каталог.

Это позволяет заранее контролировать:

  • источник весов модели;
  • лицензию;
  • формат весов;
  • поддержку закреплённой средой;
  • требования к GPU;
  • рабочий контекст;
  • аргументы запуска;
  • отсутствие небезопасного trust_remote_code.

Перспективная модель может отображаться в каталоге для планирования, но установка будет заблокирована до прохождения проверки лицензии или среды выполнения.


Почему размер файла модели меньше требуемой видеопамяти?

Потому что VRAM расходуют не только сами веса.

Также нужны:

  • кэш контекста;
  • служебные буферы;
  • память среды выполнения;
  • запас на параллельные запросы;
  • внутренние структуры вычисления.

Поэтому модель весом, например, 20 ГБ не обязательно безопасно работает на GPU с 24 ГБ.


Как открыть Студию после создания ВМ из образа Яндекс Облака?

Основной адрес:

https://<публичный-IP>:8143/

При первом открытии браузер покажет предупреждение о локальном сертификате.

Для чистой ВМ это ожидаемо.

Перед добавлением исключения:

  1. сверьте публичный IP с консолью Яндекс Облака;
  2. убедитесь, что открываете именно свою ВМ;
  3. при повышенных требованиях сверяйте отпечаток сертификата через SSH;
  4. только после этого добавьте временное исключение браузера.

Подробнее: «Установка в Яндекс Облаке».


Почему браузер пишет, что сертификат недоверенный?

При чистом запуске Студия создаёт собственный локальный центр сертификации и серверный сертификат.

Он нужен, чтобы HTTPS был доступен с первого запуска, но публичные браузеры не доверяют частному центру сертификации автоматически.

Кроме того, IP ВМ намеренно не включается в сертификат.

После первоначальной настройки можно:

  • назначить домен и получить Let’s Encrypt;
  • загрузить сертификат организации;
  • оставить локальный сертификат в контролируемом закрытом контуре.

Подробнее: «HTTPS, домен и сертификаты».


Где настраивается сертификат?

Для администратора:

Параметры → Сертификат и домен.

В 0.3.66 сертификатами управляет отдельная внутренняя служба.

Закрытый ключ через интерфейс обратно в браузер не выдаётся.


Нужно ли открывать административный порт 3001 в Интернет?

Нет.

Для обычного пользовательского входа и первой регистрации используется основной порт:

8143/tcp

Порт 3001 не нужен пользователям для первого входа и не должен без необходимости публиковаться во внешнюю сеть.


Для чего нужен порт 80?

В актуальном сертификатном контуре он используется для HTTP-проверки домена при получении сертификата Let’s Encrypt.

Открыт специальный путь:

/.well-known/acme-challenge/

Остальные обычные HTTP-запросы не превращают Студию в незащищённый HTTP-сайт и должны получать отказ/404 согласно текущей конфигурации.


Кто становится первым администратором?

На чистой одиночной установке первый зарегистрированный локальный пользователь получает роль ADMIN.

После этого администратор создаёт или приглашает остальных пользователей и выдаёт им минимально необходимые права.

При восстановлении существующей базы правило «первый пользователь» заново не срабатывает, поскольку пользователи уже существуют.


Может ли администратор просто сделать всех ADMIN?

Технически полный доступ возможен, но это плохая эксплуатационная практика.

В Студии есть:

  • роли;
  • группы;
  • права на классы функций;
  • права на отдельные ресурсы;
  • делегируемые системные административные полномочия.

Например, сотруднику поддержки можно разрешить управление пользователями без полного контроля всей установки.

Подробнее: «Права и роли».


Где хранятся мои диалоги?

В рабочем контуре конкретной установки Студии.

Обычные локальные диалоги не становятся автоматически доступными другим пользователям.

Но конкретная граница обработки зависит от активных функций: Yandex AI, интернет-поиск или подключённый внешний сервис могут получать данные, необходимые для выполнения запроса.


Кто может видеть мои чаты?

Обычный пользователь не должен видеть частные чаты другого пользователя.

Отдельно существуют:

  • явно опубликованные общие ссылки;
  • административные полномочия;
  • резервные копии;
  • серверные журналы и технические процедуры организации.

Правила доступа к данным должны быть частью общей политики эксплуатации.


Что такое временный чат?

Это разговор, который не появляется в обычной истории и удаляется автоматически по сроку хранения.

В 0.3.66 текущий срок — 720 часов, то есть 30 суток.

Временный чат не означает:

  • что данные вообще нигде не обрабатываются;
  • что Yandex AI перестаёт быть облачной моделью;
  • что системные журналы инфраструктуры исчезают;
  • что запрос можно использовать для секретов.

Подробнее: «Временный чат».


Чем память отличается от истории?

История — сохранённые разговоры.

Память — отдельное структурированное хранилище устойчивых сведений, которые могут использоваться для персонализации будущих разговоров.

Память не должна использоваться для хранения:

  • паролей;
  • токенов;
  • закрытых ключей;
  • одноразовых кодов.

Чем проект отличается от общей памяти?

Проект в текущей реализации — личное пространство для группировки связанных диалогов.

Он не превращает все чаты в один общий бесконечный контекст.

Для устойчивого общего контекста используйте:

  • документы;
  • базу знаний;
  • помощника;
  • память там, где это уместно.

Чем помощник отличается от проекта?

Проект организует работу.

Помощник задаёт устойчивое поведение ИИ:

  • инструкции;
  • знания;
  • навыки;
  • разрешённые сервисы;
  • память;
  • плановые задания.

Один помощник может использоваться в разных рабочих задачах, а проект не является моделью или помощником.


Можно ли загрузить PDF?

Да, если формат и размер укладываются в текущие ограничения.

Для цифрового PDF с текстовым слоем содержимое может быть извлечено локально.

Если PDF состоит только из изображений/сканов, текущий document_parser не следует считать полноценным OCR. Такой документ лучше предварительно распознать доверенным средством.

Подробнее: «PDF и DOCX».


Что выбрать: «прочитать файл целиком» или поиск по документам?

Для небольшого документа и задачи, где важен весь текст, используйте обработку целиком.

Для большой документации, большого числа файлов или базы знаний лучше использовать поиск по документам/RAG.

RAG передаёт модели наиболее относящиеся к вопросу фрагменты, а не весь архив целиком.


Можно ли загрузить 100 МБ одним файлом?

Серверный абсолютный предел может достигать 100 МБ, но у активного маршрута модели в 0.3.66 отдельный предел одного файла составляет 50 МБ.

Практически ориентируйтесь именно на более строгий лимит активного маршрута.

Суммарный лимит текущей конфигурации — 100 МБ, число файлов — до 20.

Подробнее: «Текущие ограничения».


Почему модель не нашла фразу в документе?

Возможные причины:

  • файл не обработался;
  • текст не извлёкся;
  • документ является сканом;
  • индексация не завершена;
  • вопрос сформулирован слишком широко;
  • искомый фрагмент не попал в число найденных частей;
  • модель неверно интерпретировала найденный текст.

Проверяйте отдельно этапы загрузки, извлечения, индексации, поиска и ответа.


Можно ли выполнять произвольный код из чата?

Нет. В штатной продуктовой политике:

runCode: false

Выполнение произвольного кода намеренно отключено.

Это не ошибка и не функция, которую обычный пользователь должен включить настройкой.


Почему некоторые действия требуют подтверждения?

Студия различает операции:

  • разрешённые автоматически;
  • требующие подтверждения;
  • запрещённые.

Подтверждение — дополнительный слой контроля перед действием с потенциальным внешним или изменяющим эффектом.

При этом системные сервисы Яндекс Облака в стандартной поставке проектируются для чтения, а не изменения инфраструктуры.


Может ли ИИ изменить мою инфраструктуру в Яндекс Облаке?

Системные интеграции текущего продуктового профиля рассчитаны на только чтение.

Дополнительную защиту обеспечивает IAM: служебной учётной записи следует выдавать минимальные роли просмотра.

Проверять нужно оба уровня:

политика Студии
+
фактические IAM-права

Чем Working Folder отличается от AI Studio Folder?

Это две разные области.

Рабочий Folder используется для анализа инфраструктуры и сервисов Яндекс Облака.

AI Studio Folder — родительский Folder служебной учётной записи, относительно которого вызываются модели Yandex AI Studio.

Они могут совпадать, но система не должна считать их одним и тем же понятием автоматически.


А Billing Account — это ещё один Folder?

Нет.

Платёжный аккаунт — отдельный ресурс биллинга.

Для детализации расходов роль billing.accounts.viewer назначается на платёжный аккаунт, а не на рабочий Folder.

Поэтому схема:

Working Folder
AI Studio Folder
Billing Account

состоит из трёх разных сущностей.


Почему расходы в FinOps могут обновляться не мгновенно?

Студия сознательно кэширует данные, чтобы:

  • не перегружать Billing API;
  • не упираться в ограничения частоты;
  • не передавать огромный необработанный ответ модели;
  • ускорять повторные запросы.

Для текущего контура используются разные сроки для оперативного снимка, детализации и закрытой истории.

Подробнее: «Текущие ограничения».


Почему cost и expense отличаются?

В финансовом контуре эти показатели имеют разный смысл.

Упрощённо:

  • cost — стоимость до части скидочных механизмов;
  • credits — применённые скидки/кредиты;
  • expense — фактический расход после учёта соответствующих корректировок.

Для управленческого анализа чаще ориентируются на expense, сохраняя остальные значения для объяснения расчёта.


Можно ли подключить собственный корпоративный сервис?

Да, но в текущем профиле это административная операция.

Обычному пользователю запрещено самостоятельно создавать и публиковать произвольные внешние подключения.

Новый корпоративный сервис следует реализовывать отдельно, с минимальными правами, сетевыми ограничениями, аудитом и собственными тестами — без изменения исходного кода базовой платформы.


Почему нет каталога публичных агентов?

Публичная торговая площадка агентов намеренно отключена продуктовой политикой.

При этом собственные:

  • помощники;
  • навыки;
  • внутренний общий доступ;

остаются доступны согласно правам организации.


Сколько плановых заданий можно создать?

В текущей конфигурации 0.3.66:

  • до 50 на пользователя;
  • минимальный интервал — 60 минут;
  • после 5 последовательных ошибок задание автоматически отключается.

Есть ли ограничение памяти?

Да.

В текущей конфигурации:

  • лимит памяти — 10 000;
  • ограничение входа агента памяти — 12 000 токенов;
  • окно последних сообщений — 10.

Точные параметры выпуска собраны в «Текущих ограничениях».


Делает ли Студия организацию автоматически соответствующей 152-ФЗ?

Нет.

Программный продукт может предоставить технические механизмы:

  • локальную обработку;
  • разграничение доступа;
  • сетевые ограничения;
  • управление секретами;
  • журналирование;
  • резервирование.

Но обязанности оператора персональных данных включают также организационные, правовые и процедурные меры.

Подробнее: «Использование с учётом 152-ФЗ».


Нужно ли включать локальные веса моделей в каждую резервную копию?

Не обязательно.

В 0.3.66 большие веса рассматриваются как воспроизводимый кэш официального артефакта и могут не входить в основной резервный архив.

Но для полностью изолированного контура организация должна иметь отдельную проверенную копию необходимых весов, потому что скачать их после аварии из Интернета будет нельзя.


Как понять, что система работает?

На сервере:

./nicesoft.sh status
./nicesoft.sh health

Но после серьёзных изменений также нужны функциональные и отрицательные проверки.

Например:

  • USER не получил ADMIN;
  • локальная модель действительно отвечает;
  • RAG возвращает контрольный документ;
  • Яндекс Облако остаётся только для чтения;
  • внутренние адреса блокируются веб-службой;
  • локальный запрос не уходит в Yandex AI скрыто.

Почему раздел «Решение проблем» пока короткий?

По решению владельца продукта единый раздел диагностики отложен до стабилизации остальных разделов документации.

Сейчас тематические способы проверки уже находятся внутри соответствующих глав:

  • модели — в разделе моделей;
  • документы — в разделе файлов;
  • Яндекс Облако — в разделе интеграции;
  • безопасность — в разделе безопасности;
  • эксплуатация — в разделе установки и эксплуатации.

Сам единый раздел помечен «в разработке» и будет сводиться позже.