Перейти к содержанию

Основные понятия

ИИ Студия специально скрывает большую часть технической сложности, но несколько терминов всё равно встречаются в интерфейсе и документации. На этой странице они объяснены на практических примерах, без необходимости изучать устройство нейронных сетей.

Не нужно запоминать всё сразу

Для первого рабочего дня достаточно понимать пять слов: Студия, модель, контекст, проект и ИИ-помощник. К остальным понятиям можно возвращаться по мере необходимости.


ИИ Студия

ИИ Студия — всё корпоративное приложение целиком: интерфейс, пользователи, модели, чаты, файлы, проекты, память, помощники, сервисы и административные политики.

Аналогия: если модель — двигатель автомобиля, то Студия — весь автомобиль с рулём, приборной панелью, сиденьями, навигацией и правилами доступа.

Не путайте

  • Студия хранит и организует работу.
  • Модель генерирует ответ.

Модель искусственного интеллекта

Модель — вычислительная система, которая принимает текстовый контекст и формирует продолжение: ответ, таблицу, код, объяснение и т. п.

Разные модели отличаются:

  • качеством рассуждений;
  • скоростью;
  • размером контекста;
  • требованиями к оборудованию;
  • специализацией;
  • способом размещения;
  • стоимостью использования.

Бытовой пример

Одна модель может быть быстрой и дешёвой для повседневных задач. Другая — медленнее, но лучше справляться со сложным техническим анализом. Студия позволяет использовать обе в одном интерфейсе.


Локальная модель

Локальная модель работает на сервере, который контролирует ваша организация.

Когда вы отправляете запрос такой модели, вычисление выполняется внутри корпоративной инфраструктуры. Это основной режим для задач, где важен контролируемый контур данных.

Важно

Локальная модель сама по себе не означает, что вообще ни один компонент никогда не выйдет в интернет. Если в диалоге отдельно включён интернет-поиск или внешний сервис, эта часть задачи использует соответствующее соединение.


Облачная модель

Облачная модель работает у внешнего поставщика и вызывается через сеть.

В ИИ Студии примером является модель Yandex AI Studio. При её использовании текст запроса и необходимый для ответа контекст передаются в Яндекс Облако.

Зачем тогда нужны облачные модели

Они могут давать другое качество, скорость, размер контекста или возможности без покупки собственного мощного оборудования. Организация сама определяет, для каких данных такой режим допустим.


Активная модель

Активная модель — модель, которую Студия использует сейчас для конкретного режима или диалога.

Если администратор заменил локальную модель, пользователю обычно не нужно перенастраивать приложение: активный маршрут обновляется на сервере.


Контекст

Контекст — информация, которую модель получает вместе с вашим текущим сообщением и может учитывать при формировании ответа.

В контекст могут входить:

  • системные правила помощника;
  • часть истории текущего диалога;
  • ваше новое сообщение;
  • содержимое прикреплённого небольшого файла;
  • найденные фрагменты большого документа;
  • память пользователя;
  • результат интернет-поиска;
  • результат подключённого сервиса.

Почему контекст конечный

У каждой модели есть максимальный объём информации, который она может обработать за один запрос. Поэтому бесконечный диалог не означает, что модель буквально перечитывает всю историю с самого первого сообщения при каждом ответе.

Студия управляет рабочим контекстом: сохраняет важные инструкции и свежие сообщения, а слишком старые части могут перестать попадать в текущий запрос.


Токен

Токен — техническая единица, на которую модель делит текст. Это не обязательно слово: одно слово может состоять из нескольких токенов, а короткие элементы — объединяться иначе.

Пользователю токены важны по двум причинам:

  1. максимальный контекст модели измеряется токенами;
  2. многие облачные модели тарифицируются по объёму входных и выходных токенов.

Не нужно считать токены вручную

Для повседневной работы ориентируйтесь на смысл: очень длинный разговор + несколько больших документов требуют больше контекста, чем один короткий вопрос.


Диалог

Диалог — последовательность ваших сообщений и ответов ИИ.

Обычный диалог сохраняется в истории. Его можно продолжать позже, переименовывать, искать и удалять.

Почему лучше не смешивать всё в одном диалоге

Если в один разговор последовательно поместить настройку сервера, написание коммерческого предложения и анализ договора, контекст станет менее сфокусированным. Для существенно разных задач лучше создавать отдельные чаты.


Ветка диалога

Ветка — альтернативное продолжение разговора из определённой точки.

Например, до сообщения №10 вы обсуждали общую архитектуру. После него можно создать:

  • ветку А — «оставляем монолит»;
  • ветку Б — «разделяем на сервисы».

Исходный разговор не уничтожается.


Временный чат

Временный чат — разговор, который не показывается в обычной истории и поиске и удаляется сервером после установленного срока хранения.

Это удобно для одноразовых задач.

Warning

Временный чат не равен «нулевому хранению». До истечения срока он может находиться в серверной базе. Политику хранения задаёт администратор.


Проект

Проект — личное рабочее пространство, объединяющее несколько связанных диалогов.

Примеры проектов:

  • «Переезд сайта»;
  • «Внедрение CRM»;
  • «Клиент А»;
  • «Документация продукта»;
  • «Подготовка к сертификации».

Что проект не делает сам по себе

Проект не превращает все разговоры в одну бесконечную память модели. Он прежде всего организует связанные диалоги. То, какой контекст получит модель, определяется конкретным разговором, файлами, памятью и настройками помощника.


ИИ-помощник

ИИ-помощник — заранее настроенная роль искусственного интеллекта.

У помощника могут быть:

  • имя и описание;
  • постоянные инструкции;
  • выбранная модель;
  • разрешённые файлы и знания;
  • память;
  • навыки;
  • подключённые сервисы;
  • ограничения.

Пример

Обычная модель получает вопрос:

Почему не запускается служба?

Помощник «Системный администратор» может иметь постоянную инструкцию:

Сначала собери признаки проблемы, затем построй гипотезы, предложи безопасные команды диагностики и отдельно предупреди о командах, которые меняют систему.

Пользователю не приходится повторять эту инструкцию в каждом чате.


Навык

Навык — переиспользуемая процедура или набор правил, которые помощник может применить к задаче.

Помощник — это «кто работает», а навык — «какую процедуру он умеет выполнять».

Пример

Помощник: Технический писатель.

Навыки:

  • «Оформить инструкцию по корпоративному шаблону»;
  • «Проверить терминологию»;
  • «Подготовить список изменений релиза».

Один навык можно использовать в разных помощниках, если политика это разрешает.


Системная инструкция

Системная инструкция — правила поведения, которые Студия передаёт модели до сообщения пользователя.

Обычный пользователь обычно не видит все серверные правила. У собственного помощника могут быть дополнительные редактируемые инструкции.

Системные инструкции помогают сделать ответы последовательнее, но не дают абсолютной гарантии безошибочного поведения.


Корпоративная база знаний

Корпоративная база знаний — набор внутренних материалов, по которым ИИ может искать информацию для ответа.

Это может быть:

  • документация;
  • регламенты;
  • инструкции;
  • стандарты;
  • описания продуктов;
  • база ответов поддержки.

Она отличается от общих знаний модели тем, что содержит ваши собственные материалы.


Поиск по документам

Поиск по документам — механизм, который находит в большом файле или коллекции файлов только фрагменты, относящиеся к вопросу.

Технически такой подход часто называется RAG, но пользователю достаточно понимать последовательность:

  1. документ загружается;
  2. Студия извлекает и индексирует его текст;
  3. вы задаёте вопрос;
  4. система ищет подходящие фрагменты;
  5. модель получает эти фрагменты вместе с вопросом;
  6. ответ может содержать ссылки на источник.

Почему это лучше, чем всегда отправлять весь PDF

Большой документ может не помещаться в контекст и тратить ресурсы на нерелевантный текст. Поиск передаёт модели только нужные части.


Цитата из файла

Цитата в интерфейсе — ссылка на фрагмент документа, использованный при формировании ответа.

Цитата важна не только для удобства: она помогает проверить, действительно ли вывод соответствует источнику.


Интернет-поиск

Интернет-поиск — отдельный инструмент, через который Студия получает свежие результаты из сети и содержимое найденных страниц.

Модель сама по себе не обязана знать сегодняшние версии программ, свежие новости или недавно изменившуюся документацию. Интернет-поиск добавляет актуальные источники в контекст.

Важно для конфиденциальности

Поисковый запрос выходит во внешний интернет. Не помещайте в него секреты, ключи или внутренние данные, если это запрещено политикой организации.


Память

Память — структурированное хранилище небольшого набора сведений, которые можно использовать между разными разговорами.

Это не полный архив чатов и не семантический поиск по всей истории.

Примеры памяти:

  • «пользователь предпочитает ответы на русском»;
  • «основной проект — система X»;
  • «в инструкциях использовать термин НАЙС.ОС».

Если функция включена, пользователь может управлять доступными записями в пределах разрешений.


История и память — в чём разница

Механизм Для чего нужен
История Открыть старый разговор целиком
Поиск по истории Найти старый разговор по словам
Контекст диалога Дать модели недавние сообщения текущего разговора
Память Сохранить небольшой набор устойчивых фактов между разговорами
Проект Организовать связанные разговоры
База знаний Искать по корпоративным документам

Сервис Студии

Сервис Студии — подключённая система или инструмент, к которому ИИ может обратиться для получения актуальных данных или разрешённого действия.

Примеры:

  • документация Яндекс Облака;
  • сведения об облачной инфраструктуре;
  • Billing;
  • корпоративная внутренняя система;
  • сервис работы с офисными документами.

Для обычного пользователя не важно, по какому техническому протоколу работает подключение. В документации мы используем понятное название «сервис Студии».


Инструмент

Инструмент — конкретная операция, которую предоставляет сервис или сама Студия.

Например, один сервис Яндекс Облака может предоставлять несколько операций чтения: получить список ресурсов, получить сведения о выбранном ресурсе, выполнить поиск и т. п.

ИИ выбирает инструмент на основании задачи и собственных инструкций, но доступность всегда ограничена политиками.


Подтверждение действия

Подтверждение — остановка перед чувствительной операцией, когда Студия просит пользователя явно разрешить её выполнение.

Организация может заранее разрешить безопасные операции чтения и требовать подтверждение для изменяющих действий.

Если ИИ только написал текст «я выполнил операцию», но фактический инструмент не был успешно вызван, это не считается выполнением.


Роль

Роль — набор базовых прав пользователя.

Например, обычный пользователь может работать с чатами и разрешёнными помощниками, а администратор — дополнительно управлять моделями, пользователями и системными настройками.


Право доступа

Право доступа — разрешение на конкретную возможность или ресурс.

Роль отвечает на вопрос «какой это тип пользователя», а права уточняют, что именно ему разрешено.

Примеры:

  • использовать помощника — да;
  • редактировать помощника — нет;
  • включать интернет-поиск — да;
  • создавать общий доступ — нет;
  • использовать интеграцию с Billing — только администратор.

Служебная учётная запись

Служебная учётная запись — техническая учётная запись для доступа приложения к Яндекс Облаку. Она принадлежит не конкретному сотруднику, а сервису.

Администратор назначает ей минимально необходимые роли.

Обычному пользователю не нужно получать её ключ или токен.


Авторизованный ключ

Авторизованный ключ — JSON-файл, который позволяет серверному компоненту Студии получать временные учётные данные Яндекс Облака от имени служебной учётной записи.

Это секрет.

Danger

Никогда не вставляйте содержимое авторизованного ключа в обычный чат, письмо, тикет или скриншот. Для подключения существует специальная административная форма.


Рабочий каталог Яндекс Облака

Рабочий каталог — область Яндекс Облака, которую администратор выбирает для инфраструктурной интеграции Студии.

Он задаёт рабочий контекст для просмотра разрешённых облачных ресурсов.


Каталог Yandex AI Studio

Для моделей Яндекса используется отдельный контекст доступа — каталог, на котором служебной учётной записи выданы права на языковые модели.

Рабочий каталог инфраструктуры и каталог AI Studio могут совпадать, но это не обязательно. Поэтому в административном интерфейсе они рассматриваются отдельно.


Billing / FinOps

Billing — данные об использовании и расходах Яндекс Облака.

FinOps в контексте Студии — практическая работа с этими данными: понять, на что ушли деньги, как меняются расходы и где стоит искать возможности оптимизации.

Доступ к Billing выдаётся отдельно от обычного доступа к облачным ресурсам.


Индекс

Индекс — служебная структура, которая помогает быстро находить нужные чаты или фрагменты документов.

Пользователю обычно не нужно управлять индексом вручную. Если поиск ничего не находит сразу после загрузки документа, возможно, индексация ещё не завершилась.


Векторное представление / embedding

В технической документации можно встретить слово embedding. Это числовое представление смысла текста, которое используется для поиска похожих фрагментов.

Пользователь не работает с такими числами напрямую. Достаточно знать: они помогают найти раздел документа по смыслу, даже если в вопросе использованы не те же слова.


Потоковый ответ

Потоковый ответ означает, что текст появляется постепенно, а не только после полной генерации.

Кнопка отправки во время ответа обычно превращается в кнопку остановки. Остановка прекращает дальнейшую генерацию, но уже полученная часть может сохраниться в диалоге.


Сеанс пользователя

Сеанс — состояние входа в Студию после успешной аутентификации.

Когда сеанс заканчивается или вы выходите из системы, браузер снова потребует вход. Это не удаляет ваши чаты.


Короткая памятка

Если видите незнакомый термин, задайте три вопроса:

  1. Это хранит мои данные? — история, проект, память, база знаний.
  2. Это генерирует ответ? — модель.
  3. Это получает актуальные данные извне? — интернет-поиск или сервис Студии.

Этого разделения достаточно, чтобы уверенно пользоваться большинством возможностей.

Что дальше

Теперь переходите к Первому входу. После входа используйте Интерфейс Студии как карту экрана.