Перейти к содержанию

Чат и диалоги

Чат — основное рабочее пространство ИИ Студии. Именно здесь пользователь формулирует задачу, прикладывает документы, видит активную модель, выбирает ИИ-помощника и включает разрешённые сервисы и получает результат.

На первый взгляд работа выглядит просто: написать сообщение и получить ответ. На практике хороший результат зависит от того, что уже находится в текущем диалоге, какая модель выбрана, какие файлы приложены и какие дополнительные возможности включены. Поэтому в этом разделе мы разберём чат не как «поле для вопроса», а как полноценное рабочее пространство.

Главная идея раздела

Один диалог лучше воспринимать как отдельную рабочую сессию с собственной историей и контекстом. Если тема задачи изменилась полностью, чаще всего лучше создать новый чат, а не продолжать бесконечную переписку.


Что такое диалог

Диалог — последовательность сообщений пользователя и ответов ИИ, объединённых общей историей.

Внутри одного диалога Студия может учитывать:

  • предыдущие сообщения пользователя;
  • предыдущие ответы модели;
  • выбранную модель или ИИ-помощника;
  • приложенные к текущей работе файлы;
  • найденные фрагменты документов;
  • включённый интернет-поиск;
  • результаты разрешённых сервисов Студии;
  • сохранённую память пользователя, если она включена;
  • проект, к которому относится чат;
  • дополнительные инструкции выбранного помощника.

Это и создаёт ощущение продолжительного разговора: вам не нужно повторять каждую фразу из предыдущего сообщения.

Пример

Первое сообщение:

У нас есть веб-сервис на Python и PostgreSQL. После обновления базы запрос стал выполняться 20 секунд вместо одной. С чего начать диагностику?

Следующее сообщение:

А если в журнале ещё есть could not receive data from client?

Во втором сообщении не требуется снова писать, что речь идёт о Python, PostgreSQL и замедлившемся запросе. Эта информация уже находится в истории текущего диалога.


Что такое контекст диалога

Контекст — информация, которую модель получает вместе с текущим запросом и может использовать для ответа.

Для новичка удобно представить его как рабочий стол. Пока на столе лежит несколько относящихся к одной задаче документов и заметок, ориентироваться легко. Если на тот же стол месяцами складывать всё подряд — договоры, код, рецепты, журналы серверов и планы отпуска — полезная информация начинает смешиваться.

Поэтому длинный чат не всегда лучше короткого.

В контекст могут входить

  1. инструкции Студии и выбранного ИИ-помощника;
  2. сохранённые сведения памяти, если функция используется;
  3. недавняя или необходимая часть истории разговора;
  4. фрагменты приложенных документов;
  5. результаты интернет-поиска;
  6. результаты вызова подключённых сервисов;
  7. текущее сообщение пользователя.

В контекст не обязательно входит абсолютно всё

У каждой модели есть ограничение на объём информации, которую она способна обработать за один запрос. Когда диалог становится очень длинным, Студия должна укладывать полезную информацию в доступный объём контекста.

Поэтому спустя сотни сообщений модель может хуже учитывать ранние детали разговора.

Практическое правило

Если новая задача больше не зависит от предыдущей переписки, создайте новый чат. Это уменьшает лишний контекст и обычно делает ответ точнее.


Что сохраняется после отправки сообщения

В обычном сохранённом чате Студия хранит данные, необходимые для продолжения работы и отображения истории.

Обычно сохраняются:

  • текст сообщений пользователя;
  • ответы ИИ;
  • название диалога;
  • время сообщений;
  • выбранные параметры разговора;
  • связь с проектом, если чат относится к проекту;
  • информация о ветках диалога;
  • ссылки на разрешённые файлы и результаты работы с ними;
  • служебные сведения, необходимые для корректной работы интерфейса.

Конкретный срок хранения определяется политикой вашей организации.

Обычный и временный чат — не одно и то же

Обычный чат появляется в истории и предназначен для дальнейшего использования.

Временный чат не показывается в обычной истории и автоматически удаляется после заданного администратором срока. В эталонной конфигурации ИИ Студии для временных чатов используется срок 720 часов, то есть 30 суток. Администратор организации может изменить это значение.

Подробнее: Временный чат.


Что не является памятью

История текущего диалога и долговременная Память — разные функции.

Если вы написали в одном разговоре:

Наш проект называется Север.

модель может использовать это в следующих сообщениях этого же чата, потому что фраза находится в его истории.

Это ещё не означает, что новый чат автоматически будет знать название проекта.

Для переноса отдельных постоянных сведений между разговорами используется функция Память, если она разрешена вашей организацией.

Подробнее: Память.


Новый чат или продолжение старого

Выбирайте продолжение текущего чата, когда:

  • вы уточняете предыдущий ответ;
  • новая задача напрямую зависит от уже обсуждавшихся данных;
  • вы продолжаете анализ того же документа;
  • вы дорабатываете один и тот же текст;
  • вы идёте по одному плану диагностики;
  • вам важны предыдущие решения и ограничения.

Создавайте новый чат, когда:

  • тема полностью изменилась;
  • вы хотите получить независимый взгляд без влияния прошлой переписки;
  • старый чат стал очень длинным и запутанным;
  • вы начали работать с другим проектом или клиентом;
  • старые инструкции больше не должны влиять на результат;
  • требуется другая граница обработки данных или другой набор инструментов.

Хороший пример разделения

Один чат:

Проект «Север» — архитектура резервного копирования PostgreSQL.

Второй чат:

Подготовка текста вакансии системного администратора.

Третий чат:

Анализ расходов Яндекс Облака за август.

Так проще и пользователю, и модели.


Что происходит после нажатия «Отправить»

Упрощённо процесс выглядит так:

  1. Студия принимает ваше сообщение.
  2. Определяет активную модель или помощника.
  3. Собирает разрешённый контекст разговора.
  4. При необходимости добавляет подходящие фрагменты документов.
  5. Если включён интернет-поиск — выполняет поиск и чтение разрешённых страниц.
  6. Если ИИ-помощнику нужны подключённые сервисы — он может обратиться к ним в пределах выданных прав.
  7. Формируется запрос к выбранной модели.
  8. Модель начинает создавать ответ.
  9. Ответ поступает в интерфейс постепенно, по мере генерации.
  10. После завершения сообщение сохраняется в текущем диалоге.

Некоторые пункты выполняются только тогда, когда соответствующая функция действительно используется.

Внешний сервис меняет границу данных

Если выбран YandexGPT/Alice AI или включён инструмент, обращающийся во внешний сервис, данные, необходимые для такого обращения, покидают локальный сервер Студии. Локальная модель сама по себе этого не делает, но наличие локальной модели не отменяет отдельно включённые внешние функции.


Потоковый ответ

Студия показывает ответ по мере его формирования. Не нужно ждать, пока модель подготовит весь текст целиком.

Преимущества:

  • сразу видно, правильно ли модель поняла задачу;
  • длинный ненужный ответ можно остановить;
  • пользователь быстрее получает первые полезные сведения;
  • проще заметить, если ответ пошёл не в нужную сторону.

Во время генерации кнопка отправки меняется на управление остановкой ответа.

Подробнее: Новый диалог и Работа с ответом.


Остановка ответа не удаляет чат

Если ответ оказался слишком длинным или модель неправильно поняла задачу:

  1. нажмите Остановить;
  2. дождитесь прекращения генерации;
  3. напишите уточнение;
  4. продолжите тот же диалог.

Остановка активного ответа не равна удалению разговора.

Например:

Остановись. Мне не нужен общий обзор. Покажи только три наиболее вероятные причины ошибки и команды для их проверки.

Это обычно эффективнее, чем ждать несколько страниц нерелевантного текста.


Сообщение можно уточнить, изменить или повторить

После ответа доступны действия, зависящие от типа сообщения и выданных прав.

Основные сценарии:

  • скопировать ответ;
  • повторно сгенерировать ответ;
  • изменить собственное предыдущее сообщение;
  • создать альтернативную ветку разговора;
  • скопировать фрагмент кода;
  • открыть использованные источники;
  • продолжить разговор уточняющим сообщением;
  • создать отдельный чат от выбранной точки.

Важно понимать: повторная генерация и редактирование старого запроса могут создавать альтернативные ветви истории, а не обязательно стирать прежний результат.

Подробнее: Работа с ответом и Ветвление диалога.


Модель влияет на ответ, но чат остаётся вашим рабочим пространством

Если вашей роли доступны несколько моделей, их можно выбирать через интерфейс Студии.

Разные модели могут отличаться:

  • качеством рассуждения;
  • скоростью;
  • объёмом доступного контекста;
  • специализацией на коде или общем тексте;
  • требованиями к оборудованию;
  • стоимостью внешнего запроса;
  • границей обработки данных.

При этом сам интерфейс, история и проекты принадлежат Студии, а не конкретной модели.

Подробнее: Выбор модели.


Локальная и облачная модель в одном интерфейсе

В организации могут одновременно использоваться:

  • локальные модели, запущенные внутри инфраструктуры;
  • YandexGPT;
  • Alice AI;
  • другие разрешённые администратором модели.

Для пользователя они доступны в одном рабочем пространстве, но режим обработки различается.

Локальная модель

Текст запроса обрабатывается локальным сервером модели.

Модель Yandex AI Studio

Необходимый текст запроса и контекст передаются в Яндекс Облако.

Не выбирайте облачную модель для запрещённых к внешней передаче данных

Если внутренняя политика организации требует локальной обработки конкретной информации, перед отправкой убедитесь, что выбрана именно локальная модель и не включены внешние инструменты.


Диалог с файлами

Файл может участвовать в разговоре несколькими способами.

Например:

  • небольшой текстовый файл можно обработать непосредственно;
  • большой документ можно индексировать и искать в нём релевантные фрагменты;
  • модель может отвечать со ссылками на найденные места;
  • отдельный офисный документ можно использовать как исходный материал для создания новой версии.

Не обязательно загружать один и тот же файл повторно в каждое сообщение. Способ использования зависит от типа файла и выбранного сценария.

Подробности находятся в разделе Файлы и знания.


Диалог с интернет-поиском

Локальная модель не знает автоматически, что произошло сегодня утром или что изменилось в документации после её обучения.

Если пользователю разрешён интернет-поиск, Студия может получить свежие источники и использовать их для ответа.

Это полезно для:

  • новых версий программ;
  • актуальной документации;
  • недавно опубликованных изменений;
  • сравнения современных продуктов;
  • проверки текущих сведений.

Поиск в интернете и поиск по вашим чатам — разные функции.

Подробнее: Интернет-поиск.


Диалог с сервисами Студии

ИИ-помощник может иметь доступ к дополнительным сервисам: например, к разрешённым данным Яндекс Облака, официальной документации, финансовой информации или офисным инструментам.

Для пользователя работа по-прежнему выглядит как обычный разговор:

Опиши виртуальные машины в нашем рабочем каталоге и выдели те, у которых нет публичного адреса.

или:

Создай таблицу XLSX из этих данных и добавь отдельный лист со сводкой.

За интерфейсом Студия определяет, какой разрешённый сервис нужен, и обращается к нему.

Note

Некоторые действия только читают данные, а некоторые способны создать или изменить файл. Для изменяющих действий Студия может запросить подтверждение в соответствии с политикой администратора.


Диалог внутри проекта

Проект помогает объединить несколько разговоров одной темой.

Например, проект Миграция ERP может содержать отдельные чаты:

  • план миграции;
  • сетевую схему;
  • анализ рисков;
  • документацию PostgreSQL;
  • подготовку письма подрядчику.

Проект не означает, что каждый чат автоматически получает полный текст всех остальных чатов. Его основная задача — организационная: связать работу одной темой и упростить навигацию.

Подробнее: Проекты.


Название диалога

После начала разговора Студия формирует название, чтобы чат было легче найти в истории.

Название можно изменить вручную.

Хорошие названия:

  • Анализ ошибки PostgreSQL 14.09;
  • Договор поставки — риски;
  • YC — расходы за август;
  • Проект Север — резервное копирование.

Плохие названия:

  • Вопрос;
  • Тест;
  • Новый чат 12;
  • Помоги.

Чем понятнее название, тем легче найти работу через месяц.


История и поиск — разные действия

История показывает сохранённые разговоры.

Поиск позволяет найти нужный чат по названию или тексту индексированных сообщений.

Поиск по истории в Студии лексический, то есть ориентируется прежде всего на введённые слова и похожие варианты написания. Он не является тем же самым семантическим поиском, который используется в больших документах.

Подробнее: История и поиск.


Закрепление, закладки и проекты решают разные задачи

Закрепление — держит важный разговор в отдельной видимой области истории.

Закладки — дополнительный механизм организации сохранённых элементов, если он разрешён вашей роли.

Проект — объединяет разговоры одной рабочей темой.

Не используйте всё как одну и ту же «папку». Для долгого проекта лучше создать проект, а не закреплять двадцать отдельных чатов.

Подробнее: Закладки и закрепление.


Ветви разговора

Один разговор может иметь альтернативные варианты развития.

Например, вы попросили:

Предложи архитектуру отказоустойчивого сервиса.

Получили вариант A, а затем изменили старый запрос и попросили делать решение без Kubernetes. Вместо потери первоначального варианта Студия может сохранить оба пути как разные ветви.

Также можно создать отдельный новый чат от выбранного сообщения — это называется ответвлением разговора.

Подробнее: Ветвление диалога.


Сравнение двух ответов

Если функция разрешена вашей роли, Студия может отправить один запрос нескольким моделям и показывать результаты параллельно.

Это полезно, когда необходимо сравнить:

  • качество текста;
  • полноту анализа;
  • стиль;
  • скорость;
  • поведение локальной и облачной модели.

Это не автоматический конкурс и не гарантия того, что «правый ответ лучше левого». Решение всё равно принимает пользователь.

Подробнее: Сравнение ответов.


Общий доступ к разговору

Разговор можно опубликовать через управляемую ссылку, если политика организации разрешает эту функцию.

Получатель видит опубликованную копию разговора в режиме чтения. В зависимости от политики ссылка может требовать входа в Студию; публичный доступ может быть полностью запрещён администратором.

В корпоративной поставке рекомендуется считать общий доступ отдельной публикацией данных, а не просто удобной кнопкой.

Перед созданием ссылки всегда проверяйте:

  • нет ли в чате персональных данных;
  • нет ли секретов, ключей и паролей;
  • нет ли внутренних адресов;
  • какие файлы попадут в снимок публикации;
  • кому разрешено открыть ссылку.

Подробнее: Общий доступ.


Импорт и экспорт

Студия поддерживает перенос отдельных разговоров в удобные форматы и импорт совместимых историй.

Экспорт полезен для:

  • сохранения итогового обсуждения;
  • передачи результата коллегам;
  • включения переписки в проектную документацию;
  • архивирования важной ветви;
  • машинной обработки структуры диалога.

Подробности: Импорт и экспорт.


Когда чат начинает работать хуже

Признаки перегруженного разговора:

  • модель путает разные задачи;
  • возвращается к старым ограничениям, которые уже не актуальны;
  • игнорирует важную деталь из начала длинной переписки;
  • отвечает слишком широко из-за накопленного контекста;
  • вы сами уже не понимаете, где обсуждалась нужная тема.

Что делать:

  1. попросить ИИ кратко зафиксировать текущие выводы;
  2. скопировать итоговые факты;
  3. создать новый чат;
  4. вставить только необходимое резюме;
  5. продолжить работу без лишней истории.

Пример стартового сообщения нового чата:

Продолжаем задачу по миграции PostgreSQL. Зафиксированные условия: версия 16, простой не более 10 минут, целевой сервер — НАЙС.ОС, размер БД 1,2 ТБ. На предыдущем этапе выбрали логическую репликацию. Теперь нужно составить пошаговый план переключения.

Это лучше, чем тащить за собой сотни нерелевантных сообщений.


Минимальная безопасная привычка перед каждым важным запросом

Перед отправкой чувствительных данных ответьте на четыре вопроса:

  1. Какая модель выбрана? Локальная или облачная?
  2. Включён ли интернет-поиск?
  3. Какие сервисы доступны помощнику?
  4. Нужно ли вообще прикладывать весь документ, или достаточно обезличенного фрагмента?

Если хотя бы на один вопрос вы не знаете ответ, сначала уточните режим работы.


Карта этого раздела

Задача Куда перейти
Начать разговор с нуля Новый диалог
Научиться формулировать запросы Как правильно задавать вопросы
Понять, какую модель выбрать Выбор модели
Копировать, повторять и изменять ответы Работа с ответом
Найти старую переписку История и поиск
Держать важные чаты под рукой Закладки и закрепление
Разделить разговор на альтернативные пути Ветвление диалога
Сравнить две модели Сравнение ответов
Провести разговор без обычной истории Временный чат
Передать результат другому человеку Общий доступ
Скачать или перенести разговор Импорт и экспорт

Управление длинной работой

В 0.3.66 чат поддерживает несколько важных функций для длинных агентных ответов:

Эти функции особенно полезны при работе с помощниками, файлами и внешними сервисами.

Что дальше

Если вы только начали пользоваться Студией, переходите к Новому диалогу и пройдите инструкцию целиком.

Если вы уже умеете отправлять сообщения, но ответы часто получаются слишком общими, начните с правильной постановки задачи.