Ограничения и значения по умолчанию — 0.3.66¶
Эта страница фиксирует фактические значения рабочей конфигурации выпуска 0.3.66. Это справочник, а не обещание навсегда: при обновлении Студии значения могут измениться.
Warning
Если установлен другой выпуск, сначала проверьте его конфигурацию. Не переносите лимиты 0.3.66 на будущую версию автоматически.
1. Временные диалоги¶
| Параметр | Значение |
|---|---|
| Функция включена | да |
| Срок хранения | 720 часов |
| Эквивалент | 30 суток |
| Режим хранения | временный |
Это исправляет раннее документационное значение в 168 часов: для 0.3.66 актуально 720 часов.
Временный чат не отменяет внешнюю обработку Yandex AI, интернет-поиска или подключённых сервисов.
2. Плановые задания¶
| Параметр | Значение |
|---|---|
| Максимум заданий на пользователя | 50 |
| Минимальный интервал | 60 минут |
| Автоотключение после последовательных ошибок | 5 ошибок |
| Одновременных запусков планировщика | до 5 |
| Проект обязателен | нет |
Если плановое задание вызывает платную внешнюю модель, каждый запуск остаётся реальным платным запросом.
3. Файлы¶
| Параметр | Значение |
|---|---|
| Глобальный максимальный файл | 100 МБ |
| Основной маршрут: один файл | 50 МБ |
| Основной маршрут: файлов за одну операцию | 20 |
| Основной маршрут: суммарно | 100 МБ |
| Помощник: файлов | 20 |
| Аватар | 5 МБ |
| Контекст файла: символов | до 1 000 000 |
Подробнее: Форматы файлов.
4. Память¶
Текущая конфигурация памяти:
| Параметр | Значение |
|---|---|
| Лимит токенов | 10 000 |
| Лимит символов | 10 000 |
| Максимум входных токенов для обработки памяти | 12 000 |
| Окно анализируемых сообщений | 10 |
| Персонализация | включена |
Разрешённые категории памяти:
- предпочтения;
- рабочая информация;
- персональная информация;
- навыки;
- интересы;
- контекст.
Агент памяти получает отдельное правило не сохранять секреты, пароли, токены и одноразовые данные.
5. Помощники и операции¶
| Параметр | Значение |
|---|---|
| Обычный предел рекурсии | 50 |
| Максимально допустимый предел рекурсии | 100 |
| Максимальный размер аргументов одной операции | 65 536 байт |
| Максимум цитат | 30 |
| Максимум цитат из одного файла | 7 |
| Минимальная релевантность найденного фрагмента | 0,45 |
| Максимум дочерних помощников | 20 |
| Максимум помощников в одной цепочке базового механизма | до 10 |
| Максимум настроенных передач специалистам базового механизма | до 10 |
| Вопросов в одном запросе «Спросить пользователя» | до 4 |
| Максимум навыков каталога | 50 |
| Срок технической контрольной точки | 86 400 секунд |
Последний параметр является сроком технического состояния и не равен сроку хранения истории чата.
6. Выполнение кода¶
Произвольное серверное выполнение кода отключено продуктовой политикой. Наличие соответствующей возможности в базовой платформе не является основанием включать её вручную.
7. Каталог расширений¶
Каталог расширений в поставке НайсСофт отключён на уровне интерфейса и принудительно на уровне ролей.
После обновления проверяется отсутствие остаточного переопределения в БД.
8. Интернет-поиск¶
Текущий локальный контур:
| Параметр | Значение |
|---|---|
| Поисковая служба | локальный SearXNG |
| Безопасный поиск | 1 |
| Время ожидания поиска | 15 секунд |
| Время ожидания получения страницы | 12 секунд |
| Максимальный размер получаемой страницы | 4 194 304 байта (4 МиБ) |
| Максимальный очищенный текст страницы | 250 000 символов |
Служба получения страниц блокирует loopback, частные, link-local и служебные адреса облачных метаданных.
9. Поиск по документам¶
Текущая базовая конфигурация:
| Параметр | Значение |
|---|---|
| Размер фрагмента | 1500 |
| Перекрытие фрагментов | 100 |
| Поставщик векторных представлений | Hugging Face |
| Модель представлений | sentence-transformers/all-MiniLM-L6-v2 |
| Векторное хранилище | PostgreSQL + pgvector |
Эти параметры являются технической опорной конфигурацией и могут меняться после повторной квалификации.
10. Финансовые данные Яндекс Облака¶
| Данные | Кэш/ограничение |
|---|---|
| Базовый Billing-кэш | 300 секунд |
| Минимальный интервал тяжёлых Billing-запросов | 61 секунда |
| Оперативный снимок FinOps | 900 секунд (15 мин) |
| Детализация | 3600 секунд (1 час) |
| Закрытая история | 86 400 секунд (24 часа) |
| REST-кэш Billing | 300 секунд |
| Максимальный компактный ответ финансового сервиса | 8192 байт |
| Обычное ожидание Billing RPC | 30 секунд |
| Ожидание шлюза Яндекс Облака | 90 секунд |
Кэш уменьшает число обращений к Billing API и объём данных, передаваемых модели.
11. Мониторинг¶
В 0.3.66:
- показатели системы обновляются в интерфейсе примерно каждые 5 секунд;
- история Prometheus хранится 30 дней по умолчанию;
- интервалы графиков: 1 час, 6 часов, 24 часа, 7 дней, 30 дней.
Если источник метрики недоступен, интерфейс должен показывать неопределённое состояние, а не выдуманное число.
12. Сертификаты¶
| Параметр | Значение/правило |
|---|---|
| Локальный сертификат при чистой установке | создаётся автоматически |
| Срок локального сертификата | 3650 дней |
| IP в локальном сертификате | нет |
| Локальное DNS-имя | nicesoft-ai-studio.local |
| Порог автопродления Let’s Encrypt | примерно 30 дней до окончания |
| HTTP-порт 80 | только проверка домена и ACME HTTP-01 |
13. Модели¶
Продуктовые ограничения:
- одновременно активен один глобальный модельный маршрут;
- рабочие локальные модели используют NVIDIA GPU и основную среду vLLM;
- основной профиль требует вычислительную совместимость 7.5+;
- V100 (7.0) не считается рабочей локальной платформой 0.3.66;
- диагностическая Qwen3 0.6B не является рабочей моделью;
- GPU-выполнение не эмулируется на CPU;
- загрузка весов требует исходящего HTTPS к официальному источнику модели;
- Студия не устанавливает произвольный репозиторий модели по пользовательскому URL;
- при отказе локальной модели нет скрытого автоматического перехода в Yandex AI.
14. Что намеренно не фиксируется как постоянное число¶
Не фиксируются:
- цены Yandex AI;
- тарифы Яндекс Облака;
- внешние квоты GPU;
- доступность конкретной модели в отдельном Folder;
- пропускная способность конкретного GPU;
- число пользователей, которое «гарантированно выдержит» одна модель.
Они зависят от внешнего сервиса, оборудования, длины запросов и реального профиля нагрузки.