Каталог проверенных моделей¶
Центр управления моделями содержит курируемый каталог, а не открытое поле «введите любую модель из интернета».
Это одна из ключевых защит Студии. Перед автоматической установкой важны происхождение модели, лицензия, формат весов, совместимость с среда выполнения, аппаратные требования и результаты квалификации.
Два класса карточек¶
Рабочая / автоматически допустимая¶
Для такой модели определены:
- официальный источник вариант весов;
- формат весов;
- профиль среды выполнения;
- рабочий контекст;
- лицензионный статус;
- аппаратные требования;
- политика автоматической установки.
Frontier / кандидат для планирования¶
Модель видна как перспективная, но её установка блокируется до выполнения условий:
- license review;
- обновление среды выполнения;
- проверка архитектуры модели;
- квалификация на реальном железе.
Warning
Видимая карточка не всегда означает, что модель разрешено устанавливать в рабочем контуре.
Что показывает карточка¶
В зависимости от модели вы увидите:
- название и роль;
- поставщика;
- статус установки;
- precision/quantization;
- среда выполнения;
- источник вариант весов;
- лицензию;
- NiceSoft rank;
- рабочий контекст;
- расчёт VRAM;
- tensor parallel / число GPU;
- размер вариант весов;
- соответствие;
- теги;
- причину рекомендации или несовместимости.
Совместимость: подходит ли модель этому серверу¶
Проверка совместимости отвечает на практический вопрос:
Можно ли безопасно эксплуатировать этот конкретный artifact на текущем сервере?
Учитываются VRAM, число и архитектура GPU, среду выполнения, контекст и запас безопасности. Это гораздо полезнее, чем сравнение моделей только по параметрам.
NiceSoft rank¶
Это внутренний эксплуатационный рейтинг для ранжирования квалифицированных кандидатов. Он не является универсальным IQ модели.
Не интерпретируйте 90/100 как «на 12% умнее 78/100». Финальную ценность проверяют на реальных задачах организации.
Текущий рабочий каталог¶
Точный состав меняется между релизами. Текущее поколение Model Manager проверяет и умеет проводить lifecycle следующих рабочих вариантов моделей:
| Модель | Основная роль | Формат | Практический класс |
|---|---|---|---|
| Qwen3 8B AWQ | универсальная | AWQ 4-bit | T4 16 ГБ |
| Qwen2.5 Coder 7B AWQ | программирование | AWQ 4-bit | T4 16 ГБ |
| Qwen3.5 4B | компактная универсальная | BF16 | по соответствие |
| Qwen3.5 9B | сбалансированная | BF16 | 24 ГБ+ по соответствие |
| Qwen3.8 27B | флагманская универсальная | BF16 | 80 ГБ class |
| Qwen3.8 27B FP8 | high-throughput универсальная | FP8 | современный FP8 GPU |
| Qwen3 Coder 30B-A3B | мощное программирование | BF16 | 80 ГБ class |
| Qwen3 Coder Next | крупный coding profile | BF16 | крупный GPU/multi-GPU |
| Ministral 3 8B FP8 | универсальная edge | FP8 | 16–24 ГБ по соответствие |
| Ministral 3 14B FP8 | универсальная | FP8 | 24 ГБ+ |
| GLM-4.7-Flash | agentic/reasoning | vendor вариант весов | большой GPU |
| Kimi Linear 48B-A3B | длинный контекст | BF16 | большой VRAM/multi-GPU |
| Mistral Small 4 119B FP8 | корпоративная/агентная | FP8 | крупная система с несколькими GPU |
Отдельно существует NiceSoft Bootstrap · Qwen3 0.6B — диагностическая, а не рабочая модель.
Почему каталог теперь не только Qwen¶
Стратегия продукта — выбирать проверенный artifact под задачу и железо, а не быть привязанным к одному бренду.
Мультивендорный реестр снижает зависимость от одной линейки и позволяет использовать специализированные варианты для:
- кода;
- agentic reasoning;
- длинного контекста;
- компактного edge-профиля;
- большого серверного GPU высокого класса.
Qwen3 8B AWQ¶
Универсальный локальный baseline для ограниченного GPU-класса. AWQ позволяет разместить полезную 8B-модель на T4 16 ГБ с рабочим резервом.
Типовые задачи:
- корпоративный чат;
- тексты;
- базовый анализ документов;
- администрирование;
- технические объяснения.
Рабочий целевой контекст — порядка 16K.
Qwen2.5 Coder 7B AWQ¶
Специализированный вариант программирования для сравнительно компактного GPU.
Подходит для:
- code review;
- bug fixing;
- тестов;
- SQL;
- shell/Python/JS;
- конфигураций;
- DevOps.
Qwen3.5 4B и 9B¶
Современные BF16-профили. Важно: меньшее число параметров не гарантирует меньший рабочий memory envelope, чем у AWQ-варианта большей модели.
Совместимость смотрите в текущей карточке.
Qwen3.8 27B / FP8¶
Класс мощных универсальных локальных моделей.
- BF16 — профиль с большим VRAM;
- FP8 — более компактный artifact для подходящих современных GPU и высокопроизводительной эксплуатации.
Это разные развёртывание-artifacts, а не две подписи одного файла.
Qwen3 Coder 30B-A3B / Coder Next¶
Кодовые модели для крупной инфраструктуры. Их смысл появляется, когда программирование является существенной частью нагрузки и организация готова выделить соответствующий GPU-класс.
Ministral 3 8B/14B FP8¶
Альтернативные универсальные профили для подходящего современного железа. Исходные модели могут быть мультимодальными, но текущий пользовательский профиль ИИ Студии остаётся текстовым.
Warning
Не рекламируйте обработку изображений только потому, что исходная модель имеет такую возможность.
GLM-4.7-Flash¶
Специализированный вариант для agentic/reasoning-нагрузки на крупном GPU. Он не обязан быть лучшей заменой универсальной модели для офисных сотрудников.
Kimi Linear 48B-A3B¶
В каталоге позиционируется как long-context specialist. Из-за размера и memory envelope требует значительно более мощной системы, чем T4/T4i.
Mistral Small 4 119B FP8¶
Крупный корпоративный вариант модели. Для таких моделей особенно важно доверять текущей проверке метаданных и предварительной совместимости, а не статической цифре старой документации: исходная ревизия и реальный объём вариант весов могут меняться.
Frontier-кандидаты¶
В capacity-planning части могут присутствовать:
- Qwen3.8 Flash Next;
- DeepSeek V4.1 Flash;
- GLM-5.3-Flash;
- MiniMax M2.5.
Они помогают оценивать будущие серверы, но могут иметь блокирующий gate:
| Gate | Смысл |
|---|---|
license-review-required |
требуется юридическая проверка лицензии |
runtime-upgrade-required |
текущая среда выполнения не квалифицирована |
license-and-runtime-review |
нужны обе проверки |
Продукт не должен предлагать «установить всё равно» в обход gate.
Почему нельзя установить произвольный репозиторий¶
Случайный model repository может принести:
- неизвестную лицензию;
trust_remote_code;- несовместимый tokenizer;
- неподдерживаемую архитектуру;
- огромный неожиданный download;
- невоспроизводимое окружение.
Поэтому рабочий путь строится на проверенном реестре моделей.
Provenance и воспроизводимость¶
Для рабочего варианта модели фиксируются:
- vendor/repository;
- вариант весов и метаданные ревизии;
- формат;
- профиль среды выполнения;
- лицензия;
- источник.
Это важно для аудита и обновлений.
Статусы модели¶
В интерфейсе могут встречаться состояния:
- совместима / несовместима;
- рекомендуется;
- устанавливается;
- установлена;
- активируется;
- активна;
- ошибка;
- blocked by policy/gate;
- diagnostic/test.
Точная подпись может меняться, но жизненный цикл остаётся тем же.
Удаление модели¶
Перед удалением рабочие модели:
- проверьте, активна ли она;
- найдите другую установленную локальную модель;
- убедитесь, что не идёт рабочая нагрузка;
- удаляйте через Центр управления моделями;
- проверьте новый active route.
Не удаляйте вариант весов напрямую из тома хранения во время работы среда выполнения.