Перейти к содержанию

Каталог проверенных моделей

Центр управления моделями содержит курируемый каталог, а не открытое поле «введите любую модель из интернета».

Это одна из ключевых защит Студии. Перед автоматической установкой важны происхождение модели, лицензия, формат весов, совместимость с среда выполнения, аппаратные требования и результаты квалификации.


Два класса карточек

Рабочая / автоматически допустимая

Для такой модели определены:

  • официальный источник вариант весов;
  • формат весов;
  • профиль среды выполнения;
  • рабочий контекст;
  • лицензионный статус;
  • аппаратные требования;
  • политика автоматической установки.

Frontier / кандидат для планирования

Модель видна как перспективная, но её установка блокируется до выполнения условий:

  • license review;
  • обновление среды выполнения;
  • проверка архитектуры модели;
  • квалификация на реальном железе.

Warning

Видимая карточка не всегда означает, что модель разрешено устанавливать в рабочем контуре.


Что показывает карточка

В зависимости от модели вы увидите:

  • название и роль;
  • поставщика;
  • статус установки;
  • precision/quantization;
  • среда выполнения;
  • источник вариант весов;
  • лицензию;
  • NiceSoft rank;
  • рабочий контекст;
  • расчёт VRAM;
  • tensor parallel / число GPU;
  • размер вариант весов;
  • соответствие;
  • теги;
  • причину рекомендации или несовместимости.

Совместимость: подходит ли модель этому серверу

Проверка совместимости отвечает на практический вопрос:

Можно ли безопасно эксплуатировать этот конкретный artifact на текущем сервере?

Учитываются VRAM, число и архитектура GPU, среду выполнения, контекст и запас безопасности. Это гораздо полезнее, чем сравнение моделей только по параметрам.


NiceSoft rank

Это внутренний эксплуатационный рейтинг для ранжирования квалифицированных кандидатов. Он не является универсальным IQ модели.

Не интерпретируйте 90/100 как «на 12% умнее 78/100». Финальную ценность проверяют на реальных задачах организации.


Текущий рабочий каталог

Точный состав меняется между релизами. Текущее поколение Model Manager проверяет и умеет проводить lifecycle следующих рабочих вариантов моделей:

Модель Основная роль Формат Практический класс
Qwen3 8B AWQ универсальная AWQ 4-bit T4 16 ГБ
Qwen2.5 Coder 7B AWQ программирование AWQ 4-bit T4 16 ГБ
Qwen3.5 4B компактная универсальная BF16 по соответствие
Qwen3.5 9B сбалансированная BF16 24 ГБ+ по соответствие
Qwen3.8 27B флагманская универсальная BF16 80 ГБ class
Qwen3.8 27B FP8 high-throughput универсальная FP8 современный FP8 GPU
Qwen3 Coder 30B-A3B мощное программирование BF16 80 ГБ class
Qwen3 Coder Next крупный coding profile BF16 крупный GPU/multi-GPU
Ministral 3 8B FP8 универсальная edge FP8 16–24 ГБ по соответствие
Ministral 3 14B FP8 универсальная FP8 24 ГБ+
GLM-4.7-Flash agentic/reasoning vendor вариант весов большой GPU
Kimi Linear 48B-A3B длинный контекст BF16 большой VRAM/multi-GPU
Mistral Small 4 119B FP8 корпоративная/агентная FP8 крупная система с несколькими GPU

Отдельно существует NiceSoft Bootstrap · Qwen3 0.6B — диагностическая, а не рабочая модель.


Почему каталог теперь не только Qwen

Стратегия продукта — выбирать проверенный artifact под задачу и железо, а не быть привязанным к одному бренду.

Мультивендорный реестр снижает зависимость от одной линейки и позволяет использовать специализированные варианты для:

  • кода;
  • agentic reasoning;
  • длинного контекста;
  • компактного edge-профиля;
  • большого серверного GPU высокого класса.

Qwen3 8B AWQ

Универсальный локальный baseline для ограниченного GPU-класса. AWQ позволяет разместить полезную 8B-модель на T4 16 ГБ с рабочим резервом.

Типовые задачи:

  • корпоративный чат;
  • тексты;
  • базовый анализ документов;
  • администрирование;
  • технические объяснения.

Рабочий целевой контекст — порядка 16K.


Qwen2.5 Coder 7B AWQ

Специализированный вариант программирования для сравнительно компактного GPU.

Подходит для:

  • code review;
  • bug fixing;
  • тестов;
  • SQL;
  • shell/Python/JS;
  • конфигураций;
  • DevOps.

Qwen3.5 4B и 9B

Современные BF16-профили. Важно: меньшее число параметров не гарантирует меньший рабочий memory envelope, чем у AWQ-варианта большей модели.

Совместимость смотрите в текущей карточке.


Qwen3.8 27B / FP8

Класс мощных универсальных локальных моделей.

  • BF16 — профиль с большим VRAM;
  • FP8 — более компактный artifact для подходящих современных GPU и высокопроизводительной эксплуатации.

Это разные развёртывание-artifacts, а не две подписи одного файла.


Qwen3 Coder 30B-A3B / Coder Next

Кодовые модели для крупной инфраструктуры. Их смысл появляется, когда программирование является существенной частью нагрузки и организация готова выделить соответствующий GPU-класс.


Ministral 3 8B/14B FP8

Альтернативные универсальные профили для подходящего современного железа. Исходные модели могут быть мультимодальными, но текущий пользовательский профиль ИИ Студии остаётся текстовым.

Warning

Не рекламируйте обработку изображений только потому, что исходная модель имеет такую возможность.


GLM-4.7-Flash

Специализированный вариант для agentic/reasoning-нагрузки на крупном GPU. Он не обязан быть лучшей заменой универсальной модели для офисных сотрудников.


Kimi Linear 48B-A3B

В каталоге позиционируется как long-context specialist. Из-за размера и memory envelope требует значительно более мощной системы, чем T4/T4i.


Mistral Small 4 119B FP8

Крупный корпоративный вариант модели. Для таких моделей особенно важно доверять текущей проверке метаданных и предварительной совместимости, а не статической цифре старой документации: исходная ревизия и реальный объём вариант весов могут меняться.


Frontier-кандидаты

В capacity-planning части могут присутствовать:

  • Qwen3.8 Flash Next;
  • DeepSeek V4.1 Flash;
  • GLM-5.3-Flash;
  • MiniMax M2.5.

Они помогают оценивать будущие серверы, но могут иметь блокирующий gate:

Gate Смысл
license-review-required требуется юридическая проверка лицензии
runtime-upgrade-required текущая среда выполнения не квалифицирована
license-and-runtime-review нужны обе проверки

Продукт не должен предлагать «установить всё равно» в обход gate.


Почему нельзя установить произвольный репозиторий

Случайный model repository может принести:

  • неизвестную лицензию;
  • trust_remote_code;
  • несовместимый tokenizer;
  • неподдерживаемую архитектуру;
  • огромный неожиданный download;
  • невоспроизводимое окружение.

Поэтому рабочий путь строится на проверенном реестре моделей.


Provenance и воспроизводимость

Для рабочего варианта модели фиксируются:

  • vendor/repository;
  • вариант весов и метаданные ревизии;
  • формат;
  • профиль среды выполнения;
  • лицензия;
  • источник.

Это важно для аудита и обновлений.


Статусы модели

В интерфейсе могут встречаться состояния:

  • совместима / несовместима;
  • рекомендуется;
  • устанавливается;
  • установлена;
  • активируется;
  • активна;
  • ошибка;
  • blocked by policy/gate;
  • diagnostic/test.

Точная подпись может меняться, но жизненный цикл остаётся тем же.


Удаление модели

Перед удалением рабочие модели:

  1. проверьте, активна ли она;
  2. найдите другую установленную локальную модель;
  3. убедитесь, что не идёт рабочая нагрузка;
  4. удаляйте через Центр управления моделями;
  5. проверьте новый active route.

Не удаляйте вариант весов напрямую из тома хранения во время работы среда выполнения.


Что дальше