Разработчик экосистемы ВЫШКА Cloud

+7 (4852) 60-91-96 Обсудить проект
Каталог ИИ-моделей · генерация контента · сентябрь 2026

Kandinsky: семейство моделей генерации изображений и видео — каталог и право

Kandinsky — российское семейство диффузионных моделей генерации изображений и видео от Сбера. На странице — проверяемые факты о версиях, открытых весах, платформе Fusion Brain и юридические нюансы использования сгенерированного контента.

Коротко · проверяемые факты · 2026-09-20

Kandinsky — семейство моделей генерации Сбера: версии 3.x для изображений (открытые веса, Apache 2.0), видеопоколение 4.0 через платформу Fusion Brain и открытые веса поколения 5.0 на Hugging Face. Выбирайте Kandinsky, когда нужна генерация изображений из российской экосистемы — от маркетинга до прототипирования.

Внедрение генерации изображений в процессы — пилот от 480 000 ₽ аудит процесса — от 90 000 ₽ · пилот — от 480 000 ₽ · MVP — от 690 000 ₽

Что такое Kandinsky

Kandinsky — семейство генеративных моделей Сбера: по текстовому описанию модель создаёт изображения (text-to-image), редактирует их, а старшие поколения — и видео (text-to-video). Семейство развивается с 2022 года командами Sber AI (публикации и открытый код — в организации ai-forever на GitHub и Hugging Face), а потребительский доступ к генерации — через платформу Fusion Brain (fusionbrain.ai) и сервисы Сбера, включая интерфейс на сайте Сбербанка.

Для бизнеса генерация изображений — прикладной инструмент: иллюстрации для карточек товаров, черновики макетов, визуализация концепций, контент для рассылок. Отличие от «нейросетей ради развлечения» — воспроизводимость: фиксированные веса, пайплайн проверки и правовая база использования результата.

Российское происхождение семейства практически важно: доступность без VPN, оплата в рублях через платформу Сбера и российский правообладатель для комплаенса. Публичный веб-сервис и открытые веса — разные способы использования, и ниже мы их разделяем.

Проверенные факты о семействе

ВерсияЧто известно
Kandinsky 3.xtext-to-image модель на latent diffusion; около 12 млрд параметров (K3.0); код на GitHub (ai-forever), веса на Hugging Face; заявлена пермиссивная лицензия Apache 2.0
Kandinsky 4.0генерация видео (text-to-video, image-to-video) в разрешениях до HD; развернута на платформе Fusion Brain; веса видео-версии открыто не публиковались
Kandinsky 5.0семейство моделей нового поколения (ноябрь 2025): изображения и 10-секундное видео; открытые веса на Hugging Face, включая компактную Video Lite (2B, сентябрь 2025)
ПлатформаFusion Brain — доступ к генерации Сбера через веб и API
ПравообладательСбер (права на программные продукты серии)

Сверка — по официальным страницам Сбера, репозиториям ai-forever и карточкам моделей на Hugging Face, 20 сентября 2026 года. Условия лицензий версий и условия конкретных весов проверяются в карточке модели перед коммерческим использованием.

Варианты использования

Платформа Fusion Brain

Самый быстрый старт: генерация изображений и видео через веб-интерфейс и API платформы. Подходит для маркетинга и контент-команд: нет инфраструктуры, есть лимиты и правила сервиса. Данные запросов (промпты) обрабатываются платформой — учитывайте это в политике.

Открытые веса в своём контуре

Версии 3.x (изображения) и 5.0 (изображения и видео, включая Video Lite) скачиваются с Hugging Face и разворачиваются на своих GPU-серверах: полный контроль над промптами и результатами, интеграция в продуктовый пайплайн. Модель 3.x требует GPU с большим объёмом видеопамяти; компактная Video Lite экономнее. Квантование здесь помогает меньше, чем в LLM: диффузионные модели упираются в память и скорость обхода шагов диффузии.

Гибрид

Типовая схема: прототипирование и штучные задачи — на платформе, промышленный поток (сотни изображений в день для каталога) — на своих весах с автопроверкой результатов.

Как НЬЮ-ССТ внедряет генерацию изображений

Лестница: аудит задач и объёмов (от 90 000 ₽) → пилот: выбор модели и режимов, метрики приемлемости картинок для вашего бренда (от 480 000 ₽) → MVP: пайплайн генерации с проверкой и маршрутизацией в ваши системы (от 690 000 ₽) → промышленный контур с контролем авторских рисков (0,9–1,2 млн ₽). Мы не обещаем «идеальные картинки с первого промпта»: Промышленное применение — это пайплайн с фильтрами брака и человеком в контуре.

Смежные направления: ИИ для маркетинга и контента (там же — генерация текстов и адаптация кампаний), мультимодальные VLM (анализ изображений), ИИ-ассистенты. Для видео- и голосовых сценариев — голосовое направление.

Практический пример маршрута

Рамка контент-проекта: маркетинг начинает с платформы Fusion Brain — штучные иллюстрации для рассылок без инфраструктуры; когда объём вырастает до потока (карточки каталога, баннеры), разворачиваются свои веса и строится пайплайн: генерация по шаблонам промптов, автопроверка технических параметров, ревью дизайнером, публикация с учётом маркировки. Правовая база фиксируется до старта потока: лицензия версии, правила сервиса, режимы использования изображений. Так компания платит за инфраструктуру только тогда, когда объём это оправдывает, а переход между платформой и своими весами не ломает процессы: пайплайн, проверки и правовая база остаются прежними.

Частые ошибки при внедрении генерации изображений

  • Начинать с веса, а не с задачи. Сначала объём и назначение картинок (штучные концепты или поток для каталога) — потом выбор между платформой и своими весами.
  • Не фиксировать лицензию версии. Открытость в семействе чередуется по версиям: 3.x и 5.0 открыты, 4.0 — платформенная; выбор закрепляется карточкой модели.
  • Поток без фильтра брака. Генерация нестабильна: промышленное применение требует автоматической отбраковки и человека в контуре.
  • Публикация без маркировки. ИИ-контент в публичных коммуникациях сопровождается информационным предупреждением — это требование закона об ИИ.
  • Игнор бренд-требований. Приемлемость картинки для бренда проверяется метриками и ревью, а не энтузиазмом автора промпта.

Генерация окупается там, где построен пайплайн: от промпта до проверки и публикации. Его мы и собираем на этапах MVP.

Безопасность, права и риски

Юридический блок — главный для генерации: кто владеет результатом, можно ли использовать изображения в рекламе, как отметить ИИ-контент. По закону об ИИ результаты генерации в публичном пространстве сопровождаются информационным предупреждением; права на результаты генерации и opt-out правообладателей данных разобраны в наших материалах о правах на результаты генерации и opt-out. Правообладатель программ семейства — Сбер; условия использования контента из конкретного сервиса — в его правилах.

Технические риски: дипфейки и выдача сгенерированного за реальное — при использовании генерации в коммуникациях обязательна маркировка; обратная сторона — атаки сгенерированным контентом на ваших сотрудников (как распознать дипфейк). Активы генерации вносим в AI BOM; большие генеративные модели — это БФМ (>1 млрд параметров, порог) с правилами эксплуатации.

Смотрите также

Частые вопросы: Kandinsky и генерация изображений

Частично. Версии 3.x для изображений и поколение 5.0 (включая компактную Video Lite) публикуются с открытыми весами на Hugging Face с пермиссивной лицензией (Apache 2.0 у 3.x). Видеопоколение 4.0 доступно через платформу Fusion Brain, но его веса открыто не публиковались. Перед использованием конкретной версии сверяем её карточку.

Права на программные продукты семейства принадлежат Сберу, а вот режим использования результатов генерации определяется правилами конкретного сервиса или лицензией весов, которые вы развернули. Для коммерческого применения (реклама, каталог) мы фиксируем юридическую базу до запуска потока: источник модели, лицензию, маркировку ИИ-контента.

GPU-сервер с большим объёмом видеопамяти для полноразмерных версий; компактная Video Lite экономнее. Веса скачиваются с Hugging Face, код — из репозиториев ai-forever. Для промышленного потока добавляются сервисный слой, очередь задач и контроль качества результатов — это и есть наш MVP-этап.

Главное отличие — критерий приёмки: у LLM мы измеряем точность ответов, у изображений — соответствие бренду и приемлемость для задачи, что проверяется человеком и фильтрами брака. Второе — правовой режим публикации: визуальный ИИ-контент в публичных коммуникациях требует маркировки. Пайплайн строится вокруг этих двух отличий.

Соберём адресное КП за 1 рабочий день

Ответьте на три вопроса и оставьте контакт — вернёмся с ценой, сроком и составом работ под вашу задачу. Без звонков-роботов и «менеджер перезвонит уточнить».

1. Какой у вас формат задачи?
2. Ваш сектор?
3. Что нужно сейчас?

Или напишите напрямую: sales@vyshka.cloud

Следующий шаг

Разбор вашей задачи — бесплатно, за 1 рабочий день

Пришлите описание задачи — вернёмся с вилкой стоимости, сроками и рисками. Если задача вне нашего профиля, скажем прямо и подскажем, к кому идти.

Ответить на 3 вопроса Все контакты

Факты о моделях — по официальным источникам разработчиков (сайты, Hugging Face, документация), проверено 2026-09-20; наши цены — «от», без НДС (УСН). ООО «НЬЮ-ССТ» (ИНН 7733311994) работает с 28.12.2016. Полный каталог направления — ИИ-разработка и защита информации.