Что такое Kandinsky и чем он отличается от других нейросетей
Kandinsky — это семейство мультимодальных нейросетей, разработанных Сбером для генерации изображений, анимации и видео по текстовому описанию. Первая версия, ruDALL-E, была представлена в ноябре 2021 года, а в июне 2022 года вышла Kandinsky 2.0 — российская диффузионная модель, способная работать с запросами на разных языках.
Главное отличие Kandinsky от зарубежных аналогов (Midjourney, Stable Diffusion) — полная бесплатность. Пользователь может генерировать неограниченное количество картинок и анимаций без подписки. Кроме того, нейросеть оптимизирована под русский язык и культурный контекст: она понимает запросы на русском, корректно обрабатывает кириллицу и учитывает российские реалии.
Kandinsky доступен на нескольких платформах: сайт Fusion Brain, сайт ruDALL-E, чат-боты в Telegram и VK, приложение «СберБанк Онлайн», виртуальный ассистент «Салют» и «Салют ТВ». Это делает его одним из самых доступных инструментов ИИ-генерации в России.
Эволюция версий: от Kandinsky 2.0 до Kandinsky 6.0
С момента запуска нейросеть прошла несколько крупных обновлений:
- Kandinsky 2.0 (2022) — первая диффузионная модель Сбера, умеющая генерировать изображения по тексту на разных языках.
- Kandinsky 2.1 — добавлена возможность смешивать несколько рисунков (Image-to-Image).
- Kandinsky 2.2 — появилась анимация: создание коротких видеороликов по текстовому описанию.
- Kandinsky 3.0 (2023) — значительное улучшение качества изображений, увеличение датасета.
- Kandinsky 3.1 — дообучена на увеличенном наборе изображений, стала доступна всем пользователям.
- Kandinsky 4.1 Image — улучшена детализация и понимание сложных запросов.
- Kandinsky 5.0 (2025) — семейство из трёх моделей: Image Lite (6B параметров), Video Lite (2B) и Video Pro (19B). Появилась поддержка HD-изображений и профессионального видео.
- Kandinsky 6.0 Image (2026) — флагманская модель на архитектуре Mixture of Experts (MoE), интегрированная в ИИ-помощник ГигаЧат. Добавлены функции редактирования: реставрация, стилизация, нейрофотосессии, смена одежды и локации, а также возможность загружать до трёх фотографий для создания нового изображения.
Каждая версия привносила новые возможности, сохраняя главное преимущество — бесплатный доступ.
Как генерировать изображения: пошаговая инструкция
Создание картинки в Kandinsky не требует специальных навыков. Рассмотрим процесс на примере сайта Fusion Brain:
- Выберите раздел «Картинки» и задайте соотношение сторон (1:1, 16:9, 9:16, 3:2, 2:3). От этого зависит максимальное разрешение: при 1:1 — 1024×1024 px, при 16:9 — 1024×576 px.
- Составьте промпт — текстовое описание того, что вы хотите увидеть. Чем больше деталей, тем точнее результат. Например: «Реалистичное фото, молодая девушка с длинными розовыми волосами улыбается, пирсинг в носу, белая футболка, фон размыт, портрет».
- Добавьте негативный промпт (необязательно) — укажите, чего быть не должно. Например, «Ночь» или «Размытость».
- Выберите стиль из 17 доступных: «Детальное фото», «Цифровая живопись», «3D рендер», «Аниме», «Киберпанк» и другие.
- Нажмите зелёную кнопку и дождитесь результата. Обычно генерация занимает около 2 минут.
Если результат не устраивает, можно изменить промпт, добавить негативные описания или воспользоваться ластиком для удаления отдельных объектов. Ластик особенно полезен, когда нужно убрать лишнюю деталь, не перегенерируя всю картинку.
Создание анимации и видео в Kandinsky
Kandinsky позволяет создавать не только статичные изображения, но и анимацию (до 4 сцен, каждая длительностью 4 секунды) и видео (до 5 секунд).
Анимация:
- Выберите режим «Анимация» в разделе «Видео».
- Составьте промпт для каждой сцены. Например, для первой сцены: «Пустыня, 4k», для второй: «Солнце, 4k».
- Укажите направление камеры: зум, панорама слева направо или снизу вверх.
- Максимальное качество при соотношении 1:1 — 640×640 px. Время генерации — около 10 минут.
- Сцены можно менять местами, негативные промпты не поддерживаются.
- Скачивается анимация в формате MP4.
Видео (Kandinsky Video):
- Первая модель для создания видео в России представлена в ноябре 2023 года.
- Максимальная длительность — 5 секунд, качество ниже, чем у изображений.
- Доступны соотношения 1:1, 9:16, 16:9. Генерация занимает около 4 минут.
- Негативные промпты не поддерживаются, отредактировать готовое видео нельзя.
С 2025 года доступны более продвинутые модели: Video Lite (2B параметров) для быстрой генерации и Video Pro (19B) для кинематографичного качества с поддержкой разрешения до 1024×1024.
Как правильно составлять промпты: советы и примеры
Качество результата напрямую зависит от промпта. Вот несколько рекомендаций:
- Выносите главное в начало. Кто или что на картинке → действие → детали. Например: «Супермен и Бэтмен сидят на скамейке и едят пиццу, на фоне небоскрёбы, общий план, яркие цвета».
- Добавляйте детали. Указывайте фон, время суток, освещение, стиль, технические характеристики (например, «снято на плёнку 35 мм»).
- Упрощайте конструкции. Избегайте сложных оборотов и метафор. Вместо «закат, напоминающий полотна импрессионистов» лучше написать «закат в стиле Моне».
- Используйте прямые отсылки. Упоминание художника, фильма или жанра помогает нейросети точнее попасть в стиль.
- Негативные промпты работают хорошо: если нужно убрать ночь, напишите «Ночь» в негативном поле.
Примеры удачных промптов:
- «Мопс в короне сидит на троне, картина в стиле Веласкеса, максимум деталей».
- «Американский мотель ночью, неоновые огни, рядом машина Mustang, кинематографичное реалистичное изображение».
- «Натюрморт: банан, груша, яблоко. Яркий красный и жёлтый цвет. Стиль Пикассо».
Даже короткий запрос, например «Лошадь», даёт осмысленный результат, но для точного попадания лучше потратить время на детализацию.
Редактирование изображений: от ластика до профессиональных инструментов
Kandinsky предлагает несколько способов редактирования уже готовых изображений:
- Ластик — позволяет удалить ненужный объект, после чего нейросеть дорисовывает фон. Доступен на сайте Fusion Brain.
- Image-to-Image — загрузите фото и получите его версию в заданном стиле или с изменениями. Например, можно превратить фотографию в акварельный рисунок.
- Смешивание изображений — объединение двух картинок в одну (доступно с Kandinsky 2.1).
С выходом Kandinsky 6.0 Image (2026) возможности редактирования стали профессиональными:
- Реставрация — восстановление старых и повреждённых фотографий.
- Стилизация — превращение фото в аниме, комикс или мультфильм.
- Нейрофотосессия — генерация серии новых кадров на основе одной фотографии с другим фоном, одеждой или локацией.
- Детальное редактирование — ручное выделение области кистью и замена или удаление объекта. Это точнее, чем текстовое описание.
- Генерация из нескольких фото — загрузите до трёх изображений, и нейросеть соберёт из них новое, взяв из каждого нужный элемент.
Все эти функции доступны бесплатно в ИИ-помощнике ГигаЧат без ограничений по количеству генераций.
Сравнение моделей Kandinsky 5.0: Image Lite, Video Lite и Video Pro
В 2025 году Сбер представил семейство Kandinsky 5.0, включающее три специализированные модели:
Kandinsky 5.0 Image Lite (6B параметров)
- Назначение: генерация и редактирование HD-изображений.
- Архитектура: Diffusion Transformer (DiT).
- Поддерживает русский и английский языки, понимает российский культурный контекст.
- Умеет редактировать изображения (Image Editing) — менять стиль, добавлять или удалять элементы.
- Обучена на датасете из 1 млрд изображений и 300 млн видео.
Kandinsky 5.0 Video Lite (2B параметров)
- Назначение: быстрая генерация видео для прототипирования и массового контента.
- Доступно 8 чекпоинтов: SFT (лучшее качество), no-CFG (в 2 раза быстрее), distilled (в 6 раз быстрее) и pretrain (для дообучения).
- Время генерации — от 35 секунд до 15 минут в зависимости от настроек.
- Подходит для социальных сетей, презентаций и экспериментов.
Kandinsky 5.0 Video Pro (19B параметров)
- Назначение: профессиональное создание кинематографичного видео.
- 60 блоков CrossDiT, поддержка разрешения до 1024×1024.
- Умеет «оживлять» статичные изображения (Image-to-Video).
- Требует больше вычислительных ресурсов, но даёт наилучшее качество.
Выбор модели зависит от задачи: для быстрых черновиков — Video Lite, для качественного ролика — Video Pro, для изображений — Image Lite.
Ограничения и частые ошибки при работе с Kandinsky
Несмотря на впечатляющие возможности, у Kandinsky есть ряд ограничений, которые стоит учитывать:
- Галлюцинации ИИ. Нейросеть может искажать детали, дублировать персонажей или добавлять лишние объекты. Например, при запросе «Супермен и Бэтмен» она иногда создаёт двух одинаковых героев. Решение — уточнять промпт и использовать негативные описания.
- Проблемы с текстом на изображениях. Kandinsky пока плохо справляется с генерацией осмысленного текста (надписей, логотипов). Буквы часто превращаются в нечитаемый набор символов.
- Сбои на сайте. Иногда нейросеть начинает дублировать предыдущие генерации. В этом случае помогает перезагрузка страницы или повторный вход в аккаунт.
- Ограничения видео. Максимальная длина — 5 секунд, качество ниже, чем у изображений. Негативные промпты не поддерживаются.
- Зависимость от интернета. Для работы требуется стабильное подключение, так как генерация происходит на серверах Сбера.
- Отказ во включении в реестр российского ПО. В марте 2026 года Минцифры отказало Kandinsky во включении в реестр из-за несоответствия требованиям об отсутствии иностранного управления. Это не влияет на работу сервиса, но может иметь значение для государственных заказчиков.
Зная эти ограничения, вы сможете быстрее добиться нужного результата и избежать разочарований.
Практические примеры использования Kandinsky в разных сферах
Kandinsky находит применение в самых разных областях — от творчества до бизнеса:
- Дизайн интерьера. Загрузите фото комнаты, образец ткани и мебель из каталога — нейросеть создаст визуализацию с нужными материалами. Можно убрать лишние элементы или примерить новую отделку.
- Мода и ритейл. Создание карточек товаров: сгенерируйте фото модели в нужной одежде на подходящем фоне. Функция нейрофотосессии позволяет менять локацию и образ без повторной съёмки.
- Маркетинг и реклама. Быстрая генерация баннеров, постов для соцсетей и рекламных макетов в едином стиле. Можно точечно менять фон или реквизит под новый сезон.
- Образование и наука. Визуализация сложных понятий, создание иллюстраций для учебных материалов. Kandinsky понимает русскоязычные запросы, что упрощает работу преподавателям.
- Личное творчество. Создание уникальных открыток, аватаров, обоев для рабочего стола. Можно экспериментировать со стилями — от акварели до киберпанка.
Благодаря бесплатному доступу и широкому набору инструментов Kandinsky становится универсальным помощником для всех, кто работает с визуальным контентом.
Вопросы и ответы
Сколько стоит использование нейросети Kandinsky?
Kandinsky полностью бесплатен. Нет ограничений на количество генераций изображений, анимаций и видео. Все функции, включая редактирование и нейрофотосессии в Kandinsky 6.0, доступны без подписки.
На каких платформах доступен Kandinsky?
Нейросеть доступна на сайте Fusion Brain, сайте ruDALL-E, в чат-ботах Telegram и VK, в приложении «СберБанк Онлайн», через виртуального ассистента «Салют» и «Салют ТВ» по команде «Включи художника».
Как улучшить качество сгенерированного изображения?
Используйте подробные промпты с указанием стиля, освещения, фона и деталей. Добавляйте негативные промпты для исключения нежелательных элементов. Выбирайте соотношение сторон 1:1 для максимального разрешения 1024×1024 px. При необходимости повторяйте генерацию с уточнённым запросом.
Почему нейросеть иногда создаёт одинаковых персонажей или дублирует объекты?
Это распространённая «галлюцинация» ИИ. Чтобы избежать дублирования, уточняйте в промпте количество объектов, используйте слова «один», «два разных» и добавляйте негативные описания. Например: «Один Супермен и один Бэтмен, разные костюмы».
Можно ли использовать Kandinsky для коммерческих проектов?
Да, сгенерированные изображения можно использовать в коммерческих целях. Однако рекомендуется ознакомиться с пользовательским соглашением Сбера на момент использования, так как условия могут меняться.
Как долго ждать генерации видео в Kandinsky?
Время генерации зависит от модели и настроек. Для Kandinsky Video (базовая версия) — около 4 минут. Video Lite может создавать ролик за 35–60 секунд в режиме distilled, а Video Pro — дольше, но с более высоким качеством.
Поддерживает ли Kandinsky генерацию текста на изображениях?
Поддерживает, но с ограничениями. Нейросеть часто выдаёт нечитаемый набор букв вместо связного текста. Для точных надписей лучше использовать специализированные инструменты или дорабатывать результат в графическом редакторе.