Нейросеть Кандинский от Сбера: возможности, версии и инструкция по использованию

Подробный обзор нейросети Kandinsky: что умеет, какие версии существуют, как генерировать изображения и видео, где доступен сервис и как составлять эффективные запросы.

Что такое нейросеть Кандинский и чем она отличается от аналогов

Кандинский — это российская нейросеть для генерации изображений, анимации и коротких видео по текстовым запросам, разработанная лабораторией Sber AI. Название выбрано в честь художника Василия Кандинского, что подчёркивает связь технологий и творчества. Первая версия появилась в ноябре 2021 года под названием ruDALL-E XL, а в 2022 году проект получил имя Kandinsky. С тех пор модель регулярно обновляется, и каждая новая версия добавляет возможности и улучшает качество.

Главное отличие от зарубежных аналогов — глубокая адаптация под русский язык. Нейросеть понимает падежи, сложные фразы, метафоры и культурные реалии, что делает её особенно удобной для русскоязычных пользователей. В отличие от Midjourney, где запросы лучше писать на английском, Кандинский корректно обрабатывает описания вроде «летний вечер в провинциальном городе 80-х» или «герб вымышленного сибирского поселения в стиле арт-деко». Также модель знакома с русским фольклором, народными промыслами (гжель, хохлома, жостовская роспись) и советской архитектурой.

По функциональности Кандинский сопоставим с популярными сервисами: он умеет генерировать изображения по тексту, редактировать их, дорисовывать, смешивать несколько картинок, переносить стиль и создавать анимацию. Однако есть и ограничения: лицензия разрешает только некоммерческое использование, а качество видео пока уступает зарубежным моделям вроде Sora или Veo 3.

Эволюция версий: от ruDALL-E до Kandinsky 4.1

Проект развивался стремительно. Первая версия ruDALL-E XL появилась в ноябре 2021 года и была экспериментальной. В апреле 2023 года вышла Kandinsky 2.1, которая получила широкую популярность, хотя и уступала Midjourney и Stable Diffusion в реалистичности. Уже в июле 2023 года версия 2.2 добавила фотореалистичную генерацию, а позже — возможность создавать 4-секундные видеоролики.

В ноябре 2023 года на конференции AI Journey «Сбер» представил Kandinsky 3.0 и отдельную модель Kandinsky Video. Ключевым нововведением стало знакомство нейросети с русской культурой: она научилась изображать Бабу Ягу, героев советских мультфильмов, элементы гжели и хохломы. В апреле 2024 года вышла версия 3.1 с поддержкой разрешения до 4K и улучшенной детализацией. По состоянию на 2025–2026 годы актуальной считается Kandinsky 4.1, которая доступна на сайте Fusion Brain и предназначена для сложных детализированных запросов.

Каждая версия имеет свои особенности. Например, Kandinsky 3.0 и 2.2 рекомендуются для «живописных и авторских» работ, а 3.1 — универсальная. Версия 4.1 лучше справляется с композицией и мелкими деталями. Пользователи могут выбирать модель в зависимости от задачи, а на сайте ruDALL-E доступны даже архивные версии, включая ruDALL-E Malevich и ruDALL-E Emojich.

Основные функции: генерация, редактирование, анимация и видео

Кандинский предлагает шесть основных режимов работы:

  • Генерация по текстовому запросу — самый популярный режим. Вы описываете желаемое изображение, и нейросеть создаёт его с нуля.
  • Смешивание изображений — загружаете две картинки, и модель создаёт их микс, сохраняя ключевые элементы обеих.
  • Вариации изображения — на основе загруженного фото или картинки можно получить новое изображение в заданной стилистике.
  • Дорисовка — позволяет дополнить изображение недостающими деталями или изменить отдельные объекты. Для этого используется инструмент «ластик»: закрашиваете область, которую нужно заменить, и описываете, что должно появиться.
  • Перенос стиля — функция переносит позу персонажа или очертания исходного изображения на новую сгенерированную картинку.
  • Генерация видео — создание коротких анимационных роликов по текстовому запросу или на основе загруженного изображения.

Кроме того, доступны фильтры в чат-ботах GigaChat: загружаете портретное фото, выбираете стиль («утро русалки», «красна девица», «сказочный рыцарь»), и нейросеть создаёт новое изображение, сохраняя внешность, но полностью меняя одежду, фон и атмосферу.

Важно понимать ограничения: видео генерируются длительностью 4–6 секунд без звука, разрешение — 512 пикселей, а качество пока далеко от реализма. Анимация может содержать артефакты, например, искажённые конечности или «плывущие» черты лица.

Где можно попробовать Кандинский: сайты, боты и приложения

Существует несколько официальных способов доступа к нейросети:

  • Fusion Brain (fusionbrain.ai) — основной сайт с полным набором функций. Требуется регистрация. Бесплатно доступно 100 запросов в месяц для генерации картинок в Kandinsky 3.0. Платные тарифы (от 2 399 ₽ в месяц) увеличивают лимиты и открывают доступ к видео.
  • Сайт ruDALL-E — упрощённая версия с урезанным функционалом, доступны только генерация по тексту и выбор версии модели. Сайт иногда работает нестабильно.
  • Телеграм-бот GigaChat — официальный бот от Сбера, бесплатный, поддерживает генерацию изображений и видео. В нём есть около 20 стилей и выбор соотношения сторон.
  • Бот GigaChat во ВКонтакте — аналогичен телеграм-боту, работает через сообщения.
  • Голосовой помощник «Салют» — команда «Включи художника» на смартфонах или умных устройствах с Салют ТВ.
  • Мобильное приложение «Салют» — доступно в Google Play и App Store.

Также продвинутые пользователи могут интегрировать Kandinsky в свои проекты через API Fusion Brain. Это удобно для разработчиков сайтов и мобильных приложений.

Важно быть осторожным: в Telegram существует множество ботов, маскирующихся под официальные, но часто они созданы мошенниками. Используйте только проверенные ссылки с официального сайта Сбера.

Пошаговая инструкция: как создать изображение на Fusion Brain

Рассмотрим процесс генерации на сайте Fusion Brain, так как он предоставляет наибольшие возможности.

  1. Зарегистрируйтесь на fusionbrain.ai и войдите в аккаунт.
  2. Выберите модель — Kandinsky 4.1 для сложных запросов, 3.1 для универсальных задач, или 2.2/3.0 для «живописных» работ.
  3. Задайте ориентацию и разрешение. Доступны форматы 1:1 (1024×1024), 2:3 (680×1024), 3:2 (1024×680), 9:16 (576×1024), 16:9 (1024×576). Качество автоматически подстраивается под выбранный формат.
  4. Введите промпт — текстовое описание того, что должно быть на картинке. Чем подробнее, тем лучше.
  5. Заполните негативный промпт — укажите, чего быть не должно. Например, «без людей», «без текста», «без водяных знаков».
  6. Выберите стиль из списка (около 20 вариантов: киберпанк, аниме, акварель, гжель, хохлома и другие) или укажите свой стиль в тексте запроса.
  7. Нажмите «Создать» и дождитесь результата. Обычно генерация занимает несколько секунд.
  8. Оцените результат. Если что-то не так, отредактируйте промпт или используйте «ластик» для точечной замены деталей.

Совет: если вы хотите дорисовать часть изображения, уменьшите рамку генерации так, чтобы она пересекалась с уже готовой картинкой. Чем больше пересечение, тем лучше нейросеть продолжит рисунок.

Как правильно составлять промпты: советы и примеры

Качество результата напрямую зависит от того, как вы сформулируете запрос. Вот несколько рекомендаций:

  • Будьте конкретны. Вместо «красивый пейзаж» напишите «закат над горным озером, сосны на переднем плане, отражение в воде, тёплые оранжевые тона».
  • Указывайте стиль и технику. Например, «в стиле импрессионизма», «фотореализм», «мультяшный стиль», «акварель».
  • Используйте детали: освещение, время суток, ракурс, цветовая гамма, настроение.
  • Негативный промпт помогает убрать нежелательные элементы. Например, если на картинке появляются лишние пальцы, добавьте «без искажённых рук».
  • Экспериментируйте с эмодзи. Нейросеть понимает некоторые из них: 💚, 💅, 🌺, 🦄, 🎁, 🤡. Но не все — например, 🧻 может превратиться в зубную щётку.
  • Используйте русский язык свободно. Кандинский понимает падежи и сложные конструкции, поэтому можно писать развёрнутые описания.

Пример хорошего промпта: «Портрет девушки в стиле киберпанк, неоновые огни, дождь, отражения на мокром асфальте, кожаная куртка, розовые волосы, детализированное лицо, кинематографичное освещение».

Если результат не устраивает, не бойтесь повторять генерацию несколько раз, корректируя промпт. Это нормально — даже опытные пользователи тратят несколько попыток.

Генерация видео и анимации: возможности и ограничения

Кандинский умеет создавать короткие видео и анимацию, но эти функции имеют существенные ограничения.

Анимация доступна на Fusion Brain во вкладке «Видео» с выбором модели «Анимация». Вы можете задать несколько сцен (каждая длится 4 секунды), описать их текстом и указать движение камеры. Чем больше сцен, тем дольше генерация. Анимация получается более управляемой, чем видео, но всё равно далека от идеала.

Видео генерируется по одному текстовому запросу без расширенных настроек. Длительность — 4–6 секунд, разрешение — 512 пикселей, звук отсутствует. Время генерации — около 4 минут. Качество пока низкое: могут быть искажения конечностей, «плывущие» черты лица, неестественные движения. Для сравнения, зарубежные модели Sora и Veo 3 создают более реалистичные ролики, но они недоступны в России.

В телеграм-боте GigaChat видео можно генерировать бесплатно, выбрав пункт «Оживить картинку». Загрузите изображение, напишите запрос и выберите один из десяти эффектов движения камеры (поворот, облёт, приближение). Готовый ролик придёт в чат.

На Fusion Brain генерация видео доступна только на платных тарифах. Если вы хотите просто попробовать, используйте бота.

Сравнение с другими нейросетями: Midjourney, Stable Diffusion и Шедеврум

Кандинский часто сравнивают с зарубежными аналогами. Вот основные различия:

  • Midjourney — лидер по качеству изображений, особенно в фотореализме и художественных стилях. Однако он платный, не поддерживает русский язык и требует VPN для доступа из России. Кандинский бесплатен (с лимитами) и полностью локализован.
  • Stable Diffusion — открытая модель, которую можно установить локально и настраивать. Требует технических навыков и мощного ПК. Кандинский проще в использовании, но менее гибок.
  • Шедеврум от Яндекса — аналог Кандинского с социальными функциями (лента, лайки, комментарии). Кандинский, напротив, фокусируется на инструментах редактирования, а не на соцсети.

По функциональности Кандинский не уступает конкурентам: он умеет дорисовывать, смешивать изображения, переносить стиль. Однако качество генераций в сложных сценах (например, с людьми) может быть ниже, чем у Midjourney. Тем не менее, для русскоязычных пользователей Кандинский — оптимальный выбор благодаря бесплатности и пониманию контекста.

В рейтинге Hi-Tech Mail Кандинский занял 2-е место среди нейросетей для генерации изображений, уступив только Midjourney.

Практические сценарии использования: от дизайна до образования

Кандинский находит применение в разных сферах:

  • Дизайн и маркетинг — создание иллюстраций для постов, баннеров, презентаций. Бесплатные 100 запросов в месяц позволяют быстро получить визуалы для соцсетей.
  • Образование — генерация наглядных материалов для уроков, иллюстраций к докладам, заданий для учеников. Нейросеть понимает запросы, связанные с российской историей и культурой.
  • Креативные проекты — художники используют Кандинский для поиска вдохновения, создания эскизов и экспериментов со стилями.
  • Бизнес — генерация изображений для каталогов, упаковки, рекламных макетов. Важно помнить о лицензии: изображения можно использовать только в некоммерческих целях.
  • Личное использование — создание аватарок, открыток, обоев для рабочего стола.

Пример: маркетолог может сгенерировать изображение для анонса статьи, просто описав тему. Учитель — создать иллюстрацию к уроку о русских народных сказках. Дизайнер — быстро получить варианты упаковки в стиле хохломы.

Однако для коммерческого использования изображений, скорее всего, потребуется платный тариф или отдельное разрешение. Внимательно читайте пользовательское соглашение.

Частые ошибки и как их избежать

Пользователи часто сталкиваются с типичными проблемами при работе с Кандинским. Вот как их избежать:

  • Слишком короткий промпт. Если написать просто «кот», результат будет случайным. Добавьте детали: «рыжий кот в голубом свитере лежит на диване, мягкий свет из окна».
  • Игнорирование негативного промпта. Если на картинке появляются лишние объекты, укажите их в негативном промпте.
  • Ожидание идеала с первого раза. Генерация — итеративный процесс. Будьте готовы делать несколько попыток.
  • Использование неофициальных ботов. В Telegram много фейковых ботов, которые могут украсть данные или генерировать некачественные изображения. Используйте только официальные ссылки.
  • Перегрузка запроса. Слишком много деталей может запутать нейросеть. Разбейте сложный запрос на несколько простых.
  • Неучёт лицензии. Если вы планируете коммерческое использование, проверьте условия тарифа.

Также стоит помнить, что Кандинский может не понимать некоторые эмодзи или искажать пропорции при редактировании. Не расстраивайтесь — это нормально для текущего уровня технологий.

Вопросы и ответы

Сколько стоит пользоваться нейросетью Кандинский?

Базовый доступ бесплатный: на Fusion Brain даётся 100 запросов в месяц для генерации картинок. Этого достаточно для личного использования. Платные тарифы начинаются от 2 399 ₽ в месяц и включают 1 000 запросов, а также доступ к генерации видео. Самые дорогие тарифы (до 189 999 ₽ в месяц) предназначены для профессионалов с большими объёмами. В телеграм-боте GigaChat генерация изображений и видео бесплатна, но с ограничениями по функционалу.

Можно ли использовать сгенерированные изображения в коммерческих целях?

По умолчанию лицензия Kandinsky разрешает только некоммерческое использование изображений. Для коммерческих проектов (реклама, упаковка, продажа) необходимо ознакомиться с пользовательским соглашением и, возможно, приобрести платный тариф. На бесплатном тарифе использование в бизнесе запрещено. Рекомендуется уточнять условия на официальном сайте Сбера перед использованием.

Какая версия Кандинского сейчас самая актуальная?

На момент написания статьи (2025–2026 годы) самой актуальной версией является Kandinsky 4.1, доступная на сайте Fusion Brain. Она предназначена для сложных и детализированных запросов. Версия 3.1 остаётся универсальной и подходит для большинства задач. Более старые версии (3.0, 2.2) рекомендуются для «живописных» работ, а на сайте ruDALL-E можно найти архивные модели.

Чем Кандинский отличается от Шедеврума от Яндекса?

Обе нейросети созданы для генерации изображений по тексту, но Кандинский от Сбера фокусируется на инструментах редактирования (дорисовка, смешивание, перенос стиля) и не имеет социальных функций. Шедеврум, наоборот, включает ленту, лайки и комментарии, что делает его похожим на соцсеть. Кандинский также предлагает больше настроек и версий модели, а Шедеврум проще в использовании для новичков.

Почему Кандинский иногда генерирует искажённые изображения?

Искажения (например, лишние пальцы, непропорциональные конечности) возникают из-за ограничений текущих моделей ИИ. Это особенно заметно при генерации людей и животных. Чтобы уменьшить вероятность ошибок, используйте детальные промпты, негативные промпты и выбирайте более новую версию модели (например, 4.1). Также можно редактировать изображение с помощью «ластика» на Fusion Brain.

Как получить доступ к генерации видео в Кандинском?

Видео можно генерировать бесплатно в телеграм-боте GigaChat, выбрав пункт «Оживить картинку». На Fusion Brain генерация видео доступна только на платных тарифах. В некоторых случаях (например, для Kandinsky Video) требуется оставить заявку и дождаться одобрения. Видео получаются короткими (4–6 секунд) и без звука, качество пока невысокое.