Нейросеть Кандинский: бесплатная генерация изображений и видео от Сбера

Подробный обзор нейросети Kandinsky от Сбера: возможности, инструкции, промпты, форматы и ограничения. Узнайте, как бесплатно генерировать изображения и видео онлайн.

Что такое Kandinsky и чем он отличается от аналогов

Kandinsky — это российская нейросеть для генерации изображений, анимации и видео, разработанная SberAI. Она стала продолжением первой отечественной модели ruDALL-E, вышедшей в ноябре 2021 года. Главное преимущество Kandinsky перед зарубежными конкурентами — полная бесплатность при неограниченном количестве генераций. В отличие от Midjourney, где требуется подписка от $10 в месяц, или DALL-E, работающего по системе кредитов, Kandinsky не имеет платных тарифов и доступен без VPN на территории России.

По степени реалистичности и детализации изображений Kandinsky находится примерно на одном уровне с Midjourney и Stable Diffusion. Однако он лучше понимает запросы на русском языке и учитывает культурный контекст. Нейросеть поддерживает более 100 языков, но именно русский является приоритетным. Это избавляет пользователей от необходимости переводить промпты и подбирать англоязычные термины.

Kandinsky доступен на нескольких платформах: сайт Fusion Brain, чат-боты в Telegram и VK, приложение «СберБанк Онлайн», виртуальный ассистент «Салют» и «Салют ТВ». Для начала работы не требуется регистрация, если пользоваться через ботов. Полный функционал открывается после входа через Сбер ID или GosKey на сайте Fusion Brain.

Как пользоваться Kandinsky: пошаговая инструкция

Генерация изображений в Kandinsky максимально проста. Чтобы создать картинку, нужно:

  1. Открыть сайт Fusion Brain или запустить Telegram-бота @kandinsky21_bot.
  2. Выбрать раздел «Картинки» и указать соотношение сторон: 1:1, 16:9, 9:16, 3:2 или 2:3. От соотношения зависит максимальное разрешение: при 1:1 получается 1024×1024 пикселя, при 16:9 — 1024×576.
  3. Составить промпт — текстовое описание желаемого изображения. Чем больше деталей, тем точнее результат. Например: «Реалистичное фото, милая молодая девушка блондинка с длинными волосами ночью, большие глаза, пухлые губы, естественный макияж, белая майка, крупные серьги, ночные огни, портрет, максимум деталей».
  4. При необходимости выбрать стиль из 17 доступных: фотореализм, цифровая живопись, акварель, аниме, 3D-рендер, киберпанк и другие.
  5. Нажать кнопку генерации. В среднем процесс занимает около 2 минут на сайте и примерно 10 секунд в Telegram-боте.

После генерации можно скачать результат в формате JPEG (исключение — стиль «3D рендер», который сохраняется в PNG). Если результат не устраивает, можно изменить промпт или применить негативный промпт — указать, чего не должно быть на картинке, например «без текста, без размытия».

Генерация анимации и видео в Kandinsky

Kandinsky умеет создавать не только статичные изображения, но и анимацию и видео. Анимация состоит из нескольких сцен — до четырёх, каждая длительностью 4 секунды. Чем больше сцен, тем дольше генерация: анимация из четырёх сцен создаётся в среднем за 10 минут. Доступные соотношения сторон: 1:1, 9:16, 16:9. При соотношении 1:1 максимальное качество — 640×640 пикселей.

Для анимации можно выбрать направление камеры: зум, отдаление, панораму слева направо или снизу вверх. Сцены можно менять местами. Важно: негативные промпты с анимацией не работают. Скачать результат можно только в формате MP4.

Видео в Kandinsky (модель Kandinsky Video) появилось в бета-версии в ноябре 2023 года. Максимальная длительность — 5 секунд, разрешение — HD (1280×720) в версии Video Pro или SD (768×512) в Video Lite, частота кадров — 24 fps. Время генерации — около 4 минут. Негативные промпты не поддерживаются. Видео можно создавать как по текстовому описанию (text-to-video), так и на основе загруженного изображения (image-to-video), например, оживляя портрет.

Редактирование изображений и работа с готовыми картинками

Kandinsky позволяет не только создавать изображения с нуля, но и редактировать уже готовые. Можно загрузить фото и получить его нарисованную версию, изменить фон, добавить или удалить объекты. Для этого используется функция инпейнтинга: выделяется область, и нейросеть заменяет её содержимое по текстовой команде. Например, можно написать «Замени фон на горный пейзаж» или «Добавь солнечные очки».

Также доступен режим смешивания изображений: загружаются две картинки, и нейросеть объединяет их стили, перенося палитру, композицию или отдельные элементы. Это полезно для создания вариаций на основе референсов.

Для удаления ненужных объектов предусмотрен ластик. После удаления можно прописать в запросе, что сгенерировать на пустом месте. Появятся слои, которые можно просматривать и редактировать. Все эти инструменты работают без навыков работы в Photoshop — достаточно текстового описания.

Как составлять эффективные промпты для Kandinsky

Качество результата напрямую зависит от того, насколько точно и подробно составлен промпт. Вот основные правила:

  • Выносите самое важное в начало. Сначала укажите, кто или что на картинке, затем — действие, потом детали. Например: «Супермен и Бэтмен сидят на скамейке и едят пиццу, на фоне небоскрёбы, общий план, максимум деталей, яркие цвета».
  • Не забывайте о деталях. Указывайте фон, время дня, погоду, цвета, настроение, крупность плана, технические характеристики (например, «снято на плёнку 35 мм»).
  • Упрощайте конструкции. Избегайте сложных деепричастных оборотов и метафор. Чем проще формулировка, тем выше вероятность, что нейросеть поймёт запрос верно.
  • Используйте прямые отсылки. Если указать художника, фильм или стиль, нейросеть сгенерирует изображение в соответствующей манере. Например: «Закат в стиле Малевича» или «Кот и собака в стиле „Криминального чтива“».
  • Применяйте негативные промпты. Указывайте, чего не должно быть: «без текста, без размытия, без искажений». Это повышает точность.

Если точность не критична, можно ограничиться одним словом — например, «Лошадь» — и Kandinsky создаст изображение на свой вкус. Однако для сложных сцен с несколькими героями лучше детализировать запрос и при необходимости повторять генерацию, меняя формулировки.

Форматы, разрешения и технические ограничения

Kandinsky генерирует изображения в разрешении до 1024×1024 пикселей (в версии Kandinsky 3.0) и до 2048×2048 в Kandinsky 3.1. Стандартный формат для скачивания — JPEG. Исключение — стиль «3D рендер», который сохраняется в PNG. Для анимации максимальное качество — 640×640 пикселей при соотношении 1:1, для видео — HD (1280×720) в версии Pro.

Доступные соотношения сторон для изображений: 1:1, 16:9, 9:16, 3:2, 2:3. Для анимации и видео — только 1:1, 9:16, 16:9. В Telegram-боте выбор соотношений ограничен тремя вариантами.

Важные ограничения:

  • Максимальная длительность видео — 5 секунд (в бета-версии).
  • Анимация — до 4 сцен по 4 секунды каждая.
  • Негативные промпты не работают для анимации и видео.
  • При генерации на сайте возможны сбои: нейросеть может начать дублировать предыдущие результаты. В этом случае помогает перезагрузка страницы или повторный вход в аккаунт.
  • Сгенерированные изображения могут содержать логотип Kandinsky или Сбера, особенно в высоком разрешении. Для коммерческого использования требуется отдельное соглашение с SberAI.

Практическое применение Kandinsky в разных сферах

Kandinsky подходит для широкого круга задач:

  • Контент-мейкеры и SMM-специалисты могут создавать уникальные иллюстрации для постов, обложек и рекламных креативов. Нейросеть генерирует изображения за полминуты, что ускоряет выпуск контента.
  • Дизайнеры и иллюстраторы используют Kandinsky для быстрого поиска идей, создания мудбордов и референсов. Функция смешивания изображений помогает экспериментировать с палитрой и композицией.
  • Маркетологи визуализируют продуктовые концепции и создают варианты для A/B-тестирования рекламы. Бесплатный доступ позволяет генерировать множество вариантов без затрат.
  • Преподаватели и студенты создают иллюстрации для учебных материалов, презентаций и визуализации сложных понятий. Например, можно сгенерировать историческую сцену или научную концепцию.
  • Для личного творчества Kandinsky открывает возможность реализовать художественные идеи без навыков рисования: от создания открыток до экспериментов с разными стилями.

Важно: для коммерческого использования сгенерированных изображений требуется отдельное соглашение с SberAI. Личные и некоммерческие проекты не требуют согласования.

Интеграция с GigaChat и другими сервисами

Kandinsky интегрирован с GigaChat — российской нейросетью для работы с текстом. В чате GigaChat можно одновременно решать текстовые и визуальные задачи: написать пост для соцсетей и сразу сгенерировать к нему изображение. GigaChat автоматически создаёт промпт для Kandinsky и выводит готовую картинку. Это ускоряет работу, так как не нужно переключаться между сервисами.

Доступ к интеграции — через веб-версию GigaChat или мобильное приложение «СберБанк Онлайн». Также Kandinsky встроен в виртуального ассистента «Салют» на Android и «Салют ТВ» (команда «Включи художника»).

Для разработчиков и бизнеса Kandinsky доступен через Yandex Cloud. Тарифы рассчитываются по количеству входных и выходных токенов. Это позволяет встраивать генерацию изображений в собственные приложения и сервисы.

Преимущества и недостатки Kandinsky

Преимущества:

  • Полностью бесплатный, без лимитов на количество генераций.
  • Работает в России без VPN.
  • Отлично понимает русский язык, не требует перевода промптов.
  • Простой и интуитивный интерфейс, доступный на нескольких платформах.
  • Быстрая генерация: изображения за 20–30 секунд, видео за 2–4 минуты.
  • Мультимодальность: создание, редактирование и смешивание изображений, генерация анимации и видео.
  • Интеграция с GigaChat для комплексных задач.

Недостатки:

  • Качество деталей (рук, лиц, мелких объектов) может уступать платным аналогам, таким как Midjourney.
  • Максимальное разрешение ниже, чем у некоторых коммерческих генераторов.
  • Инструменты для тонкого редактирования ограничены.
  • Возможны сбои: дублирование генераций, «галлюцинации» ИИ.
  • Для коммерческого использования требуется отдельное соглашение.
  • Сгенерированные изображения могут содержать водяные знаки.

Несмотря на недостатки, Kandinsky остаётся мощным и доступным инструментом для широкой аудитории, особенно для тех, кто только начинает знакомство с ИИ-генерацией.

Вопросы и ответы

Нужно ли скачивать Kandinsky на компьютер?

Нет, Kandinsky работает полностью онлайн. Для использования достаточно открыть сайт Fusion Brain в браузере, запустить Telegram-бота @kandinsky21_bot или воспользоваться приложением «СберБанк Онлайн». Никаких установок не требуется.

Можно ли использовать Kandinsky без регистрации?

Да, если пользоваться через Telegram-бота или ВКонтакте. Для доступа к расширенным функциям (редактирование, генерация видео, сохранение истории) потребуется регистрация на сайте Fusion Brain через Сбер ID или GosKey.

Сколько стоит генерация в Kandinsky?

На данный момент Kandinsky полностью бесплатен. Нет ни подписок, ни скрытых платежей, ни ограничений на количество генераций. Для коммерческого использования требуется отдельное соглашение с SberAI.

В чём отличие Kandinsky от Midjourney и Stable Diffusion?

Kandinsky бесплатен, работает на русском языке и доступен без VPN в России. Midjourney требует платной подписки и понимает только английский. Stable Diffusion схож по архитектуре, но Kandinsky оптимизирован под российскую аудиторию и культурный контекст.

Как улучшить качество изображений в Kandinsky?

Подробно описывайте сцену: объекты, стиль, освещение, детали. Используйте негативные промпты, чтобы исключить нежелательные элементы. Выбирайте подходящий стиль из списка. Если результат не устроил, меняйте формулировку и пробуйте снова.

Поддерживает ли Kandinsky генерацию видео?

Да, Kandinsky Video позволяет создавать видео длительностью до 5 секунд (бета-версия) и анимацию до 4 сцен по 4 секунды каждая. Доступны режимы text-to-video и image-to-video. Негативные промпты для видео не поддерживаются.

Можно ли редактировать уже сгенерированные изображения?

Да, Kandinsky поддерживает редактирование: замена фона, удаление или добавление объектов с помощью текстовых команд. Также доступно смешивание двух изображений для переноса стиля. Для удаления объектов используется ластик.