Нейросеть Kandinsky 3.0: полный обзор возможностей, инструкция по работе и советы по созданию промптов

Подробный обзор нейросети Kandinsky 3.0 от Сбера: возможности генерации изображений, анимации и видео, инструкции по работе на Fusion Brain, советы по составлению промптов и ответы на частые вопросы.

Что такое Kandinsky 3.0 и чем он отличается от предыдущих версий

Kandinsky 3.0 — это третья major-версия нейросети от Сбера для генерации изображений, анимации и видео по текстовому описанию. Модель пришла на смену Kandinsky 2.2 и стала значительным шагом вперёд в качестве и понимании запросов.

Главные улучшения по сравнению с предыдущими версиями:

  • Улучшенное понимание детальных запросов. Нейросеть стала точнее следовать сложным промптам, особенно когда нужно изобразить несколько объектов или конкретные действия.
  • Расширенный набор данных. Модель обучали на большом объёме отфильтрованных пар «текст-картинка», что повысило эстетику и релевантность результатов.
  • Фокус на русскую культуру. Kandinsky 3.0 значительно лучше справляется с генерацией образов, связанных с российским и советским культурным наследием: известные личности, архитектурные достопримечательности, элементы народного творчества (например, гжельская роспись) и персонажи советских мультфильмов.
  • Режимы редактирования. Появилась возможность изменять отдельные области изображения (inpainting) и расширять границы картинки (outpainting).

Первая версия нейросети Сбера — ruDALL-E — вышла в ноябре 2021 года. Kandinsky 2.0 появился в конце 2022 года, а Kandinsky 3.0 был представлен на конференции AI Journey в конце 2023 года. Сейчас это основная рабочая модель, доступная на большинстве платформ.

Где можно пользоваться Kandinsky 3.0: все платформы и способы доступа

Одно из главных преимуществ Kandinsky — доступность на множестве платформ. Вы можете выбрать наиболее удобный способ:

  1. Сайт Fusion Brain — основная платформа для работы с Kandinsky 3.0. Здесь доступны все функции: генерация изображений, анимация, видео, а также редактирование (inpainting/outpainting). Требуется регистрация по email.
  2. Сайт ruDALL-E — более старая платформа, где можно сравнивать версии 2.1, 2.2 и 3.0, но функционал ограничен генерацией изображений.
  3. Telegram-бот — удобен для быстрой генерации картинок и стикеров. Поддерживает запросы на русском языке, но имеет меньше настроек (доступны соотношения сторон 1:1, 16:9, 9:16).
  4. Бот во ВКонтакте — аналогичен Telegram-боту, позволяет генерировать изображения.
  5. Приложение «СберБанк Онлайн» — встроенная функция для генерации изображений.
  6. Виртуальный ассистент «Салют» на Android — можно попросить «Нарисуй…» голосом.
  7. «Салют ТВ» — по команде «Включи художника».
  8. GigaChat — сервис Сбера, где Kandinsky используется как один из инструментов.

Важно: генерация анимации и видео (Kandinsky Video) на данный момент доступна только на платформе Fusion Brain. В Telegram и VK эти функции пока не реализованы.

Как генерировать изображения в Kandinsky 3.0: пошаговая инструкция

Создание картинки на Fusion Brain занимает всего несколько шагов:

Шаг 1. Регистрация и вход Перейдите на сайт Fusion Brain, зарегистрируйтесь (email + пароль) и подтвердите аккаунт через письмо. Без регистрации работа невозможна.

Шаг 2. Выбор режима На главной странице выберите раздел «Картинки». Перед вами откроется рабочая область с окном для запроса, выбором размера и стиля.

Шаг 3. Составление промпта Введите текстовое описание того, что хотите получить. Чем детальнее запрос, тем выше шанс на точный результат. Например: «Маленький серый котёнок на улице зимой, пушистый, смотрит на снежинки».

Шаг 4. Негативный промпт (опционально) В отдельное поле можно ввести то, чего на изображении быть не должно. Например: «стволы деревьев, кусты, ветки, лес». Это помогает убрать лишние детали.

Шаг 5. Выбор стиля Перед генерацией можно выбрать один из 17 стилей: «Детальное фото», «Цифровая живопись», «Мультфильм», «3D рендер», «Киберпанк», «Аниме», «Рисунок карандашом» и другие. Стиль сильно влияет на итоговую картинку.

Шаг 6. Выбор соотношения сторон Доступны варианты: 1:1 (квадрат), 16:9 (широкий), 9:16 (вертикальный), 3:2, 2:3. От соотношения зависит максимальное разрешение: при 1:1 — 1024×1024 px, при 16:9 — 1024×576 px.

Шаг 7. Генерация и оценка Нажмите зелёную кнопку. В среднем генерация занимает около 2 минут. Если результат не устраивает, можно изменить промпт или стиль и попробовать снова.

Шаг 8. Сохранение Готовое изображение можно скачать. На Fusion Brain картинки сохраняются в формате PNG (для стиля «3D рендер» — тоже PNG, для остальных — JPEG).

Как создавать анимацию и видео с помощью Kandinsky

Kandinsky 3.0 умеет создавать не только статичные картинки, но и анимацию (короткие зацикленные ролики) и видео (до 8 секунд).

Анимация

  • Доступна на вкладке «Видео» → модель «Анимация».
  • Можно создать до 4 сцен, каждая длительностью 4 секунды.
  • Для каждой сцены пишется отдельный промпт и выбирается направление камеры (зум, панорама, отдаление и т.д.).
  • Соотношение сторон: 1:1, 9:16, 16:9. Максимальное разрешение при 1:1 — 640×640 px.
  • Время генерации: от 3 до 10 минут в зависимости от количества сцен.
  • Результат скачивается в формате MP4.
  • Ограничение: негативные промпты для анимации не работают.

Видео (Kandinsky Video)

  • Это отдельная модель, доступная только на Fusion Brain.
  • Максимальная длительность — 8 секунд (в некоторых источниках указывается 5–7 секунд, точное значение может варьироваться).
  • Частота кадров — около 30 FPS.
  • Разрешение — 512×512 px.
  • Нет разделения на сцены и выбора направления камеры — пишется один общий промпт.
  • Время генерации — около 4 минут.
  • Качество видео пока уступает качеству изображений, но модель постоянно улучшается.

Пример использования: для создания короткого рекламного ролика или анимации для соцсетей можно описать сцену в одном промпте и получить готовый результат за несколько минут.

Как правильно составлять промпты для Kandinsky 3.0: советы и примеры

Качество результата напрямую зависит от того, как вы сформулируете запрос. Вот несколько проверенных рекомендаций:

  1. Начинайте с главного. Первым словом укажите основной объект: кто или что изображено. Затем — действие, потом детали. Например: «Кот спит на диване, реализм, максимум деталей, неяркие цвета».
  1. Добавляйте детали, но без перегруза. Укажите фон, время суток, освещение, настроение, технические характеристики (например, «снято на плёнку 35 мм»). Но избегайте слишком длинных и запутанных конструкций.
  1. Используйте прямые отсылки. Вместо метафор лучше указывать конкретных художников, фильмы или стили. Например: «Закат в стиле Малевича» или «Кот и собака в стиле „Криминального чтива“».
  1. Негативный промпт — ваш друг. Если нейросеть упорно добавляет нежелательные элементы, пропишите их в негативном запросе. Например: «без машин, без людей». Важно: не используйте слова «не», «кроме», «без» в позитивном промпте — нейросеть их может не понять. Лучше сразу выносить запреты в отдельное поле.
  1. Упрощайте формулировки. Избегайте деепричастных оборотов и сложных предложений. Чем проще и чётче запрос, тем выше вероятность, что ИИ его корректно обработает.
  1. Экспериментируйте со стилями. Выбор стиля может кардинально изменить результат. Попробуйте один и тот же промпт с разными стилями, чтобы найти наиболее удачный вариант.

Примеры удачных промптов:

  • «Реалистичное фото, плёнка 35 мм, милая молодая девушка блондинка с длинными волосами ночью, большие глаза, пухлые губы, естественный макияж, белая майка, крупные серьги, ночные огни, портрет, максимум деталей» (стиль «Детальное фото»).
  • «Мопс в короне сидит на троне, картина в стиле Веласкеса, максимум деталей» (без стиля).
  • «Закат в пустыне, максимальный реализм» (стиль «Детальное фото»).

Пример простого промпта: «Лошадь» — нейросеть сама решит, как её изобразить. Результат может быть красивым, но непредсказуемым.

Редактирование изображений: inpainting и outpainting в Kandinsky 3.0

Одна из ключевых новых функций Kandinsky 3.0 — возможность редактировать уже созданные изображения. Это реализовано через две техники:

Inpainting (замена области) Вы можете выделить на картинке конкретную область (например, лицо персонажа, фон или объект) и попросить нейросеть сгенерировать там что-то другое. Для этого используется инструмент «Ластик» — он удаляет ненужную часть, а затем вы пишете промпт, что должно появиться на этом месте. Например, можно убрать шапку с персонажа и попросить нарисовать причёску.

Outpainting (расширение границ) Позволяет выйти за рамки исходного изображения, дорисовывая новые элементы по краям. Это полезно для создания панорам или изменения композиции. Например, если у вас есть портрет, можно расширить фон, добавив пейзаж или интерьер.

Как это работает на практике:

  1. Сгенерируйте изображение.
  2. Нажмите на иконку ластика (или выберите соответствующий инструмент в меню).
  3. Закрасьте область, которую хотите изменить.
  4. Введите новый промпт для этой области.
  5. Нейросеть сгенерирует новый фрагмент, стараясь сохранить стиль и цветовую гамму исходной картинки.

Ограничения:

  • Результат не всегда идеально сочетается с оригиналом — могут быть заметны границы или различия в текстуре.
  • Для сложных изменений может потребоваться несколько попыток.
  • Функция доступна только на платформе Fusion Brain.

Сравнение Kandinsky 3.0 с другими нейросетями: плюсы и минусы

Kandinsky 3.0 часто сравнивают с мировыми лидерами в области генерации изображений — Midjourney и Stable Diffusion. Вот основные различия:

Плюсы Kandinsky 3.0:

  • Полностью бесплатный. В отличие от Midjourney, у Kandinsky нет платных тарифов. Вы можете генерировать неограниченное количество изображений, анимаций и видео без подписки.
  • Понимание русского языка. Нейросеть отлично работает с запросами на русском, а также поддерживает более 100 других языков.
  • Фокус на российскую культуру. Kandinsky значительно лучше справляется с генерацией образов, связанных с Россией: от архитектуры до персонажей мультфильмов.
  • Множество платформ. Доступен через сайт, мессенджеры, приложения и голосовых ассистентов.
  • Режимы редактирования. Inpainting и outpainting — функции, которые есть не у всех бесплатных аналогов.

Минусы Kandinsky 3.0:

  • Качество иногда уступает. По степени реалистичности и детализации Kandinsky может быть на уровне Midjourney и Stable Diffusion, но в некоторых сценариях (особенно с двумя и более персонажами) возможны ошибки: дублирование объектов, неправильные пропорции.
  • Ограничения по разрешению. Максимальное разрешение для изображений — 1024×1024 px, для видео — 512×512 px. Это меньше, чем у некоторых платных сервисов.
  • Скорость генерации. В среднем картинка создаётся около 2 минут, анимация — до 10 минут. Это медленнее, чем у некоторых конкурентов.
  • Галлюцинации. Как и любая нейросеть, Kandinsky может выдавать неожиданные результаты, особенно если промпт сформулирован неточно.

Вердикт: Kandinsky 3.0 — отличный выбор для тех, кто хочет бесплатно и на русском языке создавать изображения, анимацию и видео. Для профессиональных задач, где требуется максимальное качество и контроль, возможно, стоит рассмотреть платные аналоги, но для большинства повседневных задач Kandinsky более чем достаточен.

Ограничения и частые ошибки при работе с Kandinsky 3.0

Даже при правильном использовании нейросеть может выдавать неожиданные результаты. Вот наиболее частые проблемы и способы их решения:

1. Дублирование объектов. Если в промпте указано два персонажа (например, «Супермен и Бэтмен»), нейросеть может нарисовать двух одинаковых героев или смешать их черты. Решение: уточните в промпте, что персонажи разные, используйте негативный промпт, чтобы исключить дублирование, или попробуйте упростить запрос.

2. Неправильные пропорции. Иногда Kandinsky рисует людей с искажёнными лицами или телами. Решение: добавьте в промпт слова «реалистичные пропорции», «естественные черты лица» или попробуйте другой стиль.

3. Игнорирование негативного промпта. В некоторых случаях нейросеть может не полностью исключить указанные элементы. Решение: переформулируйте негативный промпт, используя более конкретные слова, или повторите генерацию.

4. Зависание или дублирование предыдущих генераций. На сайте Fusion Brain иногда возникает ситуация, когда нейросеть начинает повторять предыдущие результаты. Решение: перезагрузите страницу или выйдите из аккаунта и войдите снова.

5. Ограничения по длительности видео. Максимальная длина видео — 8 секунд. Если нужно больше, придётся создавать несколько роликов и монтировать их вручную.

6. Отсутствие поддержки негативных промптов для анимации и видео. В режимах анимации и видео негативные промпты не работают. Придётся корректировать только позитивный запрос.

7. Качество видео. Пока Kandinsky Video уступает по качеству статичным изображениям. Ожидать кинематографичного результата не стоит, но для прототипов и черновиков видео вполне пригодно.

Практические примеры использования Kandinsky 3.0 для разных задач

Нейросеть может быть полезна не только для развлечения, но и для рабочих задач. Вот несколько сценариев:

1. Создание контента для соцсетей. С помощью Kandinsky можно быстро генерировать уникальные изображения для постов, stories или обложек. Например, промпт «Сочный бургер, картошка фри и бутылка колы на столе, яркие цвета, максимум деталей» (стиль «Детальное фото») даст отличную картинку для меню или рекламы.

2. Разработка концептов и moodboard. Дизайнеры могут использовать Kandinsky для визуализации идей: «Американский мотель ночью, неоновые огни, рядом машина Mustang, кинематографичное реалистичное изображение». Это поможет быстро показать клиенту направление стиля.

3. Образовательные проекты. Учителя и студенты могут создавать наглядные материалы: «Натюрморт: банан, груша, яблоко. Яркий красный и жёлтый цвет» (стиль «Пикассо») — отличный пример для урока искусства.

4. Анимация для презентаций. Короткие анимационные ролики (например, «Пустыня, 4k» → «Солнце, 4k») можно использовать в качестве фонов для видео или слайдов.

5. Генерация персонажей. Для игр или комиксов: «Человек сидит за столом и печатает на компьютере, на фоне плакаты с героями боевиков из 90-х, яркие цвета, общий план. Жизнерадостная картинка» (стиль «Аниме»).

6. Быстрое прототипирование видео. Kandinsky Video позволяет создать короткий ролик по описанию, например, для предварительного просмотра сцены перед съёмкой.

Важно: помните, что нейросеть не всегда точно следует инструкциям, поэтому для критически важных задач лучше делать несколько дублей и выбирать лучший результат.

Вопросы и ответы

Сколько стоит использование Kandinsky 3.0?

Kandinsky 3.0 полностью бесплатен. Вы можете генерировать неограниченное количество изображений, анимаций и видео без подписки и скрытых платежей.

На каких языках можно писать промпты?

Нейросеть понимает запросы более чем на 100 языках, включая русский. Рекомендуется использовать русский или английский для наилучшего результата.

Как увеличить качество изображения?

Используйте максимальное соотношение сторон (1:1 даёт 1024×1024 px). Добавляйте в промпт слова «максимум деталей», «высокое разрешение», «реалистичное фото». Выбирайте стиль «Детальное фото» для фотореалистичных результатов.

Почему нейросеть рисует не то, что я прошу?

Возможные причины: слишком сложный или метафоричный промпт, отсутствие негативного промпта, неправильный выбор стиля. Попробуйте упростить запрос, убрать отрицания и добавить конкретные детали.

Можно ли использовать сгенерированные изображения в коммерческих целях?

Официально Сбер не ограничивает использование изображений, созданных с помощью Kandinsky, в коммерческих проектах. Однако рекомендуется уточнять актуальные условия в пользовательском соглашении на момент использования.

Как удалить фон или объект на готовой картинке?

Используйте инструмент «Ластик» на платформе Fusion Brain. Закрасьте ненужную область, затем введите новый промпт для этой части изображения. Нейросеть дорисует фон или объект по вашему описанию.

Почему видео получается низкого качества?

Kandinsky Video находится на ранней стадии развития. Разрешение видео — 512×512 px, что меньше, чем у статичных изображений. Для улучшения результата используйте детальные промпты и избегайте сложных сцен с множеством движущихся объектов.