Нейросеть Кандинский: как сгенерировать картинку бесплатно и без ограничений

Подробный гайд по нейросети Kandinsky от Сбера: возможности, способы доступа, инструкции по генерации изображений, секреты промптов, ограничения и ответы на частые вопросы.

Что такое Kandinsky и почему он популярен

Kandinsky — это семейство генеративных нейросетей, разработанных Сбером совместно с Институтом искусственного интеллекта AIRI. Название выбрано в честь художника Василия Кандинского, что подчёркивает творческую направленность модели. Проект позиционируется как отечественная альтернатива зарубежным сервисам вроде Midjourney и Stable Diffusion, и в отличие от них полностью бесплатен и доступен из России без VPN.

По состоянию на март 2025 года совокупная аудитория Kandinsky и чат-бота GigaChat превысила 18 миллионов пользователей. Модель постоянно развивается: в июне 2025 года вышла версия Kandinsky 4.1, построенная на новой архитектуре Diffusion Transformer (DiT), которая пришла на смену U-Net. Это обеспечило более высокое качество генерации, устойчивость и масштабируемость, а также ускорение работы почти в четыре раза.

Kandinsky умеет не только создавать изображения с нуля по текстовому описанию, но и редактировать готовые картинки, дорисовывать детали, смешивать стили двух изображений, а также генерировать анимацию и короткие видео. Модель понимает запросы более чем на 100 языках, но лучше всего работает с русским языком, что делает её особенно удобной для русскоязычных пользователей.

Где можно пользоваться Kandinsky: все способы доступа

Одно из главных преимуществ Kandinsky — множество точек входа. Вы можете выбрать наиболее удобный для вас способ:

  • Сайт Fusion Brain — основной веб-интерфейс с полным функционалом: генерация, редактирование, анимация, видео. Здесь доступны все последние версии модели.
  • Платформа ruDALL-E — более ограниченный функционал, но позволяет попробовать ранние версии моделей, включая Kandinsky 2.2, 2.1 и оригинальный ruDALL-E.
  • Telegram-бот GigaChat — удобен для быстрой генерации изображений прямо в мессенджере. Поддерживает создание стикеров, вариаций и видео.
  • Бот GigaChat во ВКонтакте — аналогичный функционал для пользователей VK.
  • Приложение «СберБанк Онлайн» — генерация изображений доступна прямо в банковском приложении.
  • Виртуальный ассистент «Салют» — на Android-устройствах и умных колонках можно попросить «Включи художника» и описать желаемую картинку.
  • GigaChat — чат-бот, который может сам составить промпт и передать его в Kandinsky, что удобно для комплексных задач.

Для работы через Telegram-бота или ВКонтакте регистрация не требуется. Однако для доступа к расширенным функциям (редактирование, видео, история запросов) рекомендуется зарегистрироваться на Fusion Brain через Сбер ID или GosKey.

Как сгенерировать картинку: пошаговая инструкция

Процесс генерации изображения в Kandinsky интуитивно понятен, но для получения качественного результата стоит следовать определённому алгоритму.

  1. Выберите платформу. Если вам нужен полный функционал, зайдите на Fusion Brain. Для быстрой генерации подойдёт Telegram-бот.
  2. Перейдите в раздел «Картинки». На сайте Fusion Brain выберите вкладку «Картинки» и укажите соотношение сторон: 1:1, 16:9, 9:16, 3:2 или 2:3. От этого зависит разрешение итогового файла: например, при 1:1 вы получите 1024×1024 px, а при 16:9 — 1024×576 px.
  3. Составьте промпт. Опишите желаемое изображение как можно подробнее. Например: «Реалистичное фото, молодая девушка с длинными розовыми волосами улыбается, пирсинг в носу, белая футболка, крупные серьги, фон размыт, портрет». Чем больше деталей, тем выше шанс получить нужный результат.
  4. При необходимости укажите негативный промпт. Это описание того, чего не должно быть на картинке, например «без текста, без размытия, без искажений». Негативные промпты особенно полезны при редактировании.
  5. Выберите стиль. Перед генерацией можно выбрать один из 17–20 готовых стилей: фотореализм, цифровая живопись, акварель, аниме, 3D-рендер, киберпанк и другие. Это упрощает задачу, так как не нужно описывать стиль словами.
  6. Нажмите кнопку генерации. Обычно результат появляется через 20–30 секунд, хотя на сайте может уйти до 2 минут. На каждый запрос выдаётся четыре варианта — выберите лучший или повторите генерацию.
  7. Скачайте результат. Стандартный формат — JPEG, но изображения в стиле «3D рендер» сохраняются в PNG.

Секреты составления эффективных промптов

Качество сгенерированного изображения напрямую зависит от того, как вы сформулируете запрос. Вот несколько проверенных рекомендаций:

  • Выносите главное в начало. Сначала укажите, кто или что должно быть на картинке, затем — что происходит, и только потом — детали. Например: «Кот в костюме астронавта на фоне звёздного неба, фотореалистичный стиль».
  • Добавляйте конкретику. Упоминайте фон, время суток, освещение, настроение, крупность плана, технические характеристики. Например: «Закат в пустыне, максимальный реализм».
  • Упрощайте конструкции. Избегайте сложных предложений с деепричастными оборотами. Чем проще формулировка, тем точнее нейросеть её поймёт.
  • Используйте прямые отсылки. Если хотите стиль известного художника или фильма, так и пишите: «Закат в стиле Малевича» или «Кот и собака в стиле „Криминального чтива“».
  • Не бойтесь экспериментировать. Если результат не устроил, переформулируйте запрос, добавьте или уберите детали, измените стиль. Kandinsky хорошо реагирует на уточнения.
  • Используйте негативные промпты. Указывайте, чего не должно быть: «без текста, без водяных знаков, без искажений». Это повышает точность.

Интересно, что Kandinsky умеет создавать симпатичные изображения даже по одному слову — например, по запросу «Лошадь» модель выдаст вполне достойный результат. Но для сложных сцен лучше потратить время на подробное описание.

Редактирование изображений: от ластика до смешивания стилей

Kandinsky — это не только генератор с нуля, но и мощный инструмент для редактирования. Вы можете загрузить готовое фото и попросить нейросеть изменить его по текстовой инструкции: «Замени фон на горный пейзаж» или «Добавь солнечные очки». Модель перерисует указанные элементы, сохраняя общую композицию.

Одна из ключевых функций — инпейнтинг. Вы выделяете область на изображении, и нейросеть заполняет её новым содержимым по вашему описанию. Это удобно для удаления лишних объектов или добавления деталей. Например, если на сгенерированной картинке появился лишний персонаж, можно выделить его и написать «убери человека».

Также доступен ластик — простой инструмент для удаления ненужных элементов. После удаления можно прописать в промпте, что именно сгенерировать на освободившемся месте.

Ещё одна полезная функция — смешивание изображений. Вы загружаете две картинки, и нейросеть объединяет их стили, перенося палитру, композицию или отдельные элементы. Это позволяет создавать уникальные визуалы без навыков работы в Photoshop.

Важно помнить, что при редактировании негативные промпты работают, но не всегда идеально. Если результат не устраивает, попробуйте переформулировать запрос или упростить задачу.

Генерация анимации и видео в Kandinsky

Помимо статичных изображений, Kandinsky умеет создавать анимацию и короткие видео. Это открывает дополнительные возможности для контент-мейкеров.

Анимация создаётся из нескольких сцен — максимально четыре, каждая длительностью 4 секунды. Вы можете задать промпт для каждой сцены, выбрать направление камеры (зум, панорама слева направо, снизу вверх и т.д.) и менять сцены местами. Соотношение сторон — 1:1, 9:16, 16:9, максимальное качество при 1:1 — 640×640 px. Генерация анимации из четырёх сцен занимает около 10 минут. Скачать результат можно в формате MP4. Негативные промпты для анимации не поддерживаются.

Kandinsky Video — отдельная модель для создания видео по текстовому описанию. Максимальная длительность ролика — 5 секунд (в версии 5.0 — до 10 секунд). Качество видео ниже, чем у изображений, но для коротких динамичных роликов этого достаточно. Генерация занимает примерно 4 минуты. Поддерживаются соотношения сторон 1:1, 9:16, 16:9. Негативные промпты также не работают.

Пример промпта для видео: «Молодой парень в белой футболке, джинсах и бейсболке едет на скейте по городу, на фоне парк аттракционов, снято на плёнку, кинематографичное видео». Редактировать уже сгенерированное видео нельзя — только перегенерировать с новым запросом.

Сравнение с Midjourney и Stable Diffusion

Kandinsky часто сравнивают с зарубежными нейросетями, и это сравнение выявляет как сильные, так и слабые стороны модели.

Преимущества Kandinsky:

  • Полностью бесплатен, в то время как Midjourney требует подписку от $10 в месяц.
  • Доступен из России без VPN, тогда как Midjourney и DALL-E блокируются.
  • Отлично понимает русский язык и культурный контекст, включая русских персонажей и фольклор.
  • Имеет множество точек входа: сайт, боты, приложения.
  • Поддерживает редактирование, анимацию и видео.

Недостатки:

  • Хуже справляется с передачей анатомии человека, изображения могут быть менее детализированными.
  • Меньше художественных стилей по сравнению с Midjourney.
  • Иногда не точно следует промпту, особенно в сложных сценах с несколькими героями.
  • Сгенерированные изображения разрешены только для некоммерческого использования (для коммерции нужно отдельное соглашение).

По степени реалистичности Kandinsky находится примерно на одном уровне со Stable Diffusion, но уступает Midjourney в художественной выразительности. Однако для большинства повседневных задач — контент для соцсетей, презентации, иллюстрации — его возможностей более чем достаточно.

Практические примеры промптов для разных задач

Чтобы вам было проще начать, вот несколько проверенных промптов для разных сценариев использования:

Реалистичное фото: «Реалистичное фото, плёнка 35 мм, милая молодая девушка блондинка с длинными волосами ночью, большие глаза, пухлые губы, естественный макияж, белая майка, крупные серьги, ночные огни, портрет, максимум деталей». Стиль: «Детальное фото».

Аниме: «Anime girl standing in neon Tokyo street, cinematic anime lighting, ultra detailed». Стиль: «Аниме».

Арт: «Космический корабль возле черной дыры, sci-fi art, ultra realistic, volumetric lighting». Стиль: «Цифровая живопись».

Киберпанк: «Бульдог идёт по ночному городу». Стиль: «Киберпанк».

Натюрморт в стиле Пикассо: «Натюрморт: банан, груша, яблоко. Яркий красный и жёлтый цвет». Стиль: «Пикассо».

3D-рендер: «Медвежонок в лесу днём, жизнерадостная картинка, яркие цвета». Стиль: «3D рендер».

Баннер для соцсетей: «Рекламный баннер онлайн казино в конфетном стиле, яркие цвета, glossy design, realistic candy world». Стиль: «Цифровая живопись».

AI-фотосессия: «Мужская фотосессия в стиле luxury fashion, realistic portrait, cinematic light». Стиль: «Детальное фото».

Помните, что даже при идеальном промпте нейросеть может «галлюцинировать» — добавлять лишние детали или искажать пропорции. В таких случаях просто повторите генерацию или используйте негативный промпт.

Ограничения и юридические аспекты использования

Несмотря на все преимущества, у Kandinsky есть ряд ограничений, о которых стоит знать заранее.

Технические ограничения:

  • Максимальное разрешение изображений — 2048×2048 px (в версии 3.1), но на сайте Fusion Brain при соотношении 1:1 вы получите 1024×1024 px.
  • Видео ограничено 5–10 секундами в зависимости от версии.
  • Анимация — максимум 4 сцены по 4 секунды.
  • Негативные промпты не работают для анимации и видео.
  • При длительном использовании сайта могут возникать сбои — например, дублирование предыдущих генераций. В этом случае помогает перезагрузка страницы.

Юридические аспекты:

  • Сгенерированные изображения разрешены для личного и некоммерческого использования.
  • Для коммерческого использования требуется отдельное соглашение с SberAI. На официальном сайте есть контакты для связи.
  • При использовании в публичных проектах рекомендуется указывать, что изображение создано нейросетью Kandinsky.

Эти ограничения не являются критичными для большинства пользователей, но важно учитывать их при планировании проектов, особенно если вы работаете в маркетинге или дизайне.

Будущее Kandinsky и перспективы развития

Kandinsky активно развивается, и разработчики не собираются останавливаться на достигнутом. Основные направления развития включают:

  • Улучшение качества генерации. Переход на архитектуру DiT уже дал значительный скачок в качестве и скорости. Ожидается, что будущие версии будут ещё точнее следовать промптам и лучше справляться с анатомией человека.
  • Развитие видео-модальности. Видеогенерация — одно из самых перспективных направлений. Уже сейчас Kandinsky Video умеет создавать ролики до 10 секунд, и в будущем длительность и качество будут расти.
  • Интеграция с продуктами Сбера. Kandinsky будет встраиваться в большее количество сервисов: от банковских приложений до умных устройств.
  • Расширение применения в бизнесе. Ожидается, что модели будут активнее использоваться для оформления выставок, создания афиш, баннеров, архитектурных проектов и других коммерческих задач.

Уже сейчас Kandinsky является одним из лучших бесплатных инструментов для генерации изображений на русском языке. С учётом темпов развития, он имеет все шансы стать полноценной альтернативой западным нейросетям не только для российских пользователей, но и для международной аудитории.

Вопросы и ответы

Нужна ли регистрация для использования Kandinsky?

Нет, если вы пользуетесь через Telegram-бота или ВКонтакте — там регистрация не требуется. Однако для доступа к расширенным функциям (редактирование, генерация видео, сохранение истории) необходимо зарегистрироваться на сайте Fusion Brain через Сбер ID или GosKey. Регистрация бесплатна и занимает пару минут.

Можно ли использовать сгенерированные изображения в коммерческих проектах?

Для личного и некоммерческого использования — да, без ограничений. Для коммерческого использования требуется отдельное соглашение с SberAI. На официальном сайте Kandinsky есть контакты для связи. В целом, если вы планируете использовать изображения в рекламе, на продаваемых товарах или в других коммерческих целях, лучше заранее уточнить условия.

Почему Kandinsky иногда выдаёт не то, что я просил?

Нейросети свойственны «галлюцинации» — ошибки в интерпретации запроса. Это может происходить из-за слишком сложной формулировки, неоднозначных метафор или перегруженности деталями. Чтобы повысить точность, упрощайте промпт, выносите главное в начало, используйте негативные промпты и выбирайте подходящий стиль. Если результат всё равно не устраивает, просто повторите генерацию — часто второй или третий вариант оказывается удачным.

Какое максимальное разрешение изображений в Kandinsky?

В версии Kandinsky 3.1 максимальное разрешение достигает 2048×2048 пикселей. Однако на сайте Fusion Brain при выборе соотношения сторон 1:1 вы получите 1024×1024 px, при 16:9 — 1024×576 px. Для большинства задач этого достаточно, но если нужно более высокое разрешение, можно использовать внешние инструменты для апскейла.

Чем Kandinsky отличается от Midjourney?

Kandinsky полностью бесплатен, доступен из России без VPN и отлично понимает русский язык. Midjourney — платный сервис (от $10 в месяц), требует VPN и понимает только английский. При этом Midjourney предлагает больше художественных стилей и лучше справляется с анатомией. Kandinsky же лучше адаптирован под российскую аудиторию и культурный контекст, а также поддерживает редактирование, анимацию и видео.

Как ускорить генерацию изображения в Kandinsky?

Скорость генерации зависит от платформы и сложности запроса. В Telegram-боте результат обещают за 10 секунд, на сайте — около 2 минут. Чтобы ускорить процесс, используйте простые промпты, избегайте слишком детализированных описаний и выбирайте меньшее количество сцен для анимации. Также убедитесь, что у вас стабильное интернет-соединение.