Нейросеть Кандинский: как писать промты для генерации изображений

Подробное руководство по работе с нейросетью Kandinsky от Сбера. Узнайте, как правильно формулировать промты, какие стили и режимы доступны, где тестировать генерации и как избежать типичных ошибок.

Что такое нейросеть Kandinsky и чем она отличается от аналогов

Kandinsky — это российская нейросеть для генерации изображений, разработанная Sber AI. Она является бесплатным аналогом зарубежных сервисов вроде Midjourney, но с рядом важных отличий. Главное преимущество — полная поддержка русского языка: запросы можно вводить на русском, а интерфейс переведён и интуитивно понятен. Для работы не требуется VPN, а количество генераций не ограничено.

Нейросеть названа в честь Василия Кандинского — русского художника, основателя абстракционизма. В 2021 году Сбер выпустил первую модель ruDALL-E, которая затем легла в основу Kandinsky. Сейчас актуальна версия Kandinsky 5.0, доступная через GigaChat, а также более ранние версии 2.1 и 2.2, которые работают на сайте Fusion Brain, в Telegram-боте и других платформах. Версия 2.2 принесла фотореализм, поддержку разных соотношений сторон и генерацию стикеров.

Где можно пользоваться нейросетью: платформы и способы доступа

Kandinsky доступен на нескольких платформах, каждая из которых имеет свои особенности.

Fusion Brain — основной онлайн-редактор. Доступны все 23 стиля, 4 режима генерации, инструмент «Ластик» для удаления частей изображения. Максимальный размер — 768x768 пикселей, можно менять соотношение сторон.

Telegram-бот — быстрый доступ через мессенджер. Поддерживает все режимы, но только три стиля. Размер картинки не регулируется.

Сайт Rudalle — позволяет создавать изображения с разрешением до 1536x768 пикселей. Доступно 19 стилей. Недостаток — перед каждой генерацией требуется проходить капчу.

GigaChat — чат-бот на основе Kandinsky 5.0. Позволяет генерировать не только изображения, но и короткие видео (до 6 секунд). Для регистрации нужен Сбер ID.

Виртуальный ассистент «Салют» — по команде «Включи художника» запускает генерацию по голосовому или текстовому описанию. Работает в приложении и на умных устройствах Сбера.

MLSpace — платформа для ИП и организаций, позволяющая развернуть нейросеть на собственном графическом процессоре.

Как правильно писать промты: формула успешного запроса

Качество изображения напрямую зависит от того, как сформулирован промт. Сбер рекомендует использовать структуру, которая включает четыре основных блока.

Основное — обязательный элемент. Укажите главный объект, действие и контекст. Например: «красный кабриолет стоит на фоне неонового города».

Подробности — детали внешности, эпоха, время суток, эмоции. Чем конкретнее, тем лучше. Вместо «человек» пишите «молодой парень, брюнет, в оверсайз худи».

Стиль — выберите один из доступных стилей (аниме, киберпанк, детальное фото, средневековый стиль, советский мультфильм и другие) или опишите свой вариант.

Тип — формат изображения. Для видео можно указать длительность и частоту кадров.

Смысловые блоки лучше разделять запятыми. Не стоит делать промт слишком длинным — нейросеть может упустить главные требования. Лучше создавать изображение в несколько итераций, каждый раз внося небольшие изменения.

Доступные стили генерации и их особенности

Kandinsky предлагает широкий выбор стилей, которые можно комбинировать с текстовым описанием. Вот полный список:

  • Аниме
  • Детальное фото
  • Киберпанк
  • Кандинский (абстракция)
  • Айвазовский
  • Малевич
  • Пикассо
  • Гончарова
  • Классицизм
  • Ренессанс
  • Картина маслом
  • Рисунок карандашом
  • Цифровая живопись
  • Средневековый стиль
  • Советский мультфильм
  • 3D-рендер
  • Мультфильм
  • Студийное фото
  • Портретное фото
  • Мозаика
  • Иконопись
  • Хохлома
  • Новый год

Стиль указывается в отдельном поле или в самом промте. Например, «Стиль: средневековый стиль, детальное фото». Экспериментируйте: один и тот же запрос с разными стилями даёт совершенно разные результаты.

Режимы генерации: от текста до смешивания изображений

Kandinsky поддерживает несколько режимов работы.

Генерация по текстовому описанию — самый популярный режим. Пользователь вводит промт, нейросеть создаёт изображение с нуля.

Смешивание изображений — объединение двух картинок в одну. Можно комбинировать стили и элементы.

Создание вариаций — нейросеть генерирует новые изображения на основе загруженного примера. Полезно для создания аватарок или поиска альтернативных вариантов.

Генерация по описанию и загруженному фото — позволяет перенести стиль, очертания или позу с загруженного изображения на новую картинку.

Дорисовка изображения — если картинка была обрезана или нужно добавить детали, нейросеть дорисовывает недостающие части.

ControlNet — инструмент для локальных изменений. Позволяет выделить контуры объекта и заменить сцену, не переделывая всю картинку.

Практические примеры промтов и результаты генерации

Рассмотрим несколько примеров, которые помогут понять, как работают промты.

Пример 1: Портрет космонавта Промт: «космонавт на фоне Земли, фотореалистичный портрет, блестящий шлем, свечение звезд вдалеке». Результат — реалистичное изображение с детализированным шлемом и звёздным небом.

Пример 2: Фантастический город Промт: «фантастический мегаполис будущего в стиле киберпанк, яркие неоновые цвета, плотная застройка, футуристическая архитектура, голографические рекламные щиты, приглушенный солнечный свет, высокая детализация». Нейросеть создаёт яркий, насыщенный город.

Пример 3: Русская зимняя сказка Промт: «фотореалистичная русская зимняя сказка, заснеженный лес, искрящиеся снежинки, глубокое синее звездное небо, мягкий холодный свет, небольшие сугробы на ветках деревьев, новогодняя атмосфера». Получается атмосферный зимний пейзаж.

Пример 4: Подводный мир Байкала Промт: «нерпа подо льдом Байкала, вид снизу, через толщу льда проходит свет, вокруг маленькие пузырьки воздуха, холодные голубые оттенки». Изображение получается детализированным и реалистичным.

Важно: если результат не устраивает, добавьте негативный промт — описание того, чего быть не должно. Например, «без лишних предметов, без искажений».

Типичные ошибки и ограничения нейросети

Несмотря на все достоинства, Kandinsky имеет ряд недостатков, которые важно учитывать.

Проблемы с руками и пальцами — нейросеть часто генерирует излишне длинные, уродливые пальцы или клешни. Негативный промт помогает не всегда.

Однотипные лица и фоны — персонажи могут получаться с одинаковыми чертами, а фоны — повторяться. Это связано с особенностями обучающей выборки.

Обрезанные макушки — на горизонтальных изображениях нейросеть часто обрезает верхнюю часть: коты без ушей, люди без лба, олени без рогов.

Проблемы с котами — животные могут получаться не того цвета, с искажёнными мордами или напоминать енотов.

Непонимание контекста — возможны ляпы: курица с головой коровы, петух с утиным клювом.

Дорисовка — при изменении пропорций дорисованные детали могут выглядеть странно.

Отсутствие ленты генераций — нельзя посмотреть работы других пользователей и скопировать понравившийся промт. С одной стороны, это защищает ваши идеи, с другой — ограничивает вдохновение.

Советы по улучшению качества изображений

Чтобы получить максимально качественный результат, следуйте нескольким рекомендациям.

Будьте конкретны — вместо общих слов используйте детальные описания. Указывайте цвет, форму, текстуру, освещение.

Используйте негативные промты — перечислите, чего не должно быть на изображении. Это поможет избежать лишних деталей.

Экспериментируйте со стилями — один и тот же запрос в разных стилях даёт совершенно разные результаты. Попробуйте «Детальное фото», «Цифровая живопись» или «Средневековый стиль».

Делайте несколько итераций — если первый результат не устраивает, измените промт и сгенерируйте заново. Постепенно вы добьётесь нужного эффекта.

Не перегружайте запрос — слишком длинный промт может запутать нейросеть. Выделите главное и добавляйте детали постепенно.

Используйте разные платформы — на Fusion Brain больше стилей, в Telegram быстрее, на Rudalle выше разрешение. Выбирайте подходящую под задачу.

Практическое применение: где использовать сгенерированные изображения

Изображения, созданные с помощью Kandinsky, можно использовать в самых разных целях.

Иллюстрации для статей и блогов — нейросеть помогает быстро получить уникальные картинки, соответствующие теме.

Дизайн и реклама — генерация идей для макетов, баннеров, постеров. Можно создавать варианты упаковки или одежды.

Социальные сети — аватарки, обложки, мемы, контент для постов. Нейросеть позволяет создавать яркие и запоминающиеся изображения.

Творческие проекты — поиск вдохновения, создание персонажей, концепт-артов. Kandinsky может стать инструментом для художников и дизайнеров.

Образование — визуализация сложных понятий, создание наглядных материалов для уроков и презентаций.

Развлечение — генерация забавных картинок, открыток, стикеров. Можно создавать персонализированные изображения для друзей и близких.

Важно: изображения, созданные нейросетью, могут использоваться в коммерческих целях, но рекомендуется проверять лицензионные условия на конкретной платформе.

Вопросы и ответы

Нужна ли регистрация для работы с Kandinsky?

Для работы через Fusion Brain, Telegram-бот или сайт Rudalle регистрация не требуется. Для GigaChat понадобится Сбер ID.

Сколько изображений можно сгенерировать бесплатно?

Количество генераций не ограничено. Kandinsky остаётся полностью бесплатным сервисом.

Почему нейросеть плохо генерирует руки и пальцы?

Это общая проблема многих нейросетей. Kandinsky особенно часто создаёт длинные или искажённые пальцы. Используйте негативные промты, но полностью избежать ошибок не всегда удаётся.

Можно ли использовать изображения в коммерческих целях?

Да, изображения можно использовать в коммерческих проектах, но рекомендуется уточнять лицензионные условия на конкретной платформе.

Какой максимальный размер изображения?

На Fusion Brain — до 768x768 пикселей, на Rudalle — до 1536x768 пикселей. В GigaChat доступны более высокие разрешения.

Как улучшить качество генерации?

Будьте конкретны в промте, используйте негативные промты, экспериментируйте со стилями и делайте несколько итераций. Не перегружайте запрос лишними деталями.

Чем Kandinsky отличается от Midjourney?

Kandinsky бесплатен, поддерживает русский язык, не требует VPN и имеет простой интерфейс. Midjourney платный, требует английских запросов и VPN, но часто выдаёт более качественные и детализированные изображения.