Что такое Kandinsky и как он появился
Kandinsky — это нейросеть для генерации изображений, анимации и видео, разработанная компанией Sber AI. Первая версия сервиса появилась в ноябре 2021 года под названием ruDALL-E XL. После серии обновлений модель получила имя Kandinsky. В апреле 2023 года вышла версия 2.1, которая стала популярной, но уступала зарубежным аналогам по реалистичности. В июле 2023 года версия 2.2 добавила фотореализм, а в ноябре 2023 года на конференции AI Journey представили Kandinsky 3.0 и Kandinsky Video. На май 2024 года актуальной является версия 3.1. Особенность Kandinsky — глубокая интеграция с русской культурой: нейросеть обучена на образах отечественных актеров, персонажей сказок, мотивах гжели и жостовской росписи.
Где можно пользоваться Kandinsky: все платформы
Нейросеть доступна на нескольких платформах, что делает её удобной для разных сценариев использования. Основной способ — сайт Fusion Brain, где доступны все функции: генерация по тексту, дорисовка, ластик, анимация и видео. Также работает сайт ruDALL-E, но с урезанным функционалом. Для быстрой генерации подходят чат-боты: в Telegram (@kandinsky21_bot) и во ВКонтакте. Через ботов можно создавать изображения, стикеры и смешивать картинки. Отдельный бот Kandinsky Video by Sber AI позволяет генерировать видео, но требует предварительной заявки. Кроме того, Kandinsky встроен в виртуального ассистента «Салют» и приложение «СберБанк Онлайн» — достаточно сказать «Включи художника».
Как начать работу на Fusion Brain: регистрация и интерфейс
Для работы на Fusion Brain требуется регистрация. После входа открывается графический редактор с интуитивным интерфейсом. Доступны горячие клавиши, подсказки и выбор модели — Kandinsky 3.1 или архивные версии 2.2 и 2.1. В редакторе можно задать соотношение сторон: 1:1, 16:9, 9:16, 3:2, 2:3. Качество изображения зависит от выбранного формата: например, квадратная картинка 1:1 по умолчанию имеет разрешение 1024×1024 пикселя, а 16:9 — 1024×576. Также доступен выбор стиля из 17 вариантов: от «Детального фото» до «Аниме» и «Киберпанк». Для точной настройки используется поле негативного промпта, где указывается, чего не должно быть на изображении.
Генерация изображений: пошаговая инструкция
Процесс создания картинки начинается с выбора соотношения сторон и стиля. Затем вводится промпт — текстовый запрос на русском или другом языке. Чем детальнее описание, тем точнее результат. После нажатия кнопки генерации нейросеть обрабатывает запрос около 2 минут. Если результат не устраивает, можно отредактировать промпт или добавить негативный промпт. Например, чтобы убрать ночь, напишите «Ночь» в негативном поле. Также доступен инструмент «ластик»: он удаляет ненужные детали, после чего на пустом месте можно сгенерировать новый фрагмент. Дорисовка работает за счёт пересечения областей — чем больше захват, тем естественнее переход.
Создание анимации и видео в Kandinsky
Анимация создаётся на вкладке «Видео» в Fusion Brain. Нужно выбрать модель «Анимация», указать количество сцен (до 4) и написать промпт для каждой. Длительность одной сцены — 4 секунды. Доступны направления камеры: зум, панорама, отдаление. Соотношение сторон: 1:1, 9:16, 16:9. Качество анимации ниже, чем у изображений — максимум 640×640 пикселей при квадратном формате. Время генерации 4-сценного ролика — около 10 минут. Негативные промпты для анимации не поддерживаются. Видео в Kandinsky Video генерируется по одному промпту длительностью до 5 секунд. Качество пока невысокое, а время ожидания — около 4 минут. Для доступа к видео-боту требуется отдельная заявка.
Как составлять эффективные промпты
Успех генерации напрямую зависит от качества промпта. Основные правила: выносите главное в начало (объект, действие), добавляйте детали (фон, освещение, время суток, стиль), избегайте метафор и сложных оборотов. Используйте прямые отсылки: «в стиле Пикассо» или «как в фильме „Бегущий по лезвию“». Негативный промпт помогает убрать нежелательные элементы. Шаблон: [тип изображения] + [главный объект] + [стиль/освещение] + [настроение]. Пример: «3D-рендер футуристического города ночью, сине-оранжевое освещение, кинематографическая атмосфера». Для простых задач достаточно одного слова — нейросеть сама дорисует детали.
Сравнение Kandinsky с Midjourney и Stable Diffusion
Kandinsky занимает второе место в рейтинге нейросетей для генерации изображений после Midjourney. Главное преимущество — полная бесплатность базовых функций и поддержка русского языка. Midjourney требует ежемесячной подписки от $10 и не понимает русский, но даёт более высокое качество и детализацию. Stable Diffusion бесплатен, но требует установки и технических навыков, при этом поддерживает видео через плагины. Kandinsky выигрывает в доступности: не нужен VPN, интерфейс на русском, есть встроенные стили. Однако уровень контроля ниже, чем у Stable Diffusion, а качество видео пока уступает изображениям.
Лицензия и коммерческое использование
Согласно пользовательскому соглашению ПАО «Сбербанк», Kandinsky разрешён только для личных и некоммерческих целей. Результаты генерации нельзя использовать в рекламе, арбитраже, брендинге или продавать без отдельного письменного соглашения. Пользователь сохраняет авторские права на созданный контент, но предоставляет банку неисключительную лицензию на его демонстрацию и переработку. Обязательно сохранять маркировку «создано с помощью Kandinsky». Возрастное ограничение — 18+. Запрещено генерировать контент, нарушающий законодательство или этические нормы. Для коммерческого применения необходимо обращаться в Sber AI за официальным разрешением.
Практические примеры и кейсы
Kandinsky хорошо справляется с генерацией портретов, пейзажей и объектов. Пример: промпт «Реалистичное фото, милая молодая девушка блондинка с длинными волосами ночью, большие глаза, пухлые губы, естественный макияж, белая майка, крупные серьги, ночные огни, портрет, максимум деталей» в стиле «Детальное фото» даёт качественный результат. Для креативных задач: «Мопс в короне сидит на троне, картина в стиле Веласкеса» — нейросеть создаёт стилизованное изображение. В маркетинге Kandinsky используют для прототипов баннеров, но не для прямого размещения. Арбитражники тестируют идеи креативов, однако коммерческое применение требует лицензии. Нейросеть также подходит для образовательных проектов и поиска вдохновения.
Ограничения и частые ошибки
Несмотря на широкие возможности, у Kandinsky есть ограничения. Бесплатная версия позволяет генерировать до 20 изображений в месяц без приоритета в очереди. Платная подписка снимает лимиты и ускоряет обработку. Нейросеть иногда «галлюцинирует»: дублирует объекты, рисует лишние пальцы или неправильно интерпретирует запрос. Например, при запросе «Супермен и Бэтмен» может создать двух одинаковых героев. Решение — упрощать промпт и использовать негативные формулировки. Также возможны сбои в работе сайта Fusion Brain, когда генерации перестают обновляться — помогает перезагрузка страницы. Видео пока уступает по качеству картинкам, а анимация не поддерживает негативные промпты.
Вопросы и ответы
Нейросеть Kandinsky полностью бесплатна?
Базовые функции Kandinsky бесплатны: на сайте Fusion Brain можно генерировать до 20 изображений в месяц. Платная подписка снимает лимиты, ускоряет обработку и добавляет расширенные настройки. Чат-боты в Telegram и ВКонтакте также бесплатны, но могут использовать не самую свежую версию модели.
Как получить доступ к генерации видео в Kandinsky?
Для генерации видео через бота Kandinsky Video by Sber AI необходимо оставить заявку и дождаться одобрения. В Fusion Brain видео доступно в разделе «Видео» при выборе модели «Анимация» или «Kandinsky Video». Качество видео пока ниже, чем у изображений, а время генерации — около 4 минут.
Можно ли использовать изображения Kandinsky в коммерческих целях?
По умолчанию — нет. Согласно пользовательскому соглашению, контент разрешён только для личного и некоммерческого использования. Для рекламы, арбитража или продажи требуется отдельное письменное соглашение с ПАО «Сбербанк». Обязательно сохранять маркировку «создано с помощью Kandinsky».
Чем Kandinsky отличается от Midjourney?
Kandinsky бесплатен, понимает русский язык и не требует VPN. Midjourney платный (от $10/мес), работает только на английском, но даёт более высокое качество и детализацию. Kandinsky удобен для быстрых тестов и простых задач, Midjourney — для профессиональной работы.
Как улучшить качество генерации в Kandinsky?
Используйте детальные промпты: указывайте объект, фон, освещение, стиль и настроение. Применяйте негативный промпт для удаления нежелательных элементов. Выбирайте подходящий стиль из 17 предустановленных. Если результат не устраивает, перезапустите генерацию или упростите запрос.
Какие форматы изображений поддерживает Kandinsky?
Стандартный формат для скачивания — JPEG. Исключение: изображения в стиле «3D рендер» сохраняются в PNG. Анимация и видео скачиваются в MP4. На сайте Fusion Brain также можно выбрать соотношение сторон: 1:1, 16:9, 9:16, 3:2, 2:3.
Почему нейросеть иногда рисует лишние объекты или искажает пропорции?
Это типичная «галлюцинация» ИИ. Kandinsky может дублировать персонажей, добавлять лишние пальцы или неправильно интерпретировать запрос. Решение: упростите промпт, используйте негативный промпт, укажите точное количество объектов (например, «один супермен и один бэтмен»). Если проблема повторяется, перезагрузите страницу.