Нейросеть Кандинский от Сбера: честный гайд по Kandinsky 3.1

Нейросеть Кандинский от Сбера: честный гайд по Kandinsky 3.1

Нейросеть Кандинский — это генеративная модель Сбера: пишешь текстом, что нарисовать, получаешь картинку. В той же линейке есть и генерация видео. Актуальная версия к середине 2026-го — Kandinsky 3.1, и пользоваться ей можно бесплатно: через сайт Fusion Brain, внутри ассистента ГигаЧат или по открытому API. Сильна модель в художественном и стилизованном — арт, иллюстрации, абстракция; понимает русские запросы без перевода и работает из России без VPN и зарубежных карт. Слабых мест три: фотореализм, мелкие детали и текст на картинке (кириллицу регулярно превращает в кашу). Дальше — без рекламных формулировок: версии, реальные возможности, где упираешься в лимиты и в какой момент под продукт всё-таки нужны зарубежные флагманы по API.

Кандинский — пожалуй, самый узнаваемый российский AI-инструмент для картинок. Запрос «нейросеть кандинский» люди гуглят обычно с одной из двух целей: либо быстро сделать одну картинку, либо понять, можно ли на этом строить рабочий процесс. Ответ на оба вопроса — ниже, снимок актуален на 08.07.2026. Если вы вообще выбираете среди русскоязычных сервисов, пригодится и обзор нейросетей на русском языке.

Что такое нейросеть Кандинский (Kandinsky от Сбера)

Kandinsky — семейство text-to-image моделей от команды Sber AI, разработанное вместе с исследователями AIRI. Имя не случайное: назвали в честь Василия Кандинского, одного из отцов абстрактной живописи. И это работает — модель исторически лучше всего чувствует себя именно в художественном, абстрактном, стилизованном.

Под капотом — латентная диффузия. Если совсем упрощать: даёте промпт («уютная кофейня в скандинавском стиле, мягкий утренний свет, акварель»), модель проявляет картинку из шума, подгоняя её под смысл описания. Для практики устройство неважно. Важно, что на входе текст, на выходе — готовый файл.

Главное отличие от зарубежных моделей — русский как родной. Kandinsky обучали с русскоязычным текстовым энкодером, он понимает запрос напрямую, без внутреннего перевода на английский и обратно, и заметно ближе знаком с российским контекстом: скажешь «в стиле советского плаката» — поймёт без пояснений. Для того, кто не хочет возиться с англоязычными промптами, это удобная точка входа.

Главное отличие от зарубежных моделей — русский как родной: Kandinsky понимает запрос напрямую, без внутреннего перевода на английский и обратно.

И сразу про границу, чтобы не было завышенных ожиданий. Кандинский рисует — картинки и видео, — но это не текстовый чат-бот уровня GPT или Claude. За текст и диалог у Сбера отвечает отдельная модель, ГигаЧат, а Кандинский подключён внутри неё как «художник».

Версии Kandinsky: от 2.1 до Kandinsky 3.1

Номер версии стоит различать. Между поколениями разница в качестве огромная, а по интернету до сих пор ходят примеры со старых моделей — судить по ним о сегодняшнем Кандинском бессмысленно.

  • Kandinsky 2.1 (2023) — с неё начался массовый интерес. Image-prior плюс латентная диффузия, поддержка русского и английского. По меркам 2026-го — музейный экспонат.
  • Kandinsky 2.2 (2023) — новый визуальный энкодер, чище композиция, появилось управление генерацией по контурам и глубине.
  • Kandinsky 3.0 (конец 2023) — вот тут случился скачок: больше параметров, лучше понимание длинных русских описаний, аккуратнее сцены. С 3.0 модель стала выглядеть по-взрослому.
  • Kandinsky 3.1 (2024, текущая линейка) — то, что работает прямо сейчас. Добавили скоростной режим Flash (генерация за счёт дистилляции — секунды вместо десятков секунд), автоматическое «улучшение промпта» (отдельная LLM дописывает и детализирует ваш запрос), правку по маске (inpainting) и расширение кадра (outpainting), плюс image-to-image.

Когда сегодня пишут «кандинский 3.1 нейросеть», имеют в виду именно этот набор — базовое качество плюс Flash и редактирование. Для одной случайной картинки разницы между 3.0 и 3.1 вы, скорее всего, не заметите. А если генерите регулярно — более широкий инструментарий 3.1 экономит время.

Нейросеть Кандинский от Сбера: честный гайд по Kandinsky 3.1

Что умеет Кандинский: изображения, фото и стили

По делу — что модель реально вытягивает.

Генерация с нуля (text-to-image). Базовый режим: описал сцену — получил картинку. Лучше всего у Kandinsky 3.1 идут иллюстрации, концепт-арт, фоны, стилизованные сцены и — что логично для «Кандинского» — абстракция и художка.

Стили. Стилевые запросы модель держит уверенно: «акварель», «плоский вектор», «масляная живопись», «киберпанк-постер». Это её конёк. Для муд-бордов, обложек и артов она выдаёт разнообразные, живые варианты, а не пять клонов одной картинки.

Правка (inpainting и outpainting). Загружаете своё изображение, выделяете область и меняете содержимое (inpainting) — убрать лишний объект, дорисовать деталь. Outpainting работает наоборот: достраивает кадр за исходные границы, продолжая сцену.

Image-to-image. Даёте картинку-референс плюс текст — модель генерит новое изображение, отталкиваясь от композиции или стиля исходника.

Теперь честно про то, где Кандинский спотыкается. Знать это стоит заранее, чтобы не убить полчаса на заведомо проигрышную задачу:

  • Фотореализм. «Кандинский нейросеть фото» — популярный запрос, но реалистичная предметка и портрет не его конёк. Художественный кадр — да, отлично. А вот «неотличимо от фотографии» продуктовое фото зарубежные флагманы (GPT Image 2, Nano Banana Pro) пока делают детальнее.
  • Мелочи и анатомия. Классика диффузии: руки, пальцы, сложные механизмы, мелкие лица на дальнем плане нередко плывут.
  • Текст на картинке. Больное место. Надписи, особенно кириллицей, Кандинский регулярно ломает — буквы выходят нечитаемыми. Для баннера, где текст должен читаться, это дисквалифицирующий недостаток.

Как разные генераторы картинок соотносятся по качеству, тексту и цене — разбирал отдельно: нейросети для генерации изображений: модели и API.

Как пользоваться Кандинским бесплатно

Доступность — едва ли не главный аргумент. Kandinsky работает из России без VPN и иностранных карт, и базовый сценарий бесплатный. Точек входа несколько.

Kandinsky работает из России без VPN и иностранных карт, и базовый сценарий бесплатный.

Fusion Brain. Официальный веб-сервис fusionbrain.ai — самый короткий путь. Регистрация, запрос на русском, выбор формата и стиля, картинка прямо в браузере. Тут же живёт правка. Для разовой обложки или иллюстрации руками — самое то.

ГигаЧат. Внутри ассистента можно просто попросить сгенерировать изображение — визуал там рисует как раз Кандинский. Удобно, когда картинка нужна по ходу разговора.

Салют и приложения Сбера. Кандинский вшит в виртуальных ассистентов Салют и часть продуктов Сбера — генерацию запускают хоть голосом.

Телеграм-боты. Есть официальные и полуофициальные боты, дающие доступ к генерации прямо в мессенджере, — вариант «на бегу».

Для веба и разовых картинок этого хватает с запасом. Упирается всё в одно: работа ручная. Кликать в браузере ради сотни картинок в день по одному шаблону — занятие бессмысленное. Отсюда начинается территория API.

Video Kandinsky: генерация видео

Запрос «video kandinsky» — это про ролики. В линейке Сбера есть Kandinsky Video (KandinskyVideo): text-to-video, которая по описанию собирает короткий анимированный клип.

Про генеративное видео вообще держите в голове одну вещь — направление ещё сырое, и Kandinsky Video тут не исключение. Ролики короткие, на несколько секунд. Разрешение и стабильность сцены ограничены. А постоянство объектов между кадрами и правдоподобная «физика» движения — самая тяжёлая зона, над которой бьются вообще все команды в мире, не только Сбер. Для экспериментов, коротких заставок и арт-роликов это интересно и доступно бесплатно через Fusion Brain. Под продакшн-видео обычно смотрят в сторону специализированных зарубежных видеомоделей — про них отдельный разбор, но принцип «модель по API в рублях» там ровно тот же, что и для картинок.

Лимиты и честный итог по сильным и слабым сторонам

Свожу всё в одну картину.

Что у Кандинского хорошо:

  • Бесплатно и без барьеров — ни VPN, ни зарубежных карт, регистрация по российским аккаунтам.
  • Русский как родной — понимает запрос напрямую, в теме культурного контекста.
  • Художка и стилизация — арт, иллюстрации, абстракция, имитация живописи.
  • Скорость — Flash в 3.1 отдаёт результат почти мгновенно.
  • Правка на месте — inpainting, outpainting, image-to-image в одном окне.

Где упираешься:

  • Фотореализм слабее флагманов — для «как настоящее фото» продуктового кадра детализации не всегда хватает.
  • Текст на изображении — надписи, особенно кириллицей, часто нечитаемы.
  • Мелкие детали — руки, дальние лица, сложные объекты плывут.
  • Очереди и лимиты бесплатного тарифа — в пик генерация ждёт очереди, у бесплатного API есть потолок по числу запросов.
  • Продакшн-надёжность — для генерации на потоке внутри продукта нужны стабильный SLA, предсказуемая пропускная способность и нормальное коммерческое оформление. Бесплатный веб-сервис такого по определению не даёт.

Итог без прикрас. Кандинский — сильный бесплатный инструмент для художественных картинок, быстрых проб и русскоязычных запросов. Но как только задача становится продуктовой — фотореалистичные карточки, баннеры с точным текстом, сотни изображений в день внутри сервиса, — упираешься в одну из трёх стен: качество, лимиты или вопрос «а как это провести по бухгалтерии».

Как только задача становится продуктовой, упираешься в одну из трёх стен: качество, лимиты или вопрос «а как это провести по бухгалтерии».

Kandinsky по API: Fusion Brain API

Для автоматизации у Сбера есть Fusion Brain API — программный доступ к тому же Кандинскому. Схема привычная: регистрируетесь, получаете пару «ключ + секрет», шлёте HTTP-запрос с промптом и параметрами, забираете картинку (обычно в base64). Есть бесплатный уровень — со своими лимитами по числу запросов.

Вариант рабочий, если вам нужен именно Кандинский в коде: внутренний инструмент, пет-проект на русском арте. Но для бизнеса у него три практических потолка. Один провайдер и одна модель — переключиться на зарубежный флагман в той же интеграции не выйдет. Собственный формат API — не OpenAI-совместимый, обвязку под него пишут отдельно. И лимиты бесплатного тарифа, которых под поток может банально не хватить.

Если проект крутится вокруг одной модели — этого достаточно, вопросов нет. Если же хочется держать под рукой сразу несколько моделей и переключаться между ними одной строкой — удобнее единый мультимодельный шлюз.

Нейросеть Кандинский от Сбера: честный гайд по Kandinsky 3.1

Когда нужны флагманы по API в рублях — provod.ai

Кандинский закрывает бесплатное и художественное. Но есть класс задач, где без зарубежных флагманов не обойтись: фотореалистичные продуктовые карточки, баннеры с аккуратным читаемым текстом, стабильная генерация на потоке внутри продукта, предсказуемое качество под конкретного клиента. Тут вперёд выходят GPT Image 2 от OpenAI (лучший в классе по тексту на картинке), Nano Banana Pro от Google (разрешение и детализация) и другие флагманы.

Загвоздка с прямым доступом к ним из России известна: зарубежная карта, VPN, аккаунт живёт до первого бана, а закрывающих документов на расход нет вообще. Под продукт — ненадёжно.

provod.ai снимает ровно эту боль: доступ к зарубежным флагманам через один российский OpenAI-совместимый endpoint. В коде меняется одна строка — адрес и ключ, — а нужная модель выбирается в поле model. Ни VPN, ни иностранных карт.

from openai import OpenAI client = OpenAI( api_key="...", # ключ provod.ai base_url="https://api.provod.ai/v1", # единственное изменение ) result = client.images.generate( model="openai/gpt-image-2", # или "google/nano-banana-pro" prompt="Продуктовый кадр: керамическая кружка на светлом фоне, " "мягкий дневной свет, вид три четверти", size="1024x1024", ) print(result.data[0].url)

Что здесь важнее самого кода — коммерческая сторона. Оплата на российское юр.лицо в рублях по договору, с полным пакетом закрывающих документов (счёт, акт, счёт-фактура, УПД) через ЭДО. Токены — по ставкам провайдера, пересчитанным в рубли по курсу ЦБ, без наценки сверху; сервисная комиссия берётся только при пополнении баланса. На практике это значит, что расход на генерацию картинок спокойно проводится по учёту компании — то, чего бесплатный веб-сервис не даст в принципе.

Рабочая связка на деле простая. Кандинский — бесплатные пробы, русскоязычный арт, разовые художественные картинки. Зарубежные флагманы через provod.ai — когда картинки идут в продукт, нужен фотореализм или читаемый текст, счёт идёт на сотни в день, а бухгалтерии нужны нормальные документы. Как соотносятся сами модели генерации по качеству и цене — в разборе нейросети для генерации изображений: модели и API.

FAQ

Что такое нейросеть Кандинский простыми словами?

Генеративная нейросеть Сбера, которая по текстовому описанию рисует картинки (а в линейке есть и короткое видео). Актуальная версия — Kandinsky 3.1. Понимает русский, работает из России без VPN и бесплатно доступна через сайт Fusion Brain, ассистент ГигаЧат и API.

Кандинский — это бесплатно?

Да, базовый сценарий бесплатный: веб-сервис Fusion Brain, ГигаЧат и бесплатный уровень Fusion Brain API. У бесплатного доступа есть лимиты по числу запросов и очереди в пиковые часы. Для потоковой продуктовой генерации этого потолка может не хватить.

Какая последняя версия Kandinsky?

На середину 2026-го актуальная линейка — Kandinsky 3.1. Относительно 3.0 в ней добавились скоростной режим Flash, автоматическое улучшение промпта и правка — inpainting (замена по маске) и outpainting (расширение кадра).

Умеет ли Кандинский генерировать видео?

Да, есть модель Kandinsky Video (text-to-video) — короткие анимированные ролики по текстовому описанию. Как и всё генеративное видео сегодня, они короткие и ограничены по разрешению и стабильности сцены; для проб и арт-клипов годится, под продакшн обычно берут специализированные модели.

Почему Кандинский плохо пишет текст на картинке?

Это общая слабость диффузионных моделей, и на кириллице она особенно заметна: буквы в надписях выходят искажёнными или нечитаемыми. Нужен баннер с точным текстом — надёжнее модель, заточенная под текст на изображении, например GPT Image 2, доступная по API в рублях через provod.ai.

Чем Кандинский отличается от зарубежных моделей вроде GPT Image 2?

Кандинский бесплатный, родной по русскому и силён в художественной, стилизованной графике, но уступает флагманам в фотореализме, мелких деталях и тексте на картинке. GPT Image 2 и Nano Banana Pro сильнее в реалистичных продуктовых кадрах и надписях, но требуют доступа по API. Через provod.ai их подключают из России в рублях по договору с закрывающими документами.

Прикидываете, что ставить под конкретную задачу — русскоязычный арт бесплатно на Кандинском или фотореалистичные карточки и баннеры с текстом через флагманы по API в рублях? Начните с главной страницы provod.ai: там доступ к зарубежным моделям генерации изображений с оплатой на юр.лицо и полным пакетом документов.

provod.ai — российский LLM API-агрегатор

Один OpenAI-совместимый endpoint ко всем флагманам: OpenAI (GPT-5.5, GPT-5.4), Anthropic (Claude Opus 4.7, Sonnet 4.6), Google (Gemini 3.1 Pro, 3.5 Flash), DeepSeek V4 Pro, Qwen 3.6 Plus.

Цены 1-в-1 с провайдером по курсу ЦБ — без наценки на токены. Оплата в рублях по договору, полный пакет закрывающих документов (договор-оферта, счёт, акт, счёт-фактура, УПД 5.03 через ЭДО). Без VPN — легальный B2B-сервис в России.

Если статья была полезной — попробуйте provod.ai: главная страница · каталог моделей · документация

1