Модели

Kandinsky 2.1

Мультиязычная модель для генерации изображений по текстовому описанию

date_range

Год выпуска: 2023

assignment

Описание

Kandinsky – модель, способная генерировать изображения по текстовым описаниям на разных языках. Архитектурно модель похожа на DALL-E 2, однако в отличие от DALL-E 2, Kandinsky генерирует сначала векторное представление изображения, подобно Stable Diffusion, а затем декодирует изображение из полученного векторного представления. Поддержка нескольких языков была достигнута использованием мультиязычной версии модели CLIP. 

Примеры использования:

  • Генерация изображений
  • Дорисовка фрагментов изображения
  • Перенос стиль с одного изображения на другое
  • Генерация изображений по референсам

Нововведения

  • Поддержка текстовых описаний на нескольких языках
  • Использование более качественного автокодировщика, чем в Stable Diffusion

Количество параметров: 3.22B

Share

Recent Posts

Российский суд не признал копирайт на сгенерированную Джоконду

Предприниматель требовал компенсацию за использование изображений, которые он сделал с помощью нейросети, но суд отказал

24.08.2026

Как самостоятельно учить иностранный язык?

Выбираете между зеленой совой, карточками и «умными» чат-ботами? Мы собрали стратегию самостоятельного и осмысленного изучения иностранного языка — от первых…

20.08.2026

Создатели ИИ требуют замедлить его разработку

В открытом письме к американским властям сотрудники ведущих ИИ-платформ призвали создать механизмы, которые позволят притормозить разработку ИИ

18.08.2026