Модели

Kandinsky 2.1

Мультиязычная модель для генерации изображений по текстовому описанию

date_range

Год выпуска: 2023

assignment

Описание

Kandinsky – модель, способная генерировать изображения по текстовым описаниям на разных языках. Архитектурно модель похожа на DALL-E 2, однако в отличие от DALL-E 2, Kandinsky генерирует сначала векторное представление изображения, подобно Stable Diffusion, а затем декодирует изображение из полученного векторного представления. Поддержка нескольких языков была достигнута использованием мультиязычной версии модели CLIP. 

Примеры использования:

  • Генерация изображений
  • Дорисовка фрагментов изображения
  • Перенос стиль с одного изображения на другое
  • Генерация изображений по референсам

Нововведения

  • Поддержка текстовых описаний на нескольких языках
  • Использование более качественного автокодировщика, чем в Stable Diffusion

Количество параметров: 3.22B

Share

Recent Posts

Google представила виртуальный музей с ИИ

The Talking Museum позволяет изучать 3D-артефакты и задавать вопросы об их истории и особенностях Gemini

09.10.2026

Господин Никто: как устроена анонимность на японских форумах

Представьте общение в интернете без аккаунтов и аватарок: есть только тред и реплики без подписи. В Японии такие анонимные форумы,…

08.10.2026

Тест: Угадайте, что отправители писали на старых открытках

До появления социальных сетей открытка была не только красивой картинкой, но и способом отправить короткое сообщение — от поздравления до…

05.10.2026