Мультиязычная модель для генерации изображений по текстовому описанию
Год выпуска: 2023
Описание
Kandinsky – модель, способная генерировать изображения по текстовым описаниям на разных языках. Архитектурно модель похожа на DALL-E 2, однако в отличие от DALL-E 2, Kandinsky генерирует сначала векторное представление изображения, подобно Stable Diffusion, а затем декодирует изображение из полученного векторного представления. Поддержка нескольких языков была достигнута использованием мультиязычной версии модели CLIP.
Примеры использования:
Нововведения
Количество параметров: 3.22B
The Talking Museum позволяет изучать 3D-артефакты и задавать вопросы об их истории и особенностях Gemini
Представьте общение в интернете без аккаунтов и аватарок: есть только тред и реплики без подписи. В Японии такие анонимные форумы,…
До появления социальных сетей открытка была не только красивой картинкой, но и способом отправить короткое сообщение — от поздравления до…