Сбер представил новую версию своей генеративной модели Kandinsky 2.1
От предшественницы она отличается тем, что была дополнительно обучена на 170 млн пар «текст-изображение» высокого разрешения. После этого команда Sber AI дообучала её с помощью отдельно собранного датасета из 2 млн пар качественных изображений.
По итогу Kandinsky 2.1 стала генерировать картинки на порядок лучше — сгладились многие «шероховатости».
Помимо классической генерации, Kandinsky 2.1 может смешать два изображения, дорисовать к картинке детали по текстовому описанию или просто представить больше вариаций одной иллюстрации. Стиль при этом сохранится.
Опробовать новинку можно в телеграм-боте.
@kstati_p