Китайская модель SenseNova U1.5-Lite-Preview стала открытым исходным кодом с нативным выводом 4K
Компания SenseTime представила и открыла исходный код модели SenseNova U1.5-Lite-Preview — легковесной нативной унифицированной мультимодальной модели, способной напрямую генерировать изображения в разрешении 4K. Модель поддерживает сложные запросы, эталонные изображения, многокомпонентную композицию и точное редактирование, что представляет собой шаг вперед в области генерации и редактирования изображений с помощью искусственного интеллекта.
SenseTime выпустила SenseNova U1.5-Lite-Preview — раннюю предварительную версию легковесной нативной унифицированной мультимодальной модели, доступную сообществу open-source (открытый исходный код). Построенная на собственной архитектуре NEO-Unify, модель объединяет в единой структуре язык, визуальную семантику и генерацию на уровне пикселей, охватывая визуальное понимание, рассуждение, генерацию
Показать ещё ↓
Источник: QbitAI 量子位 —
оригинал
