← Все новости Модели

SenseTime выпустила мультимодальную модель SenseNova-U1.5-8B-MoT

15 сентября 2026 г.
SenseTime выпустила мультимодальную модель SenseNova-U1.5-8B-MoT

Компания SenseNova-U1.5-8B-MoT-SFT представила новую архитектуру, предназначенную для работы с визуальным контентом. Модель базируется на подходе Mixture-of-Tokens (MoT) и оптимизирована для выполнения задач генерации и редактирования изображений.

Разработчики реализовали поддержку вывода в разрешении 4K, что выделяет систему среди аналогов с сопоставимым количеством параметров. Модель обладает 8 миллиардами параметров и прошла стадию SFT (Supervised Fine-Tuning) для повышения точности следования инструкциям пользователя при создании графики.

Техническая реализация модели позволяет использовать её как нативную мультимодальную систему, способную обрабатывать сложные визуальные запросы. Веса модели и документация по её развертыванию уже доступны для скачивания в открытом доступе на платформе Hugging Face.

Интеграция MoT-архитектуры позволяет более эффективно распределять вычислительные ресурсы при обработке визуальных токенов. Это решение направлено на снижение задержек при генерации изображений высокого разрешения, сохраняя при этом компактный размер модели для локального запуска на специализированном оборудовании.

Новый релиз расширяет экосистему инструментов для работы с генеративным контентом, предлагая разработчикам гибкий инструмент для встраивания функций редактирования изображений в сторонние приложения. Исходный код и веса модели распространяются для исследовательских и прикладных целей.

mozgi.io — AI-инструменты и промпты
Скопировано