← 所有新聞 模型

SenseTime 釋出了多模態模型 SenseNova-U1.5-8B-MoT

2026年9月15日
SenseTime 釋出了多模態模型 SenseNova-U1.5-8B-MoT

公司 SenseNova-U1.5-8B-MoT-SFT 推出了新的架構,專門用於處理視覺內容。該模型基於 Mixture-of-Tokens (MoT) 方法,並針對圖像生成和編輯任務進行了優化。

開發人員實現了 4K 解析度的輸出支持,這使得系統在具有相似數量參數的同類產品中脫穎而出。該模型具有 8 億 個參數,並經過了 SFT (Supervised Fine-Tuning) 階段,以提高用戶創建圖形時遵循指令的準確性。

模型的技術實現允許將其用作原生多模態系統,能夠處理複雜的視覺請求。模型的權重和部署文檔已在 Hugging Face 平台上公開發布,可供下載。

MoT 架構的集成允許在處理視覺令牌時更有效地分配計算資源。這個解決方案旨在降低生成高解析度圖像的延遲時間,同时保持模型的緊湊大小,以便在專用設備上進行本地運行。

新的版本擴展了生成內容工具的生態系統,為開發人員提供了一個靈活的工具,以便在第三方應用程序中嵌入圖像編輯功能。模型的原始碼和權重以供研究和應用目的發布。

mozgi.io — AI 工具與提示
已複製