商汤科技开源轻量级多模态模型 SenseNova U1.5-Lite-Preview
商汤科技近日宣布开源旗下轻量级统一多模态模型预览版 SenseNova U1.5-Lite-Preview。该模型是 SenseNova U1 的系统性迭代版本,基于 NEO-unify 架构,在仅 8B-MoT 参数规模下,实现了原生 4K 图像生成、更细致的纹理表现、更精准的中英文文字生成,以及更稳定的图像编辑能力。
据悉,SenseNova U1.5-Lite-Preview 重点提升了模型对长篇自然语言描述和结构化视觉指令的理解能力,能够根据复杂需求实现更精准的视觉控制。在图像编辑方面,新模型支持参考图风格迁移、多参考图组合编辑以及交互式精准调整,推动 AI 图像创作从一次性生成向持续迭代优化转变。
与上一代模型相比,U1.5-Lite-Preview 在多项评测基准中均有提升。商汤方面表示,该模型能够在较小参数规模下兼顾生成质量与交互能力,进一步降低多模态 AI 技术的应用门槛。
目前,SenseNova U1.5-Lite-Preview 已在 GitHub、Hugging Face 及魔搭社区开放下载,开发者和研究者可基于该模型进行二次开发。与此同时,面向专业创作者和企业用户的交付级创作模型 SenseNova U1Pro 正处于紧密邀测阶段。
当前,多模态模型的竞争焦点正逐渐从参数规模转向效率、控制能力与实际应用体验。商汤此次开源轻量化模型,也体现了行业推动高性能 AI 能力向更广泛开发者生态开放的趋势。