商汤开源SenseNova U1.5-Lite-Preview,原生统一多模态能力再进阶
原标题:原生统一多模态进阶!SenseNova U1.5-Lite-Preview开源,生成编辑能力再进化
AI 摘要
商汤科技发布了SenseNova U1.5-Lite-Preview,这是基于NEO-Unify架构的原生统一多模态模型的预览版本,以8B-MoT轻量级规模支持4K图像生成、精细编辑和复杂视觉指令遵循。该模型在多个评测基准上显著超越前代U1,并已开源至GitHub、Hugging Face和魔搭社区。商汤表示,U1.5验证了统一架构能力的可持续扩展,并计划近期开放面向专业用户的U1 Pro。
正文节选
0 今年4月,商汤科技发布了SenseNova U1,首次完整展示了基于NEO-Unify架构的原生统一多模态路线:在单一模型中联合建模语言、视觉语义与像素生成,让模型能够原生完成视觉理解、推理和生成。 过去几个月中,我们持续强化模型的图像生成与编辑能力,现面向社区开源轻量级统一多模态模型的预览版本SenseNova U1.5-Lite-Preview。SenseNova U1.5-Lite-Preview并非简单的模型规模升级,而是基于U1的一次系统性迭代,不仅在同一架构中贯通视觉理解、推理、生成与编辑,还仅以 8B-MoT 的轻量大小,将能力推进到4K、更精细的真实质感、更复杂的视觉控制和可持续迭代编辑。 SenseNova U1.5-Lite-Preview 生成 相比U1,U1.5-Lite-Preview在以下方向上带来了显著提升: ▪ 原生支持4K图像生成; ▪ 更精细的局部纹理、细节与真实世界质感; ▪ 更准确的中英文文字生成与复杂版式组织; ▪ 更稳定的图像编辑和视觉指令遵循; 如果说U1成功验证了“统一架构是否可行”,证明了从像素和语言出发、端到端构建原生统一多模态模