商汤开源8B多模态模型SenseNova U1.5 Lite,支持4K图像输出
商汤科技于8月21日宣布开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite。该模型原生支持3-4k上下文长度,能同时处理主体、数量、空间关系、文字、布局、风格等多重约束,提升复杂视觉任务的执行稳定性。

SenseNova U1.5 Lite 具备以下特点:
- 更高质量的视觉生成:改善整体构图、色彩、材质、光影、真实感和局部细节,减少“局部正确但整体完成度不足”的情况。
- 更可靠的原生图像编辑:增强主体身份、空间结构、版式关系和非编辑区域的保持,同时提升局部修改、元素替换、文字精修和多参考图编辑能力。
- 更好的文字与复杂布局:加强中英文文字、海报、信息图、品牌视觉及多文本排版能力,从“生成内容”进一步走向“组织完整视觉表达”。

- 更精细的视觉控制:支持 Bounding Box、Visual Marker 以及单图、多图参考等方式,对指定区域和对象进行更准确的编辑。
- 原生 4K 高分辨率输出:在高分辨率生成中兼顾整体构图与极精细的肌理、微小文字与光影折射。
官方表示,作为 8B 参数的轻量化模型,SenseNova U1.5 Lite 在指令遵循与图像编辑保持度上超越了同量级模型,并在文字渲染与复杂布局上达到了媲美超大规模商业模型的交付水平。


模型已开源至 GitHub、Hugging Face 和魔搭社区,相关链接如下:
本文图片来自互联网,仅供学习交流使用,版权归原作者或原平台所有。如认为图片侵犯了您的权益,请联系我们删除。

