
凤凰网科技讯 8月21日,商汤科技宣布正式开源轻量级多模态大模型SenseNova U1.5 Lite正式版。相比预览版,正式版重点围绕真实视觉任务优化训练数据与后训练流程,强化了复杂指令遵循、原生图像编辑、文字布局与原生4K输出等能力,旨在让AI视觉生成从“能看”走向“稳定完成真实视觉交付”。

该模型采用8B参数架构,基于NEO-unify统一框架,通过多专家在线策略蒸馏技术将多专家能力融合至单体模型,支持单卡流畅运行。核心能力包括:原生支持3-4k字符超长指令遵循,打破多数开源模型在1k字符以上易崩溃的瓶颈;增强主体身份保持与局部修改能力;强化中英文文字与复杂海报布局;支持Bounding Box与多图参考等精细控制;支持原生4K高分辨率输出。
在实测场景中,模型在创意海报、高密度信息图、艺术质感生成、多参考图融合、局部编辑及文字替换等任务中展现了可控性。商汤表示,该模型已面向全球开源,开发者和创作者可在GitHub、Hugging Face及魔搭社区部署体验,并在SenseNova Studio在线体验。商汤称,此举旨在为全球开发者提供“轻量、统一、高性价比且高可控”的AI视觉生产力工具。