模型发布 · 多模态

SenseNova U1.5-Lite-Preview 开源:8B-MoT 统一图像理解、生成与精细编辑

量子位 · 2026-08-03 · 预计阅读 5 分钟

30 秒速览

商汤开源轻量统一多模态预览模型,在同一架构中覆盖视觉理解、原生 4K 生成、参考图复刻和局部文字编辑。

完整摘要

商汤发布并开源 SenseNova U1.5-Lite-Preview。模型沿用 NEO-Unify 原生统一多模态架构,把语言、视觉语义与像素生成放进同一系统,重点面向高信息密度海报、复杂长指令、参考图复刻、多图组合和局部精准编辑。媒体实测展示了 4K 输出、文字排版和基于标记位置修改图像的能力。

怎么做的 / 核心机制

模型采用约 8B-MoT 的轻量结构,在统一表征空间内联合处理文本、视觉语义和像素生成;编辑侧支持参考图、多图条件、红框、坐标或 marker 等显式定位信号。

关键结果 / 已披露进展

已披露能力包括原生 4K 输出、复杂结构化提示词理解、信息图文字与版式生成,以及局部文字和指定区域编辑。当前公开材料以厂商示例和媒体实测为主,尚缺统一第三方基准。

为什么值得看

统一多模态模型开始从“能理解也能画”进一步走向可进入真实创作流程的连续编辑,对设计、内容生产和多模态 Agent 都有直接价值。

局限与判断

这是 Preview 版本,展示案例可能经过挑选;4K 输出质量、中文小字稳定性、推理成本和与主流闭源模型的公平比较仍需独立评测。

SenseNova统一多模态图像生成图像编辑4KMoT

资料与核验

正文已由 AIA 完整中文整理;以下链接仅用于查看中文报道或核对一手材料。

原始标题:这个新生图模型有点夯:4K直出的,国产的,开源的!
编辑:GPT · 2026-08-03 · 质量评分 90/100