先看一个真实案例:一张只有简单线条、栏目框架和流程箭头的手绘草图,交给 AI 之后,直接变成了一张符合商业出版标准的”深海潜水装备流程”高精海报——模型不仅认出了草图里的氧气瓶、面镜、潜水电脑表,还保留了”装备总览、功能详解、下潜前检查、安全下潜流程、下潜后检查”五个板块结构,并自动为每个栏目补充了图片、图标和说明文字。完成这件事的,是商汤 8 月 3 日刚刚开源的轻量级多模态模型 SenseNova U1.5-Lite-Preview。对完全不会设计的普通人来说,这可能是今年最友好的 AI 做图工具之一,而且免费。

U1.5 是什么:一个”能看懂图、也能画图”的统一模型

先解释两个容易混淆的点。第一,商汤的 SenseNova U1 系列今年 4 月就已经发布过,今天的主角是它的系统性迭代版本 U1.5-Lite-Preview,8 月 3 日才正式开源,是全新版本;第二,它不是”又一个文生图工具”,而是基于商汤自研的 NEO-Unify 架构、把”理解”和”生成”统一在一个模型里的多模态模型——既看得懂图,也画得出图。

传统多模态模型通常走”拼接”路线:一个模块负责看、一个模块负责翻译成文字、一个模块负责推理、还有一个模块负责出图,信息在各模块之间来回传递,既慢又容易丢失细节。NEO-Unify 架构则去掉了视觉编码器和中间转换环节,把语言和视觉作为统一信息直接建模——打个比方,传统方案像”一群说不同语言的人接力干活”,U1.5 像”一个全能大脑直接处理所有信息”,因此能以更小的模型规模实现更强的能力。

核心能力:8B 轻量模型,原生 4K 出图

SenseNova U1.5-Lite-Preview 的体量只有 8B-MoT 参数,却支持原生 4K 图像生成,并且官方强调在中英文文字生成、复杂版式组织上有显著提升——这正是 AI 生图长期以来的痛点:以前让 AI 在图上写中文,十个字能错一半,版式也经常乱;U1.5 在信息密集的海报、信息图场景中能稳定输出,文字排版相对可控。

从评测数据看,U1.5-Lite-Preview 的 Qwen-Image-Bench 得分从上一代 U1 的 47.14 大幅提升到 55.20;在衡量图像编辑能力的 GEdit-Bench 测试中,英文项 8.17 分、中文项 8.05 分,均超过了多款参数规模更大的开源及闭源模型。商汤表示,U1.5 能在较小模型规模下兼顾生成质量和交互能力,进一步降低多模态 AI 的应用门槛。

对普通用户最有用的三个玩法

官方演示和媒体报道里,有三个场景最适合普通人直接上手:

  • 手绘草图变海报:画个草稿、拍照上传,模型自动补全结构、配色、图标和文字,几分钟内得到一张接近成品的海报。这是零基础用户最容易获得成就感的玩法;
  • 信息图与图文长图:把一段教程、一个流程、一份攻略交给模型,生成带清晰版式的信息图、步骤流程图,适合做知识科普内容、课程配图;
  • 参考图风格化创作:支持参考图风格迁移、多参考图组合编辑,能把一张图的风格应用到另一张图上,也能把几张图合成一张,让 AI 出图从”一次抽卡”变成”持续迭代修改”。

对副业党来说,这意味着海报设计、公众号配图、小红书封面、教程长图这类高频需求,可以从”求设计师帮忙”变成”自己用 AI 搞定”,节省的是真金白银的设计外包成本。

怎么获取与部署:开源免费,门槛不高

SenseNova U1.5-Lite-Preview 目前已在 GitHub、Hugging Face 以及魔搭社区(ModelScope)开放下载,开发者和研究者可以免费获取、基于它进行二次开发。8B 参数量意味着它对部署硬件的要求相对友好,有条件的个人开发者可以在自己的电脑上尝试本地部署;完全不懂技术的普通用户,则可以等待商汤生态里的消费级应用(如面向办公场景的 AI 助手)逐步接入该模型的能力。

需要说明的是,商汤目前正式开源的预览版本主打”轻量+免费+可部署”,而面向专业创作者和企业用户的交付级创作模型 SenseNova U1 Pro 正处于紧密邀测阶段,追求更高成品质量的用户后续可以关注。

零基础做设计这件事,以前是门槛,现在更像是一个”会不会用工具”的问题。你最近有没有想做的海报、封面或长图?想不想试一下手绘草图变海报这个玩法?评论区告诉我们,下一篇可以出详细的上手教程。


数据来源:IT之家(2026-08-03)、《36氪·智东西》报道(2026-08-04)、品玩(2026-08-03)、商汤官方开源仓库(github.com/OpenSenseNova/SenseNova-U1)。评测数据来自商汤官方公布口径。