雷科技 AI 硬件组 | 编辑:天星 | 监制:罗超
以后用 AI 做图改图,再也不用「抽卡」赌概率了。
2026 年 8 月 21 日,商汤科技正式开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite(U1.5 Lite)。就雷科技的体验来说,SenseNova U1.5 Lite 在上下文长度、画面风格和文字理解方面都有着相当显著的提升,就连画布大小也支持到了原生 4K。
大家都知道,提示词生图时,提示词越准确、完善,生成出来的图片就越符合我们的预期。但在创作大型图片时,不少模型都「吃不下」太长的提示词。中途让 AI 对图片进行二次编辑时,模型也容易因上下文超限而崩溃。
那么 SenseNova U1.5 Lite 又是怎么解决这个问题的呢?首先在上下文长度上,U1.5 Lite 原生支持 3-4K 超长上下文,即使面对超长提示词和多次修改,同样能控制画面元素的一致性。
举个例子:过几天雷科技要去德国参加 IFA 报道,我先让 SenseNova U1.5 Lite 输出一张手绘风格的柏林观光指南。

在同一个对话中把带文字的图片交还给 U1.5 Lite,并要求它将图中的文字翻译成中文。将结果并排对比,除了少数本身分辨率就不够高的文字外,原始图片的风格、插图甚至是字体风格都得到了保留。

至于 SenseNova U1.5 Lite,我们甚至可以直接在图片上标记要修改的地方,而模型也会按照「约定」只修改指定区域。

图片来源:商汤

当然了,这种大上下文窗口和保留原始信息的能力,也为 SenseNova U1.5 Lite 带来了很多新的用法,比如在保留原始图片信息的情况下利用多张图片进行合成。而就雷科技的体验来说,U1.5 Lite 在长指令和精准编辑上的表现相当能打。
也正因如此,在雷科技看来,商汤决定开源 SenseNova U1.5 Lite,也从另一个角度印证了AI 已经走出了曾经的「小打小闹」,开始投身真正工作场景的观点。过去我们「抗拒」在真实工作中使用 AI,担心的无非还是 AI 的不可控性。如果你玩过早期 Stable Diffusion,对文生图的「蛮荒时代」一定不会陌生:即使用上 ComfyUI,最终的成果也有一定的不确定性。
而 U1.5 Lite 这类模型的出现,意味着 AI 生图已经不是过去那种「抽卡」的玩法。一个拥有可靠、稳定生图、改图能力的开源模型,将显著降低 AI 制图的门槛,这对创作者和小团队可谓意义非凡。在开源模型的赛道,商汤已经领跑行业,接下来,就看同行怎么接招了。

扫码免费加入
「一起 AI」社群,一起拥抱 AI 大时代。