商汤SenseNova U1.5 Lite正式开源:AI制图终于进入新时代
创始人
2026-08-21 17:54:49

以后用AI做图改图,再也不用「抽卡」赌概率了。

2026年8月21日,商汤科技正式开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite(U1.5 Lite)。就雷科技的体验来说,SenseNova U1.5 Lite 在上下文长度、画面风格和文字理解方面都有着相当显著的提升,就连画布大小也支持到了原生 4K。

大家都知道,提示词生图时,提示词越准确、完善,生成出来的图片就越符合我们的预期。但在创作大型图片时,不少模型都「吃不下」太长的提示词。中途让AI对图片进行二次编辑时,模型也容易因上下文超限而崩溃。

那么 SenseNova U1.5 Lite 又是怎么解决这个问题的呢?首先在上下文长度上,U1.5 Lite 原生支持 3-4K 超长上下文,即使面对超长提示词和多次修改,同样能控制画面元素的一致性。

举个例子:过几天雷科技要去德国参加 IFA 报道,我先让 SenseNova U1.5 Lite 输出一张手绘风格的柏林观光指南。

图片来源:雷科技

在同一个对话中把带文字的图片交还给 U1.5 Lite,并要求它将图中的文字翻译成中文。将结果并排对比,除了少数本身分辨率就不够高的文字外,原始图片的风格、插图甚至是字体风格都得到了保留。

图片来源:雷科技

另外 SenseNova U1.5 Lite 还有一个我非常喜欢的特性:区域修改。之前雷科技曾让AI按照同一个图片模板输出不同企业 IPO 信息的卡片,但没做几张后AI就开始不听使唤了,时常把局部修改意见应用到整张图片上。

至于 SenseNova U1.5 Lite,我们甚至可以直接在图片上标记要修改的地方,而模型也会按照「约定」只修改指定区域。

原始图片

图片来源:商汤

修改后图片

图片来源:雷科技

当然了,这种大上下文窗口和保留原始信息的能力,也为 SenseNova U1.5 Lite 带来了很多新的用法,比如在保留原始图片信息的情况下利用多张图片进行合成。而就雷科技的体验来说,U1.5 Lite 在长指令和精准编辑上的表现相当能打。

也正因如此,在雷科技看来,商汤决定开源 SenseNova U1.5 Lite,也从另一个角度印证了AI已经走出了曾经的「小打小闹」,开始投身真正工作场景的观点。过去我们「抗拒」在真实工作中使用AI,担心的无非还是AI的不可控性。如果你玩过早期 Stable Diffusion,对文生图的「蛮荒时代」一定不会陌生:即使用上 ComfyUI,最终的成果也有一定的不确定性。

而 U1.5 Lite 这类模型的出现,意味着AI生图已经不是过去那种「抽卡」的玩法。一个拥有可靠、稳定生图、改图能力的开源模型,将显著降低AI制图的门槛,这对创作者和小团队可谓意义非凡。在开源模型的赛道,商汤已经领跑行业,接下来,就看同行怎么接招了。

机器人产业最重要风向标,世界机器人大会(WRC)2026重磅来袭,还有世界人形机器人运动会紧随其后。

宇树、智元、启元、魔法原子、银河通用、云深处、灵心巧手等300余家TOP展商联袂呈现,定义全球机器人产业未来!

所有关于机器人的核心问题,WRC都将给出答案。

雷科技WRC 2026报道团已抵达WRC现场。

相关内容

热门资讯

华硕组建AI LAB团队 上调... 观点网讯:8月21日,华硕宣布组建数十人的专属AI LAB团队,用于AI服务器的验证与开发,并将其今...
原创 华... 里蹦岛的海风,裹挟着青春的气息和躁动的音符,将这个小小的海边音乐营地推上了风口浪尖。两年前的日出演唱...
热点追踪|这个暑假,“入境游”... “我们选了桂林、阳朔、龙脊梯田这条路线,在旅游App上订了机票、酒店和漓江游船票。”来自意大利罗马的...