街坊秀 街坊秀

当前位置: 首页 » 街坊资讯 »

商汤SenseNova U1.5 Lite正式开源:AI生图就此告别「抽卡」

  炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会!

(来源:雷科技)

以后用AI做图改图,再也不用「抽卡」赌概率了。

2026年8月21日,商汤科技正式开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite(U1.5 Lite)。就雷科技的体验来说,SenseNova U1.5 Lite 在上下文长度、画面风格和文字理解方面都有着相当显著的提升,就连画布大小也支持到了原生 4K。

大家都知道,提示词生图时,提示词越准确、完善,生成出来的图片就越符合我们的预期。但在创作大型图片时,不少模型都「吃不下」太长的提示词。中途让AI对图片进行二次编辑时,模型也容易因上下文超限而崩溃。

那么 SenseNova U1.5 Lite 又是怎么解决这个问题的呢?首先在上下文长度上,U1.5 Lite 原生支持 3-4K 超长上下文,即使面对超长提示词和多次修改,同样能控制画面元素的一致性。

举个例子:过几天雷科技要去德国参加 IFA 报道,我先让 SenseNova U1.5 Lite 输出一张手绘风格的柏林观光指南。

图片来源:雷科技

在同一个对话中把带文字的图片交还给 U1.5 Lite,并要求它将图中的文字翻译成中文。将结果并排对比,除了少数本身分辨率就不够高的文字外,原始图片的风格、插图甚至是字体风格都得到了保留。

图片来源:雷科技

另外 SenseNova U1.5 Lite 还有一个我非常喜欢的特性:区域修改。之前雷科技曾让AI按照同一个图片模板输出不同企业 IPO 信息的卡片,但没做几张后AI就开始不听使唤了,时常把局部修改意见应用到整张图片上。

至于 SenseNova U1.5 Lite,我们甚至可以直接在图片上标记要修改的地方,而模型也会按照「约定」只修改指定区域。

原始图片

图片来源:商汤

修改后图片

图片来源:雷科技

当然了,这种大上下文窗口和保留原始信息的能力,也为 SenseNova U1.5 Lite 带来了很多新的用法,比如在保留原始图片信息的情况下利用多张图片进行合成。而就雷科技的体验来说,U1.5 Lite 在长指令和精准编辑上的表现相当能打。

也正因如此,在雷科技看来,商汤决定开源 SenseNova U1.5 Lite,也从另一个角度印证了AI已经走出了曾经的「小打小闹」,开始投身真正工作场景的观点。过去我们「抗拒」在真实工作中使用AI,担心的无非还是AI的不可控性。如果你玩过早期 Stable Diffusion,对文生图的「蛮荒时代」一定不会陌生:即使用上 ComfyUI,最终的成果也有一定的不确定性。

而 U1.5 Lite 这类模型的出现,意味着AI生图已经不是过去那种「抽卡」的玩法。一个拥有可靠、稳定生图、改图能力的开源模型,将显著降低AI制图的门槛,这对创作者和小团队可谓意义非凡。在开源模型的赛道,商汤已经领跑行业,接下来,就看同行怎么接招了。

未经允许不得转载: 街坊秀 » 商汤SenseNova U1.5 Lite正式开源:AI生图就此告别「抽卡」