首页 / 资讯详情

SenseNova U1.5 Lite正式版发布:支持超长指令,解锁原生4K真实视觉创作流

雷锋网 2026-08-21 12:33 中文

摘要

今天,商汤科技正式开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite。与预览版(U1.5 Lite Preview)呈现的原生统一多模态模型能力相比,正式版更关注的是,这些能力能否更准确、更稳定地进入真实视觉创作流程。模型重点围绕真实视觉任务重新完善训练数据、任务设计与后训练流程,强化视觉质量、复杂指令遵循、文字与布局、原生4K、图像编辑和精细视觉控制等,提供更高可控性、更高清、更高性价比的能力工具,推动 AI 视觉生成真正跨越到“稳定完成真实视觉交付”的新阶段。目前模型已面向全球开源,开发者与创作者可直接部署体验。GitHub:https://github.com/OpenSenseNova/SenseNova-U1Hugging Face:https://huggingface.co/collections/sensenova/sensenova-u15 魔搭社区:https://modelscope.cn/models/SenseNova/SenseNova-U1.5-8B-MoTSenseNova Studio在线体验:https://unify.light-ai.top/ 更完整的视觉创作能力,告别AI创作瓶颈“精心写了 25 分钟的详细 Prompt,模型却只能解析 1k 字符,不得不花半小时删减细节”;“只想改掉图里的一只杯子,AI 却把背景和主角的脸一起换了”。 这些几乎是每个创作者都遇到过的“崩溃瞬间”。过往几年,行业往往把重点放在卷“画面美感”和“写实感”上;但在实际生产流程中,真正的核心问题是:模型能否精准执行你的完整意图?SenseNova U1.5 Lite 解决了这一难题:• 3-4k 字符超长复杂指令遵循:打破大多数开源模型在指令超过 1k 字符时易崩溃、遗漏细节的瓶颈。SenseNova U1.5 Lite 原生支持 3-4k 上下文长度,能够同时处理主体、数量、空间关系、文字、布局、风格等多重约束,提升复杂视觉任务的执行稳定性。• 更高质量的视觉生成:改善整体构图、色彩、材质、光影、真实感和局部细节,减少“局部正确但整体完成度不足”的情况。• 更可靠的原生图像编辑:增强主体身份、空间结构、版式关系和非编辑区域的保持,同时提升局部修改、元素替换、文字精修和多参考图编辑能力。• 更好的文字与复杂布局:加强中英文文字、海报、信息图、品牌视觉及多文本排版能力,从“生成内容”进一步走向“组织完整视觉表达”。• 更精细的视觉控制:支持 Bounding Box、Visual Marker 以及单图、多图参考等方式,对指定区域和对象进行更准确的编辑。• 原生4K高分辨率输出:在高分辨率生成中兼顾整体构图与极精细的肌理、微小文字与光影折射。实战演练:真实场景深度还原我们挑选了最能考验“硬实力”的创作场景,带你看 SenseNova U1.5 Lite 如何搞定真实交付。场景一:复杂视觉表达1、创意海报与封面生成:展现出极佳的美学完成度与高对比度质感。具备高精度的复杂布局能力,可精准掌控文字与留白节奏;在处理文字与物体的空间遮挡时,能够维持光影的自然连贯,充分展现了原生多模态对三维空间叠加关系的深刻理解。 2、高密度信息图生成:保证中英文、数据等丰富细节的准确无误;通过多层级结构化空间映射,完美串联各类标签和信息,实现了复杂信息可视化图表的高质量一次性交付。瑞士旅行攻略手绘地图滑板信息图馄饨制作指南3、高清细节与艺术质感:在建筑结构、人像肌理、艺术画作笔触等复杂场景中,展

阅读原文(雷锋网)→

本站为资讯聚合平台,仅展示标题与摘要,原文版权归原发布方所有;如有侵权请联系我们删除。