AI消息速览

商汤开源SenseNova U1.5 Lite,支持超长指令与4K

事件日期 2026-08-24 · 产业观察 · 已接受

事件日期2026-08-24
信息日期2026-08-24
入库日期2026-08-24
通道产业观察
状态已接受
来源腾讯研究院(搜狐同步)

知识卡片:商汤开源SenseNova U1.5 Lite,支持超长指令与4K

英文标题(译): SenseTime Open-Sources SenseNova U1.5 Lite, Supporting Ultra-Long Instructions and 4K

英文关键词: SenseNova U1.5 Lite; SenseTime; open source; unified multimodal model; NEO-Unify; MOPD; native 4K; image editing

原始来源: 腾讯研究院AI速递(2026-08-24);https://m.sohu.com/a/1066618305_455313

一句话结论

商汤开源轻量级原生统一多模态模型 SenseNova U1.5 Lite,以8B参数规模支持3-4k字符超长复杂指令、原生4K输出与图像编辑;据材料口径,该模型在指令遵循和图像编辑保持度上超过同量级模型,且可单卡运行,兼顾性能与部署成本。

事件概述

商汤开源 SenseNova U1.5 Lite,定位为轻量级原生统一多模态模型的“正式版”,聚焦真实视觉创作交付。模型原生支持超长复杂指令、4K输出与图像编辑,并已在 GitHub、Hugging Face、魔搭社区全球开源。

方法/产品要点

  • 产品:SenseNova U1.5 Lite,轻量级原生统一多模态模型,正式版聚焦真实视觉创作交付。
  • 架构:基于 NEO-unify 统一架构,将多专家能力无损融合至单体 8B 模型。
  • 蒸馏:采用 MOPD 多专家蒸馏,避免多专家路由带来的额外开销。
  • 部署:单卡可运行,无须 Router 切换,兼顾语义理解与像素生成,降低成本和延迟。
  • 能力:原生支持 3-4k 字符超长复杂指令,强化视觉质量、原生4K输出与图像编辑。

主要结果或产业意义

  • 按材料口径,仅 8B 参数即在指令遵循、图像编辑保持度上超越同量级模型。
  • 材料称其文字渲染与复杂布局表现可媲美超大商业模型。
  • 产业意义:轻量级开源多模态模型有望降低创作者工具、图像编辑和复杂视觉生成任务的使用门槛;单卡运行能力也让中小团队更容易部署。

为什么重要(含与既有脉络的关系)

这是对已有“商汤开源SenseNova U1.5-Lite-Preview”知识卡片的后续更新。增量信息包括:版本从 Preview 走向“正式版”,补充了“支持3-4k字符超长复杂指令”、MOPD 多专家蒸馏,以及“单卡运行、无须 Router 切换”的部署特点。整体上,它代表中国厂商在多模态模型领域继续走“开源 + 轻量 + 强指令遵循”的路线。

局限与不确定性

  • 材料未给出可复现的第三方评测基准,“超越同量级模型”“媲美超大商业模型”等说法待核实。
  • 正式版与 Preview 版的具体能力差异、训练数据规模、开源许可协议和商用条款未在材料中说明,待核实。
  • 单卡运行的显存需求、推理速度、实际图像编辑效果等具体部署参数待核实。

可用于图书/PPT/简报的角度

  • 从“多专家”到“单体8B”:MOPD 多专家蒸馏如何降低部署成本与延迟。
  • 单卡可运行的多模态模型,能否成为 AI 视觉创作的新基线。
  • 3-4k 字符超长指令对图像编辑的意义:从“生成一张图”到“按复杂指令完成视觉交付”。
  • 开源轻量化路线与商业闭源大模型之间的竞争格局。

原始材料

腾讯研究院AI速递(2026-08-24):“商汤开源SenseNova U1.5 Lite,支持超长指令与4K”。URL:https://m.sohu.com/a/1066618305_455313