随着具身智能趋势的演进,
商汤科技开源日日新 SenseNova U1,实现多模态原生统一架构

发布于AI新闻资讯
发布时间 :2026年4月29号 9:57
阅读 :1分钟

随着具身智能趋势的演进,
商汤科技面向社区开源轻量统一多模态模型SenseNova U1.5-Lite-Preview。该模型基于U1系统性迭代,在单一架构中融合视觉理解、推理、生成与编辑四大能力,仅以8B-MoE参数即支持4K分辨率、更真实质感与复杂视觉控制。商汤称U1验证了统一架构可行性,U1.5则实现了轻量高性能的突破。
商汤开源轻量级多模态模型SenseNova U1.5-Lite-Preview,采用8B-MoT参数和NEO-unify架构,支持原生4K图像生成、精细纹理、精准中英文字生成及稳定图像编辑。该模型重点提升长篇自然语言与结构化视觉指令理解,实现复杂需求下的精准多模态生成。
商汤科技开源多任务视觉模型SenseNova-Vision-7B-MoT,集成目标检测、OCR、深度估计、法线估计、图像分割与多视图处理等核心视觉任务于7B参数单一架构,为视觉理解及GUI智能体开发提供高效基座。
商汤发布并开源“日日新SenseNova-Vision”视觉大模型,核心是将视觉能力原生融入通用基础模型,打破传统将检测、分割等专家模型打包的割裂模式。该模型以单模型在多项评测中实现了四大领域的性能碾压,标志着视觉任务向统一原生架构的关键升级。
大模型竞争转向智能体,商汤正研发业内首个原生全模态智能体基座,集成“理解、生成、行动”统一内核,直接对标GPT-Image 2,推动AI从被动问答向主动执行的突破。