随着具身智能趋势的演进,
商汤科技开源日日新 SenseNova U1,实现多模态原生统一架构

发布于AI新闻资讯
发布时间 :2026年4月29号 9:57
阅读 :1分钟

随着具身智能趋势的演进,
商汤开源8B轻量级统一多模态模型SenseNova U1.5Lite,核心视觉任务表现超越同级,部分复杂排版与文字渲染媲美大规模商业模型;原生支持3-4K上下文,可同时处理主体、数量、空间关系、文字、布局、风格等多重约束。
商汤科技面向社区开源轻量统一多模态模型SenseNova U1.5-Lite-Preview。该模型基于U1系统性迭代,在单一架构中融合视觉理解、推理、生成与编辑四大能力,仅以8B-MoE参数即支持4K分辨率、更真实质感与复杂视觉控制。商汤称U1验证了统一架构可行性,U1.5则实现了轻量高性能的突破。
商汤开源轻量级多模态模型SenseNova U1.5-Lite-Preview,采用8B-MoT参数和NEO-unify架构,支持原生4K图像生成、精细纹理、精准中英文字生成及稳定图像编辑。该模型重点提升长篇自然语言与结构化视觉指令理解,实现复杂需求下的精准多模态生成。
商汤科技开源多任务视觉模型SenseNova-Vision-7B-MoT,集成目标检测、OCR、深度估计、法线估计、图像分割与多视图处理等核心视觉任务于7B参数单一架构,为视觉理解及GUI智能体开发提供高效基座。
商汤发布并开源“日日新SenseNova-Vision”视觉大模型,核心是将视觉能力原生融入通用基础模型,打破传统将检测、分割等专家模型打包的割裂模式。该模型以单模型在多项评测中实现了四大领域的性能碾压,标志着视觉任务向统一原生架构的关键升级。