商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 大模型范式里程碑!商汤科技旗舰级SenseNova U1 Pro正式发布:从“内容生成”走向“系统级交付”

大模型范式里程碑!商汤科技旗舰级SenseNova U1 Pro正式发布:从“内容生成”走向“系统级交付”

  发布于2026-08-02 阅读(0)

扫一扫,手机访问

2026世界人工智能大会(WAIC)刚刚开幕,商汤科技就扔出了一枚重磅冲击波——正式发布大模型家族的新旗舰:SenseNova U1 Pro(以下简称U1 Pro)。

作为“日日新 SenseNova U”系列的旗舰版本,U1 Pro的定位非常明确:面向长程任务的交付级原生多模态智能体基座。简单说,它把理解、生成和行动深度统一在了一起。更关键的是,基于原生统一架构,U1 Pro在视觉创作领域做了深度迭代,具备了直接对标全球顶尖模型的“交付级”复杂图片创作能力。这意味着,多模态AI正在经历一场深刻的长程演进——行业正式告别传统的“单点式内容生成”,全面迈向能够闭环完成复杂、长程任务的“系统级内容交付”新时代。

多模态演进第三阶段:攻克“抽卡”痛点,定义“交付级”新标准

先来聊聊多模态领域的演进路径。就像代码产品已经走通了“从Copilot工具辅助,到Vibe Coding意图驱动,再到Agentic Coding系统级任务交付”的路径一样,多模态产品也在经历相似的长程演进:第一阶段解决“真实感生成”的问题;第二阶段能够以自然语言交互,并持续修改,实现多模态创作进阶;而第三阶段,则是在真实场景中直接完成“交付级”创作,完美兼顾设计美感和内容精准,彻底解决反复抽卡的困境。

不过,能交互,不等于能交付。旗舰版SenseNova U1 Pro围绕“一个复杂目标,持续理解、规划、执行、检查和修正”,带来了四大核心交付能力:

首先,巅峰设计美感,告别“AI味”。图像生成从“细节逼真”推进到了“专业设计美感”的全新阶段,作品具备极强的构图、色彩与排版美学,直接实现专业交付品质。其次,原生8K超清输出,最高支持8K原生分辨率,轻松驾驭高信息密度的超长、超大图创作。画幅放大后,文字、线条、图标和模块关系仍然清晰稳定,经得起印刷、展览级的细节检验。第三,极致的图文与细节控制。大幅加强了图文信息整合分析能力,在极高信息密度下,U1 Pro仍能维持整体版式与内容表达,文字渲染出错率极低。最后,长程Agentic闭环思维。基于统一基座内生的理解、生成和行动能力,支持长程图文交错思维,能够围绕复杂目标进行数十轮的Agentic Generation Loop。最新版本中,还进一步实现了整体风格与局部文本的同步精准可控编辑,让交付结果可被持续修改与使用。

技术基石:NEO-unify架构与原生视觉底座的深度融合

SenseNova U1 Pro之所以能突破“生成”边界、走向“稳定交付”,底层核心得益于NEO-unify内核架构。它在原生多模态体系中实现了语言和视觉的统一表征,打破了理解与生成的割裂壁垒。

今年4月,商汤开源了基础模型SenseNova U1。开源两个多月以来,在真实高强度工作流实践中,U1迎来了爆发式增长。今年6月,U1的用户人均日生图量相比5月提升近3倍,表明模型已经深度切入真实应用工作流。截至7月中旬,SenseNova U1以及集成了U1能力的SenseNova-Skills代码库在GitHub的总Star数突破8000。

同时,商汤开源的SenseNova-Vision统一视觉大模型,基于原生统一架构,让经典视觉任务如实例分割、目标检测等,直接成为通用大模型的原生能力,告别了传统“多专家模型拼凑”的局限。商汤在视觉AI领域十余年的技术沉淀,也为多模态长程智能体提供了坚实的世界理解底座。

超稠密物体分割:重叠鱼群各显其形

看穿镜面反射:正确还原空间几何

零样本泛化:未知游戏“一秒读懂”

突破视觉错觉:不看表象,洞察空间本质

真实物理世界大考:高难度场景实战检验

在考验其面向复杂多模态任务的“系统级交付”实力时,SenseNova U1 Pro在美学叙事、逻辑控制以及硬核数据推理三大高难度场景,交出了惊艳的答卷。

首先是高信息密度视觉叙事——WAIC九周年《智会世图》东方山水长卷。U1 Pro最终交付了一幅4:1超宽画幅的宣纸水墨风东方美学长卷,图中包含丰富的河流、山脉、城市地标与高密度小字信息。远看具备统一的视觉叙事,放大后大量文字、图标等设计细节完美支撑,自然连接起2018至2026年跨越九年的世界人工智能大会发展历程。

WAIC九周年(2018-2026)水墨长卷全景,及部分局部细节图。

其次是可控视频创作:《沙影之刃》世界观设定与22镜分镜。在复杂视频创作任务中,模型不再只是依靠随机抽卡拼凑镜头,而是率先自主规划并生成了包含剧情世界观、主角与敌人人设、服装武器、沙漠环境色调在内的整体视觉蓝图,并一次性输出多达22个逻辑一致的连续分镜。在此基础上,配合商汤视频工具,实现了人物、剧情和视觉语言的高度可控交付。

《沙影之刃》世界观设定&22镜分镜总览

最后是硬核逻辑推理与复杂交付:世界杯黑马预测与决赛全景复盘。商汤“小浣熊”依托专属Skills进行持续分析,在2026年世界杯开赛前一个月,成功预测本届最大黑马——佛得角出线,在12家参与预测的大模型中高居第二。同时,U1 Pro展现了极强的“数据向视觉转化”能力。它能将复杂的体育战术及数据——如世界杯决赛双方的晋级路径、核心球员对位、战术体系、传球网络及触球热力图等高密度推理结果融会贯通,自主生成一张高清的可视化图表报告,完整闭环了“信息搜集-分析推理-复杂视觉交付”的全流程。

赋能生产力底座:重塑个人、组织与企业单元

作为一个极具通用性的多模态基座,SenseNova U1 Pro正在重塑办公、电商、教育等每一个生产单元。商业与办公领域,可以实现企业信息图、高品质商业演示文稿的自动化与精准交付;品牌与电商领域,可以完成商业海报、产品宣传视觉的专业级美学输出;教育与出版领域,能够实现高精度科学图解、教学用图像的无错漏绘制;创意内容创作领域,则能进行电影影视概念设计、动漫分镜脚本等数字艺术创作,大幅缩短创意与专业制作之间的距离。

这些能力在商汤旗下的产业级AI“小浣熊”及视频创作工具“Seko”中已经得到深度验证,帮助数以千万计的个人用户、接近一万家企业用户以及大批AI原生组织,将自身经验、兴趣和创意转化为可规模化复用的真实交付成果。

即日起,商汤科技SenseNova U1 Pro的预览版本已正式邀请测试,并将随着推理服务资源扩大逐步放开邀测范围。模型的正式版本将在今年8月份正式上线对公众开放服务,届时相应的定价和API服务也将同步推出。

可以确定的是,在“理解、生成、行动”原生统一架构下,“视觉和语言的联合涌现”将加速实现,最终为物理世界的AGI构建全新的通用智能底座。

本文转载于:https://www.163.com/dy/article/L25D8M1H0531LTUZ.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注