在2026世界人工智能大会(WAIC)上,商汤科技正式推出其大模型家族的旗舰新品——SenseNova U1 Pro(以下简称U1 Pro)。这款产品作为“日日新 SenseNova U”系列的顶级版本,致力于成为面向长程任务的交付级原生多模态智能体基座,实现了理解、生成和行动的深度统一。U1 Pro的问世,标志着多模态人工智能正迈入一个全新的发展阶段,行业从传统的“单点式内容生成”向能够闭环完成复杂任务的“系统级内容交付”时代转变。
U1 Pro在原生统一架构的基础上,通过在视觉创作领域的深度迭代,具备了媲美全球顶尖模型的“交付级”复杂图片创作能力。其核心优势在于能够围绕一个复杂目标,持续进行理解、规划、执行、检查和修正,从而带来四大核心交付能力:巅峰设计美感、原生8K超清输出、极致的图文与细节控制,以及长程Agentic闭环思维。这些能力使U1 Pro在图像生成领域从“细节逼真”推进到“专业设计美感”的新阶段,作品具备极强的构图、色彩与排版美学,可直接实现专业交付品质。
U1 Pro的技术基石在于NEO-unify架构与原生视觉底座的深度融合。这一架构在原生多模态体系中实现了语言和视觉的统一表征,打破了理解与生成的割裂壁垒,使模型能够突破“生成”边界,走向“稳定交付”。商汤在视觉AI领域十余年的技术沉淀,也为多模态长程智能体提供了坚实的世界理解底座。基于原生统一架构的SenseNova-Vision统一视觉大模型,让经典视觉任务如实例分割、目标检测等直接成为通用大模型的原生能力,告别了传统“多专家模型拼凑”的局限。
在真实场景的高难度考验中,U1 Pro展现了其面向复杂多模态任务的“系统级交付”实力。例如,在WAIC九周年《智会世图》东方山水长卷项目中,U1 Pro交付了一幅4:1超宽画幅的宣纸水墨风东方美学长卷。图中包含丰富的河流、山脉、城市地标与高密度小字信息,远看具备“统一视觉叙事”,放大后大量文字、图标等设计细节完美支撑,自然连接起2018至2026年跨越九年的世界人工智能大会发展历程。在可控视频创作任务中,U1 Pro自主规划并生成了包含剧情世界观、主角与敌人人设、服装武器、沙漠环境色调在内的整体视觉蓝图,并一次性输出多达22个逻辑一致的连续分镜,实现了人物、剧情和视觉语言的高度可控交付。
作为一个极具通用性的多模态基座,U1 Pro正在重塑办公、电商、教育等各个生产单元。在商业与办公领域,它可实现企业信息图、高品质商业演示文稿的自动化与精准交付;在品牌与电商领域,能够输出商业海报、产品宣传视觉的专业级美学作品;在教育与出版领域,可绘制高精度科学图解、教学用图像的无错漏作品;在创意内容创作领域,则大幅缩短了电影影视概念设计、动漫分镜脚本等数字艺术创作的周期。这些能力已在商汤旗下的产业级AI“小浣熊”及视频创作工具“Seko”中得到深度验证,帮助数以千万计的个人用户、近万家企业用户以及大批AI原生组织将创意转化为可规模化复用的真实交付成果。
目前,商汤科技已正式邀请测试U1 Pro的预览版本,并将随着推理服务资源的扩大逐步放开邀测范围。模型的正式版本计划于今年8月上线,届时将同步推出相应的定价和API服务。这一举措有望为物理世界的AGI构建全新的通用智能底座,推动“视觉和语言的联合涌现”加速实现。

