直击WAIC|商汤科技多模态AI模型升级 瞄准长程任务系统交付
中国经营报
中经记者 曲忠芳 北京报道
7月18日,商汤科技在2026世界人工智能大会(WAIC)上发布多模态模型SenseNova U1 Pro。该模型主要面向耗时较长、步骤较多的任务,可以在理解用户要求后,继续完成规划、生成、检查和修改,重点服务图片、长图、分镜和商业视觉内容制作等需求的“系统级交付”。
据商汤科技方面介绍,U1 Pro采用NEO-unify架构,将语言理解和视觉生成放在同一套模型中。与一次生成一张图片相比,这一模型可以围绕同一个目标持续工作,根据反馈修改整体风格、局部文字和画面细节。模型最高支持8K原生分辨率输出,并加强了文字、线条、图标和版式的处理能力。商汤科技希望借此减少使用者反复生成、挑选图片和人工返工的时间。
在大会现场,商汤科技展示了几个应用案例。U1 Pro制作了一幅4∶1比例的水墨长卷,将2018年至2026年世界人工智能大会的发展历程放入同一画面;在《沙影之刃》创作案例中,模型完成了故事背景、人物和场景设定,并生成22个连续分镜。它还可以把比赛数据、球队战术、传球网络等内容整理成可视化报告。商汤科技称,这些能力可用于企业信息图、演示文稿、电商海报、教学图解、影视概念设计和动漫分镜等工作。
就在今年4月,商汤科技开源基础模型SenseNova U1,该公司提供的数据显示,截至7月中旬,SenseNova U1及相关SenseNova-Skills代码库在GitHub上的星标总数超过8000;今年6月,用户人均每日生成图片的数量约为5月的3倍。目前,U1 Pro预览版已开始邀请测试,正式版计划于8月向公众开放,届时将公布价格并提供API服务。
(编辑:张靖超 审核:李正豪 校对:陈丽)