打开网易新闻 查看更多图片

7月18日,2026世界人工智能大会现场,商汤科技正式推出全新旗舰多模态大模型SenseNova U1 Pro。以往AI绘图大多只能单次生成图片,想要合格商用图要反复刷新;这款新模型能独立走完一整套完整创作流程,意味着AI图文创作正式从“简单出图”升级到直接交付可用成品的新阶段。

日常用AI作图的人基本都有同一个困扰:想要能直接商用的图片,只能不停刷新“抽卡”,生成的画面经常构图混乱、文字出错、细节粗糙,没法直接商用。行业AI作图先是解决了画面逼真度,后来优化了文字修改,但始终摆脱不了反复试错的麻烦。而U1 Pro自带完整创作逻辑:看懂用户需求、规划整体画面、生成完整内容、自查画面漏洞、自动修正缺陷,从根源解决反复出图的痛点,核心有四项实用能力。

打开网易新闻 查看更多图片

U1 Pro创作作品:商业建筑视觉

第一,生成图片摆脱廉价“AI感”,构图、配色、排版达到专业设计师水准,拿到手不用大面积修改;第二,原生支持8K超清大图,不管是超长画卷还是大型展会展板,放大后文字、线条依旧清晰完整,印刷、线下办展都能直接使用;第三,图文混排能力大幅提升,海报、图表里的文字出错率极低,就算信息密集也不会排版混乱;第四,模型自带自主循环优化能力,能自动迭代调整几十轮,画面整体风格、局部文字可以分开精准修改,做好的稿件还能被持续修改与使用。

这款模型强悍的创作能力,依托商汤自研NEO-unify统一底层架构,打通文字理解和图像生成,不会出现“看得懂文字、画不出对应画面”的脱节问题。今年4月商汤开源基础版SenseNova U1,短短两个多月使用量快速上涨,6月用户平均每日出图数量,对比5月提升近3倍。到7月中旬,这套模型和配套工具在代码平台收获超8000个收藏。

同时,商汤开源的SenseNova-Vision统一视觉大模型,依托十余年视觉技术积累,不用拼接多款专业模型,就能自动识别重叠物体、镜面反射、视觉错觉等复杂画面,精准看懂各类现实场景。

商汤用三类高难度实操任务,实测了模型完整交付能力,落地效果直观可见:

打开网易新闻 查看更多图片

独立完成WAIC九周年水墨长卷

第一类大型视觉创作:模型独立完成WAIC九周年水墨长卷,狭长画卷完整记录2018到2026年世界人工智能大会发展历程,画卷里城市地标、文字标注、产业信息排布密集,但整体画面协调统一;

第二类影视内容制作:不用人工分段构思,模型一次性搭建《沙影之刃》完整故事世界观,产出22个逻辑连贯的镜头分镜,搭配商汤视频工具,全程统一人物、剧情、画面风格;

第三类数据分析可视化:依托商汤办公智能助手“小浣熊”,模型在2026世界杯开赛一个月前,就预判黑马佛得角能够顺利出线,预测准确度在12款主流大模型里排第二名;还能自动整理球队战术、球员数据,生成清晰图表,完整走完“收集信息—分析数据—产出可视化报告”全流程。

U1 Pro通用性很强,各行各业日常工作都能适配:职场人一键生成企业图表、完整PPT;电商商家快速产出高质量商品宣传海报;老师、出版社制作无错误科普示意图;动画、影视行业高效绘制角色原画、故事分镜。目前相关能力已经搭载在商汤办公工具“小浣熊”、视频制作工具“Seko”中,服务千万普通用户、近万家企业。

打开网易新闻 查看更多图片

U1 Pro创作作品:武康路旅游攻略图

据了解,SenseNova U1 Pro测试版现已开启定向邀请体验,后续会根据算力扩容,逐步放开测试名额;完整版将于2026年8月面向全社会上线,同步公布收费标准与开放接口服务。

商汤表示,依托统一底层架构,文字与图像融合能力会持续迭代升级,U1 Pro将成为适配各类现实场景通用AI的基础底座。依靠商汤AI大装置SenseCore,日日新SenseNova大模型体系持续降低普通人使用AI的门槛,这款新品也会让AI不再只是简单画图工具,变成能直接产出商用成品的一站式生产力工具。

送你一个新闻盲盒

快来打开看看吧

记者:王永娟

编辑:耿洁玉

转载请注明来自上海徐汇官方账号

打开网易新闻 查看更多图片