Token导航 LogoToken导航

商汤SenseNova U1 Pro实测:五大场景验证图片生成能力

更新时间 2026-09-24来源 卡尔的AI沃茨正文 4687字阅读约 15分钟

好久没有测图片模型了,最近真的有点手痒,

很想找个新模型,丢几道难题进去,看看现在的 AI 生图还能玩出什么新花样。

然后我发现了商汤最近悄悄上线了SenseNova U1 Pro,

在8月的SuperCLUE-Image中文文生图榜单里,总分 93.81,排在第一,复杂信息布局拿到95.80分,

那我必须马上实测了,

想看看这模型到底是啥效果,能不能pk过gpt image 2.5,我先跑了一张图,是给一本科幻小说设计精装书封,展示封面、书脊与封底的完整延展稿,主要是想看看这个设计的完整性,SenseNova U1 Pro做出来的是这样的。

同样的提示语用GPT的Image2.5做出来是这样的,

说实话我真的更喜欢SenseNova U1 Pro做出来的,尤其是把日食从初亏到复圆的过程,直接变成了一条横跨整本书的视觉线索,扣住了日落主题,能真实的感受到时间的流动,gpt image 2.5做出的图日落的设计就没有什么条理性了,高楼上的反光AI感也还是有些重。

这效果,难道说我的工作流要换模型了?

SenseNova U1 Pro 对自己的定位很直接,想让AI生图从抽卡走向可交付,围绕一个最终目标,串起需求理解、信息搜索、生成编辑、结果检查和局部修正,还支持最高 8K 和特殊长宽比输出。

看起来有够全面的,那我必须给它上上强度。

我把任务分成审美和中文版式、多文字运营物料、资料检索和高密度信息、局部修图、多图融合这五类,看看SenseNova U1 Pro的表现,老规矩,还是提示语都放给大家,也会上到goodcase上。

先来最直观的,审美和中文版式。

因为要看一个图片模型,首先看的就是它做出来的图好不好看,是不是够有审美,它的排版是不是没有只用单一的字体,会不会用多种字体排列起来,画面留白会不会啥的。

所以我首先给它测试了两张风格不太一样的海报,看看它的科幻类型图片以及中式风格图片生成效果如何。

    为虚构的「极夜国际电影节 POLAR NIGHT FILM FESTIVAL」设计一张竖版 3:4 主海报。画面中心是被冰层折射成两部分的人脸侧影,上半部像电影银幕上的静止肖像,下半部沉入深蓝冰海,出现轻微胶片错帧。使用冰蓝、银灰、近黑与一点酸性红,气质冷静、神秘,具有欧洲艺术电影节正式视觉的完成度。主标题「极夜国际电影节」使用窄长中文字体,英文标题大尺寸竖排贯穿画面。只保留「2026.12.05–12.12」「海港艺术中心」「在最长的夜里,看见另一种光」。确保中英文字边缘清晰,不生成虚构导演或片名,不做通用电影海报模板。
      为虚构茶品牌「汀上 TINGSHANG」设计春季限定主视觉,竖版 4:5。主产品是一只雾白细陶茶罐,表面只有很小的「汀上」印记。茶罐放在浅水中,一枝刚抽芽的柳条从画面外伸入,水面的涟漪形成隐约的山峦轮廓。将宋画的留白、现代产品摄影和轻微凸版印刷质感融合,不直接仿古。色彩只用宣纸白、青灰、柳芽绿和少量旧金。文字包含「汀上」「明前春茶」「春水初生,新茶刚好」「80g」。字距克制,留白充足,茶罐材质、水面倒影与接触阴影真实,形成可用于商场灯箱的高级品牌视觉。

      我觉得这两张完成度都很高,而且效果不是那种千篇一律的。电影节海报这个视觉冲击力很强,人物、碎冰、海面和水下倒影,完整呼应了极夜主题。左侧竖排标题形成鲜明识别度,冷蓝画面中加入一点红光,也有效制造了焦点和悬念,整体很像成熟的国际电影节主视觉。

      中式茶叶这张海报用大面积留白、水墨山水和水面倒影把春茶的清润感表现得很自然,画面上柳枝既补足层次,也把视线引向产品。陶罐材质、中文排版和低饱和配色统一,东方审美完整,商业成片感很强。

      那再看两张比较现代风格的,一张是现代舞表演的海报,一张是高级香水海报。

        为当代舞蹈作品「向内的风」设计一张竖版 2:3 海报。画面只有一名舞者,身体在高速旋转中失去清晰边界,但脸和一只向内收拢的手保持清晰。长曝轨迹像半透明织物,围绕人物形成一个不完整的洞。黑白摄影为主,只使用一点草绿作为方向标记。排版参考当代舞蹈节目册,中文标题拆成两列,与舞者的身体轨迹发生遮挡。保留「向内的风」「INWARD WIND」「编舞 / 表演 林川」「2026.10.18 19:30」「水岸小剧场」。身体受力真实,不生成额外肢体,不使用俗套美光或飘带。
          为虚构中性香水「TIDELINE」设计一张竖版 3:4 高奢广告。透明厚壁玻璃瓶悬在一条静止的水面线上,瓶内是极淡海绿色液体,水下有机弧形石体,水上只有极淡海雾。光线像阴天海边的银色天光,玻璃边缘、折射、水下焦散和接触阴影必须真实。配色只用海盐白、浅青绿和石墨灰。仅出现「TIDELINE」「EAU DE PARFUM」「Between sea and silence」。精确字距,极大留白,主体有克制的张力,最终像真实投放的奢侈品平面广告。

          这两张给我的感觉是真的可以拿出去用的程度了,确实达到了SenseNova U1 Pro想要的可交付的程度。

          表演海报的动态感很强,把风做成可视化的雾气形状,人物动作、标题和情绪都很统一,克制又有当代舞蹈海报的实验感,中文标题的排版也很有识别度。香水海报的产品质感很干净,折射光纹很好地传达了清冷、安静的香气联想。画面留白、居中构图和低饱和色彩做的恰到好处,整体很像完成度较高的香水商业广告。

          不错啊,真不错,接着我们俩看看多文字的稳定性表现怎么样。

          首先我设计了一家虚构抹茶店 Mòmo,给它十款甜品和十个价格,图和名字还有价格都要对应上,然后还做了一藏博物馆楼层导览图,需要每一层的楼层信息和对应展览信息都要对应上。

            为抹茶甜品店「Mòmo」制作竖版菜单海报。Slogan 为「吃抹茶?Mò问题!」。必须完整呈现以下十款。宇治抹茶芭菲 48 元,青山抹茶厚乳 26 元,抹茶青岚千层 42 元,抹茶舒芙蕾 48 元,流心大福 32 元两个,抹茶红豆铜锣烧 28 元,冰椰抹茶 20 元,宇治金时抹茶冰 55 元,春日抹茶草莓蛋糕 38 元,小熊抹茶慕斯杯 32 元。每款图片、名称和价格必须一一对应,不遗漏,不增加新商品。以抹茶粉的青绿、和纸暖白和少量草莓红建立主视觉,用分组和网格建立层级,不做十张图的简单拼贴。生成后请逐项自检数量、品名、价格和图片映射关系,发现错误后先修正再交付。
              为虚构的「沿海自然博物馆」制作 A3 竖版楼层导览。建筑共四层:1F 海洋起源、票务、寄存、商店;2F 潮间带生命、儿童探索室;3F 鲸与深海、临时展厅;4F 海岸气候、观景台、咖啡厅。主视觉为清晰的建筑爆炸轴测图,各楼层用不同海水深度色区分;标出两部电梯、楼梯、无障碍卫生间、母婴室、急救点和疏散出口。右侧提供推荐 60 分钟与 120 分钟两条路线,箭头连续且不穿墙。沙白、浅海蓝、深海蓝、救生橙,兼具博物馆审美与公共导视规范。所有空间只出现一次,图例统一。

              两张图的信息都完全对应上了,自己画的食物和楼层概览图都很符合逻辑,文字都没有出现错误的地方,整体完成度都很高,排版也很蛮舒服的。    那在目前文字稳定性保持得都还不错的情况下,我们再上强度,考验一下模型是否具备联网能力,是否能够正确搜集信息并在把这些信息合乎逻辑的做成图片的同时保持密集文字稳定,首先我先叫它做可以一张科普图解。

                制作一张竖版 3:4 中文科普信息海报,主题「一滴雨如何穿过一座城」。请实际检索水利部、住建部或权威科普机构资料,核对降雨、地表径流、雨水管网、调蓄、渗透和再利用的基本流程。用一条水滴路径串联云层、屋顶、街道、下沉式绿地、地下管网和湿地,补一个「传统快排」与「海绵城市」的小型对照。蓝灰、青绿和少量荧光黄,精密科普插画与建筑剖面图融合。只放经过核对的短文字,设置三级信息层级,箭头连续,图例统一,正常观看尺寸下文字可读。完整来源另存,不要把来源长链接铺满画面。

                可以看到,在没有提供具体资料的情况下,SenseNova U1 Pro不仅准确拆解了海绵城市的运行原理,还主动完成了知识补全、逻辑编排与可视化表达。六个环节配合剖面、箭头、对比和图例,把复杂概念讲得直观易懂,信息理解与视觉策划能力都不错。

                那既然是测试文字的稳定性,我必然要上我的最高难度,让他来写一首全文的《琵琶行》,效果是这样的,一起来挑挑看有没有糊掉的文字吧。

                反正目前我是只看到零星几个文字是想要写对但是可能笔画比较复杂有一点点糊的感觉,但是这个字也不影响阅读,重要的是,他还把白居易的简介写上去了,同时这个《琵琶行》的小序他也搜到并放进图中了,整体完成度已经比gpt image 2.5还高了。

                接下来再来看看SenseNova U1 Pro的局部编辑能力,这里最关键的,也是图片编辑模型最容易出错的地方就是改图的时候容易把其他东西一起改了,比如说,我在用gpt image 2.5的时候,如果我不给它加限定词说 「不要修改画面中任何其他的东西」,它就总是会在改图的时候,给我加那么一两个字,或者改变一点视角。

                那我先来个简单的,先SenseNova U1 Pro让帮我把图片里面的灯换掉,很简单的指令,也没有给他加特别的限定词。可以看到这两张图,除了灯换成了我想要的一个黑色弧形立式灯之外,其他的细节处都没有发生改变。

                改个衣服颜色也是,这里我特意在衣服的胸口处留了一个比较小的刺绣logo,看它改图会不会把logo改掉,实际上SenseNova U1 Pro也没动这些细节。

                文字修改也是一样,只改我想要的修改的文字,不仅能沿用原本的字体,也不会进行多余的调整。

                最后上压轴,多参考图融合,主要是看SenseNova U1 Pro能不能根据我的想法获取对应图片中的元素或者风格并进行合理的融合。

                我的第一个任务就是,让SenseNova U1 Pro融合第一张图和第二张的风格,给第三章的人物作为主视觉,制作一张夜航编辑部的海报。

                得到的结果是这样的,可以看到文字排版和酸性风格都保留的很好,人物形象也成功保留下来了,整体完成度真的蛮好的。

                然后我又给了几张家具图,

                让SenseNova U1 Pro根据左边这张海报的风格制作一张中古家具的海报,右边这张给我的结果图也是妥妥延续原本的拼贴风格,家具也保留了原图的样子,没有发生变化。

                最后最后,我们再来个极限测试,真的给我测high了。

                用U1 pro实现从包装设计刀板图——到包装渲染图——侧面文字修改的流程,看似只是简单的一个渲染过程,但真正在用AI出图的品牌设计师朋友们,就能明白,要做到成片百分百与设计表达完全一致,做到可交付给甲方的程度,是gpt image 2.5都要抽卡的程度。

                首先我拿了这样一张刀版图给U1 pro,

                直接看SenseNova U1 Pro 根据刀版图生成出来的包装渲染图,可以说复现的非常之好,不管是外套包装,还是内盒,尺寸和文字还有设计都能对应上。

                如果想要做细节的修改,比如把右侧下方的很小的英文修改掉,下面改后的图中文字清晰度、准确度以及透视关系都没有问题,途中其他的文字和包装细节也没有变化。这个编辑的精准度真的是很可以了。

                其实图片模型迭代到今天,我们对它的要求越来越高,

                要它做的图片够好看,

                清晰度够高,

                不能有AI味儿,

                文字要够稳定,排版要好看,还能精准编辑,

                归根结底,就是希望AI能够真的落实到工作中,替我们认认真真的完成一些事。

                其实我把AI融入我的图片工作流很长时间了,

                平时的公众号配图,短视频封面,我基本都是用AI帮我来加工的。

                这个过程里,我觉得AI创作真正好玩的部分,

                就是可以在很短的时间内让一个人把脑子里那个模糊的东西,稳定做出来。

                光有灵感还不够,还得经得住修改。

                所以,一旦有模型表现的足够好,

                我就会毫不犹豫的替换到我的工作流中,

                这次,SenseNova U1 Pro就很不错。

                @ 作者 / 卡尔 & 阿汤

                文章标签智能体
                资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

                继续浏览更多资讯

                返回资讯目录

                相关资讯

                更多