超多案例实测GPT Image 2.5!一口气了解10个应用场景

嗨大家好,我是阿真!

早上发现大家都催 Image 2.5,你们这么积极我真的有点害怕了哈哈哈。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

好的,来了来了~

这一次是 Image 2.5。当然它的全称不是这个,大家懂的都懂。

根据 9 月 8 日的官方发布说明,这次升级主要围绕参考图保真、精准局部编辑和多轮修改,同时改善光影、材质与复杂指令理解,还加入了草图、模板和图片评论编辑等入口。

接下来大家可以跟我一起来看看今天的案例。

二、精准局部编辑

局部修改时,其他细节大多能保持住。比如,修一修蛋挞的小细节。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

把蛋挞表面左上方那块最大的深黑焦斑修成自然的浅琥珀色烘烤斑,保留周边蛋液凝固纹理与光泽。其余细节保持原样。@创建图片

修改一个轮子的轮毂。类似的去精准要求,效果都还不错的。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

@创建图片 编辑上传的行李箱照片,只把画面右下方、最靠近镜头的那一只黑色滚轮外圈改成珊瑚橙色,轮毂继续保持黑色。轮子的直径、厚度、朝向和接地点保持原样,其他三只轮子继续保持黑色。

小字修改,其他都没有变化,只改最后一行的文字。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

将原文 “连续木框,悬浮软包,为独处提供更舒服的高度” 完整替换为: “以温润曲线,承托每一刻松弛”

一致性真的很强,这时候我想到了一个主意:如果是多张图跑起来,那它岂不是就像动画一样?通过这样的方式,也可以去验证它的一致性是不是真的有那么好。

于是我让它一次生成 8 张图片,图片会依次把一张图从左推到右。这样如果把 8 张图连续起来,我们就可以看到这个字母和表情像字幕一样,从左滚到右了。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

一次连续生成8张独立图片,制作电影院银幕上“AZHEN+描边笑脸”的无缝左向滚动序列。每张16:9,分别输出,不要宫格或拼图。

【固定场景】
昏暗的电影院,镜头位于观众席后方,正对巨大的矩形银幕。画面下方是背对镜头的深色椅背,无观众。银幕黑框、纯白底。8张共用完全相同的背景,镜头、座椅、边框、光线和曝光保持不变。

【固定文字带】
黑色、中粗、有衬线的艺术字体“AZHEN”,N后紧跟一个黑色描边的扁平笑脸,再接下一轮AZHEN。顺序始终为:
AZHEN ◡ AZHEN ◡……
其中◡仅代表笑脸的位置,实际绘制为完整的圆形描边笑脸,内部白色,包含两只弯弯的笑眼和微笑弧线,无黄色填充、渐变或立体效果。

字母和笑脸高度占银幕内部高度的90%至95%,上下只留极窄白缝。字母保持自然宽度,禁止横向压扁或使用极窄字体。采用紧字距,A与Z之间不留大空隙。

将“AZHEN+笑脸”这一完整单元的宽度固定为银幕内部宽度的2倍。银幕只能显示这个单元的一部分,禁止在同一张银幕内塞下两组完整名称。所有字母、笑脸、字距和垂直位置一次确定,后续完全沿用。

【严格等距左移】
把白色银幕左边缘记为x=0,右边缘记为x=100%。以同一个A的最左侧为定位点,第1张从x=75%开始,此后每张向左移动银幕宽度的25%:

第1张:A定位点在75%。
第2张:A定位点在50%。
第3张:A定位点在25%。
第4张:A定位点在0%。
第5张:A定位点在-25%。
第6张:A定位点在-50%。
第7张:A定位点在-75%。
第8张:A定位点在-100%。

负数表示这个A已移到银幕左侧画外,其后的字母与笑脸继续从右侧进入。下一轮A与这个A相距200%的银幕宽度,随整条文字带同步移动。第8张再左移25%,应与第1张形成相同的循环画面。

每张只允许整条文字带水平向左平移,禁止根据当前可见字母重新居中、调整间距、缩放或改写。字母与笑脸经过边界时自然裁切。即使只露出半个字母,也保持真实位置,不补成完整字母。

先统一规划8张的文字位置,再按顺序生成。检查相邻帧:同一个可辨认的笔画必须始终向左移动相同距离,不能向右回跳,不能重复停留。首尾使用同样的移动步幅,不添加重复结束帧。

所有图片清晰锐利,无运动模糊、无淡入淡出、无形变。不要在图片里显示坐标、编号、辅助线或说明文字。

朋友们,猜猜看,我成功了吗?

超多案例实测GPT Image 2.5!一口气了解10个应用场景

只保留第 3 张到第 6 张岂不循环了。当然也可以看到,其实除了图片以外,还是会有一点点光影起伏的变化。文字和表情符号的稳定性还算是挺不错的了。当然如果非常严格来说的话,目前还是没有达到百分之百只改变编辑区域

超多案例实测GPT Image 2.5!一口气了解10个应用场景

但是简单使用丝毫不成问题,比如让它基于一张 logo 生成 8 张不同材质的图,组在一起就是 GIF 图了。可玩性很强啊。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

以这张图为基准,直接制作 8 张 4:3 横版图片,同时改变「AZHEN」和右侧竖向「Studio」字母内部的材质。

固定复用原图背景和文字轮廓:暖白纸纹背景完全不变;AZHEN 和 Studio 的字体、字号、字距、位置、方向、边缘和字母内部留白完全一致,字母保持分开。

8 张分别采用:
01 石墨黑哑光:细腻、克制。
02 镜面银铬:强烈的黑白金属反射。
03 橙红熔融玻璃:通透、流动。
04 钴蓝冰晶:冷色、裂纹与折射。
05 粉色绒毛:柔软、细密。
06 翠绿釉面陶瓷:厚润、光滑。
07 黑白胶片:明显颗粒与抽象摄影纹理。
08 虹彩珠母:紫、青、粉交织的变色光泽。

材质、色彩和光学质感要有显著差异,避免仅换颜色或套滤镜。每张图中的 AZHEN 和 Studio 使用相同材质、色调和光照,同步变化。Studio 的纹理精细度适配小字号,保持清晰可读。

所有材质严格裁切在固定的 AZHEN 和 Studio 字母蒙版内,不能改变外轮廓,不能向外长毛、融化、膨胀或产生投影。高光保留细节,避免字母与暖白背景融为一体。背景直接复用原图,确保连续切换时背景和文字位置完全稳定。

交付 8 张尺寸完全一致的独立图片。

还是上面的 Logo,给品牌做系列品牌宣传海报,一次 6 张。这个也参考了官方的案例,亲测确实是挺实用的。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

以我提供的「AZHEN Studio」logo 为品牌标识,为这家设计工作室一次完成 6 张独立的品牌宣传海报。以下风格描述是整组作品的固定视觉 DNA,请贯穿所有画面。

【固定风格 DNA】
复古现代主义图形海报,融合包豪斯几何构成、瑞士粗体排版与 20 世纪六七十年代的印刷色彩感。整体明快、大胆、简洁,兼具专业设计感与轻松的人文气息。

配色统一限定为:暖奶油白 #F5F1E7、近黑 #111111、钴蓝 #155EB0、橙红 #EF501D、明黄 #F8C522、柔粉 #F2A1B8、深绿 #23765B。每张选用其中 3–4 种颜色,允许局部双色叠印。多数使用暖白底,部分使用整版饱和色底。

图形由圆、半圆、扇形、矩形、拱门、叶片形和宽幅波浪色带构成。使用大块实色、明确轮廓和巧妙的正负形关系,几何形状可以拼接成太阳、植物、道路、窗口等熟悉意象。图形大胆放大,允许局部延伸出画面边缘。避免细碎装饰和复杂描边。

标题使用极粗、紧凑的无衬线字体,类似 Helvetica Black 或 Grotesk Heavy;大字号、紧行距,分成 2–3 行,通常左对齐。标题与图形形成明确的上下分区或穿插关系,部分海报可以由超大文字主导。禁止所有海报机械复用同一模板。

画面保持平面印刷感,暖白纸底带极轻微纸纹,色块饱满、边缘清楚。避免立体渲染、金属、玻璃、光泽高光、复杂渐变、投影和过度做旧。

【logo 使用规则】
准确保留参考图中 AZHEN 的字形与字距,以及右侧竖向 Studio 的组合关系,不重新设计 logo。允许整体等比例缩放,统一使用近黑或暖白实色。每张都放置完整 logo,作为清晰的品牌署名,保持一致的尺寸规范与安全边距。

【6 张海报】
01 灵感出发
标题:“MAKE IDEAS MOVE”
用巨大的明黄半圆太阳与向地平线汇聚的几何色带,表现道路、出发和行动。搭配橙红、深绿与暖白,构图开阔、动势强。

02 自由创造
标题:“CREATE WITH CURIOSITY”
用宽幅波浪色带与有机曲线交错穿行。钴蓝、柔粉、明黄与暖白为主,构图流畅、自由、活泼,产生音乐般的节奏。

03 共同生长
标题:“GROW TOGETHER”
用圆形花心、成对半圆叶片与简洁直线茎干,构成一株抽象植物。深绿、柔粉、橙红与暖白为主,构图接近对称,温暖而舒展。

04 多元视角
标题:“SEE THINGS DIFFERENTLY”
用拱形窗口、错位圆形和正负形构成抽象的观察装置或眼睛。近黑、钴蓝、明黄与暖白为主,构图不对称,突出视角变化与视觉巧思。

05 找到平衡
标题:“BOLD IDEAS. CLEAR DESIGN.”
用圆、半圆和矩形搭建一组看似悬而未落的平衡结构。橙红、柔粉、近黑与暖白为主,保留较多留白,呈现克制、精准与张力。

06 品牌发声
标题:“LET YOUR BRAND SPEAK”
以超大暖白粗体标题占据画面大部分面积,使用钴蓝满版背景与一个橙红圆形点缀。文字紧凑、有力量,形成鲜明的品牌宣言。

【系列一致性】
统一配色体系、字体气质、图形语言、纸张质感和 logo 规范;每张在主色、构图、图形意象、疏密与情绪上明显不同。整组既能并排形成完整品牌系列,也能单张独立传播。

标题与 logo 层级清晰,所有英文准确,不添加虚构联系方式或无意义小字。图形系统应适合后续延展到帆布袋、名片、包装等品牌物料。

【交付】
直接生成 6 张独立的竖版 3:4 高清海报,尺寸统一,按 01–06 编号。每张交付完整平面设计原稿,不要拼成六宫格,不要添加相框或场景样机,不要只提供设计方案。

三、照片精修

也可以用来精修照片了。我手头没什么比较好的参考图,大家可以去试一下这个功能。在场景差不多的情况下,可能修一张图,让其他的直接参考这个去做就行了。后续也是直接给图。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

以后不能线下看到阿真还说没见过本人了奥。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

四、 参考图保真

接下来这两张图是参考图,这是我和我的猫。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

在根据不同的年代、时代以及真实场景的还原上,它已经可以做得非常好了,包括对于一些材质和质感的控制,像是 90 年代的照片,它的图片会有那种浅浅的胶片感。

这里注意,我测试比较粗糙,没有去过度要求动作的改变,所以大家可能觉得动作比较拘谨。大家实际上也可以提供动作参考图,或者是具体要求怎么改变姿势、增加道具之类的。

深圳世界之窗 / 夏尔袋底洞

超多案例实测GPT Image 2.5!一口气了解10个应用场景

生成一张我在90年代深圳世界之窗游玩的真实照片。保留我的脸、五官、肤色和辨识度,换上自然的90年代发型与日常穿搭,背后清楚可见世界之窗的埃菲尔铁塔缩景。像朋友随手拍下的旅行纪念照,带有90年代胶片颗粒和纸质照片的温润质感,自然、真实、有生活气息。
/
生成一张我在《指环王》中土世界的真实照片。保留我的脸、五官、肤色和辨识度。我站在夏尔袋底洞、佛罗多家的绿色圆门前,穿着霍比特人风格的亚麻衬衫、马甲与朴素长裙。周围是绿草覆盖的小丘、鲜花和温馨的乡间庭院,阳光柔和,像亲身来到夏尔时拍下的纪念照,具有电影般的真实质感。

大家之前应该也有体会:人物图片,国外的图片模型经常还原不好人像细节,容易让人觉得亚洲人都长得一样,尤其是多编辑两轮就不像本人。

但现在它在多轮编辑后,依然能够保持比较好的效果。接下来的图片是按顺序往下多轮编辑了很多次的,当然大家也可以在后面发现,它的细节确实有了一些变化。

下面已经到了第九轮和第十轮的编辑,可以看到面部细节上还是挺不错的,没有出现明显的面部伪影和噪点、斑驳等。但是缺点也很明显,尤其是在对于金属或者是刺绣等复杂细致的材质的表现上时,那种碎碎的感觉又像鬼魂一样追了上来(左一)。

埃及猫与人肖像 / 蓝缎宫廷肖像

超多案例实测GPT Image 2.5!一口气了解10个应用场景

用我的人像和猫咪照片作为参考,保留我的五官与辨识度,以及猫咪原本的毛色、眼睛和外形,生成一张古埃及猫神主题的暗黑幻想艺术肖像。我戴着高耸的尖耳金属头冠与黑色纹样头巾,黑发齐刘海,细长编辫点缀彩珠,身穿黑金色斜裹式服装,佩戴宽大的层叠金属颈环、垂坠耳饰和金色臂环,双臂交叠,正面看向镜头,神态神秘自信。我的猫坐在肩后高处,佩戴精致的埃及风格项圈。灰米色斑驳墙面背景,强烈侧光,低饱和黑金与暗红配色,呈现细腻厚涂笔触和金属光泽。竖幅半身构图,无文字、无水印。
/
让我 cos 安格尔《布罗意公主肖像》中的贵族女性。黑发中分盘起,两侧点缀蓝色缎带,身穿华丽的冰蓝色露肩缎面长裙,领口与袖口饰有精细白色蕾丝,宽大的裙摆铺展开,泛着细腻银蓝光泽。佩戴金色吊坠项链和多层珍珠手链,侧身坐在古典扶手椅上,手臂轻搭金色靠垫,脸朝向镜头。深灰色室内背景,柔和侧光,呈现古典油画般典雅的真人艺术摄影质感。竖幅构图,无文字、无水印。

如果只露出人物的一半面孔,出错的几率会高很多

下面这两组图像中就可以看到:一个是人物容易出现一些不明的结构;另一个是人物在全身照时,头部和身体也出现了明显的人体结构问题。简单来说,脖子和身体感觉对不上。这个问题 2.0 没有解决,2.5 依然没有解决。

09 F1 赛车手 / 10 未来宇航员

超多案例实测GPT Image 2.5!一口气了解10个应用场景

保留我的五官和辨识度,让我成为正在驾驶 F1 方程式赛车的赛车手。身穿专业赛车服,戴着头盔,透过透明护目镜清楚看见我的面容,双手握住赛车方向盘,目光专注前方。从座舱前方斜侧角度近距离拍摄,背景赛道飞驰模糊,充满速度感与临场感。真实体育摄影质感,竖幅构图,无文字、无水印。
/
保留我的五官和辨识度,让我成为未来世界的宇航员。身穿精密的银白色宇航服,透过透明头盔清楚看见我的面容,站在外星基地的观景平台上。身后是宏大的未来城市、停泊的飞船与悬在天空中的巨大行星,冷色灯光映在头盔和金属表面,氛围壮丽而神秘。真实科幻电影质感,竖幅构图,无文字、无水印。

测试上限,那我就上强度了。这里我让他把我前面测试过的所有的图片全部放到一张海报里。当然,崩得很厉害。

这次把这么多人像放在一起,确实有点顶不住了。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

将上传的全部阿真造型图片合成一张竖版人物主题海报,以草图作为排版参考。纯白背景,人物抠图大小错落排列,用粗糙的黑色手绘曲线、星星和箭头串联,形成自由流动的构图,避免整齐的照片网格。

保留每张图片中的人物面容、服装、姿态与原有质感,所有造型全部呈现,不遗漏、不重复。保留猫咪、独角兽、铁王座和赛车等与造型相关的重要元素,去掉各自多余的背景。人物保留原图色彩,装饰与文字使用黑色,形成真实人物与粗糙手绘的混搭效果。

左上大标题“阿真的无限可能”,副标题“ONE FACE, MANY WORLDS”,中间穿插“无限变身”,底部“AZHEN / STYLE UNIVERSE”。不保留草图中的编号与造型说明。文字避开面部,画面丰富但有留白,呈现个性鲜明的时尚拼贴海报。实际制作不要使用手写体。
/
花木兰的那一张,武器有问题,修改一下。

宇航员的那张,宇航员的头盔已经戴在头上了,手里为什么还有一个?霍比特人的那个错了,还有人物一致性不行

五、多轮编辑

再看看多轮编辑的表现。这里我换了一种风格,用了一张原图,然后要求切换其他的场景,并且让它根据环境去调整人物的光影

整体表现上是不错的,有个别图片它会基于场景挪动位置。如果强制要求不要改变两个主体的位置,应该也是可以的。

但是在多轮编辑的过程中,有的图片可以明显看到脸上已经有了一些伪影和噪点,这个还是不可避免的。

全部场景快速切换

超多案例实测GPT Image 2.5!一口气了解10个应用场景

部分生成图片

超多案例实测GPT Image 2.5!一口气了解10个应用场景

两个角色动作保持和上一张图一致,人物把书包去掉。镜头换到室内,温馨的室内房间,背后有书架,旁边有沙发,注意角色的光源要跟着环境的光源发生变化
/
保持小男孩和白猫的外形、服装、动作、相对位置与参考图一致,两位角色靠在水族馆观景区的宽平台前,一起望向右上方。身后是巨大的弧形水族箱,鲸鲨从上方缓缓游过,成群银色小鱼穿过深蓝色海水,远处有珊瑚和摇曳的海草。前景有虚化的海洋主题导览册。水中透下的蓝绿色光线和波纹投影落在角色脸颊、头发、衣服与白猫身上,保持原图温柔细腻的动漫画风。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

保持小男孩和白猫的外形、服装、动作、相对位置与参考图一致,两位角色坐在复古列车靠窗的小桌前,一起望向右上方。前景有虚化的车票、橘子和玻璃汽水瓶,身后宽大的车窗外是金黄色稻田、远山和乡间电线杆,车厢内有墨绿色座椅与黄铜行李架。午后阳光斜照进车厢,在角色脸上和桌面形成柔和的明暗分区,保持原图温柔细腻的动漫画风。
/
保持小男孩和白猫的外形、服装、动作、相对位置与参考图一致,两位角色靠在童话森林的树桩茶桌前,一起望向右上方。前景有虚化的橡果杯和小浆果,身后长着比角色高出许多的红色蘑菇,巨大的草叶挂着露珠,远处树根里嵌着亮灯的小圆门,一只瓢虫停在弯曲的草茎上。清晨阳光透过蘑菇边缘,带来轻微的暖红色透光,角色受到柔和天光照明,保持原图温柔细腻的动漫画风。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

保持小男孩和白猫的外形、服装、动作、相对位置与参考图一致,两位角色靠在渡轮甲板的宽木台前,一起望向右上方。前景有虚化的缆绳与救生圈边缘,身后是湛蓝海面、白色船尾浪花与渐渐远去的港口,岸边排列着彩色房屋,几只海鸥跟随渡轮。明亮的日光与海面反光照亮角色,微风轻轻吹起男孩的发梢,保持原图温柔细腻的动漫画风。
/
保持小男孩和白猫的外形、服装、动作、相对位置与参考图一致,两位角色靠在摩天轮座舱内的观景台沿,一起望向右上方。前景有虚化的座舱窗框,身后透过玻璃能看到逐渐远去的游乐园、旋转木马与密集的城市灯火,远处天空绽放一簇金粉色烟花。烟花与游乐设施的彩色光线映在角色脸上、眼睛里和白猫毛发上,玻璃保留轻微反光,保持原图温柔细腻的动漫画风。

六、跨格跨页角色一致

角色一致性进步不大。给了参考图,偶尔还是会有双马尾变成单马尾的情况。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

参考我上传的两张成年角色四视图,一次生成4张独立图片,讲述连续的热血奇幻冒险故事《最后一束光》。

【最重要的数量要求】
一共输出4张图片。
每张图片里面恰好只有4个漫画格子。
每张图片都是一张完整的四格漫画。
不要把4张图片拼在一起。
不要把所有剧情画在同一张图片里。
不要增加插入小格、回忆小格、人物特写小窗或装饰性分格。
同一个格子可以有两个人物、多个对话气泡,但仍然只有一个完整场景。
本轮故事停在两位主角准备联手反击的位置,后续结局留待下一轮继续。

【画面与排版】
每张图片为2:3竖版彩色漫画。每张图的4个格子采用清楚的两层结构:上面2格,下面2格。可以将中间分隔线改成斜线,让格子呈现梯形或不规则四边形,也可以调整四个格子的大小,但始终只有4个清楚的区域。

按照左上、右上、左下、右下的顺序阅读。人物手臂、头发、魔法与速度线可以适度突破边框,但不能形成额外格子,不能遮挡对白,也不能让相邻场景混在一起。

画风为精细的原创日式热血奇幻漫画彩页,清晰线稿、鲜明赛璐璐阴影、强透视、速度线和有力量感的动作。两位主角都是20至23岁左右的成年年轻人,严格保持参考图中的正常成年人体比例,约七到八头身,禁止CHIBI、Q版、大头娃娃或儿童体型。

【角色保持一致】
女主:严格沿用成年女主四视图中的金色双侧卷发马尾与编发、蓝眼睛、尖精灵耳、太阳花发饰、深蓝蝴蝶结、白色立领短袖上衣、深蓝束腰、蓝白金分片裙装、太阳纹饰和蓝金短靴,使用金色光魔法。

男主:严格沿用成年男主四视图中的黑色短刺发、额前赤红挑染、红棕色眼睛、尖精灵耳、赤红夹克、炭灰内搭、炭灰长裤、银色配饰、护腕与手套、深棕腰包和黑红战斗靴,使用赤红火焰。

所有图片中的脸型、头身比例、身高关系、发型、服饰结构、花纹和配饰位置保持一致。男主始终穿长裤。不要改变角色设计,不要更换服装。

【场景与道具】
场景是一座拥有红瓦屋顶、石板街道和古老钟楼的幻想小镇,时间为暴风雨前的黄昏。

太阳灯是一盏可以双手抱住的黄铜六角提灯,内部悬浮金色太阳形发光核心。

影兽由黑紫色烟雾组成,具有一对向后弯曲的角、浅紫色狭长眼睛、锋利前爪和烟雾尾迹。夺走太阳灯后,它将提灯封在胸口的半透明烟雾里。影兽与太阳灯在所有图片中造型一致。

【对白】
把下方指定对白准确画进对应格子的对话气泡里,使用清晰的简体中文。每句话只出现一次,不额外添加旁白。
“男主”“女主”为说话者说明,不印在图片上。
同一格有两个人说话时,分别绘制两个独立气泡,尾巴指向正确的人物。气泡按对白顺序排列,不能遮住脸部与关键动作。
不要把同一格里的不同对白拆成新的格子。
以下图片编号、格子编号及场景说明不印在画面里。

【第1张图片:灯被抢了】
这张图片只有以下4格:

左上格:黄昏广场,两位主角站在悬挂太阳灯的石台旁。女主检查提灯,男主得意地在指尖转动小火苗,两人同框。
女主:“小心,别又烧到袖子。”
男主:“放心,我练过了!”

右上格:男主指尖火苗突然蹿高,他慌忙缩手,女主在旁边无奈地看着他。远处钟楼后出现黑紫色阴影。
男主:“只是……稍微旺了一点。”
女主:“你上次也这么说。”

左下格:影兽从钟楼后扑出,一爪扯走太阳灯,广场瞬间暗下来。两位主角抬头,影兽爪尖可以轻微突破边框。
女主:“太阳灯!”

右下格:女主踏上金色光阶跃向屋顶,男主紧随其后,影兽带着灯逃向钟楼。
女主:“天黑前,必须抢回来!”
男主:“算我一个!”

【第2张图片:追上去】
这张图片只有以下4格:

左上格:两人在红瓦屋顶并肩奔跑,前方影兽胸口透出太阳灯的金光。
男主:“我来拦住它!”
女主:“等等,先看清它的身体!”

右上格:男主借脚底火焰跃起,一拳击中影兽肩膀,赤红火焰与黑紫烟雾炸开。用强透视表现火拳,拳头可以适度破框。太阳灯完好。
男主:“打中了!”

左下格:影兽被打散的肩膀重新聚拢成利爪,反手挥向男主。女主跃到男主身前,撑起金色光盾。两位主角同框。
男主:“怎么又长回来了?!”
女主:“到我身后!”

右下格:金色光盾出现裂纹,冲击让两人在屋顶边缘失去平衡,男主及时抓住女主手腕。
女主:“盾撑不住了!”
男主:“抓紧我!”

【第3张图片:跌落】
这张图片只有以下4格:

左上格:两人滑落到屋檐下的平台,男主护住女主,碎瓦落在周围,动作惊险但没有血腥。
男主:“没伤到吧?”
女主:“我没事,你呢?”

右上格:两人坐在平台上,男主垂着肩,掌心只剩微弱火苗。女主袖口与男主脸颊出现少量灰尘及轻微擦痕,之后保持这些痕迹。
男主:“对不起……”
男主:“我总是搞砸。”

左下格:女主蹲到男主面前,双手轻轻托住他握着小火苗的手,眼神坚定。两个人都在同一个画格里。
女主:“把火交给我。”
男主:“可我控制不好……”

右下格:女主用金色光环包住赤红火苗,将它收束成一支小巧的赤金光箭。两人看着掌心的光箭,男主露出惊讶神情。
女主:“你来出力,我来瞄准。”
男主:“真的成形了!”

【第4张图片:这次一起】
这张图片只有以下4格:

左上格:双人近景,男主抬头看向女主,神情从迟疑转为期待,掌心的光箭照亮两人的脸。
男主:“你真的相信我?”
女主:“当然。刚才你也接住我了。”

右上格:两人站起,望向钟楼。影兽盘踞塔顶,太阳灯依然封在胸口,夜色逐渐加深。
女主:“看,它胸口的灯还亮着。”
男主:“只要打穿外面那层黑雾!”

左下格:两人在屋顶试着配合,女主展开金色光弓,男主将稳定的赤红火焰注入弓弦。保持两人同框,手部动作与魔法连接清楚。
女主:“保持这个力度。”
男主:“好,我跟着你的节奏。”

右下格:低机位双人全身画面,两人并肩站在屋檐上,女主持金色光弓,男主握着燃烧赤红火焰的拳头,坚定望向远处的影兽。光弓可以轻微突破边框,人物保持正常成年比例。
男主:“这次,一起!”
女主:“一起把灯带回家!”

本轮到这里结束。最终必须输出4张独立图片,每张恰好4格。不要提前画出结局,不要生成额外格子。

风格锁定并迁移,也还是比较精细的。做批量的图要多方便有多方便了。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

就保持住这个风格,接下来做热带植物 
/ 
接下来做中药

超多案例实测GPT Image 2.5!一口气了解10个应用场景

接下来做海底的藻类
 / 
接下来做陆生动物

七、草图锁构图

涂鸦,就能直接作画作图做海报了。不过这个属于纯好玩。

下方选择【绘图】

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

画成什么样都给你变成好的哎嘿。其实这个功能,Seedream 5.0 Pro 上新的时候也已经支持了。大家可以尝试一下看看。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

我想要那种气垫风格、颜色比较丰富的海报
 / 
我想要那种扁平矢量风格的

八、透明底资产

前一阵子我很喜欢野兽派对,还给自己做了这种 Q 弹材质的造型。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

基于这个材质让 image 2.5 延伸生成带有 Alpha 透明通道的 PNG 图,基本能够保持背景完全透明,非常好用。如果大家有做视觉相关需求的,这个功能会很棒。

这个其实也确实有进步了,可以给大家对比一下。精细到头发丝了,抠图拜拜。

2.0 的时候,哪怕是让它出透明的 PNG,同样经常会出现有白边、处理不好的情况,在深灰色背景下可以明显看出来。2.5 就好很多。下面第一排是 2.5 生成的图,第二排是 2.0 的图。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

以参考图中的女孩为唯一角色原型,生成一张宇航员主题的透明底毛绒微缩场景。保留深蓝色星光长卷发、蓝色大眼睛、圆脸、腮红和大头小身体比例,只出现一个全身角色。

女孩穿奶白色与深蓝色拼接的软绒宇航服,戴敞开面罩的圆形头盔,露出完整脸部和卷发,一只手挥手,另一只手抱着小星球。身后左侧放一艘矮胖的小火箭,右侧放两块月球石和一面无文字小旗,脚下是一小块不规则月面垫。道具围绕人物形成紧凑、有前后层次的独立小景,人物始终最突出。

人物、服装、火箭、石头和月面垫统一使用参考图中的细密短绒、羊毛毡与软布材质,轮廓圆润,柔和棚拍光,精致立体玩偶效果。竖版3:4,完整展示人物与全部道具,四周留白。输出带真实Alpha透明通道的PNG,场景外部及道具间隙完全透明,无天空、无背景墙、无大面积地面、无白底、无棋盘格、无文字水印。

九、精确文字与版式

官方也有提到,文字信息和版式方面有提升。版式我们已经可以看见,在设计相关方面确实是有提升了。

那我们再看一下比较复杂的版式呈现。这种信息图大家可能今年以来已经看得要烦了,这里就不多放了,简简单单测试一下。文字细节上仔细看,还是会有一些字出错。小字部分那里会有一点点问题,但是整个阵营挺清晰,猛一看还是挺唬人的。有出错的地方吗?有出错的话,大家在评论区留言说一下。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

绘制一张《三国演义》阵营与人物关系全景信息图,横版 16:9,融合泛黄绢本、工笔人物小像与精密信息排版,内容丰富、层级清晰,不出现地图。以魏、蜀、吴为三大主区,分别用靛蓝、朱红、青绿区分,外围设置汉室与群雄区。收录曹操、曹丕、司马懿、荀彧、郭嘉、张辽;刘备、诸葛亮、关羽、张飞、赵云、马超、黄忠、庞统;孙坚、孙策、孙权、周瑜、鲁肃、吕蒙、陆逊;汉献帝、董卓、吕布、貂蝉、袁绍、袁术、刘表、张角。每人配独立头像、姓名、身份及一句 12 字以内的小说人物简介,核心人物放大。用不同线型与简短标签表达君臣、亲族、联盟、敌对及重要归属变化,仅连接关键关系,线条避让文字;底部以时间轴串联黄巾起义、虎牢关之战、官渡之战、赤壁之战、入蜀、夷陵之战、六出祁山与三家归晋,侧栏补充代表谋略、关键战役与阵营图例。以小说叙事为准,魏蜀吴按主要人物归属归类,跨时期关系标注阶段,避免表现为同一时刻;人物不重复,中文准确清晰,小字可读,装饰克制,呈现可放大阅读的博物馆级知识全景图。

十、信息图与复杂排版

有方向感了,更懂精细修改了。

做 PPT,后面的页面的格式可以稳稳保留了,可以保存好页眉、页脚格式以及风格哎嘿。感觉我置顶的那篇文章 Visual Style PPT Skill 大家又可以用上了。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

这是我的文档和我想要用的风格的描述,你帮我生成 PPT 图片,比例为 16:9,我要 6 页。第 2 页到第 6 页的页眉和页脚需要保持一致,能够明显感觉到风格一致。

每次都有朋友说图片内容信息太多,不喜欢繁琐,要求让它简单点也行。如果还是觉得太密了,就多分一些页

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

你去减去一些信息,重做。这个风格我很满意,版式也可以,就是后面 5 张图信息太密了

十一、产品合成与品牌物料

之前我大多做的都是基于一个 logo 去延展相关的周边。今天我们尝试一个不一样的:基于已有的产品去反推 VI,来看一下效果。

图一是参考图,后面是一次性生成的图。不过这个偶尔也会出现直接一张图全部输出内容拼在一起的情况,所以大家在提示词里面一定要限制清楚,每一张图是怎样的去单独输出

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

以我上传的产品图为唯一参考,从瓶身的配色、圆润造型、极简表情、几何细节和现有品牌文字中提取视觉基因,反向设计这个品牌的完整 VI,并分别生成 8 张独立的横向 16:9 图片。品牌名称统一为 “XIAO ZHEN”,系列名称为 “LITTLE MOODS”,以奶油黄、蜜桃粉、雾紫、薄荷绿和番茄红为品牌色,建立统一的圆润字标、字体风格、表情符号、辅助图形和插画语言,整体年轻、温柔、俏皮,具有成熟生活方式品牌的设计感。8 张图片分别表现:①以品牌标志与字标为主体的视觉形象;②运用品牌色彩和字体设计的创意文字海报;③由表情和几何元素延展的品牌图案;④具有独立角色形象的品牌插画;⑤包装盒、手提袋与包装纸的组合;⑥名片、信封、品牌卡片等印刷物料;⑦帆布袋、T 恤、贴纸等品牌周边;⑧品牌店铺门头与空间导视。产品图用于提供品牌设计线索,瓶子无需出现在每张图中,品牌图形和角色也无需沿用瓶子轮廓;让提炼出的视觉语言自然应用于不同载体。整套设计保持同一个标志、字体、配色与图形系统,同时让每张作品具有不同构图与鲜明重点。每张图片只呈现一幅完整的平面作品或一个统一空间中的应用场景,图文排版精致,主体突出,留白合理,物料材质真实。禁止分屏、分格、拼贴、模块拼版、九宫格、规范展示板和缩略图集合。依次生成并单独输出 8 张图片文件,每张均为 16:9,不要合并成总图。

再来一组原产品保真合成图,也是一次输出。这里第二张图,之前生成的时候只有三个杯子,所以我让它重新生成了。仔细看细节的话,感觉它还是有一点点质量上的损失。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

超多案例实测GPT Image 2.5!一口气了解10个应用场景

以我上传的产品图为唯一产品参考,制作一组原产品保真合成广告图,共 4 张,每张竖版 2:3,分别生成、单独输出。严格保留原产品的瓶身比例、杯盖结构、表情、哑光质感、配色对应和原有印字:奶油黄瓶身搭配薄荷绿斜顶盖,蜜桃粉瓶身搭配番茄红圆环盖,雾紫瓶身搭配薄荷绿猫耳盖,薄荷绿瓶身搭配番茄红矩形提手盖。将原产品作为摄影主体融入新场景,可调整摆放位置、整体大小与光影匹配,避免重新设计、拉伸变形、混搭杯盖或改变产品颜色。每张可选择其中 1 至 4 款展示,产品完整清晰,场景道具不遮挡关键造型。

四张分别围绕不同活动节点展开:①春日上新,以嫩绿草地、柔和日光和少量春季花卉营造清新氛围,标题“春日好心情”;②夏日出游,以晴朗天空、野餐布和旅行小物营造轻松户外场景,标题“带上小情绪,出发”;③开学季,以书本、笔记本和彩色文具构成有秩序的桌面场景,标题“新学期,好状态”;④年末礼赠,以礼盒、缎带、暖色灯光和少量番茄红装饰营造温暖节日氛围,标题“把好心情送给你”。

每张均清晰展示品牌名称“XIAO ZHEN”与系列名称“LITTLE MOODS”,品牌名称作为画面中的正式广告排版,搭配圆润醒目的标题字体和简洁辅助文字。整组延续产品的奶油黄、蜜桃粉、雾紫、薄荷绿和番茄红视觉体系,保持统一品牌气质,同时让四个活动主题在场景、构图和氛围上有明显区别。采用精致商业摄影与自然合成效果,产品与环境的透视、光线方向、接触阴影和反射协调可信,主体突出,留白合理,不添加虚构功能、价格或促销信息。每张都是一幅完整广告画面,禁止分屏、分格、拼贴、九宫格及多图展示板,最终输出 4 张独立的 2:3 图片文件。

Templates 和热门这里,点击直接出相关周边也很方便的,大家可以多尝试一下,非常有趣。

比如上传图片,点击表情,直出贴纸。

超多案例实测GPT Image 2.5!一口气了解10个应用场景

十二、小结

整体来说,局部修改更听话了,透明底素材也非常好用。在做系列海报、产品换场景以及日常修图时,这些功能都会非常实用。

但是在风格化这一部分,我的感觉是并没有那么惊喜。

在今天的这些尝试里面,复杂材质和部分的风格化画面依然有噪点和杂质。在多轮的改图过程中,它并没有延伸出更多、更加有亮点的全新风格。

它的风格还是比较常规,都是一些大众所熟悉的风格,并没有像 Midjourney 那样具备更多的美感。这里多嘴一句,Midjourney V8.2 最近的那个对话编辑功能其实也挺好用的。

速度方面,我在网页版的体感上是快了一些。官方给出的口径是相比于 2.0 生成的延迟最多降低了 50%,但我感觉具体还是要看任务。

不过在多图生成的时候,反而会发现它的平均速度可能还会快过单张图的生成。

官方开发文档也写了局限:复杂提示词可能需要长达 2 分钟,文字的位置和清晰度仍然有可能出错;多次生成时,角色与品牌元素可能变化;复杂版式里的元素也可能放不准。

官方说会向 ChatGPT、ChatGPT Work 和 Codex 用户开放,API 也已发布 Flare 和 Sunburst 两个版本,分别侧重速度与更精细的编辑,后者耗时更长。

我本来想从 API 去跑,但是充完钱之后,被提示说需要验证(个人验证或者组织验证),基本上都很难搞。大家谨慎消费,理性充值哦。

回到标题说的 “小小进步”,对模型本身来说,这次提升的幅度或许不算大,但落到我们日常做图、改图的流程中,已经能带来不少实用的帮助。大家也可以多试试不同的用法,看看这些细节上的进步,能帮自己省下哪些事。

最后,今天的分享就到这里了。如果你是半夜刷到的,看来是真爱粉了。那么在这里感谢你看到最后~!

如果大家觉得内容有趣或者有用,请猛猛给阿真猛猛三连,非常感谢~~

下期见朋友们!

收藏
点赞 26

复制本文链接 文章为作者独立观点不代表优设网立场,未经允许不得转载。