一管洗面奶立在抛光大理石上,牛奶像被人按了暂停键,水花在半空中冻住,米粒悬着一动不动。整张图里唯一真实的东西,是它看起来足够贵。
这种图以前得请摄影师、租棚、上高速闪光,拍砸一次就重来,现场一片狼藉。现在它是一段文字换来的,贴进 ChatGPT 就行。
这段文字长这样:一个 JSON,也就是程序员用来写配置的那种花括号格式,里面分了 negative_prompt(禁止清单)、camera(镜头)、lighting(灯光)、composition(构图)、render_settings(渲染设置)好几块,光是镜头就拆了四个子项。看起来像一张精密的参数表。
这张表里没有一个字段是模型真的在执行的。它从头到尾只是在读一段被排版过的话。
那为什么还要写成 JSON?因为这套结构不是写给 AI 的,是写给你自己的。它的价值不是让 AI 听得更准,是让你改得更快。
这话有点狠,我用这张图自己露出来的三处破绽来证明。
打开这段提示词的第一行,你会看到花括号后面直接跟了一个字符串,前面没有键名。
正常的 JSON 里每一项都得是“键: 值”,比如“镜头: 85mm”。这一项只有值,没有名字。这份被当参数表转来转去的东西根本不是合法 JSON,拿校验器一跑就报错。
可它出图了,而且出得很好。
这件事只能推出一个结论:在 ChatGPT 这类直接把提示词当文本吃进去的图像模型里,没有解析器在读这个 JSON。模型收到的是一长串文字,不是字段和取值。花括号、冒号、引号,在它眼里和逗号句号一样,都只是分隔符。
我给这个认知起个名字,叫读稿不读表。你写的每一个字段名,比如 lighting、camera,模型都当普通英文单词读。它们确实起作用,但方式是“这段话里提到了灯光和镜头”,而不是模型收到了一个叫灯光的参数。
适用范围说一句:这条只管把整段提示词当自然语言读的模型,也就是你在 ChatGPT 里直接贴提示词那种。有些工具确实提供了独立参数接口,不在此列。
先说清楚证据的分量:这三处破绽我是从同一张成片上读出来的,样本就一张。后面那八张图是我按这套判断反过来验证的,目前没碰到例外。你要是跑出了反例,我很想看。
想清楚这一点,后面两个破绽就都能看懂了。
回头数一下这段提示词里的重复项。
正文那一大段里已经写了 85mm lens, f/8,后面 camera 块又写了一次 "lens": "85mm" 和 "aperture": "f/8"。正文写了 soft diffused studio lighting 和 subtle rim light,lighting 块再写一次。正文写了 photorealistic、global illumination、ray-traced reflections,render_settings 块又把这三样写成了 true。
如果真有个解析器,这叫冗余,该删。但在读稿不读表的前提下,这叫重复加权:同一个概念在一段话里出现两次,它在整段里占的分量就更重。
所以这套结构真正在做的事,不是把参数整理干净,是把最重要的那几件事说了两遍。它更像一份带着强调号的稿子。
再看一个更有意思的地方。这段提示词里同时写了 f/8 和 shallow depth of field。懂摄影的都知道这两个是打架的,f/8 是大景深,前后都清晰,浅景深得开大光圈才有。
那成片是哪一种?都不是。整张图从水花到米粒到台面几乎全清晰,背景是一片没有任何物体的渐变,压根不存在虚化这件事。
模型执行的不是光学,是气质。
你写 85mm、f/8、shallow depth of field,它接收到的意思是“这应该像一张专业广告摄影棚里出来的照片”,然后往那一类图像上靠。矛盾不矛盾它不在乎,因为它从来没有在算镜头。
同理,render_settings 里的 ray_tracing、global_illumination 也不是渲染开关,没有渲染器被打开。它们的作用是把画面往 CG 广告图那一堆参考里拽。有用,但和你想的那种有用不是一回事。
这是最反直觉的一处。
negative_prompt 里明明白白写着不要 text overlays、不要 AI generated visuals text、不要 logos in corners、不要 duplicate rice grains。
再看图。包装正面是大号品牌标识,下面一整段产品文案清清楚楚,容量、成分、认证圆标一个不少。米粒几十颗,形态高度相似。
禁令全被无视了,而且被无视得非常正确。
原因还是那句话,这里没有独立的负向通道,你写的 negative_prompt 是被一起读进去的一行字。(有种说法是写多了反而会把这些词召唤出来,这一条我没有做过对照实验,你就当我的猜测听。)
但更关键的是第二层:就算禁令全部生效,这张图也就废了。产品包装上不印字,那还叫产品吗?
所以你要学会分辨两种东西:
受控出现:这类东西表面被禁,实际必须以正确方式存在。包装上的印刷文字必须清晰正确,画面上的浮层文字必须没有。产品正面的品牌标识要留,画面四角的贴标要去。同一种颗粒可以成群出现,机械复制粘贴式的整齐阵列不行。
真禁令:这类才是写了就该管用的,比如水印、社媒账号、第二件产品入画、产品被裁切、暗光脏背景、包装变形、糊图。这些一旦出现,图就是废的。
以后写负面清单,先问一句“这东西完全没有,图还成立吗”。答案是不成立的,就不该写进禁令,该写进正面描述里说清楚它以什么形式出现。
拆完了骗你的部分,说真的起作用的部分。我把这张图反复看下来,撑住它的只有七条关系,少任何一条它都会掉档:
商品绝对静止绝对清晰,介质绝对动态。整张图的张力全来自这个速度差。
介质在商品周身形成环绕结构,要围一圈,不能只在一边。原图里那圈向上炸开的牛奶叫皇冠,是液体溅起时的经典形状。
空中有第三种悬浮固体颗粒。液体给爆发,颗粒给纵深,缺了它画面会扁。
一块有厚度的实体承台,表面湿润带倒影,把上下画面连成一体。
背景是没有任何可辨识物体的同色系柔光渐变。
正面大柔光箱做主光加边缘轮廓光,商品身上不能有硬阴影。
全图收敛在两三个邻近色内,介质颜色和背景颜色同源。
这七条我叫它锁死区。你改任何东西都别碰它们,碰了就不是这一类图了。
既然结构是写给自己看的,那就该按“哪些会变、哪些永远不变”来排,而不是按 camera、lighting 这种教科书顺序排。
下面这份是我重排过的版本,锁死区写死,要改的地方全部提成变量:
Ultra-premium [品类] product photography, hero shot of [主体描述] standing upright at the center on a polished [承台材质] slab, dramatic frozen [介质] splash wrapping around the product, soft foam clouds on both sides, floating [悬浮颗粒] suspended in mid-air, [色板] color palette, clean luxury advertising aesthetic, high-end commercial campaign, pristine studio environment, glossy reflections on wet surface, translucent liquid dynamics, ultra-detailed packaging, macro product focus, elegant minimal composition, [情绪定调] mood, photorealistic, soft diffused studio lighting, subtle rim light, high dynamic range, crystal-clear textures, realistic liquid simulation, 85mm lens, f/8, ultra sharp, cinematic quality, global illumination, ray-traced reflections, clean background gradient, professional retouching, magazine cover quality, product packaging text must be crisp and legible, brand mark on product front is kept negative: watermarks, social media handles, corner stickers, floating caption overlays, a second product in frame, cropped product, dark lighting, messy background, deformed packaging, mechanical grid-like duplication, artifacts, compression, blurry, low resolution
要改的只有六个位置:[品类]、[主体描述]、[承台材质]、[介质]、[悬浮颗粒]、[色板],加一个可选的 [情绪定调]。
填的时候别只填一个词,一个词模型接不住。[主体描述] 填 a bottle 太空,填 a dark forest-green apothecary glass essential-oil bottle with a matte black dropper cap 才有画面。[介质] 填 honey 不够,填 amber honey 才带上颜色。具体到材质、颜色、质感三层,这是变量位好不好用的分水岭。
比例不在这段文字里控制,你在 ChatGPT 里生成时直接说要几比几,或者在生图工具的比例选项里选。原图是 4:5,下面这八张我用的是 3:4。
我还在正面描述里加了两句原版没有的话:包装文字必须清晰可读,产品正面标识保留。这就是把那两个受控出现从禁令里捞出来,明写成要求。负面清单只留真禁令,text overlays 换成了更准确的 floating caption overlays,duplicate 换成了 mechanical grid-like duplication。
下面八张图,全部只动了这六个位置。
看图之前先说清楚,免得白高兴:这八张图上的牌子全是模型自己编的。
开头那张原图的品牌标识、成分文案、容量标注全部准确,是因为它有产品实拍图垫底。纯靠文字描述,模型不可能凭空还原一个真实存在的包装。这段提示词单独用,只能得到一个好看的虚构瓶子。
要做自家产品:先在 ChatGPT 里上传两三张产品实拍图,白底正面一张、带包装细节的近景一张,再贴这段提示词,加一句“保持上传图中的产品外观、包装文字和标识完全不变,只重建场景、介质和光线”。模型负责换环境,不负责重新设计你的包装。出图后重点检查包装上的字有没有被改写,那是最容易翻车的地方。
主体换成墨绿玻璃精油瓶,介质换成琥珀色蜂蜜流,悬浮颗粒换成金色迷迭香针叶和琥珀碎粒,承台换成湿润胡桃木,色板换成暖金棕。
为什么这样改:先做一次最保守的验证。六个变量位全换,七条锁死区一条不碰,如果这张图还能成立,说明这张图纸是真的。
改完什么样:
主体不动,只动光和色。主光从正面亮白棚光改成侧后强轮廓光加微弱正面补光,色板从亮白冷蓝压到近黑深蓝,介质从牛奶水换成碎冰与冰水,颗粒换成冰晶碎屑。
为什么这样改:主体描述一个字没动,只靠光和色,清爽干净就变成了冷冽克制。做冬季款、做男士线、做夜间场景,这一招够用了。
改完什么样:
题材换成冷萃咖啡铝罐,介质换成牛奶与冷萃没有完全混合的双色分层涡流,颗粒换成烘焙咖啡豆,承台换成深绿大理石,皇冠形态从高瘦改成矮宽。
为什么这样改:换品类不能只换名词。饮品广告卖的是倒进去的那一秒,皇冠得压矮、铺宽,才有那个往外涌的感觉。如果你只把 face wash 改成 coffee,其余照抄,出来的图会像一罐咖啡站在别人的舞台上。
顺便说个坑:这张我生了两次。第一次模型在罐子上编了个真实存在的咖啡品牌名,补一句“品牌名必须是虚构的”才干净。做展示图,这句建议常备。

第一句从产品摄影改成成分科普海报,主体换成医用滴管瓶,介质换成透明凝胶柱,颗粒换成在凝胶里分层悬浮的微囊球,信息组织从环绕爆发改成垂直分层。
为什么这样改:前三张都在卖货,这张第一次换用途。换用途必须从第一句改起,不改第一句,模型永远返回一张卖货图。观看目的从想买变成想懂,画面就得从炸开变成排好。
这张还暴露了一件事:我的禁令里写着不要浮层文字,但海报天然需要文字,模型直接把成分注释排上去了,而且排得比我预想的好。换用途的时候,真禁令也要跟着换。卖货图里的浮层文字是脏东西,科普海报里它就是内容本身。
改完什么样:
把荷兰静物油画的视觉方法嫁接进来,单侧窗光、深色场、厚涂笔触质感、器物排布的沉静秩序。主体换成沙龙香水的厚玻璃瓶,介质换成黑墨与金粉的涡流,颗粒换成干玫瑰花瓣。
为什么这样改:外来的视觉方法能接进来,但锁死区不是被打破了,是被等价迁移了。柔光渐变从亮调换成暗调同色系衰减,正面柔光箱换成单侧大面积柔光,商品身上依然没有硬阴影。气质随便变,那七条得找到对应的新身份,这是改图的安全绳。
改完什么样:
把观众整个挪到水面之下,从下往上仰视。主体换成银色不锈钢保温杯,承台被水面替代,皇冠从水下看变成一圈倒扣的光环,颗粒换成上升气泡与碎冰。
为什么这样改:观看位置本身也是变量位。商品从被供奉在台上,变成从上方刺进你的世界,性格立刻就变了。
改完什么样:
主体换成手工黄铜钢笔,介质换成熔融黄铜液,颗粒换成飞溅火星与铁屑,承台换成锈蚀铁砧,色板换成黑与橙铜。
为什么这样改:这张是故意找茬。锁死区要柔光、无硬阴影、洁净,熔融金属天生自带强自发光和硬影,两者打架。解法是让熔铜当画面里唯一的暖光源,环境用大面积冷柔光把阴影压软,火星去承担边缘光。冲突要成立,得给个物理上说得通的理由,不能硬堆。
改完什么样:
主体换成古董黄铜潜水头盔,场景换成深海,介质换成墨蓝海流,颗粒换成生物发光孢子与细小气泡,承台换成被珊瑚包裹的沉船木梁,用途从卖货变成沉浸展览主视觉。
为什么这样改:最后一张试边界。主体、场景、介质、用途全换掉,只留最小的那条关系:绝对静止的主体、环绕式动态介质、悬浮颗粒的纵深、无物体的同色系柔光,这次柔光来自发光孢子。只要这条还在,图就不会散。
改完什么样:
第一件,你可能想反驳我:JSON 版出图确实更稳,我对比过。
这个反驳是对的,稳是真的。但原因不是格式被解析了,是这套格子逼你把该写的全写全了,还顺手制造了关键词重复加权。JSON 改变的是你,不是模型。把这段提示词的花括号全删掉、连成一段逗号隔开的长句再跑一次,出图质量不会明显下降。这是验证我这套说法最快的方式。
认清这一点你才有得赚:既然结构是给自己用的,那就按自己的使用方式排,把变量集中放在一起,别再按 camera、lighting 这种和你实际工作无关的顺序排。
第二件,别去动那七条。
最常见的翻车,是有人觉得背景太空了加点东西吧,往后面塞了绿植和窗户。加完那一刻,这张图就从广告大片掉成了产品摆拍。锁死区的每一条都在替你挡掉一次掉档。动它之前,先想清楚你是想要另一种图,还是想要这一种图的更好版本。
01 / 04
02 / 04
03 / 04
04 / 04
四个牌子,四种气质,全是 AI 生成的。共同点是:你划到的第一秒不会想"这是 AI 做的",你会想"这个广告投了不少钱"。
我把这套提示词整个拆开研究了一遍,今天把方法给你。不管你是想给自家小店做张海报、做个活动图发朋友圈,还是接一单设计私活,这副骨架都能直接抄。
大多数人写生图提示词,写的是画面里有什么:一位女模特,穿米白色西装,站在柔和的渐变背景前,8K,超写实,浅景深。
这些词全对,图也会很好看。但它挂不上广告牌,只是一张好看的照片。
真实的商业海报里几乎都压着两层东西:一层照片,一层版面。版面里有品牌标志、标题、卖点、按钮、价格、网址、边角上竖着排的小字。AI 图一眼假,不是因为脸不真、布料不真,是因为它只有照片,没有版面。
所以这套提示词做的第一件事不是描述画面,是把画布切开,规定谁占多大地方。
这里有个地方你得先接受:只要这张图要放促销信息,那它越像一张设计稿,就越像真的广告。你为了让图更真而堆的那些参数,方向反了。
这是全篇最短、也最值钱的一句。下面我管它叫分地——这类叫法都是我自己顺口起的,不是设计圈通用行话,你知道我在指哪个动作就行。
在提示词的构图段落,写死三个数字:
Typography occupies 70%. Model occupies 20%. Promotional elements occupy 10%. Visual hierarchy: [主视觉词] → 主体 → 促销 → 行动指令
一旦写下这三个数字,模型对这张图的理解就变了。它不再把人当主角、把字当贴纸,而是反过来:字是主角,人是配角,促销是脚注。这正是真实广告海报的重心分布。
这个动作跟风格没有半点关系。我拿一个气质完全相反的牌子试给你看。
把奢华米白换成 Dr. Martens 的硬核黑皮,主视觉词换成 BROKEN IN(穿到服帖了),色板换成黑皮革、水泥灰、黄色缝线,模特从站姿改成坐在字母上系鞋带。面积分配一个字没动。
为什么这样改:Dr. Martens 和奢华时装是两个极端。如果连它都成立,说明分地是骨架,不是风格。
改完什么样:
字占了七成,接下来的问题是:这七成怎么放才不像 PS 加上去的水印。
提示词里写死 letters extend beyond frame edges、some letters cropped。字母被画框切掉一截,人脑会自动补全那一截,尺度感立刻起来;完整端正摆在正中的字,多数时候反而像后期贴上去的。切的位置有讲究:切主干比切边缘狠,横杠被切一半的 A 比缺个角的 A 有力得多。这一条最舍不得下手,也最见效。
高对比衬线(笔画粗细反差大、两端带小装饰,像西式请柬上的字)给的是奢华克制,紧缩无衬线(笔画等粗、两端光秃)给的是街头音量,学院粗衬线配徽章是复古美式。这是常见搭法不是定律,也有牌子拿极简无衬线做出克制感。但字形得在动笔前定,选完再用形容词补救会很吃力。
让它参与遮挡、投影、反射,平铺的图层就变成了建筑。这一步是整张图的承重墙,墙塌了图就散。
两个案例,一个演示裁切,一个演示字形。
Freitag 那套回收卡车篷布做包的路子,主视觉词 CUT,让字母 C 被画框真的切走一半,场景从影棚换到卡车装卸月台,材质换成防水布拼接色块。
为什么这样改:这个牌子的做法本来就是把废料裁开再拼起来。概念和形式对上了,裁切就不只是技巧,是在说这个品牌是谁。
改完什么样:
Rimowa 铝合金箱,主视觉词 BUILT,字形从高对比衬线换成工业等宽体,字母表面带铝制凹槽的反光,柔光换成硬光。
为什么这样改:同一个位置、同一个面积,只换字形,出来的气质完全是另一家公司。全篇最省力、也最见效的一次改动。
改完什么样:
现在把人放进去。
绝大多数人在这里犯同一个错:把人放在字前面。人站在版面前,版面就退化成背景板,那张图又变回照片了。
正确的写法是让人和字咬合:
Some letters hidden behind the model. Body partially intersecting typography. Model stepping through the giant typography.
看第一张 ZARA。模特的肩膀正好切断了字母 A 的横杠,你分不清她是站在字前面,还是字从她身后长出来。这一点点分不清,就是这张图的空间纵深。
人物本身也要换个写法。别写表情,写状态:不笑、不摆拍、直视镜头、双手放松、纯粹的自信。表情词会让模型交出图库脸,状态词才会给你广告脸。
跳出服装,做一场现代舞演出季的海报。机位从平视改成贴地仰视,主视觉词 WEIGHTLESS 断成 WEIGHT / LESS 两行,舞者腾空,一条腿横穿过上面那行字的字缝,黑场加一束顶光。
为什么这样改:把咬合关系推到极限。看的人不再是在挑商品,而是在仰头看一个悬在半空的人,观看关系整个变了。
改完什么样:
让 AI 把海报文字排对,靠的不是写清楚"我要什么字",而是先告诉它每一块字坐在哪。
我自己反复试下来,位置钉死之后,文字错位和乱码明显少了,版面也会自动长得像广告公司出的稿。这九个位置照抄就行:
这跟"把提示词分块写"不是一回事。常见的分块分的是内容;这里分的是坐标,写每块字钉在哪个角。文字位置恰好是 AI 生图最容易翻车、外行也一眼能看穿真假的地方,所以这九行性价比高得离谱。
还有一条纪律:促销信息绝不做成横幅或弹窗,要用细线、小字号和大留白嵌进网格,处理成杂志的信息层。提示词里那句 Integrated naturally into layout. Not banner spam. 就是干这个的。
只保留三样东西不动(巨型主视觉词、这九个位置、单一品牌色主导),其余全换。主体从人换成一块被掰得东倒西歪的巧克力板,牌子换成 Tony's Chocolonely,主视觉词 UNEQUAL,满屏正红。
为什么这样改:这个牌子的巧克力故意掰得不均匀,讲的是可可产业的分配不公。信息最密的场景,正好把九个位置一次用满,你能看清每块字各自坐在哪。
改完什么样:
前面四步给了你一副骨架。最后这一步决定它长成谁。
在提示词最前面,写一句这个品牌到底在卖什么。下面三句不是品牌官方话术,是从这套提示词里拆出来的定位判断:
这三句不描述任何画面,却决定了后面所有事。卖身份,画面就得干净、单色、克制、没有环境干扰;卖梦里的生活,就得有阳光、远处的海、被风吹起来的布料;卖可能性,就得挤进四个人、四种穿法、高饱和撞色。
这句是整张图的灵魂句:整份提示词里唯一一句不写画面的话,也是唯一一句换掉之后整张图会彻底变样的话。
把「向往和逃离」这个主题换一条表达路径,从地中海度假换成一句道别。Vespa,主视觉词 CIAO,薄荷绿车身,罗马石板路,骑手回头,字母被拱门截断。灵魂句改成:Vespa 卖的不是摩托车,是一句意大利语的再见。
为什么这样改:同样是让人想立刻出门,度假场景讲的是"去某个地方",一句 CIAO 讲的是"离开这里"。想说的东西没变,路径换了,情绪完全不同。
改完什么样:
五步合拢,就是下面这份。方括号里的是变量,其余原样保留。
FORMAT Ultra-Premium [品类] SMM Promotional Poster Vertical 3:4, Instagram Hero Creative Commercial Graphic Design, Agency-Level Art Direction 8K UHD, Hyper-Realistic, Photography × Graphic Design Fusion CORE STRATEGY [品牌名] sells [卖的不是什么,是什么] rather than [商品]. This is not an advertisement. This is a [品牌主张] disguised as a promotional poster. Typography is not decoration. Typography is architecture. COMPOSITION Typography occupies 70%. [主体] occupies 20%. Promotional elements occupy 10%. Visual hierarchy: [主视觉词] → [主体] → Promotion → CTA MASTER VISUAL Massive oversized [字形族] typography dominates the composition. The word [主视觉词] occupies nearly 70% of the canvas. Letters extend beyond frame edges. Some letters cropped. Some hidden behind [主体]. Some functioning as compositional structure. HERO SUBJECT [主体描述:材质 + 廓形 + 配色策略] [状态词,不写表情:不笑 / 抓拍而非摆拍 / 纯粹自信] Body partially intersecting typography. TYPOGRAPHY HIERARCHY Top Left: [品牌标志], small wordmark Center: [主视觉词], massive scale, partially cropped Left Mid: [季度信息] + [促销标签列] Lower Left: [活动标题,两行] + [支撑文案一句] CTA Block: [动词] → [一行说明], solid color block Bottom Strip: [品类导航,竖线分隔] Bottom Right: [起价或折扣] Bottom Center: [网址] Vertical Edge: [品牌 + 季度代号] Integrated naturally into layout. Not banner spam. COLOR SYSTEM Primary: [主色组] Accent: [强调色] Single dominant brand color, neutrals for balance. LIGHTING & CAMERA [布光方案],Shot on ARRI Alexa Mini LF, [焦段] lens [调色方向] grading, visible [材质] texture, natural skin detail NEGATIVE No AI slop. No artificial HDR. No excessive retouching. No catalogue styling. No editorial-only aesthetic.
最后那行 No editorial-only aesthetic(不要只有摄影感)千万别删。它管的是这张图会不会退回成一张普通照片。
里面有三个词值得单独说一句:
SMM 是社交媒体营销的缩写。这一行在告诉模型:这张图是拿去社媒投放的,不是杂志内页。
ARRI Alexa Mini LF 是一款专业电影摄影机的型号。写它不是真要它拍,是让模型往真实广告的光影和景深上靠。换成任何你叫得出名字的相机也行,但别空着。
Vertical 3:4 只是我这次的出图比例。Instagram 信息流常用 4:5,竖屏故事是 9:16,按你要投的地方改。
方括号里的变量填成什么样最难拿捏,照第一张 ZARA 的填法看一眼就有数了:
变量一律用英文填最稳。中文也能出,但要控制在两到四个字,而且得单独交代字形和字重,不然笔画容易粘成一团。
用之前还有两句话得说在前面:这套模板粘进任何支持长提示词的生图工具都能跑,即梦、Midjourney、GPT 生图都行,但别指望一次成片,我一般抓三五张才挑得出一张文字不歪、人和字咬得准的;另外,文章里用的都是真实品牌,只是拿来做技法演示,真要发出去或者交给客户,品牌名、标志、口号得全换成你自己的或者拿到授权,否则就是拿别人的商标做广告。
时装是这套骨架最舒服的场子。跳出去还能不能站住,才是它值不值得学的地方。四个案例,越走越远。
用途从社媒投放改成书店橱窗海报,画面里一个人都没有,主体换成一摞鸽灰色书脊。Persephone Books,主视觉词 FORGOTTEN。
为什么这样改:没有人的时候,谁来和字母咬合?答案是让书脊来。这一条一旦成立,这套方法就跟"必须有模特"解绑了。
改完什么样:
Smeg 那台薄荷绿复古冰箱,主视觉词 CHILL,我硬塞进五十年代的网点印刷质感——就是老报纸和旧漫画上那种由密密麻麻小圆点拼出来的印刷效果——再加粗描边和爆炸角标。网点印刷天生带廉价感,跟大留白的高级版式是打架的,让它俩正面撞一次,才知道骨架托不托得住。托住的办法是糖果色配严格网格:工艺还是那个工艺,态度变成了刻意复古。

把那一成的促销层换成公共信息。城市图书馆深夜开放公告,主视觉词是一个时间数字 03:00,主体是趴在桌上睡着的人,光只剩一盏台灯,底部原本放折扣和价格的地方换成开放时间、地址、末班车。
它一次证明了两件事:占一成的那层可以装完全不卖东西的内容;承重墙也不非得是单词,数字、符号、一个时间点都撑得住。

主题、载体、场景、媒介、主体五类全换:深海研究所的公众开放日海报,DEEP 沉在水里被鲸鱼尾巴截断,一台橙色深潜器悬在字缝中间,满画面悬浮微粒。
走到这么远,我仍然能一句话说清它靠什么成立——字大过人、主体嵌进字缝、信息层钉在坐标上。哪天说不清了,才是这套方法失效的时候。

能改的:品牌、主视觉词、灵魂句、主体、场景、字形、色板、焦段、所有促销文案、比例、语言。
看着像禁令、其实不是的:提示词里有一堆"不要",别照字面执行。它写"不要建筑不要风景",可另一张整个就是地中海建筑;写"不要亮色",可另一张满屏高饱和红;写"不要微笑",可另一张模特笑得很自然。这些"不要"更像缰绳,作用是把元素收着而不是拴死,正确读法是允许受控出现,禁止喧宾夺主:环境可以有,但不能吃掉字的地盘;亮色可以有,但只能一个主色打头;表情可以有,但得符合这个牌子的人格,不能是图库式假笑。照字面全删掉,图会变得又空又硬,这是最常踩的坑。
真的不能碰的:AI 味(多余的手指、糊掉的文字、扭曲的标志)、假 HDR、图库式正面站定摆拍。还有唯一的致命项:画面里不能只有照片、没有文字系统。前面所有努力都撑在这一层上,它一没,图当场退回成一张好看的照片。