ARTICLE READING
AI 构图就三个动作:主体、留白、视线动线
AI 构图听起来玄,落到提示词里其实只有三件事:主体占多大、空的地方留在哪一边、画面朝哪个方向走。用站内两批真实素材的写法把这三件事拆开,包括留白为什么得先有理由。
构图落到提示词里,只有三件事要说清楚
构图这词听起来很大,动不动就是三分法、黄金分割、框架式构图。真到写提示词的时候,需要交代的只有三件事:主体在画面里占多大、空的地方留在哪一边、画面里的东西朝哪个方向走。剩下的都属于风格和光线。
我把站里两批素材放在一起对过一遍,一批是灵感画册里那 70 张实景,一批是创作解析里充气幻境、晶体异境、流体冲击这 45 件 3D。题材差得很远,构图的做法却是同一套。
主体:写它占多大、站在哪,别只写一个名词
画册那 70 张的构图字段,除去后面固定的三个尾巴(16:9 横构图、空间纵深、不需要给文字留位置),真正逐张被改写的只有一个视角词:低机位广角、超远景、近景浅景深、门框构图、仰视框景。70 张写出了 65 种不同说法。
换个视角词,主体是主角还是陪衬就定了。云海孤亭那张写的是「超远景,以群山云海中孤亭立于悬崖边作为视觉锚点」——亭子只占一小块,整张画的注意力却都在它身上。
45 件 3D 那边写得更直白。CQ-005 的构图栏是「主体上左偏置,地面阴影偏右,保留较大悬浮间距」,连影子落在哪、离地多远都交代了。LT-001 的构图是「液片从左下扫向右上,右下大留白」,主体栏写的是「钴蓝不透明漆液形成宽阔斜向飞溅薄片,末端少量液滴」——末端剩几滴都写进去了。
所以别只给主体一个名词。「漆液」是名词,「宽阔斜向飞溅薄片,末端少量液滴」才是在画面里能占位置的东西。这和机位、焦段与光比是同一件事的两面:视角定了,主体的地位才定。另外那 45 件的风格、约束、避免清单基本共用一套,每件重写的只有主体、构图和环境——变量要留在该变的地方,风格词块是另一半。
留白:空的地方得有理由,最好是「刚才还有人」
45 件 3D 里有 25 件,直接在构图栏写了哪一边留白。「垂流位于左三分之一,上端出画,右半整片留白」「主体压在左侧,末端向右下伸出」。
这类留白好写,背景是纯色摄影棚,右边什么都没有就是留白。换到实景就不是这回事了。画册那 70 张的构图字段里,70 张全都带着「不需要给文字留位置」这句尾巴——它只说明不必为文字空出一块,跟画面该不该空完全是两件事。实景里的空白得能被看住。
看那批图的叙事线索。雪庭回声是「庭院中央只留下新鲜脚印」,雾中路口是「空无一人的斑马线形成秩序」,无影戏台是「帷幕半开,暗示刚有人离开」。
三张画的共同点:空下来的地方都不是空的,是一段刚结束的事。脚印、斑马线的秩序、半开的帷幕,都是「刚才还在这里」留下的证据。
我的做法比较土:图哪里都填满了,先别急着加负面词,先把某样东西拿掉,再给它留个痕迹。空本身不构成画面,空的理由才构成画面。这和负面提示词是同一层意思——减掉之后总得有另一样东西接住画面,只是这里的接法是把痕迹留下。
视线动线:让一样东西往里走,眼睛才跟着走
动线最难的地方是没法直接写。「让眼睛先看左边再看右边」这种话,模型不认。
能写的是方位和动词。45 件 3D 的构图栏全都写了方位,动词也很密:扫、展开、延伸、转折、入画、越过。「长弧从左下起向上越过中部,右侧低处滴落,弧内大留白」——一句话里从哪起、到哪落、中间怎么走,全在了。
画册那批的做法是留一个开口。水榭残照是「水面几盏漂浮灯向画面深处延伸」,宫墙杏影是「一扇半开的侧门露出深院」,沙海遗门是「门洞里显出远处蓝色山影」,水面长阶是「阶梯末端隐入云中」。门、洞、长阶、长廊、水面都是同一个结构:画面里有个开口,开口后面还有一层。眼睛会自己往里走。
反过来也成立。伞下归人写着「人物不看镜头,画面重在环境」——不看镜头就是在把视线往画外推,重心随之落到环境上。
这里说一句不确定的:动线这套做法在器物特写里基本没用。青瓷微光、玉佩雪声那种近景浅景深,画面里就一个东西,谈不上视线往哪走,它们要解决的是材质边缘怎么反光。
三个动作有先后,反过来会打架
顺序是:先定主体的占比,这一步改的是机位和焦段;再腾地方,这一步改的是留白的量和位置;最后才拉线,这一步改的是那个开口朝哪。
反过来做很常见:先想好一条漂亮的动线再往里塞主体,主体被挤到边上,占比也定不下来。这时加多少描述词都救不回来,只能动机位。
那 70 张图的记录里,「关键调整」第一条全部是同一句话:「生成后如与同批次作品视角相近,优先调整镜头高度和前景元素」。这句值得抄下来——一批图里出现相似画面,该动的是视角,不是题材或风格。另两条也是同一个逻辑:主体不清晰就去增强视觉锚点、别加文字;风格跑偏就降饱和、强化真实材质。改的都是画面里的关系,不是换一套词。这种先立判断再动手的思路,和先立规则、再破规则是一路的。
还有一条来自 45 件里某一件的自评:「画面不靠多个物体制造层次,而以近端卷曲、中央薄片和末端液滴组织距离」。纵深不一定靠往里堆东西,同一个主体的不同段落也能排出远近。同一件自评里那句「主要方向清楚,缩略图仍能读出冲击」,在 45 件里只出现过一次,算不上那批的统一标准,但拿来当检查口径很好用。
出图以后把图缩到拇指那么大
不用打分,就问三件事:主体还在不在?空的那块还有没有理由?眼睛先落在哪,然后往哪走?
答不上两个,回去动机位,别加词。