1. 第三辑选稿流程:从600多份投稿里留下24件的四道关
第三辑开始征稿的时候,我其实有点担心。前两辑已经把"一眼惊艳"的作品收得差不多了,这一辑会不会变成矮子里拔高个?结果三个月后投稿量不降反升,加起来有600多份,比我预估的多了快一半。这说明Imagifly 的用户群体确实在快速变大,而且大家对自己的作品越来越有表达欲,不是随手生成一张好看图就丢社区,而是会认真写提示词、反复调优、甚至为一张图配上一段完整的创作笔记。
这一辑的24件作品,就是从这600多份里筛出来的。有不少朋友在后台问过,到底怎么才能上精选?我借这篇博文把筛选逻辑完整说一遍,也算是给下一辑定个相对透明的标准。
1.1 初筛:淘汰最快的是一眼AI
初筛阶段我只看两件事:原创性和可辨识度。
原创性不是指"你是不是从零画了一张图",而是指你有没有在生成结果之上留下自己的判断。比如同样用Imagifly 生成一个赛博城市,新人可能直接按默认参数出一张图就投稿;成熟用户会先确定视角是俯瞰还是平视,再决定街道密度、霓虹灯颜色倾向,甚至会在生成之后用局部重绘工具改掉几个不协调的元素。后者的画面里也许会有瑕疵,但你能感觉到有人在背后做决策,而不是甩手交给模型。
可辨识度则是另一道试金石。很多投稿作品单看局部都很华丽,但整体风格飘忽不定,像三张不同风格的图硬拼在一起。这种作品在初筛阶段就会被放回待定池,除非它有极强的叙事支撑,否则很难走得更远。另外,我在初筛时会抽查投稿附带的生成记录或工作流截图,目的不是查水表,而是确认作品确实来自Imagifly 社区流程,防止有人把别的工具生成的成品直接贴过来。
这一轮下来,600多份大概会砍掉一半以上。留下来的共同特征是:你看第一眼就知道作者想表达什么,而且愿意再看第二眼。
1.2 复选:看的是控制感,不是运气
进入复选之后,我的评片维度会变成三个:可复现性、叙事效率、风格一致性。
先说可复现性。我筛选时会私下复制优秀投稿的提示词结构,在Imagifly 里按同样思路跑一遍,看能不能复现出接近的效果。能复现不意味着"提示词写得越长越好",恰恰相反,很多入选作品的提示词核心只有十几到二十几个词,但每个词都踩在关键点上。如果一张图从提示词到参数都复现不出当时的效果,我会怀疑它是不是多张图拼接或者大量手动修图的结果,这种作品虽然美,但对社区其他人的借鉴价值有限。
叙事效率则是我个人很看重的一条。举个实际例子,这一辑有两张黄昏场景投稿,一张拍的是高楼间隙里的落日,构图很标准,颜色也很漂亮;另一张把落日处理成一枚正在缓缓下沉的钟表指针,周围的行人都朝着指针方向走。后者严格来说光影问题不少,但它在三秒之内给了我一个故事,落选那张也很好,只是它太"正确"了,正确得没有留下作者自己的指纹。
风格一致性在单图作品里体现为"所有元素服从同一视觉逻辑"。入选作品很少出现人物很写实、背景却很卡通的割裂感。即使要做材质拼接,也一定有一条统一的打光逻辑把所有物体捆在一起。这不是玄学,而是"整张图的光源方向和阴影密度是否统一"这种可以被量化的判断。
1.3 终选:把24件分成五组的真正原因
终选阶段我碰到的最大难题不是选出最好的,而是如何让这24件彼此之间不撞型。如果24张全是超写实人像,读者看三张就会疲劳,精选集也就失去了"打开眼界"的意义。
所以我按画面的主要动机,而不是按题材,把入选作品分成五组:想象力重构、光影氛围、扁平叙事、材质特写、概念造型。你可能会问,为什么不按"风景""人物""科幻"这种传统题材分?因为Imagifly 的创作者很多时候不是先想好题材再动手,而是先被某种画面感觉击中,再去寻找合适的题材承载它。按动机分组,更容易让读者理解"原来这类画面效果是可以被有意识追出来的"。
这五个组名并不是我拍脑袋定的,它们来自投稿中对创作意图的自我描述。我发现凡是入选作者,几乎都能说清楚自己这张图"好玩在哪里",哪怕说法很朴素,比如"我想让云看起来像奶油",这已经构成了创作动机。反之,写不出动机的作品,多数停留在技术练习层面,我会建议作者再沉淀沉淀再投。
2. 入选作品拆解:五个组别里的代表性画面
下面我会从每组里挑一两件来聊,不会提作者ID,只谈画面和画面背后的思考。一方面是不想打扰创作者,另一方面也是因为对作品的解读本来就应该是开放的,不应该被"作者原意"锁死。
2.1 想象力重构组:熟悉的东西换个姿势
这一组最打动我的作品,是一把悬浮在城市街道上方的伞。它的构思如果拆开看并不复杂:还是那把普通的黑色长柄伞,还是灰蓝色的雨天街景,但伞的高度被放在了楼顶上方,伞下挂着一串细小的水滴,形成一截悬空的"雨帘"。伞的材质处理得很收敛,没有刻意做金属反光,反而保留了布料受潮后的哑光感,这让整个超现实场景有了一种奇怪的合理感。
另一件入选作品是"灯塔内部剖面图":作者把灯塔切成纵剖面,每一层分别是守塔人的书房、旋转楼梯、巨大的透镜机组、底部潮汐发电装置。画面用色不多,以暖黄色灯光和冷蓝色海水做对比。它的提示词技巧可以从画面反推出来,应该是在主体名词前加了"cutaway view"这类剖面视角词,同时在每个功能层里都放了一两个材质锚点,比如黄铜望远镜、生锈阀门,让AI 不会把细节全糊成一片。
这组作品给普通用户最大的启发是:想象力不是天马行空,而是"把熟悉的元素放到一个错误但自洽的空间里"。伞不应该在天上,但它配上雨帘就自洽了;灯塔剖面图也是,现实中你不会同时看到所有楼层,但在剖面视角下,这种压缩是成立的。
2.2 光影氛围组:让光线成为第一主角
选这组时我忍痛淘汰了不少高动态范围的"炫技作"。那种一看就能感觉到作者把对比度拉满、阴影死黑、高光过曝的图,放在手机屏幕上确实很抓眼,但经不起放大细看。真正能留下来的是把光线当作叙事语言的作品。
我印象最深的是那张"清晨雾街"。场景本身只是一个普通居民区的转角,作者没有安排任何戏剧性主体,就是一杯外带咖啡放在窗台上,蒸汽和晨雾混在一起。画面整体饱和度压得很低,只在咖啡杯边缘给了极细的一抹暖光。看第一眼觉得寡淡,但三秒钟之后你会开始好奇:这杯咖啡是谁放的?人去了哪里?这是典型的用"缺失感"讲故事的思路。
另一张入选作品是一组玻璃器皿的静物,不同之处在于作者用硬光制造了极其锐利的投影,玻璃透明部分的边缘线控制得格外干净。这个效果在Imagifly 里通常需要反复微调提示词,单纯写"glass"容易得到一堆半透明噪点,需要在负向提示词里排除"折射模糊""过度反光""玻璃泛白发灰"等特征。从这两张图的经验来看,氛围感不是靠堆滤镜,而是靠克制。你告诉模型光线从哪里来、往哪里去、在哪个平面上留下痕迹,比你写一百个形容词都管用。
2.3 扁平叙事组:把复杂世界压成图案
这组作品和主流AI绘图偏爱的高细节写实风格正好相反,它们追求的是"少就是多"。
入选的一张是"通勤地铁平面图":作者用俯视视角把一节车厢里的人物压成扁平的剪影色块,每个人物的动态都不同,有看手机的、打哈欠的、抱紧背包的,虽然都没有五官,但乘客的情绪反而因为"失去表情"变得更强烈。颜色上用了低饱和的莫兰迪色系,车厢内部结构线是极细的白色勾边,整体感觉像是一张用色块写成的社会观察笔记。
另一张"城市漫游路线图"也很有意思,它把一张地图变成了一条由街道、桥梁、屋顶和路灯组成的连续线条,行人被绘制成沿路径移动的点状符号,每个点都带有一段短短的尾巴,形成速度感。这种作品其实对构图要求极高,因为一旦线条的疏密没有组织好,画面很容易变成一锅粥。作者显然是先用草图定了线稿走向,再通过图生图方式交给AI 上色,这比纯靠提示词一次成型要可靠得多。做这类作品最忌讳的是贪多,每一寸画面都想塞细节,结果一看反而像个填色游戏。
2.4 材质特写组:让观看者想伸手去摸
材质特写组是我个人最偏爱的一组,因为它的门槛非常直白:你要让观看者相信画面的质感是真的。
这一辑有一张"磨损工具箱"特写,入选原因很简单,它把皮革提手磨出的包浆、金属锁扣的划痕、木头角落磕碰留下的凹坑都表现得恰到好处,既不会干净得像样品展览,也没有脏到让人不适。这里的关键不是提示词里堆"old""rusty""worn"这些形容词,而是要在画面里给出物理线索,比如划痕的方向必须符合使用习惯,锁扣的锈迹应该从边角开始而不是均匀分布。为了达到这种效果,用AI生成之后通常还要做局部重绘,把个别不合理的磨损位置单独修掉。
另一张"水的形态"组图被拆成了四联画:一滴水坠入水面的瞬间、涟漪扩散到边缘的波形、玻璃表面凝结的水珠、以及水汽在冰冷金属上凝成的雾面。单独看每一张都只是材质练习,合在一起就形成了一种"时间切片"的叙事张力。作者给每组图统一了深色背景和45度侧光,让四张图之间有了强烈的序列感。这也提示我们,材质图不一定非要一张图惊艳所有人,做成系列反而更容易获得评委的好感。
2.5 概念造型组:先有设计,再有画面
最后一组和上面四组都不太一样,它考验的不只是审美,还有造型设计能力。
入选作品里有一件"机械植物",你可以把它理解成由黄铜、橡胶管和玻璃灯泡组成的藤蔓植物,每一片叶子都是一块半透光的电路板。它的厉害之处不在于单个零件画得有多精细,而在于整棵植物的生长逻辑是自洽的:藤蔓沿着金属支架攀爬,灯泡的位置对应着植物开花的位置,连根部的营养液都被设计成一种发光的电解液。这种自洽感让一个明显不存在的东西变得可信。
还有一件"由民居组成的人像侧影",它的做法是用大量方块形建筑拼出一个人脸的轮廓,阳台窗户作为高光节点,屋顶的坡度作为阴影转折。这张作品如果只看小图会觉得是像素艺术,放大了才发现每栋建筑都有自己的细节,有晾晒的衣物、有空调外机、有露台花盆。作者一定是先画了侧脸轮廓的草图,再确定建筑群的网格密度,最后才交给Imagifly 补充细节。概念型作品最忌讳的是"先画了再说"——设计在前,生成在后,AI 才能成为你的笔,而不是你的老板。
3. 这些作品都在用的生成参数组合:提示词与后处理节奏
看完作品点评,很多人可能更想知道具体怎么调出类似效果。这辑入选作品我没有刻意统计过参数,但在整理工作流截图的时候确实看到了一些共性,把它们总结成了一套可以落地的操作思路。
3.1 提示词的三层结构:主体、环境、影调
大多数落选作品的提示词都栽在同一个坑里:想表达的东西太多,写成一长串名词堆叠,模型反而不知道该强调谁。
我更推荐把提示词拆成三层来看。第一层是主体层,用一到两个不间断词组锁定画面核心,比如"一位穿着旧皮衣的老人坐在候车厅长椅上",这里的关键是"旧皮衣"和"候车厅长椅"提供了人物与环境的关系。第二层是环境层,专门补充背景和空间氛围,比如"清晨六点的冷光从落地窗斜射进来,地面上一层薄灰",它为画面填充了可感知的空气。第三层是影调层,控制整体色彩和镜头感,比如"低饱和度胶片色,35mm镜头,略有颗粒感",这决定了画面的质地去向。
我选了三张投稿中比较典型的提示词结构做示例,读者可以直接参考框架,不必照抄名词:
主体层:an old fisherman mending a net beside a wooden boat 环境层:harbor in the early morning, mist over the water, ropes and buoys scattered nearby 影调层:soft overcast light, muted blue-gray palette, documentary photography, 50mm lens注意环境层里的"ropes and buoys"这类小物件,它们的作用是给模型更多的"锚点",让画面不至于只有主角和一个空洞背景。但如果环境层里出现超过四个并列元素,画面就会失焦,所以一定要克制。
3.2 负向提示词:把灾难挡在门外
这一辑入选作品里,凡是人物特写类,几乎都用了负向提示词。负向提示词不是万灵药,但它确实能用最低成本排除掉最常见的高频瑕疵,比如扭曲的手指、多余的肢体、对称性崩坏、文字乱码。
我的建议是建立一套自己的"基础黑名单",每次生成时都带上。以下是我常用的负向词池,供参考:
- 手指相关:extra fingers, deformed hands, missing fingers, fused fingers
- 结构相关:asymmetric face, double chin, distorted face, broken anatomy
- 渲染相关:oversaturated, overexposed, plastic skin, smooth plastic texture
- 画质相关:blurry, low-res, watermark, text, signature
负向提示词不是越多越好,因为过度约束会让模型变得"不敢画",导致画面发灰、构图平庸。把负向提示词控制在十到十五条以内,并且定期根据翻车案例增删,效率会高很多。
3.3 分辨率、步数与种子:成片前最后一道关
Imagifly 用户里流传着一句话:"生成一张好图的时间,有一半花在选种子上。"
步数不必一味求大。以我这边的实测经验来说,步数在25到35之间通常就有足够细节,再往上走并不会带来肉眼可辨的提升,反而可能让画面噪点变多。采样器选择上,DPM++ 2M Karras 这类偏稳的采样器更适合场景塑造,而DPM++ SDE Karras 更适合追求光影强烈变化的作品,但这只是经验,不绝对。
分辨率设置上,我建议先以768或1024的短边起步,把构图和主题确定下来,再通过放大脚本或外部超分工具处理成高清版本。直接一上来拉到2048甚至更大,很容易在细节区域出现"脑补过度"的问题,比如皮肤纹理变成不规则的褶皱,树叶被涂抹成奇怪的线条。
种子(Seed)是很多人最容易忽略的参数。同一套提示词,换一个种子可能就是完全不同的世界。入选作者普遍会花时间"刷种子",先锁定三到五个满意的种子号,再在其中挑选最能代表自己意图的画面,而不是跑出一张觉得不错就立刻收手。这个刷种子的过程看似笨拙,但它保证了最终作品的完成度。
3.4 图生图与局部重绘:把"差不多"改成"对了"
第十届作品谁也不会蠢到直接一张图到底。入选作品里至少有六成经历过二次甚至三次处理,最常用的两步是图生图和局部重绘。
图生图适合整体调整风格和色彩倾向,比如想保留原构图但把写实风格往手绘方向拉,重绘幅度一般控制在0.4到0.6之间。幅度太低,风格变化不明显;幅度太高,构图和主体物都会跑掉,反而得返工。
局部重绘则适合修细节。比如某张街景作品的人物手部崩了,我一般会用蒙版把手臂区域选出来,单独填一条描述清晰手势的提示词,再把重绘范围控制在0.5左右,生成两三次后替换原区域。很多时候,一张图从"看起来还行"到"真的能入选",靠的就是这最后10%的修正功夫。
4. 投稿里的高频问题复盘:为什么有些作品初看很好、细看就垮
评完这600多份稿子,我最大的心得不是审美问题,而是大多数人根本不知道自己的图"垮在哪里"。这些问题非常典型,我拉出来逐条复盘一下,也方便大家对着自己的图自检。
4.1 主体与背景糊在一起
这是最普遍的问题,大概占落选作品的四成。表现为主体和背景的边缘过渡模糊,人物或物体像是被"贴"在背景里,缺少空间层次。
原因通常有两个。一是提示词里的景深信息不够,模型没有被告知"哪个该实、哪个该虚",于是雨露均沾。二是在后处理时把景深效果生硬地涂抹掉,或者反转了远近关系。修复方法比较简单:在提示词环境层里加入明确的景深词,比如"shallow depth of field, background softly blurred",同时在图生图阶段尽量保持背景虚化区域的一致性。还有一种很管用的做法是给主体加一圈"轮廓光",也就是让背景光源从主体边缘透出来,这样哪怕主体和背景颜色接近,也能通过边缘光分成两个图层。
4.2 细节崩坏与"塑料感"
细节崩坏容易出现在手指、对称的结构、复杂重复图案上。但它并不总是被一眼发现,尤其是小尺寸预览时,可能要到放大之后才看到六根手指或扭曲的关节。这种问题在终选阶段几乎是一票否决的存在,因为一张图的细节最能反映创作者是否真的完成了最后一步检查。
但"塑料感"比结构崩坏更隐蔽,也更要命。很多作品经过放大和锐化处理后,皮肤或者物体表面会呈现出一种光滑得不自然的质感。它来自两个地方:一是生成阶段采样器选择不当导致过度平滑,二是后期盲目叠加降噪滤镜。要解决塑料感,我建议在后期处理中减少全局锐化,改为只对眼睛、轮廓线、布料纹理等关键区域做局部增强。请记住:真正的质感往往藏在瑕疵里,过度光滑反而显得廉价。
4.3 光线方向不一致
这个问题非常有意思:单看每个局部都画得很好,但整体就是觉得"不对"。绝大多数情况是光源方向没有统一。比如一个人物脸上是左侧光,帽子的投影却朝向左后方,背景建筑的受光面又来自右边。AI 生成时如果提示词里没有明确的光源设定,就可能出现这种"多头灯"效果。
我的建议是养成一个习惯,在提示词里写清楚主光源的方向和强度,甚至在条件允许的情况下给一个简单的光源布局描述,比如"soft window light from the left, warm tone, gentle shadows falling to the right"。这个动作能解决很大比例的"说不清哪里怪"的问题。
4.4 后期过度修饰
这个坑通常是"想救图"救出来的。我在投稿里看到不少底子不错的作品,被一键锐化搞得边缘发白,或者被饱和度拉到失真。有些作者明显把生成图当照片来修,什么HDR、局部提亮、色彩平衡全上,结果弄成了一张塑料味十足的商业图。
说到底,Imagifly 生成的作品本身已经具有完整的色彩倾向,后期的角色应该是微调和修复,而不是重塑。我的经验是:后期最多做三件事,压缩画质损失、修正小瑕疵、统一画面明暗关系。如果做完这三步还没解决问题,不如回到提示词层面重新来过,而不是继续在错误的方向上修补。
5. 下一辑投稿前建议:想进精选集,先想清楚这三件事
文章的最后一部分,我想给准备投下一辑的朋友一些非常具体的建议,不是泛泛的"多练习",而是我从600多份投稿里总结出的、真的能提升入选概率的操作。
5.1 题材选择:小而完整的场景远胜大而空的架子
我注意到一个有趣的现象:落选作品里"宏大世界观"特别多,比如全景式未来城市、横跨星空的战舰、超级英雄对阵怪兽。这些题材当然有视觉冲击力,但也恰恰因为题材太宏大,作者往往只完成了一个"大场面",没有余力照顾具体的人物情感或环境细节,结果画面空洞,像一张舞台背景板。
相反,那些投稿里的小场景,比如一个雨夜便利店的橱窗、一台老旧咖啡机旁边的杯子、一只蹲在防盗网上的猫,反而更容易打动评委。原因在于小场景的目标明确,作者有能力把光线、材质、氛围都打磨到位,完成度因此更高。第三辑的投稿建议第一条就是:别急着拍宇宙,先把一个小小的角落拍好。
5.2 组图优于单图
从第二辑开始,我就发现组图的入选率比单图高出一截。原因不难理解:单图只能展示一个瞬间,组图却可以展示一个过程、一种变奏、一组并列关系,它能更完整地呈现作者的思考。这就像拍照片,单张可能是运气,一套系列则是能力。
第三辑里无论是"水的形态"四联画,还是一组"午夜加油站"不同机位的三连张,都明显比它们单拆出来的效果更耐看。建议想冲精选的作者尝试做2到4张的同主题组图。不需要复杂的故事情节,只需要保证统一的视角逻辑、统一的色彩倾向、统一的光源规则,就能让作品的完成度上一个台阶。
5.3 保留创作过程:这是你的隐形加分项
投稿表单里有个可填项叫"创作说明",很多作者直接留空,非常可惜。其实评委对"作品背后的过程"一直很有兴趣。你是如何构思提示词的?中间有没有反复翻车?为什么最终选择这个种子?这些问题能让作品从一幅好看的图,变成一次可以被学习、被复盘的案例。
第三辑入选作品里有不少作者通篇只写了一两句话,比如"想把以前家楼下的路灯画出来",就足够打动人了。因为这句话解释了画面中那种说不清的熟悉感从哪里来。建议大家在投稿时随手保留至少一份过程截图、一个参数列表、一段100字以内的创作意图,这些材料也是将来做个人作品集时的重要资产。
整理完这一辑,我最大的感受是:好作品的标准并没有因为工具变强而提高,反而变得更朴素了。以前大家赞叹一张图是因为"它居然能生成得这么像",现在大家都在问"这个人在其中做了哪些选择"。工具把生成的门槛拉平之后,审美判断、叙事意识和自我表达的边界,就成了真正区分作品的东西。下一辑征稿开启时间会在Imagifly 社区里公布,我依然会在后台一个个看过去,也希望在这篇文章里提到的那些坑,大家最好一个都别踩。要是能在投稿时告诉我"你从这篇文章里改进了什么",那这第三辑精选集就又多了一层意义。