从生硬到惊艳:我的AI做图半年进阶路
今年年初,平顶山做新媒体运营的小陈第一次用AI做图时,生成了一张构图诡异、手指畸形、背景像灾难现场的"设计图"。她差点当场放弃这个工具。但半年后的今天,她已经在用AI为平顶山本地的餐饮店、美容院、培训机构生成日常宣传图,客户完全看不出是AI做的。这个转变背后,是她在反复踩坑中总结出的实用技巧。
很多人觉得AI做图就是打几个字的事情,事实远没有那么简单。AI是一个"技术很好的画手,但完全不懂你在想什么"——你给出的提示词越模糊,它生成的画面就越不可控。经过半年的摸索,我总结出一套让AI乖乖听话的提示词写法,无论是在Midjourney、DALL-E还是国内的文心一言、通义万相上都通用。
提示词三段式写法,让AI秒懂你的意图
这是半年里学到的最核心的技巧:把提示词拆成三段——主体描述、环境氛围、风格参数。第一段说清楚画面里有什么(主体和动作),第二段描述整体氛围和颜色,第三段指定艺术风格和画质。比如平顶山一家奶茶店要做一个春季新品的海报,一般的提示词可能是"春天的奶茶"——这太笼统了。用三段式写法则是:"一杯粉色的草莓奶茶放在木质桌面上,有新鲜草莓和薄荷叶装饰,背景是虚化的樱花树" + "柔和温暖的春日阳光,粉白色调,清新文艺氛围" + "摄影级质感,景深效果,4K画质,小红书风格"。
用这个结构生成的图片,从第一版就能达到可用的水平。平顶山一家做中式糕点的老店,我们帮他们生成了一组端午礼盒的推广图,三段式提示词生成的画面,从礼盒质感、光线效果到背景道具,每一张都可以直接拿来用,省去了请摄影师拍摄的成本和时间。三段式写法的核心价值在于:你把控制权从AI手里夺了回来,变成了你在"指挥"AI。
局部修改+参考图,解决"手指不正常"难题
AI做图最让人崩溃的就是细节翻车,尤其是手部。平顶山一家手作工坊要生成一张"老师傅在做陶瓷"的图片,第一次生成的手部图片完全没办法看——要么手指多一根,要么握姿别扭。后来我们用了两个技巧解决了这个问题:第一,利用AI工具的局部重绘功能,框选手部区域,加入"hand, realistic, natural position"这样的提示词,重新生成手部细节;第二,提供参考图——找一张真实的陶瓷师傅工作照片,让AI参考手部姿势。
这两个方法组合使用后,手部问题基本解决了。同样的逻辑也适用于文字生成。AI在画面中生成文字经常出现乱码或者错别字,平顶山一家教育培训机构要一张"暑期招生"的海报时,我们直接用图片编辑软件把文字部分留空,AI生成完背景图之后再用PS加上文字,这样既保证画面质量,文字又是完全正确的。这个"做减法"的思路值得分享:不要让AI去做它不擅长的事情(精细文字、复杂手部),而是让它做最擅长的(构图、光影、质感),然后人工收尾。
从通用到专业:建立自己的提示词库
半年下来,我积累了一个包含200多条提示词的专属库。这些提示词按照场景分类:餐饮美食、人像写真、产品展示、室内设计、活动海报等。平顶山的场景和一线城市不同,我们更常需要的是"接地气"的画面——比如本地小吃、街边店铺、社区活动。这些场景如果直接用通用的提示词模板,往往会生成太"洋气"或者太"假"的画面。比如生成平顶山街边早餐店的画面,需要在提示词里加入"中国三线城市街景、早市氛围、红色招牌、接地气"等关键词,才能得到符合本地审美的效果。
建立自己提示词库的方法其实很简单:每次生成一张满意的图片,就把它的提示词和不满意的地方一起记录下来。然后在下一次生成类似画面时,在这个基础上微调。经过两三个月的积累,你会发现针对自己的行业,已经有了几十条经过验证的"最佳提示词"。平顶山本地做电商的商户,花一周时间就能建立起针对自己产品的提示词库,之后每生成一张图片的效率和质量都会有质的飞跃。这六个月的真实感受是:AI做图不是魔法,而是你需要用心去"驯化"的工具。掌握了正确的方法,它就是你最得力的设计助手。