我用AI做了100张图,总结出这些实用技巧
2026-08-06
我用AI做了100张图,总结出这些实用技巧
上个月心血来潮,给自己定了个小目标——用Midjourney和Stable Diffusion做满100张图。本来以为就是写写提示词、点个生成的事,结果真做下来才发现,这里面的坑比我想象的多太多了。今天不聊那些虚的,直接把我这100张图踩出来的经验分享给你。
提示词真不是写得越多越好
刚开始玩的时候,我总觉得提示词写得越详细,出来的图就越接近我想要的效果。结果呢?我写过一段两百多字的提示词,包含光线、角度、镜头型号、色彩、风格、服装细节……生成出来的图反而乱七八糟,元素堆在一起,主体都不知道该看哪。
后来我学乖了,把提示词精简到核心几个要素:主体、动作、环境、风格、光线。举个例子,我写"a fox wearing a suit, sitting in a vintage bar, dramatic lighting, cinematic style"比之前那堆长篇大论效果好得多。关键信息越集中,AI就越明白你想让它干嘛。
我的经验是:提示词控制在20-40个词左右就够了,把最核心的视觉元素说清楚,别贪多。
负面提示词是你的救命稻草
这个真的是我踩坑踩出来的。用Stable Diffusion的时候,前期我完全没管负面提示词,结果生成的人物经常出现六根手指、三只眼这种诡异情况。后来我才意识到,负面提示词就是用来告诉AI"你千万别画这些"的。
我现在固定的负面提示词里至少会包含:变形的手指、多余的肢体、模糊、低质量、水印、文字。就这么几项,出图质量直接提升了一个档次。Midjourney虽然不支持负面提示词,但可以用--no参数,效果类似。
不同工具,脾气完全不同
我100张图里大概有60张用Midjourney,40张用Stable Diffusion,这两个工具的性格差异真的很大。
| 对比维度 | Midjourney | Stable Diffusion |
|---|---|---|
| 上手难度 | 低,纯对话式操作 | 高,需要调参数 |
| 艺术感 | 天生自带氛围感 | 偏写实,需要调教 |
| 可控性 | 中等,靠抽卡 | 高,ControlNet加持 |
| 出图速度 | 快,一分钟内 | 看显卡,30秒到几分钟 |
| 成本 | 付费,10-30美金/月 | 免费开源,但需显卡 |
Midjourney就像是那种天生有审美的朋友,你说个大概,它给你整得挺好看。Stable Diffusion则像个理工男,你得把每个参数都掰扯清楚,但一旦调好了,它比Midjourney听话得多。
别迷信"一键出图",后期微调才是关键
做这100张图的过程中,我最大的领悟就是:AI出图只是第一步,后期微调才是拉开差距的地方。
有张图我特别满意,主体是一只坐在王座上的猫,但背景的窗户透视有问题。用Midjourney重抽了五六次都解决不了,最后我把图扔进Photoshop,手动把窗户调了一下,五分钟就搞定。
我的工作流是:AI生成初稿 → 选最满意的1-2张 → 局部重绘或PS修图 → 加滤镜微调。 这样既不浪费AI的效率,又能保证最终质量。
风格一致性有诀窍
做系列图的时候,最头疼的就是风格不统一。同样写"赛博朋克风格",第一张可能偏霓虹灯感,第二张就跑偏成机械义肢风了。
后来我找到了一个比较管用的方法:固定风格词。找到一张满意的图之后,把它的风格描述词(比如"blade runner atmosphere, neon noir, cyberpunk")抄下来,后面每张图都带上这几个词,再加上不同的主体和场景描述。这样出来的系列图,风格统一度会高很多。
关于版权,想说两句
用AI做图这段时间,我也在思考版权的问题。说实话,目前国内对AI绘画的版权界定还在摸索阶段。我的建议是: - 商用的图,最好用完全自己生成的,别直接拿别人分享的prompt和参数来用 - 如果参考了别人的图,记得在发布时注明灵感来源 - 有些平台(比如OpenAI)是明确禁止用他们的工具生成商用内容的,用之前先看清楚条款
最后聊点实在的
做了100张图,真正能用的可能就二三十张,这个淘汰率太正常了。你要是刚开始玩,别因为出图不好看就觉得自己不行,多试几次,慢慢摸清规律就好了。
我现在养成了一个习惯,每次生成满意的图,都会把提示词和参数存下来,顺手记一句"为什么这张效果好"。时间长了,你就有了自己的素材库,再出图就快多了。
AI绘画这东西,说到底是工具,用得好不好全靠你自己琢磨。希望我这些踩坑经验能帮你少走点弯路,要是你也有什么好用的技巧,欢迎在评论区分享,咱们一起进步。