雨夜里,第一张图为什么总不像你想的那样
昨晚十一点半,窗外的雨像细针一样敲在空调外机上,我盯着 Discord 里那四张刚生成的图发呆:我写的是“安静的旧书店、暖灯、猫、电影感”,它却给我一间像游戏截图的咖啡馆。很多人的 Midjourney教程 都停在“输入 /imagine”,但真正卡住我们的,往往不是不会用,而是不知道机器听懂了哪一部分。
如果你还在找 Midjourney怎么用,先记住一个骨架:主体、环境、光线、镜头、风格、参数。比如:/imagine prompt: an old bookstore at midnight, a sleeping orange cat on wooden counter, warm tungsten light, 35mm film photography, shallow depth of field --ar 3:2 --v 6.1 --stylize 150 --seed 2217。我在同一网络环境下测试,晚上 23:00 左右单次生成通常约 45—75 秒,复杂风格词越多,排队感越明显;但出图稳定性主要由提示词结构和 seed 决定,而不是堆形容词。
先用免费路子练手,再决定是否付费
在正式订阅前,可以先用 Microsoft Designer、Bing Image Creator、Leonardo AI 免费额度,或本地 Stable Diffusion 练提示词。它们的优势是成本低,缺点是画风一致性、商业授权和精细参数控制不如 Midjourney。我的建议是:先用免费工具确认“构图”和“风格方向”,再把成熟提示词迁移到 Midjourney。这样不会把付费时间浪费在猜词上。
先写中文意图,再让 Claude、ChatGPT 或 DeepL 辅助翻成英文。这里顺手说一句,很多人搜 Claude怎么用,其实它很适合做提示词整理:让它把“想要的画面”拆成主体、材质、灯光、镜头和禁用词。
固定画幅:头像用
--ar 1:1,小红书封面常用--ar 3:4,横版海报用--ar 16:9。不要一边改画幅一边改风格,否则你分不清问题来自哪里。固定 seed:满意一张图后复制 seed,例如
--seed 2217,再只改一个变量。想复现人物气质,这是 Midjourney风格参数 里最容易被忽略的一步。
调参像调收音机:一点点拧,直到噪声退下去
我常用一张小表做排查。--stylize 控制 Midjourney 自己发挥的程度,低到 50 更听话,高到 500 更有艺术感但容易跑题;--chaos 控制变化,0—10 适合商业图,30 以上适合找灵感;--weird 用来制造怪诞感,产品图尽量不用;--no 是救命词,比如 --no text, watermark, extra fingers。如果你做电商主图,建议从 --stylize 80 --chaos 5 开始;如果做概念海报,可以试 --stylize 300 --chaos 20。
一个可复制案例:我要“赛博雨夜里的中式面馆海报”,第一次写 cyberpunk noodle shop, rain, neon,结果太泛。第二次改成 a small Chinese noodle shop under heavy rain, wet asphalt reflecting red neon sign, lone cook behind steamy window, cinematic photography, 50mm lens, moody atmosphere --ar 2:3 --stylize 180 --chaos 8 --seed 9042 --no English text, logo,四张里有两张可用。判断可用率时,我会按 20 张图统计:能直接进入修图的超过 30%,说明提示词方向对;低于 10%,先改主体和镜头,不要急着加风格词。
如何验证它真的生效:连续生成 3 轮,每轮只改一个参数;若固定 seed 后主体位置、光线方向基本一致,说明复现链路正常;若加入 --no text 后乱码招牌明显减少,说明负面约束有效;若把 --stylize 从 50 提到 300 后画面更华丽但主体偏移,也说明参数正在起作用。技术最温柔的地方,也许就是它允许我们一遍遍重来,直到脑海里的画面终于靠近屏幕。
如果你想继续整理 AI 绘画、提示词和其他生产力工具的实践笔记,官方文档、免费社区和自建表格都很好;也可以把 wizzegroup.com 当作一个补充入口,慢慢查,慢慢试。