1. 一个被低估的参数:--style raw 到底改变了什么
第一次看到--style raw这个参数的时候,我和大多数人一样,以为它就是个"去滤镜"开关。直到有一次帮一个做产品摄影的朋友调图,他用 Midjourney 生成一批极简风格的产品场景图,怎么调提示词都有一股说不清的"AI 味"——画面太满、光影太戏剧化、构图太"标准"。我让他加上--style raw试试,出来的第一张图他就愣住了:画面安静了,留白多了,光影变得克制,像是一个真实摄影师在自然光下拍的,而不是一个渲染引擎算出来的。
这就是--style raw的核心价值。它不是一个简单的风格开关,而是改变了 Midjourney 底层对提示词的"解读权重"。默认模式下,Midjourney 的模型会主动往画面里"加戏"——它会自动补全它认为好看的构图、光影、色彩饱和度,甚至会自动添加一些你没要求的元素。而--style raw会大幅降低这种"自动美化"的倾向,让模型更忠实地执行你提示词里写的东西,减少它自己的"审美判断"。
打个比方:默认模式像一个热情过头的助理,你说"帮我拍张咖啡杯的照片",他会自动帮你摆盘、打光、加背景、调色,最后交给你一张很漂亮但可能不是你想要的图。而--style raw更像一个听话的摄影师,你说什么他拍什么,光线是平的、背景是素的、构图是直的,但每一个细节都对应你指令里的描述。
这个参数在 V5.1、V5.2、V6 以及后续版本中都可以使用,写法就是直接在提示词末尾加上--style raw。它和--stylize参数是互补关系:--stylize控制的是"艺术化程度"的高低,数值越高模型越自由发挥;而--style raw是一个开关,开启后模型的自由发挥被大幅压缩。两者可以同时使用,比如--style raw --stylize 100,意思是"在 raw 的基础上,允许一点点艺术化处理"。
很多人第一次用--style raw会觉得"怎么变丑了",这很正常。因为默认模式那种高饱和、高对比、强光影的"糖水片"风格,在视觉上确实更抓眼球。但如果你做的是商业摄影、产品图、建筑可视化、纪实风格插画,或者任何需要"真实感"和"可控性"的场景,--style raw几乎是必选项。它让 Midjourney 从一个"艺术家"变成一个"执行者",这个转变对专业工作流来说价值巨大。
2. 为什么这个参数值一百万:从可控性说起
标题里说"一个百万元的 Midjourney 问题",这不是夸张。在商业设计领域,可控性就是钱。一个设计师如果每次生成图都要抽卡几十次才能得到一张能用的,时间成本就是最大的浪费。而--style raw解决的核心问题,恰恰是"可预测性"。
我做过一个粗略的统计:在默认模式下,同一个提示词连续生成 20 张图,画面之间的差异可能非常大——构图、光影、色调、甚至主体位置都在变。而开启--style raw后,同样 20 张图的差异会明显缩小,画面更稳定,更接近你提示词描述的那个"基准状态"。这意味着你可以用更少的抽卡次数得到可用的结果,也意味着你可以更精确地控制画面的走向。
这个"稳定性"在批量生产场景下尤其重要。比如你要为一个品牌生成 50 张风格统一的产品场景图,默认模式下你可能需要反复调整提示词、反复抽卡,最后还要靠后期统一色调。而--style raw配合固定的提示词模板和种子值(--seed),可以做到批量输出风格高度一致的图,后期只需要微调。
另一个被低估的点是:--style raw让提示词里的"负面描述"更有效。默认模式下,你写"no people",模型可能还是会塞几个人影进去,因为它觉得画面需要"故事感"。而 raw 模式下,模型对提示词的服从度更高,"no people"就是真的没有人。这个特性在做建筑效果图、室内设计图、纯风景图的时候特别有用。
还有一个实际场景:当你需要把 Midjourney 生成的图作为底图,再导入 Photoshop 或 Stable Diffusion 做二次加工时,--style raw输出的图通常"更干净"——光影更平、色彩更中性、细节更少被模型"脑补"。这给后期留出了更大的操作空间。默认模式那种已经"调好色"的图,后期再改反而容易脏。
所以这个参数值不值一百万,取决于你怎么用它。如果你只是随便玩玩,它可能没什么感觉。但如果你把它嵌入到一个商业工作流里,它带来的可控性提升、时间节省、后期便利,折算成人力成本,确实值这个数。
3. 核心参数拆解:--style raw 与它的搭档们
要真正用好--style raw,不能只盯着它一个参数。它和 Midjourney 的其他参数是协同工作的,理解它们之间的关系,才能发挥最大效果。
3.1 --stylize 与 --style raw 的配合逻辑
--stylize(简写--s)控制的是模型"艺术化"的程度,取值范围通常是 0 到 1000。数值越低,模型越保守,越接近提示词的字面意思;数值越高,模型越自由,画面越有"艺术感"。
默认模式下,即使你把--stylize调到 0,模型仍然会做一些基础的"美化"。而--style raw是在这个基础上进一步压缩模型的自主发挥。两者叠加的效果是:
| 参数组合 | 效果描述 | 适用场景 |
|---|---|---|
默认 +--s 100 | 模型适度美化,画面平衡 | 通用插画、概念图 |
默认 +--s 750 | 模型高度自由,画面戏剧化 | 艺术创作、海报 |
--style raw+--s 0 | 极度忠实提示词,画面朴素 | 产品图、纪实摄影 |
--style raw+--s 100 | 忠实为主,轻微美化 | 商业摄影、建筑可视化 |
--style raw+--s 300 | 在真实感基础上增加艺术感 | 时尚大片、氛围图 |
我的经验是:如果你做的是需要"真实感"的图,--style raw --s 50到--style raw --s 150是最舒服的区间。再低会显得太"干",再高又会开始出现默认模式那种"AI 味"。
3.2 --chaos 参数在 raw 模式下的表现
--chaos(简写--c)控制的是生成结果的多样性,取值范围 0 到 100。数值越高,四张图之间的差异越大。
在默认模式下,--chaos高的时候画面会变得很"乱",因为模型本身就在自由发挥,再加上 chaos 的随机性,结果往往不可控。但在--style raw模式下,--chaos的表现会温和很多——因为模型的基础发挥被压制了,chaos 带来的更多是构图和视角的变化,而不是风格和光影的失控。
我通常在做"同一主题多方案探索"的时候会用--style raw --c 20左右,既能得到不同的构图方案,又不会让画面风格跑偏。
3.3 --seed 与 raw 模式的稳定性叠加
--seed参数可以固定生成的随机种子,让同一提示词在同一 seed 下生成相似的结果。在默认模式下,即使 seed 相同,画面仍然会有较大波动。但在--style raw模式下,seed 的"锁定"效果会明显增强——相同 seed 生成的图,构图和光影会非常接近。
这个特性在做"系列图"的时候特别有用。比如你要生成一组 10 张同一风格的图,可以先固定一个 seed,然后用不同的提示词主体去生成,这样出来的图在风格上会高度统一。
3.4 权重语法与 raw 模式的化学反应
Midjourney 支持用::给提示词的不同部分分配权重,比如cat::2 dog::1表示猫的权重是狗的两倍。在默认模式下,权重语法经常被模型的"自主发挥"稀释——你给猫加了权重,但模型可能还是把狗画得很大。
而在--style raw模式下,权重语法的效果会明显更"听话"。你给谁加权重,谁在画面里的存在感就真的更强。这让精确控制画面元素比例成为可能,对做商业构图的人来说是刚需。
4. 实操流程:从提示词到成图的完整链路
光说原理没用,我把自己日常用--style raw的工作流完整拆一遍,你可以直接照着抄。
4.1 提示词结构设计
用 raw 模式的时候,提示词的结构比默认模式更重要。因为模型不再帮你"补全"了,你写得不清楚,画面就会很空。我通常用这个结构:
[主体描述] + [环境/背景] + [光线描述] + [视角/构图] + [风格参考] + [参数]举个例子,我要生成一张极简风格的产品图:
a ceramic coffee cup on a wooden table, minimal white background, soft natural window light from left, top-down view, clean composition, product photography --style raw --s 80 --ar 4:5注意几个细节:光线描述要具体("soft natural window light from left"而不是"nice lighting"),视角要明确("top-down view"),风格参考要克制("product photography"就够了,不要堆一堆风格词)。
4.2 参数配置与迭代
第一轮生成后,我会根据结果调整。常见的调整方向:
- 画面太暗:加 "bright, well-lit" 或者调整光线描述
- 构图太满:加 "minimal, negative space" 或者降低
--s值 - 主体不够突出:用权重语法给主体加权重,比如
ceramic coffee cup::2 - 风格太"AI":继续降低
--s,或者加 "realistic, photographic"
我一般会迭代 3 到 5 轮,每轮只改一个变量,这样才能知道是哪个改动起了作用。
4.3 批量生成与筛选
确定好提示词和参数后,我会用--repeat或者多次提交来批量生成。raw 模式下,同一提示词的输出稳定性较高,所以筛选成本比默认模式低很多。我通常生成 20 到 30 张,然后挑出 3 到 5 张可用的。
筛选的时候重点看:构图是否符合预期、光线方向是否正确、主体细节是否清晰、有没有多余元素。raw 模式的图通常"素"一些,所以后期空间大,不要因为第一眼不够惊艳就淘汰。
4.4 后期处理衔接
raw 模式输出的图,我通常会导入 Lightroom 或 Photoshop 做基础调整:对比度、色温、锐化。因为 raw 模式的图色彩偏中性,后期调整的余地很大。如果是做产品图,我还会用 Photoshop 抠图换背景,raw 模式的图边缘通常更干净,抠图难度更低。
5. 常见问题与排查技巧实录
用--style raw的过程中,我踩过不少坑,这里整理成速查表,方便你对照排查。
| 问题现象 | 可能原因 | 解决方法 |
|---|---|---|
| 画面太灰、太暗 | raw 模式减少了模型的光影美化 | 在提示词里明确写光线,如 "bright natural light" |
| 画面太空、元素太少 | raw 模式不自动补全元素 | 提示词里补充环境细节,如 "with a plant in background" |
| 风格太"素"不够好看 | --s值太低 | 适当提高--s到 100-200 |
| 主体不够突出 | 权重分配不明确 | 用::语法给主体加权重 |
| 四张图差异太大 | --chaos值偏高 | 降低--c到 10 以下 |
| 相同 seed 结果仍不同 | 提示词有微小变动 | 确保提示词完全一致,包括标点和空格 |
| 画面出现多余元素 | 提示词有歧义 | 用负面描述,如 "no people, no text" |
| 色彩偏淡 | raw 模式色彩中性 | 后期调整,或在提示词里加 "vibrant colors" |
几个我踩过的具体坑:
第一个坑是提示词写得太简略。默认模式下,你写 "a cat" 模型能给你生成一张完整的猫图。但 raw 模式下,你写 "a cat",它可能真的只给你一只猫,背景是纯灰的,光线是平的。所以 raw 模式下,提示词要写得像给摄影师写 brief 一样详细。
第二个坑是--s值没调对。我一开始用--style raw --s 0,出来的图太"干"了,像没调色的原片。后来发现--s 80到--s 150才是甜点区,既有真实感,又不至于太朴素。
第三个坑是忽略了--ar参数。raw 模式下,宽高比对构图的影响更明显。如果你要竖构图的人像,一定要写--ar 2:3或--ar 9:16,否则默认的 1:1 会让画面显得很"堵"。
第四个坑是 seed 的复用。我以为固定 seed 就能得到完全一样的图,但实际上如果提示词有任何改动(哪怕加了一个逗号),seed 的效果就会变。所以做系列图的时候,提示词模板要完全固定,只改主体描述部分。
6. 进阶玩法:把 raw 模式嵌入专业工作流
如果你已经把--style raw用熟了,可以试试这几个进阶玩法。
6.1 与 Stable Diffusion 联动
raw 模式输出的图,因为光影平、色彩中性,非常适合作为 Stable Diffusion 的 ControlNet 底图。我通常用 raw 模式生成构图和光影,然后导入 SD 用 ControlNet 锁定构图,再用不同的模型和 LoRA 做风格化。这样既能保证构图可控,又能得到更丰富的风格。
6.2 批量生成品牌视觉素材
做品牌视觉的时候,我会先确定一套提示词模板和参数组合(--style raw --s 100 --ar 16:9 --seed 12345),然后只替换主体描述,批量生成几十张风格统一的图。因为 raw 模式稳定性高,这批图的风格一致性很好,后期只需要统一加 logo 和文字就行。
6.3 建筑与室内可视化的快速草图
做建筑可视化的时候,raw 模式可以快速生成"素模"级别的效果图,光影真实、材质朴素,非常适合给客户看方案方向。确定方向后,再用默认模式或--s更高的参数生成"效果图"级别的图。这个流程比直接出效果图再改要高效得多。
6.4 与 Photoshop 生成式填充配合
raw 模式的图细节较少,这反而给 Photoshop 的生成式填充留出了空间。我经常用 raw 模式生成基础场景,然后导入 PS 用生成式填充添加细节元素,比如加个人、加个植物、换个天空。因为 raw 模式的图"底子干净",填充后的融合效果通常比默认模式的图更好。
7. 我个人的使用心得
用了大半年--style raw,最大的感受是:它把 Midjourney 从一个"灵感工具"变成了一个"生产工具"。默认模式适合头脑风暴、找灵感,因为模型会给你惊喜。但 raw 模式适合执行、落地,因为模型会给你控制。
我现在的工作流基本是:用默认模式快速探索方向,确定方向后切到 raw 模式做精确执行。两个模式配合使用,效率比只用一种高很多。
还有一个心得是:raw 模式对提示词功底的要求更高。默认模式下,提示词写得糙一点,模型能帮你圆回来。raw 模式下,提示词写得糙,画面就真的糙。所以如果你刚开始用 raw 模式,建议先把提示词结构练熟,把光线、视角、构图这些描述写清楚,再上参数。
最后分享一个小技巧:如果你觉得 raw 模式的图太"素",可以在提示词末尾加--s 100到--s 150,再配合 "cinematic lighting" 或 "soft shadows" 这类光线描述,出来的图会在真实感和美感之间找到一个很好的平衡点。这个组合我用了很久,实测下来很稳,适合大多数商业场景。