

大家好,很久没有写 Midjourney 文章了,今天着手写一下,在写之前说一下最近的两条新闻,以及 Midjourney 医疗实体扫描设备 Midjourney Scanner。
1.美国斯坦福大学研究团队在这个月6号《科学》杂志上发表论文,大概内容是用AI设计出 全新、具有完整功能在实验室中复制的噬菌体。

地址:https://www.science.org/doi/10.1126/science.aec2657?utm_source=chatgpt.com
2.中国科学院历经15年研究,首次证明胶球存在,在自然界中,原子核由质子和中子组成,质子和中子又由夸克 组成,夸克之间靠胶子传递强相互作用力,胶子之间可以相互吸引而形成一种全新粒子-胶球。

地址:https://www.ihep.cas.cn/xwdt2022/rd/202608/t20260805_8259263.html?utm_source=chatgpt.com
3.Midjourney 将推出一款高端人体成分分析仪,旨在用于日常健康管理,让用户能够查看其身体成分随时间变化的精细3D图像。

地址:https://www.midjourney.com/medical/blogpost_device_development?utm_source=chatgpt.com
从上面的新闻大家看到没有,第1条在基因上一直在用AI研究,第2条量子上用的北京谱仪III对撞机 ,第3条在AI医疗上下功夫。AI 正在经历一次身份变化:从“替人做事的工具”,变成“参与人类发现、创造和改造现实的基础设施”。
在开始之前还是要聊一下,最近群里的小伙伴讨论 “MJ 是不是已经过时了”“没有人用了”等等,我看到后也认真的回复一下,这是一个非常有意思的话题,其实每一个模型都有自己的优势和劣势,通常在我用的时候 MJ 依旧是不可或缺的,如果你是偏视觉方向的运营应该理解我这句话,也有可能群里的设计师群体较多,偏向 GUI 界面可能对你没有多大用处。
比如以我的某些使用方式:用 MJ 出审美比较高的角色图像,用 Nano Banana Pro 出稳定且统一的角色姿势图像,再用 GPT image 2 出画面发散且连续的场景图像。
开始这次文章的内容,先看看 V8.1。

其实在 Midjourney V7版本以后,并不存在一种唯一 “正确” 的提示词写法。只要最终生成的图像符合你的预期,那么这个提示词就是有效的。
但是当生成结果与你的想法不一致时,你把提示词看作一种 视觉控制工具,那么提示词调试会变得更加容易。
描述你希望画面中 实际出现的内容。将最重要的主体放在提示词靠前的位置,保持句子直接,并且容易被模型解析。
而不是:
指令式表达 [例如“让它看起来像……”]、模糊的情绪描述、相机参数信息、与画面无关的故事性填充内容。
我将用 niji 7 加风格参数作为例子演示:


原文提示词:
Hades, the Greek god of the underworld, a powerful and handsome dark ruler, masculine and elegant, noble facial features, intense mysterious eyes, long dark hair, pale porcelain skin, regal and dangerous presence, wearing ancient Greek-inspired black and deep purple armor mixed with flowing royal robes, obsidian crown, dark golden details, long dramatic cape, subtle smoke and shadow aura around him, standing in the underworld throne hall, black marble columns, glowing blue fire, mist, ancient Greek architecture, cinematic animated movie style, dark fantasy fairytale atmosphere, beautiful but intimidating, not evil-looking monster, stylized animated film look, cartoon animation aesthetic, expressive face, soft shapes, rich colors, cinematic composition, highly detailed, enchanting and mythological feeling --sref 2583858235
中文提示:
哈迪斯 [重要的主体角色名字] ,希腊神话中的冥界之神,一位强大而英俊的黑暗统治者,具有男性化魅力与优雅气质,高贵的面部轮廓,深邃神秘的眼神,长长的黑色头发,苍白如瓷器般的肌肤,散发着威严且危险的气场 [主体角色描述] 。
身穿融合古希腊风格元素的黑色与深紫色铠甲,以及飘逸的王室长袍,佩戴黑曜石王冠,搭配暗金色细节装饰,披着长款戏剧性斗篷,周围环绕着若隐若现的烟雾与阴影气息 [衣着服饰描述] 。
他站立于冥界王座大厅之中,周围是黑色大理石柱,燃烧着幽蓝色火焰,弥漫着薄雾,拥有古希腊建筑风格 [周围背景] 。
电影感动画电影风格 [风格描述] ,黑暗奇幻童话氛围,美丽但令人敬畏,不是邪恶怪物般的外貌,具有风格化动画电影视觉效果,卡通动画美学,富有表现力的面部表情,柔和的形态,丰富的色彩,电影级构图,高度细节化,充满迷人且神话般的感觉。
以上是 niji 7 以及 mj v7 表述,风格画风非常的符合我的审美!
1. 如果换成 v8.1 模型,我们需要注意什么呢?
Midjourney v8.1 能够理解比早期模型更加丰富的细节,但它同时也对以下因素更加敏感:词语选择 [wording]、词元顺序 [token order]、标点符号 [punctuation]、语义歧义:描述不明确导致理解偏差 [ambiguity]。
如果你的提示词过长,或者包含过多信息,Midjourney 可能会自动缩短你的提示词 [如果超过 1024 个字符,会触发离谱的 Prompt Shortener 提示词压缩机制]、削弱重要细节的权重、自行补充或创造缺失的信息。
因此,要保持提示词足够清晰,让关键视觉信息能够被模型保留下来。说人话就是一个优秀的 v8.1 提示词通常遵循这样的结构:
主体 + 最重要的可见特征 + 紧密关联的主体细节 + 前景元素或动作 + 背景或环境 + 风格或媒介 + 官方的基础参数
可以看到我上面的提示已经遵循了这样的提示方式,只不过再用 v8.1 版本生成图像演示一下。


v8.1 这个版本效果看着更为的真实,细节方面有克制,相较而言我还是喜欢 niji 7 的风格画风。
核心规律:第一个名词通常是视觉锚点 [核心主体 + 主体特征 + 环境 + 风格],在 Midjourney v8.1 中,提示词不仅是在描述 “有什么”,更是在告诉模型:什么应该成为主体;什么应该占据视觉中心;什么应该作为背景环境;如何组织画面构图。
因此,主体的位置 + 语法主语 + 描述顺序,是控制生成构图的重要方式。
2. 提示应该先放什么?为什么要排列顺序?
如果你发现:某些细节在生成过程中被忽略;镜头没有聚焦到你想要的主体;那么可以尝试调整提示词中信息的排列顺序。
可以将你希望成为画面重点的对象,放在提示词更靠前的位置,甚至放在最开始。Midjourney v8.1 会让更靠前的词语获得略微更高的影响权重。
因此,提示词开头的第一个名词短语 [noun phrase],最好就是你最希望模型准确表现的核心对象。句子的语法主语也会改变画面焦点,同样的视觉元素,如果改变句子的语法主语 [grammatical subject],Midjourney 对画面的组织方式也会发生变化。
下面两个提示词包含完全相同的基本元素,但它们要求 Midjourney 采用不同的画面组织逻辑:

提示:一只鸭子站在田野中。
在这个提示词中:鸭子 [duck] 是句子的主语。因此生成的画面更可能:以鸭子作为视觉中心;更突出鸭子的形态、细节和动作;让田野成为辅助环境。

提示:一片田野中有一只鸭子站在那里。
在这个提示词中:田野 [field] 是句子的主语。因此生成的画面更可能:将田野作为主要视觉对象;把鸭子视为环境中的一个组成部分;强调整体景观,而不是鸭子的细节。
核心规律:提示词开头决定视觉优先级 [强调角色还是环境],不只是关键词重要,语法关系也重要 ,改变提示词中的语法主语,就可以改变 Midjourney 对画面中心的判断。
3. v8.1提示词编写指南
使用简短、直接的句子,因为过长的句子结构会让 Midjourney 需要同时处理过多信息。每个句子应该描述:一个视觉单元,或一种简单的视觉关系。不要试图在一个长句中塞入所有信息。


提示:一位穿着红色羊毛大衣的女性站在冰冻的湖边。她的编发垂落在一侧肩膀上。积雪覆盖的松树林排列在远处湖岸。
每句话只表达一个视觉信息,主体、细节、环境、风格层次清晰,模型更容易准确理解。
不要多个视觉关系被压缩在一个长句中,主体、动作、环境、风格混杂,模型更容易降低部分细节的重要性。
使用可视化语言,Midjourney 无法直接绘制:抽象意图、象征意义、世界观背景、某件事为什么重要。因此,需要将抽象概念转换为可被看到的视觉特征。


提示:一名满身泥泞的战士跪在烟雾弥漫的战场旁,身边是一面破损的旗帜。断裂的长矛和凹陷的盾牌散落在前景。戏剧化历史绘画风格。
在没有使用 “勇气”“牺牲”“悲壮”等这些词,画面也非常有效,也就是没有情绪、价值判断、故事概念等。因为模型无法直接绘制这些抽象信息。
避免使用命令式提示词文本,传统提示词方式更适合作为描述 [description],而不是指令 [instruction]。
不要使用:“创建 [create]”“绘制 [draw]”“添加 [add]”“使用 [use]”“展示 [show]”这类命令式词语。应该直接把最终生成的图像描述成一个完整场景。
命令式语言更适合用于:对话模式 [Conversational Mode],例如:“把这张图里的天空改成黄昏色”“增加一个角色”这种交互式编辑需求。
尽可能避免使用否定表达,相比告诉模型:什么东西不应该出现。更好的方式是描述:什么东西应该出现。


提示:一个空旷的极简主义房间,配有浅色橡木家具、纯白墙面和柔软的米色织物。柔和的自然光透过纱帘进入室内。室内设计摄影风格。
这里通过正向描述表达:空旷 → 没有人;极简 → 没有杂物;白墙、米色织物 → 没有鲜艳颜色。
保持相同画面区域的信息集中,不要把主体细节、背景细节、风格描述混乱地分散排列在句子里。应该让同一个画面区域的信息保持连续。


提示:一座破败的城堡矗立在山谷上方,残破的塔楼高耸其中。飘动的雾气填满背景。粗糙黑色线条的水墨插画风格。
清晰的视觉层级:主体 → 主体细节 → 动作 / 前景 → 环境 / 背景 → 风格 / 媒介,而不是:主体 → 风格 → 补充细节 → 背景。
减少冗余信息,Midjourney 的注意力处理能力是有限的。不要浪费提示词中的词元 [tokens],重复描述主体已经隐含的信息。说人话:不要反复强调一个对象本身已经包含的概念。
但这不是绝对的,在修改某个被模型忽略的细节时,适度重复有时是有效的。比如模型总是忽略手里拿着的东西,你需要提高该元素出现的概率,作为基础提示词:应该保持简洁、干净,避免无意义重复。
那么以上这些都掌握了,能解决80% MJ 的图像问题,同时也代表着 v8.2已经掌握,v8.2更新的只不过在 v8.1 的基础上基础上更奔放,创建个性化配置文件时,可选择的图片库规模更大。
剩下的20%里包含参数和美学控制,下期有时间再来细细道来...
4.v8.1与v8.2的美学对比
看对比图,我就不比比了...






复制本文链接 文章为作者独立观点不代表优设网立场,未经允许不得转载。








发评论!每天赢奖品
点击 登录 后,在评论区留言,系统会随机派送奖品
2012年成立至今,是国内备受欢迎的设计师平台,提供奖品赞助 联系我们
用户体验增长
已累计诞生 795 位幸运星
发表评论
↓ 下方为您推荐了一些精彩有趣的文章热评 ↓