Midjourney 放出首个 V8.2 编辑模型全员测试

Midjourney 8 月 27 日开始让所有用户测试第一个 V8.2 图像编辑模型。官方更新页上的原话很随意:

“Today we’re gonna start letting everyone test our first V8.2 image edit model.” (今天开始,我们让所有人来测测第一个 V8.2 图像编辑模型。)

这次开放没有分档,也没有先给年费用户或 Discord 里的活跃测试者,直接全员可用。midjourney.com 和 alpha.midjourney.com 两个站点都能进,其中 alpha 站还在快速改界面,官方明说它处于频繁试验状态。

一个模型收编了四件事

编辑模型这次合并的能力,此前散落在几个入口里:用文字指令改图、局部重绘、画布外扩、以及参考图控制。合到一处之后,它同时吃 personalization(个性化模型)、moodboard(情绪板)和风格参考三类调性设定,也就是说改图的时候不必重新交代审美,之前调好的那套风格还在。

其中最具体的一条是参考图上限:一次生成可以同时挂最多四张参考图。做电商详情页或者角色设定的人最清楚这个数字的分量——一张定人物、一张定服装、一张定场景、一张定光线,四张刚好覆盖一次商业出图里需要钉死的几个变量。此前 omni-reference 一次只吃一张,多个约束条件只能靠提示词硬描述,出图靠碰。

调用入口给了四个:把图片拖进提示栏、在 lightbox 里点 edit、走 edit 标签页,以及在 Discord 上直接打 --edit url...。四条路都通向同一个模型,网页端和 Discord 端这次没有能力差,这在 Midjourney 的历史上不算常态——过去几年新功能往往先在 Discord 落地,网页端隔一阵才补齐。

局部重绘和扩图合进同一个模型,改变的是修图的往返成本。以前一张图不满意,改法基本是重新生成,出十张挑一张;现在可以只圈出人物的手部重画,或者把竖构图往两侧扩成横构图,画面主体不动。这两件事听起来是小功能,落到商业出图的流程里省掉的是最耗时的一段:不用为了改一个局部而赌上整张图的审美

补的是长期的短板

Midjourney 这几年的位置一直很固定:出图审美强,可控性弱。想要精准改一个局部、保住角色跨图一致,用户往往得跳到别的工具里绕一圈。V8.2 本体 7 月 24 日成为默认版本,带来原生 2K 输出和重建过的个性化引擎,走的还是加强审美这条老路;编辑模型晚了一个多月才跟上,补的正是可控性这一侧。

时间点上不算早。图生图和指令编辑这条赛道今年挤得厉害,谷歌那套廉价图像模型主打走量和成本,别的家在拼指令遵循的精度,Midjourney 入场时手里的牌是审美底子和已经养熟的个性化模型——用户在自己账号里调了半年的风格,能直接用到改图上,这层迁移成本是别家短期给不了的。

价格暂时是个空白

官方这次一个字没提消耗。V8.2 编辑模型按什么档位扣 GPU 时间、快速模式和放松模式怎么算、编辑一次和重新生成一次是否同价,更新页里都没写。对按月吃时长的重度用户来说,这一栏空着比功能本身更影响排产计划。

官方同时在 Discord 开了两个讨论区收反馈,一个收想法和边缘案例,一个收作品展示。一次性全员开放加上主动征集异常情况,指向的是同一件事:模型还在测试阶段,团队要的是覆盖面,而非漂亮的首发样张。按这套路子迭代,一两周内版本号大概率还会再动一次。

参考来源:Midjourney 官方更新页、CocoLoop、Midjourney 版本文档;核验编辑模型的开放范围、四张参考图上限与四个调用入口。