Midjourney 從 8 月 27 日開始,讓所有使用者測試首個 V8.2 圖像編輯模型。官方更新頁上的說法相當隨性:
"Today we're gonna start letting everyone test our first V8.2 image edit model."
(今天開始,我們讓所有人來測試第一個 V8.2 圖像編輯模型。)
這次開放沒有分級,也沒有先給年費訂閱用戶或 Discord 裡的活躍測試者優先體驗,直接全員可用。midjourney.com 與 alpha.midjourney.com 兩個站台都能進,其中 alpha 站介面還在快速調整中,官方也明講它目前處於頻繁實驗的狀態。
一個模型整合了四項功能
這次編輯模型合併的能力,先前分散在好幾個入口:用文字指令改圖、局部重繪、畫布外擴,以及參考圖控制。整合到同一處之後,模型會同時讀取 personalization(個人化模型)、moodboard(情緒板)與風格參考這三類調性設定,也就是說改圖時不必重新交代美感偏好,先前調好的那套風格會直接沿用。
其中最具體的一項是參考圖上限:一次生成最多可以同時掛四張參考圖。做電商詳情頁或角色設定的人最清楚這個數字的分量——一張固定人物、一張固定服裝、一張固定場景、一張固定光線,四張剛好能覆蓋商業出圖需要釘死的幾個變數。先前的 omni-reference 一次只吃一張,多個限制條件只能靠提示詞硬描述,出圖結果全靠運氣。
呼叫入口一共有四個:把圖片拖進提示欄、在 lightbox 裡點 edit、透過 edit 分頁,以及在 Discord 上直接打「--edit url...」指令。四條路都通向同一個模型,這次網頁端與 Discord 端沒有能力落差,這在 Midjourney 的歷史上不算常態——過去幾年新功能往往先在 Discord 上線,網頁端要隔一陣子才補齊。
局部重繪與擴圖合進同一個模型,改變的是修圖的往返成本。以前一張圖不滿意,通常只能重新生成,出十張挑一張;現在可以只圈出人物的手部重畫,或是把直式構圖往兩側擴成橫式構圖,畫面主體不動。這兩項聽起來是小功能,但放進商業出圖流程裡,省下的是最耗時的一段——不必為了改一個局部,就賭上整張圖的美感。
補的是長期存在的短板
Midjourney 這幾年的位置一直很固定:出圖美感強,可控性弱。想精準改一個局部、讓角色在多張圖之間維持一致,使用者往往得跳到別的工具繞一圈。V8.2 本體在 7 月 24 日成為預設版本,帶來原生 2K 輸出與重建過的個人化引擎,走的還是強化美感這條老路;編輯模型晚了一個多月才跟上,補的正是可控性這一側。
時間點上不算早。圖生圖與指令編輯這個賽道今年競爭相當激烈,Google 那套低成本圖像模型主打走量與成本,其他業者則在拚指令遵循的精準度。Midjourney 入場時手上的牌是美感底子,以及已經養熟的個人化模型——使用者在自己帳號裡調了半年的風格,能直接帶進改圖流程,這層轉移成本是其他業者短期內給不了的。
價格暫時是空白
官方這次完全沒提消耗量。V8.2 編輯模型按哪個等級扣 GPU 時間、快速模式與放鬆模式怎麼算、編輯一次跟重新生成一次是否同價,更新頁上都沒寫。對按月計算使用時數的重度使用者來說,這一欄空著比功能本身更影響排程規劃。
官方同時在 Discord 開了兩個討論區收集意見,一個收想法與邊緣案例,一個收作品展示。一次性全員開放、又主動徵集異常狀況,指向的是同一件事:模型還在測試階段,團隊要的是覆蓋範圍,而不是漂亮的首發樣品。照這個節奏迭代下去,一兩週內版本號大概率還會再變動一次。
參考來源:Midjourney 官方更新頁、CocoLoop、Midjourney 版本文件;已核實編輯模型的開放範圍、四張參考圖上限與四個呼叫入口。