Midjourney 开了 V8.2 图像编辑模型的测试。这是它第一次把”编辑”做成一个正经的模型,而不是挂在生成流程上的附加功能。
四个能力:
指令编辑——直接用文字改已有的图。”把背景换成黄昏”这种。
多图参考——单次最多融 4 张参考图。这个功能直接把之前的全景参考(omni-reference)替换掉了,不是并存,是替代。
局部重绘 + 画布扩展——inpainting 和 outpainting,改细节和扩画幅。
另外还兼容个性化设置、情绪板这些老功能。
要说这几个能力有多新,其实没有,竞品早就有了。Midjourney 的问题从来不是能力清单,是控制力。它出图的审美一直是这个赛道里的天花板,但你想让它精确改一个地方,历史上基本靠重摇 + 运气。做商业稿的人都懂那种感觉:出了张几乎完美的图,就是模特的手不对,然后你只能一遍遍重来。
V8.2 是在补这块短板。多图参考换掉 omni-reference 这个动作尤其能说明问题——omni-reference 是”给一个整体氛围”,多图参考是”给我这几个具体的东西”。前者服务的是探索,后者服务的是交付。
产品方向上,这是从”灵感机器”往”生产工具”挪。Midjourney 过去几年一直守着 Discord 那套反效率的交互,靠社区氛围和审美优势活得很好,但客户结构在变——现在真正付钱的越来越多是要交稿的人,不是玩票的人。要交稿就得能改,能改就得可控。
目前还是测试阶段,实际的可控性有多少,得等一批真实商稿跑过才知道。指令编辑这类功能最容易翻车的地方在于”改一处动全局”——你让它改背景,人物的光影跟着变了,这种事在别家产品上还是常态。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






Midjourney V8.2 开测图像编辑,它终于开始补「可控」这块短板