用 AI 生图最崩溃的时刻,不是生成得丑,而是「就差一点点」。
背景对了、人物对了,就是衣服颜色不对;构图很好,就是画面太窄撑不满海报;想要的效果只差换个道具,结果只能重抽十几次,抽到一张更差的。
8 月 27 日,Midjourney 把这个问题正式摆上台面——首个 V8.2 图像编辑模型开始向所有用户开放测试。AI 绘画从「只能生成」进入「能改了」的阶段。
一、这次开放的是什么
Midjourney 官方公告写得很直白:今天开始让所有人测试我们的第一个 V8.2 图像编辑模型。官方给它定了四件事:
- 指令编辑:用文字指令直接修改已有图像
- 以图生图:一次最多同时引用 4 张参考图,官方明确说这替代了原来的 omni-reference
- 局部重绘(inpainting):只改画面里你指定的那块区域
- 扩画(outpainting):把画布往外延伸,补出原本没有的画面
个性化设置、moodboards、srefs 这些老功能也还能用。不过官方给了一句提示:在这个版本里,moodboards 和 srefs 配合更明确的提示词引导,效果会更稳定。
二、四个能力,对应四类真实痛点
指令编辑解决的是「改一个元素要重画整张」。以前衣服颜色不对,只能改提示词重新抽;现在直接告诉它改成什么,原图的构图、光线、人物状态都保留。
4 图参考解决的是「多元素合成」。以前想把 A 的服装、B 的场景、C 的光影、D 的配色揉在一起,得分好几步拼;现在一次塞 4 张参考图进去。官方说这套机制是替代 omni-reference 的,等于把参考图能力从「单张参考」升级到「多张融合」。
局部重绘解决的是「一处瑕疵毁全图」。手上多一根手指、脸上有块脏污、背景里多了个不该出现的东西——框住那一块,只重画那一块。
扩画解决的是「尺寸不合」。做海报、做封面、做不同平台尺寸的素材时,画面比例对不上是最常见的问题。扩画能顺着原图往外长,把 1:1 的图扩成适合竖版的比例。
三、四种入口,你用哪种
Midjourney 这次把入口铺得很开,四种方式任选:
- 把图片直接拖进提示词输入框下方的「attach to prompt」区域
- 在图片灯箱(lightbox)右下角点「edit」按钮
- 点左侧导航栏的「edit」标签,上传图片
- 在 Discord 里输入
--edit加图片链接
网页主站和 alpha.midjourney.com 的界面都做了更新。按官方说法,alpha 站会快速迭代,拿来做各种界面实验,想尝鲜的可以去那边看新交互长什么样。
四、和以往最大的不同:不用排队,且明确是社区测试
两个背景值得知道。第一,V8.1 成为默认模型之后,编辑能力等了两个月才出来,官方自己也说「比预期晚」。第二,这次开放不需要排队,所有用户都能直接试。
但官方的态度也很坦诚:这就是一次面向社区的公开测试,边界情况(edge case)很多,需要大家一起找问题。遇到效果不对的图,可以点灯箱右侧的「哭脸」图标,或者提供那张图的 job id / 链接来反馈;想法和建议发到 #ideas-and-features,作品可以发到 #edit-showcase。
界面也还没定稿,官方明说后续会有 fast-follow 更新。所以现在这段时间,它更像一个「功能已经可用、体验还在打磨」的状态。
五、对普通人意味着什么
如果你是做设计、电商、内容运营的,这次更新最直接的价值是「返工成本」大幅下降。以前甲方说「背景换一下」「换个颜色」,你得重新抽一批;现在是在原图上改,出图速度和可控性都不是一个量级。
如果你只是偶尔玩图,价值在于「废片率降低」。过去抽十张废九张是常态,现在很多废片是可以救回来的。
需要说清楚的是:Midjourney 本身是付费订阅产品,这次免费的是「新功能的测试权限」,不是产品本身免费。而且它是测试版,效果不稳定是预期内的。
六、一个值得观察的信号
AI 图像工具的竞争焦点正在转移。上半年大家比的是「生成质量」,现在开始比「能不能编辑」——也就是生成之后还能不能继续控制。这个转向和文本模型这两年的路径很像:先比谁生成得好,再比谁能迭代、能修改、能嵌进工作流。
Midjourney 这次把编辑能力做成独立模型并全量开放测试,等于承认了「只生成不能改」已经不够用了。
最后问你一个:你用 AI 生图时,最常卡在哪一步?是改不动细节、尺寸对不上,还是多元素合成搞不定?评论区说说你最想让 AI 替你改掉的那件事。
关注「AI 智习室」,每天一条看得懂的 AI 情报。