问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
AI绘画厂商Midjourney于2026年8月28日开放测试首款V8.2图像编辑模型,打破此前仅靠文本生成图像的单一模式,融合指令微调、多图参考、局部重绘、画布扩展四大核心功能,单次最多支持4张图片融合参考,为创作者提供精度更高、可控性更强的专业视觉创作解决方案。
对于AI绘画从业者和创意工作者而言,此前最头疼的问题莫过于生成结果的不可控性——想要调整画面局部细节、融合多个参考图的风格、适配不同投放场景的尺寸,往往要反复修改prompt、多轮生成甚至导出到其他设计工具二次加工,才能达到预期效果,而Midjourney此次更新,恰好瞄准了这一行业普遍存在的效率痛点。
近年AIGC图像赛道的竞争逻辑已经发生明显变化:从早期比拼生成速度、画面质感,转向比拼落地能力、可控性。此前不管是开源阵营的Stable Diffusion,还是闭源阵营的DALL·E 3,都已经先后上线了成熟的图像编辑功能,而Midjourney凭借极高的生成质感长期稳居行业第一梯队,但编辑能力的缺失一直是其核心短板,不少用户会将Midjourney生成的初稿导出到其他工具完成后期调整,大幅拉长了创作流程。
此次推出的V8.2图像编辑模型,核心就是补齐编辑能力短板,四大技术特性全面覆盖创作全流程需求。
首先是指令微调能力,用户无需重新输入prompt生成新图,直接对着已有图像发送文本修改指令,即可完成风格、元素、场景的调整,大幅降低了修改成本。
其次是多图参考生成机制,彻底替代了此前的全景参考功能,单次最多可同时融合4张参考图的风格、元素、光影特征,创作者可以同时导入人设稿、材质参考图、光影参考图,生成的内容匹配度较此前提升超60%。
再者是局部重绘(inpainting)与画布扩展(outpainting)功能,前者支持精准框选画面任意区域做针对性修改,不会破坏其他区域的原有质感;后者支持按需延展画布尺寸,不管是适配横版海报还是竖版短视频素材,都不会出现边缘生硬、内容断层的问题。
最后,新模型全面兼容用户此前积累的个性化风格设置、情绪板预设,无需重新适配新模型即可直接复用,降低了用户的学习成本。
此前AI绘画工具大多被定位为创意灵感辅助工具,很难直接落地到商业生产流程,而V8.2的落地,意味着Midjourney已经具备覆盖商业设计全流程的能力:从初稿生成、细节调整到多尺寸适配,都可以在同一平台内完成,有望进一步替代传统设计软件的部分功能,降低专业视觉创作的门槛。
不过行业也存在待解的问题:多图参考功能涉及的素材版权归属、AI生成内容的商用授权规则,目前还没有统一的行业标准,后续仍需要平台、创作者、监管方共同推动规范落地。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。