Midjourney是位于美国加州旧金山的同名研究实验室开发的人工智能图像生成工具,由大卫·霍尔茨(David Holz)领导,用户输入文字提示词即可在较短时间内得到多张候选图像。该工具于2022年7月12日进入公开测试阶段,早期依托Discord的机器人指令运行,后增设网页版。它以艺术化风格见长,是文本生成图像领域具有代表性的产品之一,同时也因训练数据与著作权问题卷入多起诉讼。
定义
Midjourney是一款人工智能文本生成图像工具,用户用自然语言描述想要的画面,系统据此输出对应图像。它由同名研究实验室开发,该实验室设在美国加州旧金山,由Leap Motion创始人大卫·霍尔茨负责主持。[1]与其他一些同期产品不同,它长期只通过聊天平台上的机器人提供服务,使用者以斜杠开头的指令调用,付费订阅是其主要的运营方式。[2]
输入一段文字提示后,该工具通常一次给出四张备选图,使用者还可以对结果进行放大、生成变体或局部修改。[2]提示词中可以写明画家风格、镜头语言或摄影术语,也可以用参数设定画幅比例、风格强度与所用模型版本。[3]
原理
Midjourney的技术基础属于扩散模型一类。这类模型在训练阶段向图像逐级叠加噪声,同时学习如何从含噪状态还原画面;生成阶段则从随机噪声出发,在文本条件的约束下反复去除噪声,最终得到与描述相符的图像。[4]
文字与图像之间的对应关系主要依靠类似CLIP的模型来建立,提示词先被编码成语义向量,再作为条件信息参与去噪过程。有研究指出,Midjourney把CLIP与VQGAN结合使用,从图像的潜在向量中生成画面。[5]
实际使用中,用户以斜杠指令或网页输入框提交提示词,并附加各类参数,例如用--ar控制比例、--v指定模型版本、--style调整风格化程度,--sref与--cref分别用于借鉴参考风格和保持角色一致。[3]网页版进一步提供下拉选项,可设定风格化强度、结果变异程度与生成速度等。[3]
发展历程
Midjourney最早以测试版本的形式出现,2022年2月推出V1,同年4月发布V2,7月25日发布V3;2022年7月12日进入公开测试阶段。[1]2022年11月5日开放V4的alpha版本,2023年3月15日开放V5的alpha版本,其后陆续更新V5.1与V5.2。[1]
2022年8月,由贾森·艾伦使用Midjourney创作的《太空歌剧院》在美国科罗拉多州博览会的数字艺术类比赛中获得一等奖,AI绘画由此成为公共话题。[6]2023年4月,Midjourney入选《福布斯》当年的AI 50榜单。[2]
2023年5月,Midjourney官方中文版开启内测,搭载于QQ频道,用户输入“/想象”加生成指令即可调用机器人作画。[7]2023年12月21日发布V6的alpha版本,2024年7月31日发布V6.1。[1]2024年8月末,公司宣布进入硬件领域,并在旧金山组建新团队。[2]
2025年,其模型迭代至V7,渲染速度较此前版本提升约40%。[8]同年6月,迪士尼与环球影业以版权侵权为由对其提起诉讼。[9]
应用
Midjourney生成的图像被用于插画、广告设计、电商素材和概念设计等场景,也常见于海报与产品图的制作。[8]其生成的画面还曾出现在杂志封面上。[2]
设计师、游戏原画师和内容创作者把它作为日常生产工具,用于快速产出视觉草稿并反复迭代。除文字生成图像外,它还支持以图为输入的生成、多图融合与局部编辑,并能将静态图片转为数秒短片。[10]
在出版与教育领域,出现了一批以Midjourney为对象的教材与操作指南,面向零基础读者的入门读物是其中主要类型。[11]
局限
Midjourney对中文提示词的支持有限,使用者往往需要先将其转写为英文;人物较多的场景容易出现构图错误,想要精准控制画面则要熟悉参数语法。[8]
训练数据的来源引发持续争议。2023年1月,数位艺术家在加州对Midjourney、Stability AI等公司提起集体诉讼,指其未经许可使用受版权保护的作品训练模型;同年10月,法院驳回了其中多数指控,原因包括部分原告作品未在美国版权局登记,以及缺乏直接侵权的证据。[12]此后,案件就版权侵权的部分继续审理。[13]
2025年6月,迪士尼与环球影业起诉Midjourney,指其能生成与旗下影视角色高度相似的图像;[9]同年9月,华纳兄弟探索公司也对其提起诉讼。[2]另一方面,完全由人工智能生成的图像在美国难以获得版权登记,《太空歌剧院》作者的登记申请被美国版权局驳回,相关上诉仍在进行。[6]
在内容审核方面,有资料指出该工具对色情、血腥与暴力题材的过滤不够精准。[2]
参见
参考资料
- 维基百科,自由的百科全书 - Midjourney[编辑] . wikipedia.org [引用日期2026-09-29]
- Midjourney . baidu.com [引用日期2026-09-29]
- Impacto_Barra_UAOTesis_2025(PDF) . tdx.cat [引用日期2026-09-29]
- AI文生图 - 一种通过文本描述生成图像的人工智能技术 . baidu.com [引用日期2026-09-29]
- DALL- E是基于VQ- VAE- 2和Transformer的文生图模型 . ceaj.org [引用日期2026-09-29]
- Midjourney AI“名画”作者注册版权被拒,目前正在募资打官司 . 163.com [引用日期2026-09-29]
- Midjourney . china.com.cn [引用日期2026-09-29]
- 首页 > AI产品库 > Midjourney . pconline.com.cn [引用日期2026-09-29]
- 迪士尼🤜Midjourney,好莱坞向大模型宣战 . dutenews.com [引用日期2026-09-29]
- Midjourney新手村攻略:三分钟让你从小白变大神!-太平洋科技 . pconline.com.cn [引用日期2026-09-29]
- AI绘画实战(Midjourney从新手到高手)(中文) . pku.edu.cn [引用日期2026-09-29]
- AI侵權訴訟大戰第一回 藝術家初嚐敗績?理由為何?|TAICCA issue|文化內容產業趨勢面面觀 . taicca.tw [引用日期2026-09-29]
- Judge Narrows Artists’ Grounds for Complaint in AI Suit . ocula.com [引用日期2026-09-29]
浏览次数:1 次
阅读量:1 次 · 阅读完成量:0 次
最近更新:2026-09-29T08:57:04Z
完成率 = 阅读完成量 ÷ 阅读量,分母是阅读量不是浏览次数 —— 关了 JS 的、秒退的都在浏览次数里、不在阅读量里。 详细口径在后台的「数据统计」页。