输入文本图像图像
它是什么
Midjourney 是 Midjourney 公司于 2022 年推出并持续迭代的文生图服务。它最初在 Discord 上以机器人形式使用,用户输入提示词后由服务端生成图像,后来也提供了网页版。与开放权重的模型不同,Midjourney 是闭源服务,用户通过订阅使用。它的迭代重点长期放在画面风格与构图质量上,并提供图生图、放大与局部修改等功能。
为什么值得记住
它用订阅制与社区化交互把文生图做成大众消费产品,在不公开模型的前提下靠画面审美赢得用户,与开放权重路线形成对照。
关键规格
- 类型
- 闭源订阅服务
- 获取方式
- Discord 机器人,并提供网页版
- 开放权重
- 否
- 发布
- 2022-03
所属能力
相关概念
同类产品
DALL·E 3
2023OpenAI
把长提示词先改写成详细描述,再据此生成图像
模型 闭源
文本图像
Stable Diffusion
2022Stability AI
把文生图权重开源,并压到消费级显卡可运行
模型 开放权重
文本图像图像
FLUX
2024Black Forest Labs
用整流流 Transformer 生成高分辨率图像
模型 开放权重
文本图像图像
Firefly
2023Adobe
面向创作者的图像生成与编辑工具
应用 闭源
图像文本图像
Imagen
2022Google DeepMind
用级联扩散与大型文本编码器生成写实图像
模型 闭源
文本图像
Seedream
2024ByteDance (Seed)
原生高分辨率、擅长文字排版的文生图模型
模型 闭源
文本图像