Midjourney V7
Midjourney Inc.
2026年4月发布的史上最大升级,分辨率提升至2048×2048,首次引入视频生成。艺术美感与商业质感行业天花板,--cref角色一致性、文字渲染、风格迁移全面强化,复杂场景表现提升40%
模型版本
V7(2026年4月)
输入方式
文本 / 图片 / 角色参考
计费模式
订阅制
授权
商业闭源
AI IMAGE GENERATORS · 图像生成选型手册
一册尽览主流 AI 图像生成工具的画质路线、分辨率、文字渲染与计费方案——为插画、电商、品牌设计与本地部署提供一份可随手翻阅的参考。
收录 PIC
12款
开源模型
4款
文字渲染
11款
免费额度
11款
Midjourney Inc.
2026年4月发布的史上最大升级,分辨率提升至2048×2048,首次引入视频生成。艺术美感与商业质感行业天花板,--cref角色一致性、文字渲染、风格迁移全面强化,复杂场景表现提升40%
模型版本
V7(2026年4月)
输入方式
文本 / 图片 / 角色参考
计费模式
订阅制
授权
商业闭源
OpenAI
OpenAI推出的ChatGPT内置默认图像引擎,无需额外订阅即可使用,带动亿级用户零门槛体验。指令理解与图内文字准确度业界领先,支持多轮对话式迭代修改
模型版本
GPT Image 2 / gpt-image-1
输入方式
文本 / 图片 / 对话上下文
计费模式
订阅 + API按量
授权
商业闭源
◈ 免费额度:免费版每日十余张
Google DeepMind
谷歌2026年推出的图像生成/编辑模型,Gemini App内免费使用。4K超宽比例输出,精准还原产品与局部修改能力突出,被Adobe Firefly 5等第三方平台集成,成为2026年编辑向标杆
模型版本
Nano Banana Pro(Gemini 3 Pro Image)
输入方式
文本 / 多图参考 / 局部编辑
计费模式
免费 + 订阅 + API
授权
商业闭源
◈ 免费额度:Gemini App免费(有限额度)
字节跳动(ByteDance)
字节跳动Seed团队推出的图像生成模型,已内置豆包App不限量使用。中文语义理解与东方美学表现优异,支持多图融合与海报级排版,是国内C端渗透率最高的生图工具之一
模型版本
Seedream 4.5
输入方式
文本 / 图片 / 多图融合
计费模式
免费 + 订阅 + API
授权
商业闭源
◈ 免费额度:豆包内不限量免费 / 即梦每日积分
Black Forest Labs
Black Forest Labs(原Stable Diffusion核心团队)推出的开源图像模型,被多方评为'当前画质天花板'。写实人像、光影层次、文字渲染表现突出,提供dev/pro/klein多版本,本地与云端均可部署
模型版本
FLUX.2(dev / pro / klein)
输入方式
文本 / 图片 / ControlNet
计费模式
开源免费 + 商用API按量
授权
dev非商用 / klein开源
Stability AI
Stability AI推出的开源文本生成图像模型,采用多模态扩散Transformer架构与Rectified Flow技术。本地部署生态最成熟(ComfyUI/A1111/Forge),社区LoRA与微调模型海量,掌控本地部署路线的代表
模型版本
Stable Diffusion 3.5(Large/Medium)
输入方式
文本 / 图片 / ControlNet / LoRA
计费模式
开源免费 + 企业授权
授权
Stability Community License
Ideogram AI
以图内文字渲染 accuracy 著称的图像生成工具,海报、Logo、 typography 设计首选。指令听话、排版精准,2026年V3版本在真实感与速度上大幅提升,提供Magic Prompt智能扩写
模型版本
Ideogram 3.0
输入方式
文本 / 图片
计费模式
免费 + 订阅
授权
商业闭源
◈ 免费额度:每日免费额度
Adobe
Adobe推出的商用安全图像生成工具,版权合规体系行业标杆(训练数据可商用)。2026年V5整合Google Nano Banana、FLUX等第三方模型,深度嵌入Photoshop/Illustrator创意工作流
模型版本
Firefly 5(多模型聚合)
输入方式
文本 / 图片 / 生成式填充
计费模式
积分制 + 订阅
授权
商业闭源
◈ 免费额度:每月免费积分
阿里巴巴(Alibaba)
阿里巴巴达摩院推出的开源图像生成模型(Qwen-Image),Apache 2.0协议可商用。中文文字渲染与东方美学理解突出,工业级高分辨率稳定性强,已接入阿里云百炼API
模型版本
Qwen-Image / 通义万相2.x
输入方式
文本 / 图片
计费模式
开源免费 + API按量
授权
Apache 2.0
快手(Kuaishou)
快手推出的开源图像生成模型,基于扩散Transformer架构。中文语义与人物肖像表现优异,支持文生图/图生图/局部重绘,已接入快手可灵生态,国内开源社区活跃
模型版本
Kolors 2.x
输入方式
文本 / 图片 / 局部重绘
计费模式
开源免费 + 订阅 + API
授权
Apache 2.0
Recraft AI
专注矢量与品牌设计的AI图像工具,可生成可无限缩放的SVG矢量图,品牌一致性控制强。适合Logo、图标、UI插画等需要矢量化交付的专业设计场景
模型版本
Recraft V3
输入方式
文本 / 图片 / 风格参考
计费模式
免费 + 订阅
授权
商业闭源
◈ 免费额度:每日免费额度
Leonardo Interactive
面向游戏与概念设计的AI图像平台,提供丰富的预训练微调模型(角色/场景/道具)。实时画布、模型训练、纹理生成等功能完善,是游戏美术与3D资产创作的专业工具
模型版本
Phoenix / Apollo + 自研微调模型
输入方式
文本 / 图片 / ControlNet
计费模式
免费 + 订阅(token制)
授权
商业闭源
◈ 免费额度:每日150 tokens免费