Bytedance / Doubao-Seedream-4.0调用ID:bytedance/doubao-seedream-4.0图像生成图像与设计Seedream 4.0 是基于领先架构的SOTA级多模态图像创作模型,其生成美感、指令遵循、结构完整度、主体保持一致性处于世界头部水平。模型采用同一套架构实现文生图与编辑能力的统一,原生支持文本 、单图和多图输入,并能通过对提示词的深度推理,自动适配最优的图像比例尺寸与生成数量,可一次性连续输出最多 15 张内容关联的图像,支持 4K 超高清输出
Bytedance / Doubao-Seedream-5.0-pro调用ID:bytedance/doubao-seedream-5-0-pro图像生成seedream-5.0-pro是字节跳动发布的最新图像创作模型。该模型在更复杂、更真实的图像生成与编辑需求维度全面升级,将图像创作推进到可控生产的新阶段。本次模型更新的主要亮点是编辑更可控、生产更落地、效果更自然。
OpenAI / GPT Image 2调用ID:openai/gpt-image-2图像生成图像与设计GPT-image-2 是 OpenAI 最新的尖端图像生成模型。主要附加价值包括性能提升、质量提升、编辑控制和面部保护。该模型支持高强度 input_fidelity,并且可以添加或移除图像的某一方面,同时保留其他部分。该模型在宽高比、分辨率和编辑能力方面都有改进。
Google / Gemini 3.1 Flash Image调用ID:google/gemini-3.1-flash-image图像生成图像与设计多模态理解谷歌最强图像模型,nano banana 2 。Gemini 3.1 Flash Image 将最强大的图像生成功能推向主流市场。它提升了图像质量、视觉理解能力,更好地渲染了多种语言的长文本段落,并提高了图像的真实性。该模型还能够生成分辨率从 512 (0.25MP) 到 4K (16MP) 的图像。
Bytedance / Doubao-Seedream-5.0-lite调用ID:bytedance/doubao-seedream-5-0-lite图像生成图像与设计Doubao-Seedream-5.0-lite是字节跳动发布的最新图像创作模型。该模型首次搭载联网检索功能,能融合实时网络信息,提升生图时效性。同时,模型的聪明度进一步升级,能够精准解析复杂指令和视觉内容。此外,模型在世界知识广度、参考一致性及专业场景生成质量上均有增强,可更好地满足企业级视觉创作需求。
Ali / Z-Image-Turbo调用ID:ali/z-image-turbo图像生成图像与设计Z-Image-Turbo是在Artificial Analysis评测中荣登文生图开源模型世界第一的高效图像生成模型,仅用60亿参数和8步推理就能生成媲美大规模商业模型的照片级真实感图像,并在中英双语文本渲染、复杂语义理解和多样化主题生成上表现卓越。
OpenAI / GPT Image 1.5调用ID:openai/gpt-image-1.5图像生成图像与设计OpenAI最强图像生成模型,新模型能够结合世界知识,生成更加符合上下文图像,质量更高,还支持多种功能自定义。
Bytedance / Doubao-Seedream-4.5调用ID:bytedance/doubao-seedream-4.5图像生成图像与设计Seedream 4.5 是字节跳动最新推出的图像多模态模型,整合了文生图、图生图、组图输出等能力,融合常识和推理能力。相比前代4.0模型生成效果大幅提升,具备更好的编辑一致性和多图融合效果,能更精准的控制画面细节,小字、小人脸生成更自然
Ali / Qwen-Image-Plus调用ID:ali/qwen-image-plus图像生成图像与设计通义千问系列图像生成模型,参数规模200亿。具备卓越的文本渲染能力,在复杂文本渲染、各类生成与编辑任务重表现出色,在多个公开基准测试中获得SOTA。
Ali / 通义万相2.2-文生图-Lora调用ID:ali/wan-2.2-t2i-lora图像生成图像与设计该模型可在 3-4 秒内生成精美的电影级 200 万像素图像,它源自 Wan 2.2 模型,并运用了 pruna 包中的优化技术。
FBlackForestLabs / Flux-kontext-dev-lora调用ID:black-forest-labs/flux-kontext-dev-lora图像生成图像与设计FLUX.1 Kontext[dev] 用于运行 lora finetunes 的图像编辑模型
FBlackForestLabs / Flux-1.1-pro-ultra-finetuned调用ID:black-forest-labs/flux-1.1-pro-ultra-finetuned图像生成图像与设计使用自定义 finetune_id 的 FLUX 1.1 [pro] Ultra 模型。支持 4MP 图像和 raw 模式,以实现逼真效果
FBlackForestLabs / Flux-1.1-pro-ultra调用ID:black-forest-labs/flux-1.1-pro-ultra图像生成图像与设计FLUX1.1 [pro] 拥有 ultra 和 raw 两种模式。图像分辨率最高可达 400 万像素。使用 raw 模式可获得更逼真的效果。
FBlackForestLabs / Flux-kontext-dev调用ID:black-forest-labs/flux-kontext-dev图像生成图像与设计FLUX.1 Kontext 的开源版本
FBlackForestLabs / Flux-1.1-pro调用ID:black-forest-labs/flux-1.1-pro图像生成图像与设计更快、更好的 FLUX Pro。文本转图像模型,具有出色的图像质量、快速的一致性和输出多样性。
OpenAI / GPT-Image调用ID:openai/gpt-image-1图像生成图像与设计OpenAI最强图像生成模型,新模型能够结合世界知识,生成更加符合上下文图像,质量更高,还支持多种功能自定义。
FBlackForestLabs / Flux-kontext-pro调用ID:black-forest-labs/flux-kontext-pro图像生成图像与设计最先进的基于文本的图像编辑模型,可提供高质量的输出,具有出色的及时性和一致的结果,可通过自然语言转换图像
FBlackForestLabs / Flux-kontext-max调用ID:black-forest-labs/flux-kontext-max图像生成图像与设计一种基于文本的高级图像编辑模型,可提供最佳性能和改进的排版生成,通过自然语言提示转换图像
JiMeng / 即梦4.0调用ID:bytedance/jimeng_v40图像生成图像与设计多模态理解即梦4.0是即梦同源的图像生成能力,该能力在统一框架内集成了文生图、图像编辑及多图组合生成的功能:支持单次输入最多 10 张图像及进行复合编辑,并能通过对提示词的深度推理,智能适配最优的图像比例尺寸与生成数量,可一次性输出最多 15 张内容关联的图像。此外,模型显著提升了中文生成的准确率与内容多样性,且支持 4K 超高清输出,为专业图像创作提供了从生成到编辑的一站式解决方案。
FBlackForestLabs / Flux-dev-lora调用ID:black-forest-labs/flux-dev-lora图像生成图像与设计flux-dev 的一个版本,文本到图像模型,支持快速微调 lora 推理