正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillBot 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 340 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

340/ 340个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • DeepSeek / DeepSeek-V4-Pro

    调用ID:deepseek/deepseek-v4-pro
    文本编程智能代理与数据数学与科学文档与办公学术与教育

    DeepSeek V4 Pro 是 DeepSeek 推出的大型专家混合模型,它专为高级推理、编码和长远视野代理工作流设计,在知识、数学和软件工程基准测试中表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统,实现高效的长上下文处理,并支持多种推理模式,根据任务平衡速度和深度。它非常适合复杂工作负载,如全代码库分析、多步自动化和大规模信息综合,这些工作在能力和效率上都至关重要。

    2026-04-24 上架¥4.5/M 输入¥13.5/M 输出1M 上下文
  • Bytedance / Doubao-Seedance-2.5

    调用ID:bytedance/doubao-seedance-2-5
    视频生成

    Seedance 2.5 是豆包大模型团队推出的新一代多模态视频创作模型,已迈入「长叙事 × 多素材 × 强编辑 × 多语言」的工业级新阶段。

    2026-08-13 上架
    多项属性定价

    多项属性定价

    480p with_video

    • 公开价格¥46.2/M token

    480p without_video

    • 公开价格¥77/M token

    720p with_video

    • 公开价格¥46.2/M token

    720p without_video

    • 公开价格¥77/M token

    default with_video

    • 公开价格¥46.2/M token

    default without_video

    • 公开价格¥77/M token
  • Bytedance / Doubao-Seedance-2.0

    调用ID:bytedance/doubao-seedance-2-0
    视频生成视频与3D多模态理解内容创作

    支持图像、视频、音频等多模态作为参考输入生成视频,还具备视频编辑、延长等能力

    2026-04-03 上架
    多项属性定价

    多项属性定价

    default with_video

    • 公开价格¥30.8/M token

    default without_video

    • 公开价格¥50.6/M token
  • OpenAI / GPT-5.1

    调用ID:openai/gpt-5.1
    文本编程数学与科学智能代理与数据对话与客服多模态理解

    GPT-5.1 是 GPT-5 系列的最新前沿模型,与 GPT-5 相比,它拥有更强大的通用推理能力、更高的指令遵循度以及更自然的对话风格。它采用自适应推理技术动态分配计算资源,能够快速响应简单查询,同时在处理复杂任务时投入更多精力。该模型能够生成更清晰、更贴近实际的解释,减少专业术语的使用,即使是技术性或多步骤问题也更容易理解。 GPT-5.1 旨在覆盖广泛的任务,在数学、编程和结构化分析等工作负载方面均取得了持续的提升,能够提供更连贯的长篇答案,并提高工具使用的可靠性。它还改进了对话对齐方式,能够在不牺牲准确性的前提下,提供更亲切、更直观的回答。GPT-5.1 是 GPT-5 的主要全功能继任者。

    2025-11-19 上架¥8.75/M 输入¥70/M 输出400K 上下文
  • Ali / HappyHorse-1.1-T2V(限时6折)

    调用ID:ali/happyhorse-1.1-t2v
    视频生成

    HappyHorse-1.1-T2V支持文生视频,进一步提升文本语义理解、镜头调度与动态生成表现。模型能够更精准地还原创作意图,在人物动作、场景氛围、视觉美感和物理运动上生成更流畅自然、细节丰富且一致性更高的高质量视频。

    2026-08-12 上架
    多项属性定价

    多项属性定价

    视频

    • 480P¥0.27/次
    • 720P¥0.54/次
    • 1080P¥0.72/次
  • Moonshot / Kimi K2 0905

    调用ID:moonshot/kimi-k2
    文本编程智能代理与数据

    ( 最新版本 0905) Kimi K2是一款上下文长度256k的模型,具备更强的Agentic Coding能力、更突出的前端代码的美观度和实用性、以及更好的上下文理解能力。

    2025-07-15 上架¥4/M 输入¥16/M 输出256K 上下文
  • bigmodel / GLM-5.3-flash

    调用ID:bigmodel/glm-5.3-flash
    文本

    GLM-5.3

    2026-09-15 上架¥0.8/M 输入¥2.8/M 输出1M 上下文
  • Ali / Qwen-audio-3.0-tts-flash

    调用ID:ali/qwen-audio-3.0-tts-flash
    音频生成

    qwen-audio-3.0-tts-flash

    2026-09-15 上架
    多项属性定价

    多项属性定价

    语音合成

    • 公开价格¥0.00014/字符
  • bigmodel / GLM-5.3

    调用ID:bigmodel/glm-5.3
    文本

    GLM-5.3

    2026-09-14 上架¥8/M 输入¥28/M 输出1M 上下文
  • OpenAI / gpt-4o-transcribe-diarize

    调用ID:openai/gpt-4o-transcribe-diarize
    音频转录

    gpt-4o-transcribe-diarize

    2026-09-13 上架¥17.5/M 输入¥70/M 输出¥0/M 缓存
  • OpenAI / gpt-4o-transcribe

    调用ID:openai/gpt-4o-transcribe
    音频转录

    gpt-4o-transcribe

    2026-09-13 上架¥17.5/M 输入¥70/M 输出¥0/M 缓存
  • OpenAI / gpt-transcribe

    调用ID:openai/gpt-transcribe
    音频转录

    gpt-transcribe

    2026-09-13 上架
    多项属性定价

    多项属性定价

    每分钟

    • 公开价格¥0.035/每分钟
  • OpenAI / gpt-4o-mini-tts

    调用ID:openai/gpt-4o-mini-tts
    音频生成

    gpt-4o-mini-tts

    2026-09-13 上架
    多项属性定价

    多项属性定价

    音频·输出

    • 公开价格¥84/M token
  • MiniMax / speech-2.8-hd

    调用ID:minimax/speech-2.8-hd
    音频生成

    minimax tts 模型 speech-2.8-hd

    2026-09-12 上架
    多项属性定价

    多项属性定价

    语音合成

    • 公开价格¥0.00035/字符
  • MiniMax / asr-1.0

    调用ID:minimax/asr-1.0
    音频转录

    minimax stt 模型 asr-1.0

    2026-09-12 上架
    多项属性定价

    多项属性定价

    语音识别

    • 公开价格¥0.000695/秒
  • Ali / Qwen3-Coder-Plus

    调用ID:ali/qwen3-coder-plus
    文本编程智能代理与数据

    Qwen3-Coder-Plus,这是通义千问系列迄今为止最具代理能力的代码模型。

    2025-07-23 上架
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥4/M token
    • 32k~128k¥6/M token
    • 128k~256k¥10/M token
    • 256k~不限¥20/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥40/M token
    • 256k~不限¥200/M token

    缓存读

    • ≤32k¥0.4/M token
    • 32k~128k¥0.6/M token
    • 128k~256k¥1/M token
    • 256k~不限¥2/M token
  • Google / Gemini Omni 1.1 Flash Preview

    调用ID:google/gemini-omni-1.1-flash-preview
    视频生成

    Gemini Omni 1.1 Flash 预览版,是谷歌在高阶人工智能模型迭代升级道路上的全新里程碑成果。该模型具备强大的通用内容创作与编辑能力,可适配任意形式的输入内容,全面覆盖视频等多元媒介形态。

    2026-09-01 上架
    多项属性定价

    多项属性定价

    视频·输出

    • 公开价格¥122.5/M token
  • Google / Gemini Omni Flash Preview

    调用ID:google/gemini-omni-flash-preview
    视频生成

    Gemini Omni Flash 是谷歌在高阶人工智能模型领域的全新迭代成果,是其推进顶尖AI模型研发的重要一步。该模型支持基于各类输入源完成内容的创作与编辑,视频是其核心落地应用场景之一。

    2026-09-01 上架
    多项属性定价

    多项属性定价

    视频·输出

    • 公开价格¥122.5/M token
  • Ali / Qwen-Image-Plus

    调用ID:ali/qwen-image-plus
    图像生成图像与设计

    通义千问系列图像生成模型,参数规模200亿。具备卓越的文本渲染能力,在复杂文本渲染、各类生成与编辑任务重表现出色,在多个公开基准测试中获得SOTA。

    2025-09-01 上架
    多项属性定价

    多项属性定价

    每张图片

    • 公开价格¥0.2/每张图片
  • Bytedance / Doubao-Seedream-4.0

    调用ID:bytedance/doubao-seedream-4.0
    图像生成图像与设计

    Seedream 4.0 是基于领先架构的SOTA级多模态图像创作模型,其生成美感、指令遵循、结构完整度、主体保持一致性处于世界头部水平。模型采用同一套架构实现文生图与编辑能力的统一,原生支持文本 、单图和多图输入,并能通过对提示词的深度推理,自动适配最优的图像比例尺寸与生成数量,可一次性连续输出最多 15 张内容关联的图像,支持 4K 超高清输出

    2025-09-12 上架
    多项属性定价

    多项属性定价

    每张图片

    • 公开价格¥0.2/每张图片
  • Ali / Qwen3.5-Omni-Flash

    调用ID:ali/qwen3.5-omni-flash
    文本

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-26 上架
    多项属性定价

    多项属性定价

    音频·输入

    • 公开价格¥18/M token

    音频·输出

    • 公开价格¥72/M token

    图片·输入

    • 公开价格¥2.2/M token

    视频·输入

    • 公开价格¥2.2/M token

    search_strategy:agent

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.5-Omni-Plus

    调用ID:ali/qwen3.5-omni-plus
    文本

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-26 上架
    多项属性定价

    多项属性定价

    音频·输入

    • 公开价格¥53/M token

    音频·输出

    • 公开价格¥213/M token

    图片·输入

    • 公开价格¥7/M token

    视频·输入

    • 公开价格¥7/M token

    search_strategy:agent

    • 公开价格¥0.004/次调用
  • Anthropic / Claude Sonnet 4.5

    调用ID:anthropic/claude-sonnet-4.5
    文本编程智能代理与数据多模态理解

    Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。

    2025-09-30 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥26.25/M token

    缓存写(1h)

    • 公开价格¥42/M token

23 / 340 个模型已加载

←上一页
  1. 1
  2. 2
  3. …
  4. 15
第 1 页,共 15 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选