Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

187/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Doubao-Seed-Evolving

    API ID:bytedance/doubao-seed-evolving
    文本

    Doubao-Seed-Evolving 面向 Coding 与 Agent 场景,持续周级升级,以统一模型 ID 提供最新能力,助力复杂任务高效落地。

    Input
    ¥6/M
    Output
    ¥30/M
    Context
    256K
    2026-06-23 Listed
  • Doubao-Seed-2.1-turbo

    API ID:bytedance/doubao-seed-2-1-turbo
    文本

    效果与成本均衡,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。

    Input
    ¥3/M
    Output
    ¥15/M
    Context
    256K
    2026-06-23 Listed
  • Doubao-Seed-2.1-pro

    API ID:bytedance/doubao-seed-2-1-pro
    文本

    Doubao-Seed-2.1 是面向 Coding 和 Agent 时代打造的新一代大模型,提供 Pro 和 Turbo 两个版本,分别面向高复杂度任务探索和规模化生产场景。相较上一代版本,Seed 2.1 在 Coding 工程交付、Agent 长链路任务执行和多模态理解三大方向上实现全面升级,以更强的自主规划与动态修复能力,胜任真实研发与高价值生产任务。

    Input
    ¥6/M
    Output
    ¥30/M
    Context
    256K
    2026-06-23 Listed
  • GLM-5.2

    API ID:bigmodel/glm-5.2
    文本

    GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。一次任务即可完成“从需求到多端可部署产物”的完整开发链路。

    Input
    ¥8/M
    Output
    ¥28/M
    Context
    1M
    2026-06-17 Listed
  • Kimi K2.7 Code

    API ID:moonshot/kimi-k2.7-code
    文本

    Kimi K2.7 Code 是 Kimi 迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务。同时支持文本、图片与视频输入,仅支持思考模式,对话与 Agent 任务。模型上下文长度 256k,支持长思考擅长深度推理,支持自动上下文缓存功能,ToolCalls、JSON Mode、Partial Mode 等能力

    Input
    ¥6.5/M
    Output
    ¥27/M
    Context
    256K
    2026-06-15 Listed
  • Claude Fable 5

    API ID:anthropic/claude-fable-5
    文本

    Claude Fable 5 是 Anthropic 下一代智能,专注于最难的知识工作和编程问题。它比以往任何普遍可用的 Claude 模型都能独立运行时间更长:通过代理框架运行,它可以连续工作数天,跨阶段规划,委派给子代理,并检查自身工作。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token
    2026-06-10 Listed
  • Qwen3.7-Plus(限时8折)

    API ID:ali/qwen3.7-plus
    文本

    Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤256k¥1.6/M token
    • 256k~不限¥4.8/M token

    输出

    • ≤256k¥6.4/M token
    • 256k~不限¥19.2/M token

    缓存读

    • ≤256k¥0.32/M token
    • 256k~不限¥0.96/M token

    缓存写(5m)

    • Public price¥7.5/M token

    缓存写(1h)

    • Public price¥7.5/M token
    2026-06-03 Listed
  • MiniMax M3(5折)

    API ID:minimax/minimax-m3
    文本

    MiniMax M3永久五折,MiniMax M3 在编程和智能体等专业任务上达到了前沿的能力。它使用了我们提出的全新注意力架构 MSA (MiniMax Sparse Attention ),最高支持 1M 超长上下文。

    Input
    ¥2.1/M
    Output
    ¥8.4/M
    Context
    1M
    2026-06-01 Listed
  • Claude Opus 4.8

    API ID:anthropic/claude-opus-4.8
    文本

    Claude Opus 4.8 是 Anthropic 在 Opus 家族中最强大的通用型号。它支持文本、图片和文件输入,并输出文本,支持推理和 1M 令牌上下文窗口。它适合高度自主的代理、长视野代理工作、知识驱动工作以及在长时间会话中保持一致性的记忆驱动任务。 它在多步推理、复杂编码和端到端项目编排方面尤为强大——大型代码库、多阶段调试和长期运行的异步代理流水线。除了编码,它还处理知识工作,如起草文档、构建演示文稿和分析数据,保持长时间输出的质量。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-05-29 Listed
  • Gemini 3.5 Flash

    API ID:google/gemini-3.5-flash
    文本

    Gemini 3.5 Flash 以 Flash 级别的成本和速度提供接近专业级的智能:专业级的编码能力、并行代理执行,所有这些都以更低的价格实现。

    Input
    ¥10.5/M
    Output
    ¥63/M
    Context
    1M
    2026-05-25 Listed
  • Qwen3.7-Max(限时5折)

    API ID:ali/qwen3.7-max
    文本

    Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥7.5/M token

    缓存写(1h)

    • Public price¥7.5/M token
    2026-05-25 Listed
  • Gemini 3.1 Flash Lite

    API ID:google/gemini-3.1-flash-lite
    文本

    Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。

    Input
    ¥1.75/M
    Output
    ¥10.5/M
    Context
    1M
    2026-05-18 Listed
  • MiMo-V2.5

    API ID:xiaomi/mimo-v2.5
    文本多模态理解智能代理与数据文档与办公
    +3
    文本多模态理解智能代理与数据文档与办公

    MiMo-V2.5 是小米原生的全模态模型。它以约一半的推理成本实现专业级代理性能,同时在图像和视频理解任务中的多模态感知上超越 MiMo-V2-Omni。其 100 万上下文窗口支持完整文档、扩展对话和复杂任务上下文,非常适合与代理框架集成,在需要强大推理、丰富感知和成本效益的环境中。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤256k¥2.8/M token
    • 256k~1000k¥5.6/M token

    输出

    • ≤256k¥14/M token
    • 256k~1000k¥28/M token

    缓存读

    • ≤256k¥0.56/M token
    • 256k~1000k¥1.12/M token
    2026-04-27 Listed
  • MiMo-V2.5-Pro

    API ID:xiaomi/mimo-v2.5-pro
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤256k¥7/M token
    • 256k~1000k¥14/M token

    输出

    • ≤256k¥21/M token
    • 256k~1000k¥42/M token

    缓存读

    • ≤256k¥1.4/M token
    • 256k~1000k¥2.8/M token
    2026-04-27 Listed
  • Claude Opus 4.5

    API ID:anthropic/claude-opus-4.5
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    Anthropic 最智能模型的下一代产品 ——Claude Opus 4.5,在编码、代理、计算机使用以及企业工作流方面处于行业领先地位。应用场景如下: 编码:Opus 4.5 能够自信地在几小时内完成原本需要数天的软件开发项目,它可以独立工作,凭借深厚的技术功底和出色的品味,打造高效且简洁的解决方案。它在各种编程语言上的性能都有所提升,在规划和架构选择方面表现更优,是企业开发者的理想模型。 代理:Claude Opus 4.5 结合我们先进的工具使用能力,能打造出功能更强大、具备新行为模式的代理。 计算机使用:作为我们目前最出色的计算机使用模型,Claude Opus 4.5 能以自信、一致的方式应对新场景,实现更接近人类的浏览体验,从而优化网络问答、工作流自动化以及高级用户体验。 企业工作流:Opus 4.5 可以为代理提供支持,助力其从头到尾管理庞大的专业项目。它能更好地利用内存来保持文件间的上下文连贯性和一致性,同时在创建电子表格、幻灯片和文档方面实现了显著的飞跃式改进。 财务分析:Opus 4.5 能够整合复杂信息系统中的各类数据,包括监管文件、市场报告和内部数据,从而实现复杂的预测建模和主动合规。 cybersecurity(网络安全):Opus 4.5 为安全工作流带来专业级别的分析能力,它能关联日志、漏洞数据库和威胁情报,实现主动威胁检测和自动化事件响应。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2025-11-25 Listed
  • KAT-Coder-Pro-V1

    API ID:streamlake/kat-coder-pro-v1
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • 32k~128k¥6/M token
    • 128k~不限¥10/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~不限¥40/M token

    缓存读

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2/M token
    2025-11-13 Listed
  • GPT-5.5

    API ID:openai/gpt-5.5
    文本编程多模态理解数学与科学文档与办公智能代理与数据
    +5
    文本编程多模态理解数学与科学文档与办公智能代理与数据

    GPT-5.5 是 OpenAI 为复杂专业工作负载设计的前沿模型,基于 GPT-5.4,具备更强的推理能力、更高的可靠性,处理困难任务。它配备了 1M上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持在单一系统内实现大规模推理、编码和多模态工作流。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token
    2026-04-27 Listed
  • GLM-5.3-flash

    API ID:bigmodel/glm-5.3-flash
    文本

    GLM-5.3

    Input
    ¥0.8/M
    Output
    ¥2.8/M
    Context
    1M
    2026-09-15 Listed
  • DeepSeek-V4-Flash

    API ID:deepseek/deepseek-v4-flash
    文本数学与科学智能代理与数据文档与办公编程对话与客服
    +5
    文本数学与科学智能代理与数据文档与办公编程对话与客服

    DeepSeek-V4-Flash是深度求索公司于2026年4月24日发布的高效经济版大语言模型。它采用混合专家(MoE)架构,总参数量约2840亿,每次推理仅激活约130亿参数,并原生支持高达100万Token的超长上下文。该版本在推理能力和简单Agent任务上接近性能强大的Pro版本,但凭借更小的参数和激活规模,能提供更快捷、低成本的API服务。适合需要快速响应和追求极致性价比的各类轻量级应用场景。

    Input
    ¥1/M
    Output
    ¥2/M
    Context
    1M
    2026-04-24 Listed
  • Hunyuan-3-preview

    API ID:tencent/hy3-preview
    文本

    混元 Hy3 preview 面向 Agent 工作负载设计,采用 295B/21B 激活的 MoE 架构。在同一个模型内提供 no_think(极速响应)、think_low(快速思考)、think_high(深度推理)三档模式,适配从高频交互到复杂工程任务的不同延迟与深度需求。在 SWE-bench Verified 等代码基准上接近当前最强水平,256K 上下文支持跨文件代码重构与长文档分析。适合需要可靠任务完成度、同时对推理成本敏感的开发者。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤16k¥1.2/M token
    • 16k~32k¥1.6/M token
    • 32k~不限¥2/M token

    输出

    • ≤16k¥4/M token
    • 16k~32k¥6.4/M token
    • 32k~不限¥8/M token

    缓存读

    • ≤16k¥0.4/M token
    • 16k~32k¥0.6/M token
    • 32k~不限¥0.8/M token
    2026-04-23 Listed
  • Step 3.5 Flash-2603

    API ID:stepfun/step-3.5-flash-2603
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    基于 Step 3.5 Flash 针对高频 Agent 场景优化,在保留旗舰推理与工具调用能力的同时,进一步提升 Token 效率与推理速度,并支持切换低推理模式以降低消耗。对 Coding 与 Agent 框架兼容性也做了专项优化。

    Input
    ¥0.7/M
    Output
    ¥2.1/M
    Context
    256K
    2026-04-21 Listed
  • Step 3.5 Flash

    API ID:stepfun/step-3.5-flash
    文本编程数学与科学智能代理与数据学术与教育
    +4
    文本编程数学与科学智能代理与数据学术与教育

    阶跃星辰的旗舰语言推理模型。该模型具备顶尖推理能力与快速可靠的执行能力。能够完成对复杂任务的分解、计划,可快速可靠地调用工具执行任务,胜任逻辑推理、数学、软件工程、深度研究等各种复杂任务。上下文长度为256K。

    Input
    ¥0.7/M
    Output
    ¥2.1/M
    Context
    256K
    2026-04-21 Listed
  • GPT-5.1

    API ID:openai/gpt-5.1
    文本编程数学与科学智能代理与数据对话与客服多模态理解
    +5
    文本编程数学与科学智能代理与数据对话与客服多模态理解

    GPT-5.1 是 GPT-5 系列的最新前沿模型,与 GPT-5 相比,它拥有更强大的通用推理能力、更高的指令遵循度以及更自然的对话风格。它采用自适应推理技术动态分配计算资源,能够快速响应简单查询,同时在处理复杂任务时投入更多精力。该模型能够生成更清晰、更贴近实际的解释,减少专业术语的使用,即使是技术性或多步骤问题也更容易理解。 GPT-5.1 旨在覆盖广泛的任务,在数学、编程和结构化分析等工作负载方面均取得了持续的提升,能够提供更连贯的长篇答案,并提高工具使用的可靠性。它还改进了对话对齐方式,能够在不牺牲准确性的前提下,提供更亲切、更直观的回答。GPT-5.1 是 GPT-5 的主要全功能继任者。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-11-19 Listed
  • Qwen3.6-Max-Preview

    API ID:ali/qwen3.6-max-preview
    文本编程智能代理与数据学术与教育
    +3
    文本编程智能代理与数据学术与教育

    Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥9/M token
    • 128k~256k¥15/M token

    输出

    • ≤128k¥54/M token
    • 128k~256k¥90/M token

    缓存读

    • ≤128k¥0.9/M token
    • 128k~256k¥1.5/M token

    缓存写(5m)

    • Public price¥18.75/M token

    缓存写(1h)

    • Public price¥18.75/M token
    2026-04-21 Listed

24 / 187 models loaded

←Previous
  1. 1
  2. 2
  3. 3
  4. …
  5. 8
Page 2 of 8Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters