Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

187/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • GLM-4.6

    API ID:bigmodel/glm-4.6
    文本对话与客服文档与办公编程内容创作学术与教育
    +5
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-10-09 Listed
  • KAT-Coder-Exp-72B-1010

    API ID:streamlake/kat-coder-exp-72b-1010
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    KAT-Coder-Exp-72B 是 KAT-Coder 系列模型中的 RL 创新实验版本,在软件开发能力评测基准 SWE-Bench verified 上取得了 74.6% 的卓越性能,创下开源模型新纪录。专注于 Agentic Coding,目前仅支持 SWE-Agent 脚手架,也可进行简单对话。

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    128K
    2025-11-13 Listed
  • GLM-5

    API ID:bigmodel/glm-5
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • 32k~不限¥6/M token

    输出

    • ≤32k¥18/M token
    • 32k~不限¥22/M token

    缓存读

    • ≤32k¥1/M token
    • 32k~不限¥1.5/M token
    2026-02-12 Listed
  • GPT-5-Nano

    API ID:openai/gpt-5-nano
    文本编程对话与客服多模态理解
    +3
    文本编程对话与客服多模态理解

    GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。

    Input
    ¥0.35/M
    Output
    ¥2.8/M
    Context
    400K
    2025-08-15 Listed
  • GPT-5

    API ID:openai/gpt-5
    文本编程数学与科学多模态理解智能代理与数据
    +4
    文本编程数学与科学多模态理解智能代理与数据

    GPT-5是OpenAI推出的最新一代先进模型,在推理能力、代码生成质量和用户体验方面实现显著提升。该模型针对复杂任务进行了专项优化,尤其擅长需要逐步推理、精准遵循指令以及对准确性要求严格的高风险场景。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-08-15 Listed
  • Qwen3-Max-Preview

    API ID:ali/qwen3-max-preview
    文本数学与科学编程翻译学术与教育对话与客服
    +5
    文本数学与科学编程翻译学术与教育对话与客服

    Qwen3-Max-Preview是阿里巴巴旗下通义千问团队发布的最新旗舰大语言模型,是 Qwen3 系列中参数量最大的模型,参数规模超过1万亿。模型在推理、指令跟随、多语言支持和长尾知识覆盖等方面有重大改进,支持超过100种语言,中英文理解能力出色。在数学推理、编程和科学推理等任务中表现出色,能更可靠地遵循复杂指令,减少幻觉,生成更高质量的响应。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥6/M token
    • 32k~128k¥10/M token
    • 128k~不限¥15/M token

    输出

    • ≤32k¥24/M token
    • 32k~128k¥40/M token
    • 128k~不限¥60/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~128k¥2/M token
    • 128k~不限¥3/M token
    2025-09-08 Listed
  • MiniMax M2

    API ID:minimax/minimax-m2
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2025-10-28 Listed
  • Qwen3-Omni-Flash

    API ID:ali/qwen3-omni-flash
    文本对话与客服内容创作翻译编程文档与办公
    +5
    文本对话与客服内容创作翻译编程文档与办公

    Qwen-Omni 模型能够接收文本、图片、音频、视频等多种模态的组合输入,并生成文本或语音形式的回复, 提供多种拟人音色,支持多语言和方言的语音输出,可应用于文本创作、视觉识别、语音助手等场景。

    Input
    ¥1.8/M
    Output
    ¥6.9/M
    Context
    65.5K
    2025-09-23 Listed
  • Qwen3-Max

    API ID:ali/qwen3-max
    文本编程数学与科学智能代理与数据多模态理解翻译
    +5
    文本编程数学与科学智能代理与数据多模态理解翻译

    Qwen3-Max 是在 Qwen3 系列的基础上构建的更新版本,与 2025 年 1 月版本相比,在推理、指令遵循、多语言支持和长尾知识覆盖方面进行了重大改进。它在数学、编码、逻辑和科学任务中提供更高的准确性,更可靠地遵循复杂的中文和英文指令,减少幻觉,并为开放式问答、写作和对话提供更高质量的回答。该模型支持 100 多种语言,具有更强的翻译和常识推理能力,并针对检索增强生成 (RAG) 和工具调用进行了优化,尽管它不包括专用的“思考”模式。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥6/M token
    • 32k~128k¥10/M token
    • 128k~不限¥15/M token

    输出

    • ≤32k¥24/M token
    • 32k~128k¥40/M token
    • 128k~不限¥60/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~128k¥2/M token
    • 128k~不限¥3/M token
    2025-09-24 Listed
  • GPT-5-Codex

    API ID:openai/gpt-5-codex
    文本编程
    +1
    文本编程

    GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-10-10 Listed
  • GLM-4.6 Thinking

    API ID:bigmodel/glm-4.6:thinking
    文本编程数学与科学学术与教育文档与办公对话与客服
    +5
    文本编程数学与科学学术与教育文档与办公对话与客服

    GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-10-09 Listed
  • Qwen3-VL-Plus

    API ID:ali/qwen3-vl-plus
    文本多模态理解图像与设计视频与3D智能代理与数据编程
    +5
    文本多模态理解图像与设计视频与3D智能代理与数据编程

    Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥1/M token
    • 32k~128k¥1.5/M token
    • 128k~不限¥3/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥15/M token
    • 128k~不限¥30/M token

    缓存读

    • ≤32k¥0.2/M token
    • 32k~128k¥0.3/M token
    • 128k~不限¥0.6/M token
    2025-09-24 Listed
  • Doubao-Seed-1.6-thinking

    API ID:bytedance/doubao-seed-1.6:thinking
    文本数学与科学编程多模态理解
    +3
    文本数学与科学编程多模态理解

    Doubao-Seed-1.6-thinking,是豆包大模型1.6系列在深度思考方面的强化版本。在代码编写、数学运算、逻辑推理等基础能力上有了进一步的显著提升。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.17/M token
    • 32k~128k¥0.17/M token
    • 128k~不限¥0.17/M token
    2025-06-12 Listed
  • Qwen3 Next 80B A3B Instruct

    API ID:ali/qwen3-next-80b-a3b-Instruct
    文本编程智能代理与数据对话与客服数学与科学翻译
    +5
    文本编程智能代理与数据对话与客服数学与科学翻译

    Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列中的一款指令微调对话模型,专为提供快速、稳定的响应而优化。它能够胜任复杂推理、代码生成、知识问答和多语言应用,同时在对齐与格式控制方面保持稳健。与以往的Qwen3 指令模型相比,该版本在超长输入和多轮对话场景下具备更高吞吐与更强稳定性,非常适用于RAG、工具调用以及需要一致性最终答案的智能体工作流。

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    131.1K
    2025-09-12 Listed
  • GPT-5-Mini

    API ID:openai/gpt-5-mini
    文本多模态理解对话与客服文档与办公内容创作学术与教育
    +5
    文本多模态理解对话与客服文档与办公内容创作学术与教育

    GPT-5-Mini是GPT-5的轻量级版本,专为高效处理日常推理任务而设计。它继承了 GPT-5的指令跟随能力和安全优化,同时具备更低的延迟和成本优势。

    Input
    ¥1.75/M
    Output
    ¥14/M
    Context
    400K
    2025-08-15 Listed
  • Hunyuan-Turbos-Vision

    API ID:tencent/hunyuan-turbos-vision
    文本多模态理解图像与设计对话与客服翻译文档与办公
    +5
    文本多模态理解图像与设计对话与客服翻译文档与办公

    采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。

    Input
    ¥3/M
    Output
    ¥9/M
    Context
    32K
    2025-11-06 Listed
  • Claude Sonnet 4

    API ID:anthropic/claude-sonnet-4
    文本编程编程数学与科学多模态理解
    +4
    文本编程编程数学与科学多模态理解

    Claude Sonnet 4是对Sonnet 3.7的全面升级,在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-05-23 Listed
  • DeepSeek V3.1

    API ID:deepseek/deepseek-v3.1
    文本智能代理与数据多模态理解数学与科学
    +3
    文本智能代理与数据多模态理解数学与科学

    DeepSeek V3.1是DeepSeek的新一代模型,具备混合推理(Think & Non-Think双模式),显著提升思考速度和任务处理效率,并通过后训练强化工具调用与多步骤智能体能力。

    Input
    ¥4/M
    Output
    ¥12/M
    Context
    128K
    2025-08-26 Listed
  • Claude Opus 4

    API ID:anthropic/claude-opus-4
    文本编程智能代理与数据编程多模态理解数学与科学
    +5
    文本编程智能代理与数据编程多模态理解数学与科学

    Claude Opus 4是Anthropic专为构建复杂的人工智能代理而设计的模型,能够在最少的监督下自主推理、规划和执行复杂的任务。该模型在需要扩展上下文、深度推理和自适应执行的软件开发场景中表现卓越。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥131.25/M token

    缓存写(1h)

    • Public price¥210/M token
    2025-05-23 Listed
  • Doubao-Seed-1.6

    API ID:bytedance/doubao-seed-1.6
    文本多模态理解对话与客服文档与办公编程数学与科学
    +5
    文本多模态理解对话与客服文档与办公编程数学与科学

    Doubao-Seed-1.6,这是一个 “All-in-One” 的综合模型,也是国内首个支持256K上下文的思考模型,它能够同时支持thinking、non-thinking、auto三种思考模式。这是一个 “All-in-One” 的综合模型,也是国内首个支持256K上下文的思考模型,它能够同时支持thinking、non-thinking、auto三种思考模式。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~128k¥0.16/M token
    • 128k~不限¥0.16/M token
    2025-06-12 Listed
  • Doubao-Seed-1.6-flash

    API ID:bytedance/doubao-seed-1.6-flash
    文本对话与客服多模态理解文档与办公
    +3
    文本对话与客服多模态理解文档与办公

    Doubao-Seed-1.6-flash为豆包大模型1.6系列的极速版本,具有低延迟的显著优势,非常适用于对延迟要求极高的实时交互场景,如客服场景等。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.15/M token
    • 32k~128k¥0.3/M token
    • 128k~不限¥0.6/M token

    输出

    • ≤32k¥1.5/M token
    • 32k~128k¥3/M token
    • 128k~不限¥6/M token

    缓存读

    • ≤32k¥0.03/M token
    • 32k~128k¥0.03/M token
    • 128k~不限¥0.03/M token
    2025-06-12 Listed
  • Claude Sonnet 4 ( Thinking )

    API ID:anthropic/claude-sonnet-4:thinking
    文本编程数学与科学
    +2
    文本编程数学与科学

    Claude Sonnet 4 ( Thinking ),在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-06-19 Listed
  • Qwen3 Next 80B A3B Thinking

    API ID:ali/qwen3-next-80b-a3b-thinking
    文本数学与科学编程智能代理与数据学术与教育
    +4
    文本数学与科学编程智能代理与数据学术与教育

    Qwen3-Next-80B-A3B-Thinking 是Qwen3-Next系列中以推理为核心的对话模型,默认输出结构化的“思维链”内容。它专为复杂多步问题而设计,能够处理数学证明、代码生成与调试、逻辑推演以及智能体规划等任务,并在知识、推理、编程、对齐和多语言评测上表现出色。与以往的Qwen3模型相比,该版本在长链式思维下的稳定性与推理阶段的高效扩展上更具优势,且在复杂指令跟随时显著降低了重复或偏离任务的情况。

    Input
    ¥1/M
    Output
    ¥10/M
    Context
    131.1K
    2025-09-12 Listed
  • Claude Opus 4.1

    API ID:anthropic/claude-opus-4.1
    文本编程智能代理与数据数学与科学
    +3
    文本编程智能代理与数据数学与科学

    Claude Opus 4.1是Anthropic旗舰模型的更新版本,在编码、推理和代理任务方面均有提升。它在SWE-bench Verified测试中达到了74.5%的准确率,并在多文件代码重构、调试精度和面向细节的推理方面展现出显著提升。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥131.25/M token

    缓存写(1h)

    • Public price¥210/M token
    2025-08-06 Listed

24 / 187 models loaded

←Previous
  1. 1
  2. …
  3. 4
  4. 5
  5. 6
  6. …
  7. 8
Page 5 of 8Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters