Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

187/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Grok Code Fast 1

    API ID:xai/grok-code-fast-1
    文本编程数学与科学
    +2
    文本编程数学与科学

    Grok Code Fast 1是xAI的首款编程模型,是一款兼具速度、高性价比的推理模型。

    Input
    ¥1.4/M
    Output
    ¥10.5/M
    Context
    256K
    2025-09-08 Listed
  • Qwen3-Coder-480B-A35B-Instruct

    API ID:ali/qwen3-coder-480b-a35b-instruct
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    基于Qwen3的代码生成模型,具有强大的Coding Agent能力,代码能力达到开源模型 SOTA。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥6/M token
    • 32k~不限¥9/M token

    输出

    • ≤32k¥24/M token
    • 32k~不限¥36/M token
    2025-08-26 Listed
  • o3

    API ID:openai/o3
    文本编程数学与科学多模态理解文档与办公智能代理与数据
    +5
    文本编程数学与科学多模态理解文档与办公智能代理与数据

    o3是一款全面且强大的跨领域模型,在数学、科学、编程和视觉推理任务中树立了新标杆。它在技术写作和遵循指令方面也表现出色。可用于处理涉及文本、代码和图像分析的多步骤问题。

    Input
    ¥14/M
    Output
    ¥56/M
    Context
    200K
    2025-08-26 Listed
  • Kimi-thinking-preview

    API ID:moonshot/kimi-thinking-preview
    文本多模态理解数学与科学
    +2
    文本多模态理解数学与科学

    Kimi-thinking-preview是月之暗面提供的具有多模态推理能力和通用推理能力的多模态思考模型,它最长支持128k上下文,擅长深度推理,帮助解决更多更难的事情。

    Input
    ¥200/M
    Output
    ¥200/M
    Context
    128K
    2025-07-15 Listed
  • GLM-4.5

    API ID:bigmodel/glm-4.5
    文本编程智能代理与数据数学与科学文档与办公
    +4
    文本编程智能代理与数据数学与科学文档与办公

    GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-07-29 Listed
  • GLM-4.5 Thinking

    API ID:bigmodel/glm-4.5:thinking
    文本编程数学与科学智能代理与数据
    +3
    文本编程数学与科学智能代理与数据

    GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-09-29 Listed
  • Hunyuan-Turbo-Vision

    API ID:tencent/hunyuan-turbo-vision
    文本多模态理解对话与客服翻译
    +3
    文本多模态理解对话与客服翻译

    2024年发布的多模态旗舰模型,支持多语种作答,中英文能力均衡。

    Input
    ¥3/M
    Output
    ¥9/M
    Context
    6K
    2025-11-12 Listed
  • Gemini 2.5 Flash Lite

    API ID:google/gemini-2.5-flash-lite
    文本多模态理解编程数学与科学文档与办公内容创作
    +5
    文本多模态理解编程数学与科学文档与办公内容创作

    Gemini 2.5 Flash-Lite 是Gemini 2.5 系列中的一个轻量级推理模型,优化了超低延迟和成本效率。与早期的 Flash 模型相比,它提供了更好的吞吐量、更快的 token 生成以及在常见基准测试中更好的性能。可通过reasoning.max_tokens开启思考并控制思维链长度。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥0.581/M token
    2025-06-24 Listed
  • Hunyuan-T1-Vision

    API ID:tencent/hunyuan-t1-vision
    文本多模态理解图像与设计文档与办公对话与客服
    +4
    文本多模态理解图像与设计文档与办公对话与客服

    采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。

    Input
    ¥3/M
    Output
    ¥9/M
    Context
    32K
    2025-11-06 Listed
  • Claude-3.7-sonnet(Thinking)

    API ID:anthropic/claude-3.7-sonnet:thinking
    文本编程数学与科学多模态理解编程文档与办公学术与教育
    +6
    文本编程数学与科学多模态理解编程文档与办公学术与教育

    Claude-3.7-sonnet(Thinking)是Anthropic于 2025 年推出的新一代思维型大语言模型。该模型首次融合自回归生成与符号推理架构,具备多步骤思维展示、自我纠错能力以及长达 10 万 tokens 的上下文理解能力,标志着AI从简单生成向深度逻辑推理与透明思考的跨越。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-03-28 Listed
  • DeepSeek-R1-0528

    API ID:deepseek/deepseek-r1-0528
    文本编程翻译编程数学与科学
    +4
    文本编程翻译编程数学与科学

    DeepSeek R1-0528是DeepSeek R1模型的小版本升级版。通过增加计算资源和引入后训练阶段的算法优化,DeepSeek R1-0528显著提升了推理与推断的深度和能力。该模型在数学、编程及一般逻辑等多项基准测试中表现优异,整体性能已接近业内领先的 O3和Gemini 2.5 Pro模型,展现出强大的多领域应用潜力。

    Input
    ¥2/M
    Output
    ¥3/M
    Context
    128K
    2025-02-20 Listed
  • MiniMax-M1

    API ID:minimax/minimax-m1
    文本数学与科学编程多模态理解
    +3
    文本数学与科学编程多模态理解

    MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型,适合在复杂场景中使用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token
    2025-07-15 Listed
  • Qwen3-235B-A22B-Instruct-2507

    API ID:ali/qwen3-235b-a22b-instruct-2507
    文本编程数学与科学多模态理解文档与办公翻译
    +5
    文本编程数学与科学多模态理解文档与办公翻译

    Qwen3-235B-A22B-Instruct-2507是Qwen3-235B-A22B-FP8的增强版本,在指令遵循、逻辑推理、文本理解、数学与编程能力、多语言知识覆盖等方面表现显著提升,并在256K长上下文处理和主观任务对齐度上进一步优化,生成内容更高质量、更贴近用户意图。

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    131.1K
    2025-07-23 Listed
  • GLM-4.5-AirX Thinking

    API ID:bigmodel/glm-4.5-airx:thinking
    文本对话与客服编程数学与科学
    +3
    文本对话与客服编程数学与科学

    GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • ≤32k¥4/M token
    • 32k~不限¥8/M token

    输出

    • ≤2k¥12/M token
    • 2k~不限¥16/M token
    • 全部¥32/M token

    缓存读

    • 全部¥0.8/M token
    • 全部¥0.8/M token
    • 全部¥1.6/M token
    2025-09-29 Listed
  • GLM-4.5-Air Thinking

    API ID:bigmodel/glm-4.5-air:thinking
    文本数学与科学编程智能代理与数据对话与客服文档与办公
    +5
    文本数学与科学编程智能代理与数据对话与客服文档与办公

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
    2025-09-29 Listed
  • GLM-4.5-X Thinking

    API ID:bigmodel/glm-4.5-x:thinking
    文本对话与客服文档与办公编程内容创作学术与教育
    +5
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
    2025-09-29 Listed
  • GLM-4.5-Air

    API ID:bigmodel/glm-4.5-air
    文本对话与客服编程文档与办公内容创作智能代理与数据
    +5
    文本对话与客服编程文档与办公内容创作智能代理与数据

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
    2025-07-29 Listed
  • GLM-4.5-X

    API ID:bigmodel/glm-4.5-x
    文本对话与客服编程文档与办公内容创作翻译
    +5
    文本对话与客服编程文档与办公内容创作翻译

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
    2025-07-29 Listed
  • Qwen3-235B-A22B-Thinking-2507

    API ID:ali/qwen3-235b-a22b-thinking-2507
    文本数学与科学多模态理解内容创作学术与教育文档与办公
    +5
    文本数学与科学多模态理解内容创作学术与教育文档与办公

    基于Qwen3的思考模式开源模型,相较通义千问3-235B-A22B逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强推理场景。

    Input
    ¥2/M
    Output
    ¥20/M
    Context
    131.1K
    2025-07-28 Listed
  • Claude 3.5 Haiku

    API ID:anthropic/claude-3.5-haiku
    文本多模态理解对话与客服内容创作文档与办公编程
    +5
    文本多模态理解对话与客服内容创作文档与办公编程

    Claude 3.5 Haiku是Anthropic最快且最具成本效益的下一代模型,非常适合速度和经济性重要的应用场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥7/M token

    缓存写(1h)

    • Public price¥11.2/M token
    2025-07-24 Listed
  • Kimi-latest

    API ID:moonshot/kimi-latest
    文本多模态理解文档与办公对话与客服内容创作学术与教育
    +5
    文本多模态理解文档与办公对话与客服内容创作学术与教育

    Kimi-latest是一个最长支持128k上下文的视觉模型,支持图片理解。同时,kimi-latest 模型总是使用Kimi智能助手产品使用最新的Kimi 大模型版本,可能包含尚未稳定的特性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤8k¥2/M token
    • 8k~32k¥5/M token
    • 32k~不限¥10/M token

    输出

    • ≤8k¥10/M token
    • 8k~32k¥20/M token
    • 32k~不限¥30/M token
    2025-07-15 Listed
  • Qwen3.5-9B

    API ID:ali/qwen3.5-9b
    文本

    Qwen3.5-9B 是 Qwen3.5 系列中的多模态基础模型,旨在以高效的 9B 参数架构提供强大的推理、编码和视觉理解能力。它采用统一的视觉语言设计,并早期融合多模态标记,使模型能够在同一上下文中处理和推理文本和图像。

    Input
    ¥0.56/M
    Output
    ¥0.91/M
    Context
    400K
    2026-09-10 Listed
  • InternVL3.5

    API ID:intern/internvl3.5
    文本

    最新的发布的通用多模态大模型系列,拥有卓越的图文推理能力。

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    128K
    2026-07-07 Listed

23 / 187 models loaded

←Previous
  1. 1
  2. …
  3. 5
  4. 6
  5. 7
  6. 8
Page 6 of 8Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters