Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

187/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • DeepSeek-V4-Pro

    API ID:deepseek/deepseek-v4-pro
    文本编程智能代理与数据数学与科学文档与办公学术与教育
    +5
    文本编程智能代理与数据数学与科学文档与办公学术与教育

    DeepSeek V4 Pro 是 DeepSeek 推出的大型专家混合模型,它专为高级推理、编码和长远视野代理工作流设计,在知识、数学和软件工程基准测试中表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统,实现高效的长上下文处理,并支持多种推理模式,根据任务平衡速度和深度。它非常适合复杂工作负载,如全代码库分析、多步自动化和大规模信息综合,这些工作在能力和效率上都至关重要。

    Input
    ¥4.5/M
    Output
    ¥13.5/M
    Context
    1M
    2026-04-24 Listed
  • GPT 5.1 Codex

    API ID:openai/gpt-5.1-codex
    文本编程
    +1
    文本编程

    (当前仅支持/v1/responses接口)GPT-5.1-Codex 是 GPT-5.1 的一个特殊版本,专为软件工程和编码工作流程而优化。它既适用于交互式开发,也适用于长时间独立执行复杂的工程任务。该模型支持从零开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5.1 相比,Codex 更易于控制,能够更严格地遵循开发者指令,并生成更简洁、更高质量的代码输出。可以通过 `reasoning.effort` 参数调整推理难度。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-11-19 Listed
  • Kimi K2.6

    API ID:moonshot/kimi-k2.6
    文本编程智能代理与数据多模态理解对话与客服学术与教育
    +5
    文本编程智能代理与数据多模态理解对话与客服学术与教育

    Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。

    Input
    ¥6.5/M
    Output
    ¥27/M
    Context
    256K
    2026-04-21 Listed
  • Kimi K2 0905

    API ID:moonshot/kimi-k2
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    ( 最新版本 0905) Kimi K2是一款上下文长度256k的模型,具备更强的Agentic Coding能力、更突出的前端代码的美观度和实用性、以及更好的上下文理解能力。

    Input
    ¥4/M
    Output
    ¥16/M
    Context
    256K
    2025-07-15 Listed
  • Qwen3-Coder-Plus

    API ID:ali/qwen3-coder-plus
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    Qwen3-Coder-Plus,这是通义千问系列迄今为止最具代理能力的代码模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • 32k~128k¥6/M token
    • 128k~256k¥10/M token
    • 256k~不限¥20/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥40/M token
    • 256k~不限¥200/M token

    缓存读

    • ≤32k¥0.4/M token
    • 32k~128k¥0.6/M token
    • 128k~256k¥1/M token
    • 256k~不限¥2/M token
    2025-07-23 Listed
  • Claude Sonnet 4.5

    API ID:anthropic/claude-sonnet-4.5
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-09-30 Listed
  • Qwen3.5-Omni-Flash

    API ID:ali/qwen3.5-omni-flash
    文本

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    Price
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥18/M token

    音频·输出

    • Public price¥72/M token

    图片·输入

    • Public price¥2.2/M token

    视频·输入

    • Public price¥2.2/M token

    search_strategy:agent

    • Public price¥0.004/次调用
    2026-08-26 Listed
  • Qwen3.5-Omni-Plus

    API ID:ali/qwen3.5-omni-plus
    文本

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    Price
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥53/M token

    音频·输出

    • Public price¥213/M token

    图片·输入

    • Public price¥7/M token

    视频·输入

    • Public price¥7/M token

    search_strategy:agent

    • Public price¥0.004/次调用
    2026-08-26 Listed
  • Gemini 3.6 Flash

    API ID:google/gemini-3.6-flash
    文本

    Gemini 3.6 Flash 是 Google 推出的一款高效模型,适用于编程、智能体工作流以及网页和应用开发。

    Input
    ¥10.5/M
    Output
    ¥52.5/M
    Context
    1M
    2026-08-17 Listed
  • Qwen3.7-Flash

    API ID:ali/qwen3.7-flash
    文本

    Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.2/M token
    • 32k~256k¥0.8/M token
    • 256k~1000k¥1.2/M token

    输出

    • ≤32k¥2/M token
    • 32k~256k¥8/M token
    • 256k~1000k¥12/M token

    缓存读

    • ≤32k¥0.02/M token
    • 32k~256k¥0.08/M token
    • 256k~1000k¥0.12/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用

    显式缓存命中

    • ≤32k¥0.02/M token
    • 32k~256k¥0.06/M token
    • 256k~1000k¥0.12/M token

    缓存写(5m)

    • ≤32k¥0.25/M token
    • 32k~256k¥0.75/M token
    • 256k~1000k¥1.5/M token
    2026-08-13 Listed
  • Claude Opus 5

    API ID:anthropic/claude-opus-5
    文本

    Claude Opus 5 是 Anthropic 公司推出的旗舰模型,适用于需要复杂推理、编码以及长期规划的代理任务。它在以下方面表现出强大的能力:端到端的软件任务处理、代码审查与缺陷检测、图表与文档的视觉分析、复杂的办公任务执行,以及平行子代理的协调工作。 这个模型在执行长时间任务时仍能保持出色的指令遵循能力和工具使用能力,同时在处理那些更注重延迟和效率的工作负载时,其性能依然十分出色。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-07-26 Listed
  • Kimi K3

    API ID:moonshot/kimi-k3
    文本

    Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

    Input
    ¥20/M
    Output
    ¥100/M
    Context
    256K
    2026-07-17 Listed
  • GPT-5.6-Terra

    API ID:openai/gpt-5.6-terra
    文本

    GPT-5.6 Terra是OpenAl旗下GPT-5.6系列中的一款均衡模型,介于旗舰级Sol层级与高性价比Luna层级之间。它适用于日常编码、推理及代理任务场景,在这些场景中需要兼顾性能与成本,且能够以大致相当于Sol成本一半的价格提供强大的性能表现。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥14/M token
    • 272k~不限¥28/M token

    输出

    • ≤272k¥84/M token
    • 272k~不限¥126/M token

    缓存读

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    缓存写(5m)

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token
    2026-07-11 Listed
  • GPT-5.6-Luna

    API ID:openai/gpt-5.6-luna
    文本

    GPT-5.6 Luna是OpenAl公司GPT-5.6系列中的一款快速且成本效益高的模型。它适用于高容量、对时延敏感的任务,如聊天、分类以及轻量级代理式工作流程,并以其在价格定位范围内的出色推理能力而著称。

    Input
    ¥7/M
    Output
    ¥42/M
    Context
    400K
    2026-07-11 Listed
  • GPT-5.6-Sol

    API ID:openai/gpt-5.6-sol
    文本

    GPT-5.6 Sol是OpenAl公司GPT-5.6系列中的旗舰模型。它适用于复杂的推理、编码及代理式工作流程, 尤其在命令行和多步骤编码任务以及长期目标问题解决方面表现尤为出色。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token

    缓存写(5m)

    • ≤272k¥43.75/M token
    • 272k~不限¥87.5/M token
    2026-07-11 Listed
  • Claude Sonnet 4.5 Thinking

    API ID:anthropic/claude-sonnet-4.5:thinking
    文本智能代理与数据编程多模态理解
    +3
    文本智能代理与数据编程多模态理解

    Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-09-30 Listed
  • Claude Haiku 4.5

    API ID:anthropic/claude-haiku-4.5
    文本编程智能代理与数据对话与客服
    +3
    文本编程智能代理与数据对话与客服

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥8.75/M token

    缓存写(1h)

    • Public price¥14/M token
    2025-10-16 Listed
  • Claude Haiku 4.5 Thinking

    API ID:anthropic/claude-haiku-4.5:thinking
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥8.75/M token

    缓存写(1h)

    • Public price¥14/M token
    2025-10-16 Listed
  • LongCat-2.0(限时4折)

    API ID:longcat/longcat-2.0
    文本

    LongCat-2.0 是美团 全量开源的1.6 万亿参数 MoE 国产大模型,也是全球首个依托五万张国产算力芯片完成完整训推流程的万亿级大模型美团技术团。

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    1M
    2026-07-07 Listed
  • KAT-Coder-Air-V1

    API ID:streamlake/kat-coder-air-v1
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    KAT-Coder 系列模型中的轻量化版本。专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    Input
    ¥0/M
    Output
    ¥0/M
    Context
    128K
    2025-11-13 Listed
  • GLM-5.3

    API ID:bigmodel/glm-5.3
    文本

    GLM-5.3

    Input
    ¥8/M
    Output
    ¥28/M
    Context
    1M
    2026-09-14 Listed
  • Claude Sonnet 5

    API ID:anthropic/claude-sonnet-5
    文本

    Sonnet 5 是 Anthropic 公司最强大的 Sonnet 类模型之一,其在各种编程、代理以及专业场景中的性能表现都非常出色。该模型支持自适应思维机制,用户可以选择不同的推理强度级别(低、中、高、最高以及超高强度)。它还具备 1 百万标记数的上下文存储能力,并且能够接受文本、图像和文件输入。Sonnet 5 采用了升级后的分词器,并配备了实时网络安全保护功能,能够阻止某些高风险的两用活动

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2026-07-01 Listed
  • GPT-5.3 Chat

    API ID:openai/gpt-5.3-chat
    文本对话与客服
    +1
    文本对话与客服

    GPT-5.3 Chat 是对 ChatGPT 最常用模型的升级,使日常对话更加流畅、实用且直接实用。它能提供更准确的答案,更好地提供上下文,显著减少不必要的拒绝、附加条件和过于谨慎的措辞,避免打断对话流畅。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2026-03-06 Listed
  • Doubao-Seed-Character

    API ID:bytedance/doubao-seed-character
    文本

    Doubao-Seed-Character 是面向新一代虚拟陪伴场景打造的 Seed 分支模型,擅长虚拟演绎与“真人”风格的角色扮演,支持剧情创作、剧情演绎与推动、多人聊天等多类对话互动场景。 模型在角色理解、人设保持、多轮对话、剧情推进与互动表达上持续增强,能够稳定理解用户意图、延续角色设定,并以更具画面感的语言带来自然、生动、连贯的互动体验。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤32k¥2/M token
    • 32k~不限¥6/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~不限¥0.16/M token
    2026-06-23 Listed

24 / 187 models loaded

←Previous
  1. 1
  2. 2
  3. …
  4. 8
Page 1 of 8Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters