Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

187/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • MiniMax M2.5

    API ID:minimax/minimax-m2.5
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    在 MiniMax 真实业务场景中,整体任务的 30% 由 M2.5 自主完成,覆盖研发、产品、销售、HR、财务等职能,且渗透率仍在持续上升。其中,在编程场景表现尤为突出,M2.5 生成的代码已占新提交代码的 80%。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2026-02-13 Listed
  • GPT 5.2 Codex

    API ID:openai/gpt-5.2-codex
    文本编程多模态理解智能代理与数据
    +3
    文本编程多模态理解智能代理与数据

    GPT-5.2-Codex 旨在实现可导向性、前端开发和交互性。 开发者可以利用 gpt-5.2-codex 进行各种智能、多模态的开发任务。对于寻求更智能、更安全、更集成 AI 协助的开发者来说,该模型为你的 AI 工具包提供了强大的新工具。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2026-01-16 Listed
  • Claude Opus 4.6

    API ID:anthropic/claude-opus-4.6
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    Opus 4.6 是 Anthropic 最强的代码生成和长期专业任务模型。它专为跨整个工作流运行的代理而构建,而不是单个提示,这使得它在大型代码库、复杂的重构和随着时间推移展开的多步骤调试方面特别有效。该模型比之前的模型表现出更深入的上下文理解、更强的问题分解能力,以及在工程任务难度较高的情况下更可靠的可靠性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-02-06 Listed
  • Kimi K2.5

    API ID:moonshot/kimi-k2.5
    文本编程多模态理解智能代理与数据
    +3
    文本编程多模态理解智能代理与数据

    Kimi K2.5 是 Kimi 迄今最智能的模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。同时 Kimi K2.5 也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。 Kimi K2.5 在原有全栈开发与工具生态优势基础上,进一步强化前端代码质量与设计表现力前端能力,实现了跨越式突破,支持从自然语言直接生成功能完整、视觉精美的交互界面,并能精准处理动态布局、滚动动画等复杂效果。

    Input
    ¥4/M
    Output
    ¥21/M
    Context
    256K
    2026-01-27 Listed
  • Qwen3-Max-2026-01-23

    API ID:ali/qwen3-max-2026-01-23
    文本对话与客服编程智能代理与数据内容创作学术与教育
    +5
    文本对话与客服编程智能代理与数据内容创作学术与教育

    通义千问3系列Max模型,相较2025年9月23日快照,此版本实现思考模式和非思考模式的有效融合,模型整体效果得到全方位的大幅度提升。在思考模式下,同时发布Web搜索、Web信息提取和代码解释器工具能力,使得模型在慢思考的同时,能够通过引入外部工具,以更高的准确性解决更有难度的问题。此版本为2026年1月23日快照。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2.5/M token
    • 32k~128k¥4/M token
    • 128k~不限¥7/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥16/M token
    • 128k~不限¥18/M token
    2026-01-27 Listed
  • Grok 4 Fast

    API ID:x-ai/grok-4-fast
    文本多模态理解文档与办公数学与科学
    +3
    文本多模态理解文档与办公数学与科学

    Grok 4 Fast 是 xAI 最新的多模态模型,具有 SOTA 成本效益和 2M 令牌上下文窗口。它有两种类型:非推理和推理。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥1.4/M token
    • 128k~不限¥2.8/M token

    输出

    • ≤128k¥3.5/M token
    • 128k~不限¥7/M token

    缓存读

    • ≤128k¥0.35/M token
    • 128k~不限¥0.35/M token
    2025-09-29 Listed
  • GPT-5.4-Pro

    API ID:openai/gpt-5.4-pro
    文本编程内容创作多模态理解学术与教育数学与科学
    +5
    文本编程内容创作多模态理解学术与教育数学与科学

    GPT-5 Pro 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面进行了重大改进。它针对需要分步推理、遵循指令和高风险用例准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑这个问题”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥210/M token
    • 272k~不限¥420/M token

    输出

    • ≤272k¥1260.001/M token
    • 272k~不限¥1890.002/M token
    2026-03-10 Listed
  • Doubao-Seed-2.0-pro

    API ID:bytedance/doubao-seed-2-0-pro
    文本多模态理解智能代理与数据数学与科学文档与办公对话与客服
    +5
    文本多模态理解智能代理与数据数学与科学文档与办公对话与客服

    旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥3.2/M token
    • 32k~128k¥4.8/M token
    • 128k~256k¥9.6/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥48/M token

    缓存读

    • ≤32k¥0.64/M token
    • 32k~128k¥0.96/M token
    • 128k~256k¥1.92/M token
    2026-03-14 Listed
  • Doubao-Seed-2.0-mini

    API ID:bytedance/doubao-seed-2-0-mini
    文本多模态理解对话与客服文档与办公内容创作翻译
    +5
    文本多模态理解对话与客服文档与办公内容创作翻译

    面向低时延、高并发与成本敏感场景,提供极致的模型推理速度。模型效果与Doubao-Seed-1.6相当。支持256k上下文、4档思考长度和多模态理解,适合成本和速度优先的轻量级任务。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.2/M token
    • 32k~128k¥0.4/M token
    • 128k~256k¥0.8/M token

    输出

    • ≤32k¥2/M token
    • 32k~128k¥4/M token
    • 128k~256k¥8/M token

    缓存读

    • ≤32k¥0.04/M token
    • 32k~128k¥0.08/M token
    • 128k~256k¥0.16/M token
    2026-03-14 Listed
  • Doubao-Seed-1.8

    API ID:bytedance/doubao-seed-1.8
    文本多模态理解智能代理与数据对话与客服
    +3
    文本多模态理解智能代理与数据对话与客服

    全新面向多模态 Agent 场景定向优化模型。更强Agent能力、升级多模态理解、更灵活的上下文管理。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~128k¥0.16/M token
    • 128k~不限¥0.16/M token
    2025-12-18 Listed
  • Doubao-Seed-2.0-lite

    API ID:bytedance/doubao-seed-2-0-lite
    文本文档与办公内容创作智能代理与数据多模态理解
    +4
    文本文档与办公内容创作智能代理与数据多模态理解

    面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.6/M token
    • 32k~128k¥0.9/M token
    • 128k~256k¥1.8/M token

    输出

    • ≤32k¥3.6/M token
    • 32k~128k¥5.4/M token
    • 128k~256k¥10.8/M token

    缓存读

    • ≤32k¥0.12/M token
    • 32k~128k¥0.18/M token
    • 128k~256k¥0.36/M token
    2026-03-14 Listed
  • Gemini 2.5 Pro

    API ID:google/gemini-2.5-pro
    文本编程多模态理解编程数学与科学学术与教育文档与办公
    +6
    文本编程多模态理解编程数学与科学学术与教育文档与办公

    Gemini 2.5 Pro是一款强大的推理模型,专为解决复杂问题而设计。它具备卓越的理解与分析能力,能够处理来自多种信息源的海量数据,包括文本、音频、图像、视频,甚至是完整的代码库。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤200k¥8.75/M token
    • 200k~不限¥17.5/M token

    输出

    • ≤200k¥70/M token
    • 200k~不限¥105/M token

    缓存读

    • ≤200k¥0.875/M token
    • 200k~不限¥1.75/M token
    2025-06-18 Listed
  • MiMo V2 Flash

    API ID:xiaomi/mimo-v2-flash
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    这是一个专为极致推理效率自研的总参数 309B(激活 15B)的 MoE 模型,通过 Hybrid 注意力架构创新及多层 MTP 推理加速,在多个 Agent 测评基准上保持进入全球开源模型 Top 2;代码能力超过所有开源模型,比肩标杆闭源模型 Claude 4.5 Sonnet,但推理成本仅为其 2.5%,生成速度提升 2 倍,成功将大模型推理效率推向极致。

    Input
    ¥0.7/M
    Output
    ¥2.1/M
    Context
    256K
    2025-12-17 Listed
  • Doubao-Seed-2.0-Code

    API ID:bytedance/doubao-seed-2-0-code
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥3.2/M token
    • 32k~128k¥4.8/M token
    • 128k~256k¥9.6/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥48/M token

    缓存读

    • ≤32k¥0.64/M token
    • 32k~128k¥0.96/M token
    • 128k~256k¥1.92/M token
    2026-03-14 Listed
  • MiniMax M2.7-highspeed

    API ID:minimax/minimax-m2.7-highspeed
    文本编程文档与办公智能代理与数据多模态理解对话与客服
    +5
    文本编程文档与办公智能代理与数据多模态理解对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2026-03-18 Listed
  • Grok 4.1 Fast

    API ID:x-ai/grok-4.1-fast
    文本智能代理与数据对话与客服
    +2
    文本智能代理与数据对话与客服

    Grok 4.1 Fast 是 xAI 最好的代理工具调用模型,在客户支持和深入研究等实际应用场景中表现出色。200 万上下文窗口。

    Input
    ¥1.4/M
    Output
    ¥3.5/M
    Context
    2M
    2026-03-23 Listed
  • GLM-5V-Turbo

    API ID:bigmodel/glm-5v-turbo
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    GLM-5V-Turbo 是智谱首个多模态 Coding 基座模型,面向视觉编程任务打造。能够原生处理图片、视频、文本等多模态输入,同时擅长长程规划、复杂编程和动作执行;深度适配 Agent 工作流,能够与 Claude Code、OpenClaw 等 Agent 深度协同,完成”看懂环境→规划动作→执行任务”的完整闭环。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥5/M token
    • 32k~不限¥7/M token

    输出

    • ≤32k¥22/M token
    • 32k~不限¥26/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~不限¥1.8/M token
    2026-04-03 Listed
  • Qwen-VL-OCR

    API ID:ali/qwen-vl-ocr
    文本多模态理解文档与办公图像与设计
    +3
    文本多模态理解文档与办公图像与设计

    通义千问VL-OCR(qwen-vl-ocr),即基于Qwen-VL训练的OCR识别大模型。通过统一模型的方式聚合多种图文识别、解析、处理类任务,提供强大的图文识别能力。

    Input
    ¥0.3/M
    Output
    ¥0.5/M
    Context
    32K
    2025-11-28 Listed
  • MiMo-V2-Omni

    API ID:xiaomi/mimo-v2-omni
    文本智能代理与数据多模态理解对话与客服
    +3
    文本智能代理与数据多模态理解对话与客服

    MiMo-V2-Omni 专为现实世界中复杂的多模态交互与执行场景而生。我们从底层构建了融合文本、视觉、语音的全模态基座,并以统一架构将“感知”与“行动”深度绑定。这不仅打破了传统模型“重理解、轻执行”的局限,更让模型原生具备了多模态感知、工具调用、函数执行及 GUI 操作能力。MiMo-V2-Omni 可无缝接入各大智能体框架,实现了从理解到操控的跨越,大幅降低了全模态 Agent 的落地门槛。

    Input
    ¥2.8/M
    Output
    ¥14/M
    Context
    256K
    2026-04-27 Listed
  • MiMo-V2-Pro

    API ID:xiaomi/mimo-v2-pro
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤256k¥7/M token
    • 256k~1000k¥14/M token

    输出

    • ≤256k¥21/M token
    • 256k~1000k¥42/M token

    缓存读

    • ≤256k¥1.4/M token
    • 256k~1000k¥2.8/M token
    2026-04-27 Listed
  • GPT 5.1 Codex Mini

    API ID:openai/gpt-5.1-codex-mini
    文本编程多模态理解智能代理与数据数学与科学
    +4
    文本编程多模态理解智能代理与数据数学与科学

    (当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。

    Input
    ¥1.75/M
    Output
    ¥14/M
    Context
    400K
    2025-11-19 Listed
  • Gemini 2.5 Flash

    API ID:google/gemini-2.5-flash
    文本多模态理解对话与客服编程内容创作数学与科学
    +5
    文本多模态理解对话与客服编程内容创作数学与科学

    Gemini 2.5 Flash是Google在性价比方面表现最优的模型,兼具全面能力与高效性能。作为首个具备“思维能力”的 Flash 系列模型,Gemini 2.5 Flash支持可视化的思维过程,让用户直观了解模型在生成回答时的推理路径。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥0.581/M token
    2025-06-18 Listed
  • Grok 4

    API ID:x-ai/grok-4
    文本对话与客服内容创作文档与办公编程学术与教育
    +5
    文本对话与客服内容创作文档与办公编程学术与教育

    Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥21/M token
    • 128k~不限¥42/M token

    输出

    • ≤128k¥105/M token
    • 128k~不限¥210/M token

    缓存读

    • ≤128k¥5.25/M token
    • 128k~不限¥5.25/M token
    2025-07-10 Listed
  • DeepSeek-OCR

    API ID:deepseek/deepseek-ocr
    文本图像与设计多模态理解文档与办公
    +3
    文本图像与设计多模态理解文档与办公

    DeepSeek-OCR 是 DeepSeek AI 发布的视觉语言模型,旨在探索视觉-文本压缩边界,专注于文档识别及图像转文本场景的解决方案 。该模型可将长文本渲染为高压缩比图像,在 10 倍无损压缩下能实现 97% 的 OCR 准确率,即使压缩到 20 倍也能保持约 60% 的准确率。

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    0
    2025-11-28 Listed

24 / 187 models loaded

←Previous
  1. 1
  2. …
  3. 3
  4. 4
  5. 5
  6. …
  7. 8
Page 4 of 8Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters