Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

187/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Qwen-Plus

    API ID:ali/qwen-plus-latest
    文本对话与客服内容创作文档与办公编程学术与教育
    +5
    文本对话与客服内容创作文档与办公编程学术与教育

    通义千问系列能力均衡的模型,推理效果、成本和速度介于通义千问-Max和通义千问-Turbo之间,适合中等复杂任务。

    Input
    ¥0.8/M
    Output
    ¥2/M
    Context
    131.1K
    2025-02-20 Listed
  • Intern-S1-Pro

    API ID:intern/intern-s1-pro
    文本

    先进开源多模态推理模型,综合性能优秀,支持内置联网搜索能力

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    128K
    2026-07-07 Listed
  • Gemini 2.5 Flash Nativa Audio

    API ID:google/gemini-2.5-flash-live
    文本语音处理对话与客服多模态理解翻译
    +4
    文本语音处理对话与客服多模态理解翻译

    Gemini 2.5 Flash 的原生音频模型,支持Live API格式调用。

    Input
    ¥3.5/M
    Output
    ¥14/M
    Context
    1M
    2025-12-17 Listed
  • Intern-S1

    API ID:intern/intern-s1
    文本

    融合了专业科学能力的多模态大模型

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    128K
    2026-07-07 Listed
  • GLM-4.5-AirX

    API ID:bigmodel/glm-4.5-airx
    文本对话与客服内容创作文档与办公
    +3
    文本对话与客服内容创作文档与办公

    GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • ≤32k¥4/M token
    • 32k~不限¥8/M token

    输出

    • ≤2k¥12/M token
    • 2k~不限¥16/M token
    • 全部¥32/M token

    缓存读

    • 全部¥0.8/M token
    • 全部¥0.8/M token
    • 全部¥1.6/M token
    2025-07-29 Listed
  • ERNIE-4.0-Turbo-128K

    API ID:baidu/ernie-4.0-turbo-128k
    文本文档与办公多模态理解内容创作编程学术与教育
    +5
    文本文档与办公多模态理解内容创作编程学术与教育

    百度自研的旗舰级超大规模⼤语⾔模型,综合效果表现出色,广泛适用于各领域复杂任务场景;支持自动对接百度搜索插件,保障问答信息时效。相较于ERNIE 4.0在性能表现上更优秀

    Input
    ¥3/M
    Output
    ¥9/M
    Context
    124K
    2025-08-13 Listed
  • Intern-S2-Preview

    API ID:intern/intern-s2-preview
    文本

    我们最新发布的 35B-A3B 科学多模态推理模型,支持 256K 上下文窗口;通过任务 scaling 与架构优化,重点提升科学发现和通用智能体能力。

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    128K
    2026-07-02 Listed
  • Qwen-Plus (Thinking)

    API ID:ali/qwen-plus-latest:thinking
    文本对话与客服文档与办公编程数学与科学智能代理与数据
    +5
    文本对话与客服文档与办公编程数学与科学智能代理与数据

    Qwen-Plus 基于 Qwen2.5 基础模型构建,是一款支持 131K 上下文长度的大模型,在性能、速度与成本之间实现了良好平衡。

    Input
    ¥0.8/M
    Output
    ¥8/M
    Context
    131.1K
    2025-05-27 Listed
  • Qwen-Turbo (Thinking)

    API ID:ali/qwen-turbo-latest:thinking
    文本对话与客服内容创作文档与办公编程翻译
    +5
    文本对话与客服内容创作文档与办公编程翻译

    Qwen-Turbo基于Qwen2.5开发,具有速度快、成本低的特点,适用于处理简单任务。

    Input
    ¥0.3/M
    Output
    ¥3/M
    Context
    131.1K
    2025-05-27 Listed
  • Qwen-Turbo

    API ID:ali/qwen-turbo-latest
    文本对话与客服文档与办公内容创作翻译智能代理与数据
    +5
    文本对话与客服文档与办公内容创作翻译智能代理与数据

    Qwen-Turbo基于Qwen2.5开发,是一款支持100万token上下文长度的大模型,具有速度快、成本低的特点,适用于处理简单任务。

    Input
    ¥0.3/M
    Output
    ¥0.6/M
    Context
    1M
    2025-05-27 Listed
  • Agnes 2.0 Flash

    API ID:agnes/agnes-2.0-flash
    文本

    Agnes 2.0 Flash 是 Agnes AI 的快速高效语言模型,适合智能体工作流、工具调用、编码、多轮对话、推理和图像理解等高频生产场景。

    Input
    ¥0/M
    Output
    ¥0/M
    Context
    512K
    2026-08-28 Listed
  • Agnes 2.5 Flash

    API ID:agnes/agnes-2.5-flash
    文本

    Agnes 2.5 Flash 是基于 Agnes 2.0 Flash 升级的全量可用语言模型。它沿用 OpenAI 兼容的 Chat Completions 接入方式,同时在编码任务、智能体工作流、工具调用、多轮对话、推理和图像理解体验上进行了优化。

    Input
    ¥0/M
    Output
    ¥0/M
    Context
    512K
    2026-08-28 Listed
  • Grok 3

    API ID:x-ai/grok-3
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    Grok 3是Grok的第三代版本,在数据提取、编码和文本摘要等企业用例中表现出色。

    Input
    ¥21/M
    Output
    ¥105/M
    Context
    131.1K
    2025-07-22 Listed
  • ERNIE-4.5-Turbo-128K

    API ID:baidu/ernie-4.5-turbo-128k
    文本多模态理解文档与办公对话与客服
    +3
    文本多模态理解文档与办公对话与客服

    模型能力全面提升,更好满足多轮长历史对话处理、长文档理解问答任务。

    Input
    ¥0.8/M
    Output
    ¥3.2/M
    Context
    128K
    2025-08-12 Listed
  • DeepSeek-V3:latest

    API ID:deepseek/deepseek-v3
    文本翻译编程数学与科学学术与教育文档与办公翻译
    +6
    文本翻译编程数学与科学学术与教育文档与办公翻译

    DeepSeek-V3是DeepSeek公司发布的一款大型语言模型,以其在数学、编码和中文等任务上的卓越性能而闻名。该模型采用了MoE架构,拥有6710亿参数,每个token激活的参数量为370亿,并且支持128K token的超长上下文窗口。DeepSeek-V3不仅在性能上对标GPT-4o等主流模型,还在推理速度和效率上取得了显著提升。

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    65.5K
    2025-02-20 Listed
  • GPT OSS 20B

    API ID:openai/gpt-oss-20b
    文本智能代理与数据多模态理解对话与客服
    +3
    文本智能代理与数据多模态理解对话与客服

    GPT OSS 20B是OpenAI发布的开放权重210亿参数模型,它采用MoE架构,每次前向传递有36亿个有效参数,并针对低延迟推理和在消费级或单GPU硬件上的部署进行了优化。该模型采用OpenAI的Harmony响应格式进行训练,并支持推理级别配置、微调和代理功能,包括函数调用、工具使用和结构化输出。

    Input
    ¥0.35/M
    Output
    ¥1.4/M
    Context
    131.1K
    2025-08-06 Listed
  • GPT OSS 120B

    API ID:openai/gpt-oss-120b
    文本智能代理与数据多模态理解编程数学与科学文档与办公
    +5
    文本智能代理与数据多模态理解编程数学与科学文档与办公

    GPT OSS 120B是OpenAI推出的开放权重、包含1170亿个参数的MoE语言模型,专为高推理、代理和通用生产用例而设计。它每次前向传递可激活51亿个参数,并经过优化,可在具有原生MXFP4量化的单个H100 GPU上运行。

    Input
    ¥0.7/M
    Output
    ¥3.5/M
    Context
    131.1K
    2025-08-06 Listed
  • ERNIE-4.5-Turbo-128K-Preview

    API ID:baidu/ernie-4.5-turbo-preview
    文本文档与办公对话与客服多模态理解
    +3
    文本文档与办公对话与客服多模态理解

    模型能力全面提升,更好满足多轮长历史对话处理、长文档理解问答任务。

    Input
    ¥0.8/M
    Output
    ¥3.2/M
    Context
    128K
    2025-08-13 Listed
  • ERNIE-4.5-Turbo-32K

    API ID:baidu/ernie-4.5-turbo-32k
    文本内容创作多模态理解学术与教育对话与客服
    +4
    文本内容创作多模态理解学术与教育对话与客服

    文本创作、知识问答等能力提升显著。输出长度及整句时延相较ERNIE 4.5有所增加。

    Input
    ¥0.8/M
    Output
    ¥3.2/M
    Context
    32K
    2025-08-13 Listed
  • ERNIE-4.5-Turbo-VL-Preview

    API ID:baidu/ernie-4.5-turbo-vl-preview
    文本多模态理解内容创作翻译编程
    +4
    文本多模态理解内容创作翻译编程

    文心一言大模型全新版本,图片理解、创作、翻译、代码等能力显著提升,首次支持32K上下文长度,首Token时延显著降低。

    Input
    ¥3/M
    Output
    ¥9/M
    Context
    128K
    2025-08-13 Listed
  • Llama 3.3 70B Instruct

    API ID:meta/llama-3.3-70b-instruct
    文本对话与客服翻译内容创作文档与办公学术与教育
    +5
    文本对话与客服翻译内容创作文档与办公学术与教育

    Meta Llama 3.3 是一款多语言大语言模型,在 70B 参数规模下进行了预训练与指令微调,支持文本输入与输出。该模型专为多语言对话场景优化,具备强大的生成与理解能力。

    Input
    ¥0.84/M
    Output
    ¥2.1/M
    Context
    128K
    2025-04-02 Listed
  • GPT-4o-2024-11-20

    API ID:openai/gpt-4o-2024-11-20
    文本多模态理解对话与客服编程数学与科学文档与办公
    +5
    文本多模态理解对话与客服编程数学与科学文档与办公

    GPT 4o是OpenAI智能水平最高、通用性最强的旗舰模型。它支持文本与图像输入,并生成文本输出(包括结构化结果),在大多数任务中表现出色,是目前除o系列专用模型外能力最强的通用模型。

    Input
    ¥35/M
    Output
    ¥105/M
    Context
    128K
    2025-04-08 Listed
  • GPT-4o-mini

    API ID:openai/gpt-4o-mini
    文本翻译多模态理解对话与客服内容创作
    +4
    文本翻译多模态理解对话与客服内容创作

    GPT-4o-mini是一款快速、经济的小型模型,适用于聚焦型任务和微调场景。它支持文本和图像输入,并生成文本输出,在成本和响应速度方面具有显著优势。

    Input
    ¥1.05/M
    Output
    ¥4.2/M
    Context
    128K
    2025-04-09 Listed
  • Hunyuan-3

    API ID:tencent/hy3
    文本

    Hy3 正式版面向真实业务场景打磨,采用 295B 总参数、21B 激活 MoE 架构,原生支持 256K 上下文,并提供no_think(极速响应)、think_low(快速思考)与 think_high(深度推理) 多档思考模式,兼顾极速响应、复杂推理与调用成本。相比 Preview 版本,Hy3 基于腾讯元宝、WorkBuddy、ima 、Marvis等真实业务反馈,重点提升了 Coding Agent、长文理解、多轮上下文承接、搜索问答与复杂任务执行能力,在减少幻觉、提升任务完成度和工程可用性方面表现更稳。更加适合前端任务、跨文件代码开发、长文档分析、办公自动化和多步骤 Agent 工作流等实用场景。

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    256K
    2026-07-07 Listed

24 / 187 models loaded

←Previous
  1. 1
  2. …
  3. 6
  4. 7
  5. 8
Page 7 of 8Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters