Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

340/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • GPT 5.1 Codex Max

    API ID:openai/gpt-5.1-codex-max
    文本编程数学与科学智能代理与数据
    +3
    文本编程数学与科学智能代理与数据

    (当前仅支持/v1/responses接口)GPT-5.1-Codex-Max 是 OpenAI 最新的代理编码模型,专为长期运行的高上下文软件开发任务设计。它基于更新版的 5.1 推理堆栈,并基于跨软件工程、数学和研究的代理工作流进行训练。 GPT-5.1-Codex-Max 在整个开发生命周期中实现了更快的性能、更优的推理和更高的代币效率。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-12-11 Listed
  • Qwen3-VL-Embedding

    API ID:ali/qwen3-vl-embedding
    向量化

    基于Qwen3-VL底座训练的统一多模态向量模型,支持文本、图片、视频单模态/混合模态输入,输出统一表征向量,适用于跨模态检索、图搜、视频检索、图像聚类、复杂多模态信息检索、打标等场景

    Price
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥1.8/M token
    2026-08-04 Listed
  • Qwen3-Rerank

    API ID:ali/qwen3-rerank
    重排

    基于Qwen LLM底座训练的文本排序模型,对输入的Query和候选Docs进行相关性排序,支持100+语种和长文本输入,适用于文本检索、RAG等场景,效果对齐开源Qwen3-Rerank系列模型

    Input
    ¥0.5/M
    Output
    ¥0/M
    Context
    1M
    2026-08-04 Listed
  • Qwen3-VL-Rerank

    API ID:ali/qwen3-vl-rerank
    重排

    Qwen3-VL-Rerank重排模型,它能够深入理解文本、图片、视频的丰富多模态信息。在初步检索获得结果后,Qwen3-VL-Rerank 能够运用其先进的跨模态关联能力,对候选项目进行智能化的二次排序,将最相关的结果置于显要位置。通用用于提升跨模态搜索的准确率、优化图搜和视频检索的精准度、辅助图像聚类的分组质量、以及实现复杂多模态信息的高效检索和精确打标。

    Price
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥1.8/M token
    2026-08-04 Listed
  • Qwen3-Reranker-0.6B

    API ID:ali/qwen3-reranker-0.6b
    重排

    Qwen3-Reranker-0.6B 是一款来自 Qwen3 系列的文本重排模型。 它专为优化初始检索系统的结果而设计,其核心功能是根据给定查询对文档的相关性进行重新排序。 该模型拥有 6 亿参数和 32k 的上下文长度,并继承了其 Qwen3 基础模型强大的多语言(支持超过 100 种语言)、长文本理解及推理能力。评测结果显示,Qwen3-Reranker-0.6B 在 MTEB-R、CMTEB-R 和 MLDR 等多个文本检索基准测试中均取得了优异的性能

    Input
    ¥0.07/M
    Output
    ¥0/M
    Context
    1M
    2026-08-03 Listed
  • Qwen3-Embedding-0.6B

    API ID:ali/qwen3-embedding-0.6b
    向量化

    Qwen3-Embedding-0.6B 是 Qwen3 嵌入模型系列的最新专有模型,专为文本嵌入和排序任务设计。该模型基于 Qwen3 系列的密集基础模型,具有 6 亿参数规模,支持长达 32K 的上下文长度,可生成最高 1024 维的嵌入向量。模型继承了基础模型卓越的多语言能力,支持超过 100 种语言,具备长文本理解和推理能力。在 MTEB 多语言排行榜上表现优异(得分 64.33),在文本检索、代码检索、文本分类、文本聚类和双语挖掘等多项任务中表现出色。模型支持用户自定义输出维度(32 到 1024)和指令感知功能,可根据特定任务、语言或场景进行优化,为需要平衡效率和效果的应用场景提供理想选择

    Input
    ¥0.07/M
    Output
    ¥0/M
    Context
    1M
    2026-08-03 Listed
  • Qwen3-Reranker-8B

    API ID:ali/qwen3-reranker-8b
    重排

    Qwen3-Reranker-8B是阿里巴巴通义实验室于2025年6月开源的80亿参数重排序模型,支持119种语言和32K超长文本处理。在中文检索(CMTEB-R 77.45分)、多语言检索(MTEB-R 69.02分)和代码检索(MTEB-Code 81.22分)任务中均刷新行业纪录,性能超越BGE等主流模型30%以上‌。 其创新单塔交叉编码器架构和指令感知能力,可显著提升检索增强生成(RAG)系统的精度与效率‌。

    Input
    ¥0.5/M
    Output
    ¥0/M
    Context
    1M
    2026-08-03 Listed
  • Qwen3-VL-Reranker-8B

    API ID:ali/qwen3-vl-reranker-8b
    重排

    Qwen3-VL-Reranker 是 Qwen3 多模态重排序模型系列的最新专有模型,专为视觉-语言相关性建模与精排决策任务设计。该模型基于 Qwen3 系列高性能视觉语言密集基础模型构建,具备强大的跨模态语义对齐与细粒度理解能力,可对文本、图像及其组合进行高精度相关性打分与排序判断。模型支持长上下文输入,能够处理复杂查询、多候选内容与多轮语义条件,在多模态检索增强生成(RAG)、跨模态搜索、内容推荐与审核等场景中显著提升最终结果质量。继承 Qwen3 系列卓越的多语言与视觉推理能力,Qwen3-VL-Reranker 在跨语言与复杂语义匹配任务中表现稳定可靠,并支持指令感知与任务自适应优化,帮助开发者针对不同业务目标实现更高相关性与转化效率。

    Price
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥1.8/M token
    2026-08-03 Listed
  • Qwen3-VL-Embedding-8B

    API ID:ali/qwen3-vl-embedding-8b
    向量化

    Qwen3-VL-Embedding 是 Qwen3 多模态模型体系中的新一代视觉-语言嵌入模型,专为跨模态语义理解、检索与排序任务设计。该模型基于 Qwen3 系列高性能视觉语言基础模型构建,能够将文本、图像及其组合统一映射到高质量向量空间,实现精准的跨模态语义对齐。模型支持长上下文输入与高维嵌入表示,兼顾细粒度语义表达与大规模检索效率,广泛适用于多模态搜索、RAG 知识增强、内容推荐、相似度计算与智能审核等场景。继承 Qwen3 系列卓越的多语言与视觉理解能力,Qwen3-VL-Embedding 在复杂语义推理与跨语言跨模态任务中表现出色,并支持灵活的输出维度与任务指令感知能力,帮助开发者针对不同业务场景进行高效优化

    Price
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥1.8/M token
    2026-08-03 Listed
  • Qwen3-Embedding-8B

    API ID:ali/qwen3-embedding-8b
    向量化

    Qwen3-Embedding-8B是Qwen家族专为文本嵌入和排序设计的8B参数模型,支持100+语言和32K长文本,在MTEB多语言榜单以70.58分排名第一‌。 其双塔结构生成高维向量,结合指令感知技术,显著提升检索、分类等任务性能‌。 开源版本提供0.6B至8B全尺寸选择,支持自定义向量维度与微调‌。

    Input
    ¥0.5/M
    Output
    ¥0/M
    Context
    1M
    2026-08-03 Listed
  • Claude Opus 5

    API ID:anthropic/claude-opus-5
    文本

    Claude Opus 5 是 Anthropic 公司推出的旗舰模型,适用于需要复杂推理、编码以及长期规划的代理任务。它在以下方面表现出强大的能力:端到端的软件任务处理、代码审查与缺陷检测、图表与文档的视觉分析、复杂的办公任务执行,以及平行子代理的协调工作。 这个模型在执行长时间任务时仍能保持出色的指令遵循能力和工具使用能力,同时在处理那些更注重延迟和效率的工作负载时,其性能依然十分出色。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-07-26 Listed
  • Kimi K3

    API ID:moonshot/kimi-k3
    文本

    Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

    Input
    ¥20/M
    Output
    ¥100/M
    Context
    256K
    2026-07-17 Listed
  • GPT-5.6-Terra

    API ID:openai/gpt-5.6-terra
    文本

    GPT-5.6 Terra是OpenAl旗下GPT-5.6系列中的一款均衡模型,介于旗舰级Sol层级与高性价比Luna层级之间。它适用于日常编码、推理及代理任务场景,在这些场景中需要兼顾性能与成本,且能够以大致相当于Sol成本一半的价格提供强大的性能表现。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥14/M token
    • 272k~不限¥28/M token

    输出

    • ≤272k¥84/M token
    • 272k~不限¥126/M token

    缓存读

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    缓存写(5m)

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token
    2026-07-11 Listed
  • GPT-5.6-Luna

    API ID:openai/gpt-5.6-luna
    文本

    GPT-5.6 Luna是OpenAl公司GPT-5.6系列中的一款快速且成本效益高的模型。它适用于高容量、对时延敏感的任务,如聊天、分类以及轻量级代理式工作流程,并以其在价格定位范围内的出色推理能力而著称。

    Input
    ¥7/M
    Output
    ¥42/M
    Context
    400K
    2026-07-11 Listed
  • GPT-5.6-Sol

    API ID:openai/gpt-5.6-sol
    文本

    GPT-5.6 Sol是OpenAl公司GPT-5.6系列中的旗舰模型。它适用于复杂的推理、编码及代理式工作流程, 尤其在命令行和多步骤编码任务以及长期目标问题解决方面表现尤为出色。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token

    缓存写(5m)

    • ≤272k¥43.75/M token
    • 272k~不限¥87.5/M token
    2026-07-11 Listed
  • Doubao-Seedream-5.0-pro

    API ID:bytedance/doubao-seedream-5-0-pro
    图像生成

    seedream-5.0-pro是字节跳动发布的最新图像创作模型。该模型在更复杂、更真实的图像生成与编辑需求维度全面升级,将图像创作推进到可控生产的新阶段。本次模型更新的主要亮点是编辑更可控、生产更落地、效果更自然。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入图片(首张免费起)

    • Public price¥0.02/张

    输出图(≥2360000px)

    • Public price¥0.3/张

    输出图(兜底档)

    • Public price¥0.6/张
    2026-07-09 Listed
  • GPT-5.2

    API ID:openai/gpt-5.2
    文本智能代理与数据编程数学与科学多模态理解文档与办公
    +5
    文本智能代理与数据编程数学与科学多模态理解文档与办公

    GPT-5.2 是 GPT-5 系列中最新的前沿级模型,相比 GPT-5.1 提供了更强的代理和长上下文性能。它利用自适应推理动态分配计算,快速响应简单查询,同时在复杂任务上投入更多深度。 GPT-5.2 专为广泛任务覆盖而设计,在数学、编程、科学和工具调用工作负载中持续带来进步,提供更连贯的长篇答案和提升的工具使用可靠性。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2025-12-12 Listed
  • GPT Image 1.5

    API ID:openai/gpt-image-1.5
    图像生成图像与设计
    +1
    图像生成图像与设计

    OpenAI最强图像生成模型,新模型能够结合世界知识,生成更加符合上下文图像,质量更高,还支持多种功能自定义。

    Price
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥56/M token

    图片·输出

    • Public price¥224/M token
    2025-12-17 Listed
  • 通义万相2.6-图生视频

    API ID:ali/wan2.6-i2v
    视频生成视频与3D
    +1
    视频生成视频与3D

    图片生成视频内容,稳定保持图像主体、风格和文字等细节信息

    Price
    Attribute-based pricing

    Attribute-based pricing

    视频

    • 720P¥0.6/次
    • 1080P¥1/次
    2025-12-17 Listed
  • LongCat-2.0(限时4折)

    API ID:longcat/longcat-2.0
    文本

    LongCat-2.0 是美团 全量开源的1.6 万亿参数 MoE 国产大模型,也是全球首个依托五万张国产算力芯片完成完整训推流程的万亿级大模型美团技术团。

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    1M
    2026-07-07 Listed
  • Gemini 3 Flash Preview

    API ID:google/gemini-3-flash
    文本智能代理与数据编程对话与客服多模态理解数学与科学
    +5
    文本智能代理与数据编程对话与客服多模态理解数学与科学

    Gemini 3 Flash Preview 旨在以极高的速度和性价比提供强大的代理功能(接近专业级)。它非常适合进行多轮对话,并能与您的编码代理进行流畅的双向协作。与 2.5 Flash 版本相比,它在各方面都实现了显著提升。 Gemini 3 型号是具有思考能力的模型,能够在做出反应之前进行推理,从而提高性能和准确性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥0.581/M token
    2025-12-18 Listed
  • GLM-4.7

    API ID:bigmodel/glm-4.7
    文本智能代理与数据编程对话与客服多模态理解内容创作
    +5
    文本智能代理与数据编程对话与客服多模态理解内容创作

    最新旗舰模型:通用对话、推理与智能体能力上实现全面升级。回复更简洁自然,写作更具沉浸感,且在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-12-23 Listed
  • Claude Sonnet 5

    API ID:anthropic/claude-sonnet-5
    文本

    Sonnet 5 是 Anthropic 公司最强大的 Sonnet 类模型之一,其在各种编程、代理以及专业场景中的性能表现都非常出色。该模型支持自适应思维机制,用户可以选择不同的推理强度级别(低、中、高、最高以及超高强度)。它还具备 1 百万标记数的上下文存储能力,并且能够接受文本、图像和文件输入。Sonnet 5 采用了升级后的分词器,并配备了实时网络安全保护功能,能够阻止某些高风险的两用活动

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2026-07-01 Listed
  • MiniMax M2.1

    API ID:minimax/minimax-m2.1
    文本编程
    +1
    文本编程

    MiniMax M2.1,强大多语言编程实力,全面升级编程体验

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2025-12-23 Listed

24 / 340 models loaded

←Previous
  1. 1
  2. 2
  3. 3
  4. 4
  5. …
  6. 15
Page 3 of 15Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters