正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillBot 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 340 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

187/ 340个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • GLM-4.6

    调用ID:bigmodel/glm-4.6
    文本对话与客服文档与办公编程内容创作学术与教育
    +5
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-10-09 上架
  • KAT-Coder-Exp-72B-1010

    调用ID:streamlake/kat-coder-exp-72b-1010
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    KAT-Coder-Exp-72B 是 KAT-Coder 系列模型中的 RL 创新实验版本,在软件开发能力评测基准 SWE-Bench verified 上取得了 74.6% 的卓越性能,创下开源模型新纪录。专注于 Agentic Coding,目前仅支持 SWE-Agent 脚手架,也可进行简单对话。

    输入
    ¥0.0001/M
    输出
    ¥0/M
    上下文
    128K
    2025-11-13 上架
  • GLM-5

    调用ID:bigmodel/glm-5
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥4/M token
    • 32k~不限¥6/M token

    输出

    • ≤32k¥18/M token
    • 32k~不限¥22/M token

    缓存读

    • ≤32k¥1/M token
    • 32k~不限¥1.5/M token
    2026-02-12 上架
  • GPT-5-Nano

    调用ID:openai/gpt-5-nano
    文本编程对话与客服多模态理解
    +3
    文本编程对话与客服多模态理解

    GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。

    输入
    ¥0.35/M
    输出
    ¥2.8/M
    上下文
    400K
    2025-08-15 上架
  • GPT-5

    调用ID:openai/gpt-5
    文本编程数学与科学多模态理解智能代理与数据
    +4
    文本编程数学与科学多模态理解智能代理与数据

    GPT-5是OpenAI推出的最新一代先进模型,在推理能力、代码生成质量和用户体验方面实现显著提升。该模型针对复杂任务进行了专项优化,尤其擅长需要逐步推理、精准遵循指令以及对准确性要求严格的高风险场景。

    输入
    ¥8.75/M
    输出
    ¥70/M
    上下文
    400K
    2025-08-15 上架
  • Qwen3-Max-Preview

    调用ID:ali/qwen3-max-preview
    文本数学与科学编程翻译学术与教育对话与客服
    +5
    文本数学与科学编程翻译学术与教育对话与客服

    Qwen3-Max-Preview是阿里巴巴旗下通义千问团队发布的最新旗舰大语言模型,是 Qwen3 系列中参数量最大的模型,参数规模超过1万亿。模型在推理、指令跟随、多语言支持和长尾知识覆盖等方面有重大改进,支持超过100种语言,中英文理解能力出色。在数学推理、编程和科学推理等任务中表现出色,能更可靠地遵循复杂指令,减少幻觉,生成更高质量的响应。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥6/M token
    • 32k~128k¥10/M token
    • 128k~不限¥15/M token

    输出

    • ≤32k¥24/M token
    • 32k~128k¥40/M token
    • 128k~不限¥60/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~128k¥2/M token
    • 128k~不限¥3/M token
    2025-09-08 上架
  • MiniMax M2

    调用ID:minimax/minimax-m2
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥2.625/M token
    2025-10-28 上架
  • Qwen3-Omni-Flash

    调用ID:ali/qwen3-omni-flash
    文本对话与客服内容创作翻译编程文档与办公
    +5
    文本对话与客服内容创作翻译编程文档与办公

    Qwen-Omni 模型能够接收文本、图片、音频、视频等多种模态的组合输入,并生成文本或语音形式的回复, 提供多种拟人音色,支持多语言和方言的语音输出,可应用于文本创作、视觉识别、语音助手等场景。

    输入
    ¥1.8/M
    输出
    ¥6.9/M
    上下文
    65.5K
    2025-09-23 上架
  • Qwen3-Max

    调用ID:ali/qwen3-max
    文本编程数学与科学智能代理与数据多模态理解翻译
    +5
    文本编程数学与科学智能代理与数据多模态理解翻译

    Qwen3-Max 是在 Qwen3 系列的基础上构建的更新版本,与 2025 年 1 月版本相比,在推理、指令遵循、多语言支持和长尾知识覆盖方面进行了重大改进。它在数学、编码、逻辑和科学任务中提供更高的准确性,更可靠地遵循复杂的中文和英文指令,减少幻觉,并为开放式问答、写作和对话提供更高质量的回答。该模型支持 100 多种语言,具有更强的翻译和常识推理能力,并针对检索增强生成 (RAG) 和工具调用进行了优化,尽管它不包括专用的“思考”模式。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥6/M token
    • 32k~128k¥10/M token
    • 128k~不限¥15/M token

    输出

    • ≤32k¥24/M token
    • 32k~128k¥40/M token
    • 128k~不限¥60/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~128k¥2/M token
    • 128k~不限¥3/M token
    2025-09-24 上架
  • GPT-5-Codex

    调用ID:openai/gpt-5-codex
    文本编程
    +1
    文本编程

    GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。

    输入
    ¥8.75/M
    输出
    ¥70/M
    上下文
    400K
    2025-10-10 上架
  • GLM-4.6 Thinking

    调用ID:bigmodel/glm-4.6:thinking
    文本编程数学与科学学术与教育文档与办公对话与客服
    +5
    文本编程数学与科学学术与教育文档与办公对话与客服

    GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-10-09 上架
  • Qwen3-VL-Plus

    调用ID:ali/qwen3-vl-plus
    文本多模态理解图像与设计视频与3D智能代理与数据编程
    +5
    文本多模态理解图像与设计视频与3D智能代理与数据编程

    Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥1/M token
    • 32k~128k¥1.5/M token
    • 128k~不限¥3/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥15/M token
    • 128k~不限¥30/M token

    缓存读

    • ≤32k¥0.2/M token
    • 32k~128k¥0.3/M token
    • 128k~不限¥0.6/M token
    2025-09-24 上架
  • Doubao-Seed-1.6-thinking

    调用ID:bytedance/doubao-seed-1.6:thinking
    文本数学与科学编程多模态理解
    +3
    文本数学与科学编程多模态理解

    Doubao-Seed-1.6-thinking,是豆包大模型1.6系列在深度思考方面的强化版本。在代码编写、数学运算、逻辑推理等基础能力上有了进一步的显著提升。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.17/M token
    • 32k~128k¥0.17/M token
    • 128k~不限¥0.17/M token
    2025-06-12 上架
  • Qwen3 Next 80B A3B Instruct

    调用ID:ali/qwen3-next-80b-a3b-Instruct
    文本编程智能代理与数据对话与客服数学与科学翻译
    +5
    文本编程智能代理与数据对话与客服数学与科学翻译

    Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列中的一款指令微调对话模型,专为提供快速、稳定的响应而优化。它能够胜任复杂推理、代码生成、知识问答和多语言应用,同时在对齐与格式控制方面保持稳健。与以往的Qwen3 指令模型相比,该版本在超长输入和多轮对话场景下具备更高吞吐与更强稳定性,非常适用于RAG、工具调用以及需要一致性最终答案的智能体工作流。

    输入
    ¥1/M
    输出
    ¥4/M
    上下文
    131.1K
    2025-09-12 上架
  • GPT-5-Mini

    调用ID:openai/gpt-5-mini
    文本多模态理解对话与客服文档与办公内容创作学术与教育
    +5
    文本多模态理解对话与客服文档与办公内容创作学术与教育

    GPT-5-Mini是GPT-5的轻量级版本,专为高效处理日常推理任务而设计。它继承了 GPT-5的指令跟随能力和安全优化,同时具备更低的延迟和成本优势。

    输入
    ¥1.75/M
    输出
    ¥14/M
    上下文
    400K
    2025-08-15 上架
  • Hunyuan-Turbos-Vision

    调用ID:tencent/hunyuan-turbos-vision
    文本多模态理解图像与设计对话与客服翻译文档与办公
    +5
    文本多模态理解图像与设计对话与客服翻译文档与办公

    采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。

    输入
    ¥3/M
    输出
    ¥9/M
    上下文
    32K
    2025-11-06 上架
  • Claude Sonnet 4

    调用ID:anthropic/claude-sonnet-4
    文本编程编程数学与科学多模态理解
    +4
    文本编程编程数学与科学多模态理解

    Claude Sonnet 4是对Sonnet 3.7的全面升级,在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥26.25/M token

    缓存写(1h)

    • 公开价格¥42/M token
    2025-05-23 上架
  • DeepSeek V3.1

    调用ID:deepseek/deepseek-v3.1
    文本智能代理与数据多模态理解数学与科学
    +3
    文本智能代理与数据多模态理解数学与科学

    DeepSeek V3.1是DeepSeek的新一代模型,具备混合推理(Think & Non-Think双模式),显著提升思考速度和任务处理效率,并通过后训练强化工具调用与多步骤智能体能力。

    输入
    ¥4/M
    输出
    ¥12/M
    上下文
    128K
    2025-08-26 上架
  • Claude Opus 4

    调用ID:anthropic/claude-opus-4
    文本编程智能代理与数据编程多模态理解数学与科学
    +5
    文本编程智能代理与数据编程多模态理解数学与科学

    Claude Opus 4是Anthropic专为构建复杂的人工智能代理而设计的模型,能够在最少的监督下自主推理、规划和执行复杂的任务。该模型在需要扩展上下文、深度推理和自适应执行的软件开发场景中表现卓越。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥131.25/M token

    缓存写(1h)

    • 公开价格¥210/M token
    2025-05-23 上架
  • Doubao-Seed-1.6

    调用ID:bytedance/doubao-seed-1.6
    文本多模态理解对话与客服文档与办公编程数学与科学
    +5
    文本多模态理解对话与客服文档与办公编程数学与科学

    Doubao-Seed-1.6,这是一个 “All-in-One” 的综合模型,也是国内首个支持256K上下文的思考模型,它能够同时支持thinking、non-thinking、auto三种思考模式。这是一个 “All-in-One” 的综合模型,也是国内首个支持256K上下文的思考模型,它能够同时支持thinking、non-thinking、auto三种思考模式。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~128k¥0.16/M token
    • 128k~不限¥0.16/M token
    2025-06-12 上架
  • Doubao-Seed-1.6-flash

    调用ID:bytedance/doubao-seed-1.6-flash
    文本对话与客服多模态理解文档与办公
    +3
    文本对话与客服多模态理解文档与办公

    Doubao-Seed-1.6-flash为豆包大模型1.6系列的极速版本,具有低延迟的显著优势,非常适用于对延迟要求极高的实时交互场景,如客服场景等。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.15/M token
    • 32k~128k¥0.3/M token
    • 128k~不限¥0.6/M token

    输出

    • ≤32k¥1.5/M token
    • 32k~128k¥3/M token
    • 128k~不限¥6/M token

    缓存读

    • ≤32k¥0.03/M token
    • 32k~128k¥0.03/M token
    • 128k~不限¥0.03/M token
    2025-06-12 上架
  • Claude Sonnet 4 ( Thinking )

    调用ID:anthropic/claude-sonnet-4:thinking
    文本编程数学与科学
    +2
    文本编程数学与科学

    Claude Sonnet 4 ( Thinking ),在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥26.25/M token

    缓存写(1h)

    • 公开价格¥42/M token
    2025-06-19 上架
  • Qwen3 Next 80B A3B Thinking

    调用ID:ali/qwen3-next-80b-a3b-thinking
    文本数学与科学编程智能代理与数据学术与教育
    +4
    文本数学与科学编程智能代理与数据学术与教育

    Qwen3-Next-80B-A3B-Thinking 是Qwen3-Next系列中以推理为核心的对话模型,默认输出结构化的“思维链”内容。它专为复杂多步问题而设计,能够处理数学证明、代码生成与调试、逻辑推演以及智能体规划等任务,并在知识、推理、编程、对齐和多语言评测上表现出色。与以往的Qwen3模型相比,该版本在长链式思维下的稳定性与推理阶段的高效扩展上更具优势,且在复杂指令跟随时显著降低了重复或偏离任务的情况。

    输入
    ¥1/M
    输出
    ¥10/M
    上下文
    131.1K
    2025-09-12 上架
  • Claude Opus 4.1

    调用ID:anthropic/claude-opus-4.1
    文本编程智能代理与数据数学与科学
    +3
    文本编程智能代理与数据数学与科学

    Claude Opus 4.1是Anthropic旗舰模型的更新版本,在编码、推理和代理任务方面均有提升。它在SWE-bench Verified测试中达到了74.5%的准确率,并在多文件代码重构、调试精度和面向细节的推理方面展现出显著提升。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥131.25/M token

    缓存写(1h)

    • 公开价格¥210/M token
    2025-08-06 上架

24 / 187 个模型已加载

←上一页
  1. 1
  2. …
  3. 4
  4. 5
  5. 6
  6. …
  7. 8
第 5 页,共 8 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选