Xiaomi

MiMo V2 Flash

xiaomi/mimo-v2-flash
/v1/chat/completions/v1/messages/v1/responses/v1beta/models/*/v1/models/*

这是一个专为极致推理效率自研的总参数 309B(激活 15B)的 MoE 模型,通过 Hybrid 注意力架构创新及多层 MTP 推理加速,在多个 Agent 测评基准上保持进入全球开源模型 Top 2;代码能力超过所有开源模型,比肩标杆闭源模型 Claude 4.5 Sonnet,但推理成本仅为其 2.5%,生成速度提升 2 倍,成功将大模型推理效率推向极致。

输入 / 输出模态
未提供 至 未提供
参考输入 / 输出价格
输入¥0.7输出¥2.1每百万 Token
上下文长度
256K
收录时间
2025年12月17日

供应通道与价格

供应通道输入 /M输出 /M缓存读取 /M上下文最大输出详情
Xiaomi¥0.7¥2.1¥0.07256K64K

Xiaomi

延迟
0.38s
吞吐量
2500 tokens/s
上下文
256K

价格

输入
¥0.7/M tokens
输出
¥2.1/M tokens
缓存
¥0.07/M tokens

规格

上下文
256K
最大输出
64K
支持的 API
/v1/chat/completions/v1/messages/v1/responses/v1beta/models/*/v1/models/*

MiMo V2 Flash 的示例代码与 API 说明

Modelmesh 会帮你在不同服务提供商之间规范化处理请求和响应,为你统一接口。

Modelmesh 提供了兼容 OpenAI 的 Completion API,可连接 300 多款模型与服务提供商,既可直接调用,也可通过 OpenAI SDK 调用。此外,还提供了一些第三方 SDK。

在以下示例中,Modelmesh 专用的请求头属于可选项。若你配置了这些请求头,你的应用就能出现在 Modelmesh 的排行榜上。

支持的接口点击接口可切换下方示例
/v1/chat/completions
from openai import OpenAI API_KEY = "$SSY_API_KEY" client = OpenAI( base_url="https://router.shengsuanyun.com/api/v1", api_key=API_KEY, ) try: completion = client.chat.completions.create( model="xiaomi/mimo-v2-flash", messages=[{"role": "user", "content": "9.11 和 9.8 哪个数更大?"}], temperature=0.6, top_p=0.7, stream=True, ) response_text = "" for chunk in completion: if chunk.choices and chunk.choices[0].delta.content is not None: content = chunk.choices[0].delta.content print(content, end="", flush=True) response_text += content except Exception as error: print(f"Request failed: {error}")
                
              

应用排行
  1. ClineShengsuan公开模型应用
  2. ClineShengsuan目标地址未通过链接安全策略
  3. ClineShengsuan公开模型应用
  4. cline-chinese公开模型应用
  5. Kilo Code Chinese公开模型应用
  6. ClineShengsuan公开模型应用
  7. Cherry Studio公开模型应用
  8. Kilo Code公开模型应用
  9. ClineShengsuan目标地址未通过链接安全策略
  10. ClineShengsuan目标地址未通过链接安全策略
  11. Roo Code公开模型应用
  12. ClineShengsuan目标地址未通过链接安全策略
  13. SSY Chatroom公开模型应用
  14. Roo Code Chinese公开模型应用
  15. ClineShengsuan目标地址未通过链接安全策略
  16. Postman公开模型应用

相关模型