New model MiMo-V2.6 Flash is launching 
Inferway
登录注册
返回工具集成指引
客户端接入指南

MiMo Code

通过 OpenCode 分支 MiMo Code 将 Inferway 添加为自定义服务商。

可接入

将 Inferway 添加为 MiMo Code 的自定义服务商。接入前,请确认账户已开通模型访问。

当前 Inferway 模型配置参数

推荐模型inferway/mimo-v2.6-flash
上下文窗口393,216
示例输出上限131,072

已在 2026-09-25 于 macOS 26.6.2 arm64(版本 0.1.14)验证:基础对话,以及读取文件、编辑文件、执行 Shell 命令三类工具往返(模型 inferway/mimo-v2.6-flash)。

开始之前

先按官方说明安装客户端。本文的 Pi 指 pi-mono coding agent;Hermes 指 Nous Research 的 Hermes Agent。

Inferway 账户激活后,从控制台 → API keys 获取 Key。建议为该客户端使用独立 Key,并确认允许的模型和消费上限。live、test 前缀共用推理与计费流程;test 是环境标签,不代表免费或模拟推理。

Inferway 地址需要 Inferway Key;OpenRouter Key 用于 OpenRouter,不能直接用于此地址。

将 Key 保存在客户端凭证存储或本机环境中,不要粘贴到提示词、截图或提交到仓库的配置文件。终端示例适用于 macOS / Linux 的 bash、zsh。

在当前终端设置 Key

下面的交互输入会隐藏 Key,并避免将其写入命令历史。请从同一个终端启动客户端;另外打开的应用可能无法继承该变量。

INFERWAY_API_KEYbash
printf 'Inferway API key: '
IFS= read -r -s INFERWAY_API_KEY
printf '\n'
export INFERWAY_API_KEY

确认地址和模型

使用完整模型 ID inferway/mimo-v2.6-flash。Base URL 只包含一次 /v1,不要在 Base URL 设置中添加 /chat/completions。确认下方响应中包含该模型 ID。

List modelsbash
curl --fail-with-body --silent --show-error --max-time 30 \
  'https://api.inferway.ai/v1/models' \
  -H "Authorization: Bearer $INFERWAY_API_KEY"

保存用户配置

将以下内容保存为 ~/.config/mimocode/mimocode.jsonc(项目级为 <repo>/.mimocode/mimocode.jsonc)。这是配置路径,不是 ~/.mimocode——后者是安装目录。

mimocode.jsoncjsonc
{
  "$schema": "https://mimo.xiaomi.com/mimocode/config.json",
  "model": "inferway/inferway/mimo-v2.6-flash",
  "provider": {
    "inferway": {
      "name": "Inferway",
      "npm": "@ai-sdk/openai-compatible",
      "only_configured_models": true,
      "options": {
        "baseURL": "https://api.inferway.ai/v1",
        "apiKey": "{env:INFERWAY_API_KEY}"
      },
      "models": {
        "inferway/mimo-v2.6-flash": {
          "name": "inferway/mimo-v2.6-flash",
          "tool_call": true,
          "temperature": true,
          "reasoning": true,
          "attachment": true,
          "interleaved": {
            "field": "reasoning_content"
          },
          "modalities": {
            "input": [
              "text",
              "image"
            ],
            "output": [
              "text"
            ]
          },
          "limit": {
            "context": 393216,
            "output": 131072
          },
          "variants": {
            "high": {
              "reasoningEffort": "high"
            },
            "none": {
              "reasoningEffort": "none"
            },
            "low": {
              "disabled": true
            },
            "medium": {
              "disabled": true
            }
          }
        }
      }
    }
  }
}

三个必须保留的字段

顶层 model 是 inferway/ 加上模型 id。模型 id 本身带斜杠,所以最终形如 inferway/inferway/<model>:MiMo 只按第一个斜杠切分 provider,少写一段就找不到模型。

variants 里的 low 和 medium 必须 disabled。否则 MiMo 会自动生成 low、medium、high 三档并发出 Inferway 不支持的档位;屏蔽后 --variant high 发 high、--variant none 发 none,medium 不会被发送。

limit.context 和 limit.output 必须成对出现:只写一个会校验失败。

启动 MiMo Code

在项目目录内运行 mimo;mimo run 一次性执行任务并指定 variant。mimo models inferway 可列出该服务商已配置的模型。

MiMo Codebash
mimo

# one-shot with an explicit variant:
mimo run -m 'inferway/inferway/mimo-v2.6-flash' --variant high 'Reply with exactly: connected'

确认接入成功

  1. 使用配置的服务商和模型开启新会话,发送“只回复:连接成功”,确认收到文本且没有 API 错误。
  2. 打开控制台 → Requests,查看请求状态与 token 用量。
  3. 处理代码任务时,让客户端读取一个非敏感文件。应用修改前,请先检查它提出的改动。

费用与用量

实际用量由 Inferway 记录:打开控制台 → Requests 查看每次请求的状态与 token 用量,在控制台 → 用量查看汇总。客户端本地显示的数字只是其自身估算,不是计费金额;请以控制台为准。

验证状态

已在 2026-09-25 于 macOS 26.6.2 arm64(版本 0.1.14)验证:基础对话,以及读取文件、编辑文件、执行 Shell 命令三类工具往返(模型 inferway/mimo-v2.6-flash)。

该验证不覆盖图片、会话恢复、推理控制。客户端内部的费用估算不是计费金额;实际用量以控制台 → Requests 与用量为准。

请求失败时

认证失败:检查 Key 是否存在、有效且获准使用该模型,并从设置变量的终端重新打开客户端。排错时不要输出完整 Key。

地址或模型错误:检查是否重复添加 /v1,使用公布的完整模型 ID,并确认客户端选择 Chat Completions。请求发往 /responses 或 /completions 时,换 Key 无法解决。

额度或超时:检查钱包余额和 Key 限额,按 Retry-After 等待,并缩短输入或降低输出上限。长输出保持流式传输,排错期间避免 Agent 连续重试。

联系支持时提供客户端版本、模型 ID、请求时间和可用的 request ID;请遮盖凭证和源码。