ZCode
通过自定义供应商将 ZCode 桌面应用接入 Inferway。
在 ZCode 中将 Inferway 添加为自定义 Chat Completions 供应商。接入前,请确认账户已开通模型访问。
当前 Inferway 模型配置参数
inferway/mimo-v2.6-flash393,216131,072已在 2026-09-25 于 macOS 26.6.2 arm64(版本 3.14.1 (agent runtime 0.16.9))验证:基础对话,以及读取文件、编辑文件、执行 Shell 命令三类工具往返(模型 inferway/mimo-v2.6-flash)。
开始之前
先按官方说明安装客户端。本文的 Pi 指 pi-mono coding agent;Hermes 指 Nous Research 的 Hermes Agent。
Inferway 账户激活后,从控制台 → API keys 获取 Key。建议为该客户端使用独立 Key,并确认允许的模型和消费上限。live、test 前缀共用推理与计费流程;test 是环境标签,不代表免费或模拟推理。
Inferway 地址需要 Inferway Key;OpenRouter Key 用于 OpenRouter,不能直接用于此地址。
将 Key 保存在客户端凭证存储或本机环境中,不要粘贴到提示词、截图或提交到仓库的配置文件。终端示例适用于 macOS / Linux 的 bash、zsh。
在 ZCode 设置中添加 Inferway
在 ZCode 设置界面完成配置:设置 → 模型供应商 → 自定义供应商 → 添加供应商 → 选「自定义端点」,再填写下方字段。代码块仅用于核对屏幕上的取值,不要手动修改 ~/.zcode 下的文件。
- 打开设置 → 模型供应商 → 自定义供应商 → 添加供应商,选择「自定义端点」。
- 依次填写:名称 Inferway;API 格式 Chat Completions;Base URL https://api.inferway.ai/v1——必须带 /v1,ZCode 不会自动补;API Key 填你的 Inferway Key。
- 启用供应商 → 添加模型,模型 ID 精确填写 inferway/mimo-v2.6-flash。
- 在该模型的「高级设置」里改四项:上下文窗口改为 393216(默认 200000);最大输出 Token 改为 131072(默认 32000);推理等级(从低到高)依次填 none、high;推理参数映射改为 {"reasoning_effort": reasoningLevel}。
- 点击「测试模型」,然后在聊天框顶部切到该模型。改完配置后重启 ZCode。
名称 / Name: Inferway API 格式 / API format: Chat Completions Base URL: https://api.inferway.ai/v1 模型 ID / Model ID: inferway/mimo-v2.6-flash 上下文窗口 / Context window: 393216 最大输出 Token / Max output tokens: 131072 推理等级(从低到高)/ Reasoning levels (low to high): none, high 推理参数映射 / Reasoning parameter mapping: {"reasoning_effort": reasoningLevel}
必改项与验证范围
推理参数映射必须修改:ZCode 对自定义 Chat Completions 端点的默认映射会被 Inferway 拒绝,请求会失败;改为 {"reasoning_effort": reasoningLevel} 后请求即被接受。
2026-09-25 实测范围:跑的是 ZCode 应用内置的同一套 agent runtime(headless),隔离了配置目录,使用上方等价配置。「设置」界面里的点击步骤本身没有逐步驱动过。
图片输入没有测过:本指南不对图片能力作任何声明,也不需要为图片勾选任何选项。
ZCode 将 API key 明文存储在 ~/.zcode 下(provider_config.json 与 config.json)。不要把 ~/.zcode 放进同步盘或备份仓库。
确认接入成功
- 使用配置的服务商和模型开启新会话,发送“只回复:连接成功”,确认收到文本且没有 API 错误。
- 打开控制台 → Requests,查看请求状态与 token 用量。
- 处理代码任务时,让客户端读取一个非敏感文件。应用修改前,请先检查它提出的改动。
费用与用量
实际用量由 Inferway 记录:打开控制台 → Requests 查看每次请求的状态与 token 用量,在控制台 → 用量查看汇总。客户端本地显示的数字只是其自身估算,不是计费金额;请以控制台为准。
验证状态
已在 2026-09-25 于 macOS 26.6.2 arm64(版本 3.14.1 (agent runtime 0.16.9))验证:基础对话,以及读取文件、编辑文件、执行 Shell 命令三类工具往返(模型 inferway/mimo-v2.6-flash)。
该验证不覆盖图片、会话恢复、推理控制。客户端内部的费用估算不是计费金额;实际用量以控制台 → Requests 与用量为准。
请求失败时
认证失败:检查 Key 是否存在、有效且获准使用该模型,并从设置变量的终端重新打开客户端。排错时不要输出完整 Key。
地址或模型错误:检查是否重复添加 /v1,使用公布的完整模型 ID,并确认客户端选择 Chat Completions。请求发往 /responses 或 /completions 时,换 Key 无法解决。
额度或超时:检查钱包余额和 Key 限额,按 Retry-After 等待,并缩短输入或降低输出上限。长输出保持流式传输,排错期间避免 Agent 连续重试。
联系支持时提供客户端版本、模型 ID、请求时间和可用的 request ID;请遮盖凭证和源码。