Pi
为 Pi coding agent 配置自定义服务商。
在 Pi 中使用 Inferway 聊天和处理代码任务。接入前,请确认账户已开通模型访问。
当前 Inferway 模型参数
inferway/qwen3.8-27b262,14432,768开始之前
先按官方说明安装客户端。本文的 Pi 指 pi-mono coding agent;Hermes 指 Nous Research 的 Hermes Agent。
Inferway 账户激活后,从控制台 → API keys 获取 Key。建议为该客户端使用独立 Key,并确认允许的模型和消费上限。live、test 前缀共用推理与计费流程;test 是环境标签,不代表免费或模拟推理。
Inferway 地址需要 Inferway Key;OpenRouter Key 用于 OpenRouter,不能直接用于此地址。
将 Key 保存在客户端凭证存储或本机环境中,不要粘贴到提示词、截图或提交到仓库的配置文件。终端示例适用于 macOS / Linux 的 bash、zsh。
在当前终端设置 Key
下面的交互输入会隐藏 Key,并避免将其写入命令历史。请从同一个终端启动客户端;另外打开的应用可能无法继承该变量。
printf 'Inferway API key: ' IFS= read -r -s INFERWAY_API_KEY printf '\n' export INFERWAY_API_KEY
确认地址和模型
使用完整模型 ID inferway/qwen3.8-27b。Base URL 只包含一次 /v1,不要在 Base URL 设置中添加 /chat/completions。确认下方响应中包含该模型 ID。
curl --fail-with-body --silent --show-error --max-time 30 \ 'https://api.inferway.ai/v1/models' \ -H "Authorization: Bearer $INFERWAY_API_KEY"
添加自定义服务商
将以下服务商合并到 ~/.pi/agent/models.json;若文件已存在,保留原有服务商。Pi 的 openai-completions 适配器使用 Chat Completions,并不是旧的 /completions 接口。
Pi 通过 $INFERWAY_API_KEY 中的美元符号识别环境变量。若仍使用旧 Key,检查 Pi 的 auth.json 是否保存了 inferway 凭证。本示例只使用文本,关闭思考和图片;验证模型与客户端行为后再启用。
{
"providers": {
"inferway": {
"baseUrl": "https://api.inferway.ai/v1",
"api": "openai-completions",
"apiKey": "$INFERWAY_API_KEY",
"models": [
{
"id": "inferway/qwen3.8-27b",
"name": "Inferway",
"reasoning": false,
"input": [
"text"
],
"contextWindow": 262144,
"maxTokens": 32768,
"compat": {
"supportsDeveloperRole": false,
"supportsReasoningEffort": false,
"maxTokensField": "max_tokens"
}
}
]
}
}
}选择 Inferway
使用下面的命令明确选择服务商和模型,或在 Pi 中输入 /model 选择 Inferway。/model 会重新加载模型配置;模型不显示时先检查 INFERWAY_API_KEY 是否已设置。
pi --provider inferway --model 'inferway/qwen3.8-27b'免费账户与长任务
注册免费账户:单次输入预算 131,072 tokens(128K),输出最多 32,768 tokens(32K);60 次/分钟,并发 2。不设每分钟 token 限制。
每日输入 5,000,000、输出 500,000、合计 5,500,000 tokens,UTC 00:00 重置。同一账户的 API Key 共享每个模型的额度。
输入预算包含系统提示词、历史对话和工具内容,按保守估算校验,实际可提交长度随内容而异。超过 4,096 tokens 的输出请使用流式请求。
Pi 使用流式响应,免费账户的 maxTokens 请保持在 32,768 以内。非交互任务请将标准输入重定向到 /dev/null。若提示单次请求过大,请压缩对话;等待不会改变单次限制。
pi --provider inferway --model 'inferway/qwen3.8-27b' -p 'Review this project and run its tests' </dev/null
确认接入成功
- 使用配置的服务商和模型开启新会话,发送“只回复:连接成功”,确认收到文本且没有 API 错误。
- 打开控制台 → Requests,查看请求状态与 token 用量。
- 处理代码任务时,让客户端读取一个非敏感文件。应用修改前,请先检查它提出的改动。
请求失败时
认证失败:检查 Key 是否存在、有效且获准使用该模型,并从设置变量的终端重新打开客户端。排错时不要输出完整 Key。
地址或模型错误:检查是否重复添加 /v1,使用公布的完整模型 ID,并确认客户端选择 Chat Completions。请求发往 /responses 或 /completions 时,换 Key 无法解决。
额度或超时:检查钱包余额和 Key 限额,按 Retry-After 等待,并缩短输入或降低输出上限。长输出保持流式传输,排错期间避免 Agent 连续重试。
联系支持时提供客户端版本、模型 ID、请求时间和可用的 request ID;请遮盖凭证和源码。