Inferway
登录注册
返回客户端指南
客户端接入指南

Hermes

让 Nous Research 的 Hermes Agent 使用自定义 OpenAI 兼容接口。

可接入

将 Inferway 添加为 Hermes 的自定义服务商。接入前,请确认账户已开通模型访问。

当前 Inferway 模型参数

模型inferway/qwen3.8-27b
上下文窗口262,144
示例输出上限32,768

开始之前

先按官方说明安装客户端。本文的 Pi 指 pi-mono coding agent;Hermes 指 Nous Research 的 Hermes Agent。

Inferway 账户激活后,从控制台 → API keys 获取 Key。建议为该客户端使用独立 Key,并确认允许的模型和消费上限。live、test 前缀共用推理与计费流程;test 是环境标签,不代表免费或模拟推理。

Inferway 地址需要 Inferway Key;OpenRouter Key 用于 OpenRouter,不能直接用于此地址。

将 Key 保存在客户端凭证存储或本机环境中,不要粘贴到提示词、截图或提交到仓库的配置文件。终端示例适用于 macOS / Linux 的 bash、zsh。

在当前终端设置 Key

下面的交互输入会隐藏 Key,并避免将其写入命令历史。请从同一个终端启动客户端;另外打开的应用可能无法继承该变量。

INFERWAY_API_KEYbash
printf 'Inferway API key: '
IFS= read -r -s INFERWAY_API_KEY
printf '\n'
export INFERWAY_API_KEY

确认地址和模型

使用完整模型 ID inferway/qwen3.8-27b。Base URL 只包含一次 /v1,不要在 Base URL 设置中添加 /chat/completions。确认下方响应中包含该模型 ID。

List modelsbash
curl --fail-with-body --silent --show-error --max-time 30 \
  'https://api.inferway.ai/v1/models' \
  -H "Authorization: Bearer $INFERWAY_API_KEY"

添加命名服务商

将下方配置合并到 ~/.hermes/config.yaml,保留其他服务商和模型设置。示例采用当前的 providers 字典;旧版可能使用 custom_providers,混用格式前请核对所装版本的官方指南。

key_env 填变量名,不加美元符号,Key 保留在当前环境中。需要持久化时,使用 Hermes 的本机凭证配置,并确保 ~/.hermes/.env 不进入版本控制或截图。

transport: chat_completions 明确选择协议,避免依赖自动判断。context_length 是目录中的输入与输出总上下文窗口,不是输出 token 上限。

~/.hermes/config.yamlyaml
providers:
  inferway:
    api: "https://api.inferway.ai/v1"
    key_env: INFERWAY_API_KEY
    transport: chat_completions
    default_model: "inferway/qwen3.8-27b"
    context_length: 262144
model:
  provider: "custom:inferway"
  default: "inferway/qwen3.8-27b"

启动 Hermes 并选择服务商

从已设置 Key 的终端启动 Hermes,model.provider 会选择保存的服务商。也可用 hermes model 交互配置 Custom endpoint,使用相同地址和完整模型 ID;会话中的 /model 用于切换已配置的服务商。

Hermes Agentbash
hermes

确认接入成功

  1. 使用配置的服务商和模型开启新会话,发送“只回复:连接成功”,确认收到文本且没有 API 错误。
  2. 打开控制台 → Requests,查看请求状态与 token 用量。
  3. 处理代码任务时,让客户端读取一个非敏感文件。应用修改前,请先检查它提出的改动。

请求失败时

认证失败:检查 Key 是否存在、有效且获准使用该模型,并从设置变量的终端重新打开客户端。排错时不要输出完整 Key。

地址或模型错误:检查是否重复添加 /v1,使用公布的完整模型 ID,并确认客户端选择 Chat Completions。请求发往 /responses 或 /completions 时,换 Key 无法解决。

额度或超时:检查钱包余额和 Key 限额,按 Retry-After 等待,并缩短输入或降低输出上限。长输出保持流式传输,排错期间避免 Agent 连续重试。

联系支持时提供客户端版本、模型 ID、请求时间和可用的 request ID;请遮盖凭证和源码。