跳到正文
原文
OpenRouter:Announcements(RSS)·· 2026-06-13精选AI 评分66

Hermes Agent 如何接入 OpenRouter:配置、模型选择与路由

How to Use Hermes Agent with OpenRouter: Setup, Models & Routing

AI 导读

OpenRouter 发布 Hermes Agent 接入教程。Hermes Agent 是 Nous Research 的开源 MIT 自主 CLI 智能体,与 Hermes 3/Hermes 4 模型是不同产品;截至 2026 年 6 月它以超过 17 万亿 token 的用量位居 OpenRouter 应用榜首。

推荐理由

原文给出 Hermes Agent 接入 OpenRouter 的完整配置方法,包括 64K 上下文要求和 fallback、辅助模型等路由设置,可直接照做。

正文 · AI 翻译

Hermes Agent 是 OpenRouter 上按 token 量计算使用最多的应用,迄今已处理超过 17 万亿个 token。OpenRouter 是人们运行 Hermes Agent 的主要方式之一,因此这套配置成熟、被广泛使用且获得全面支持。

Hermes Agent 是来自 Nous Research 的开源自主智能体,可直接在终端中运行,并且可以搭配你选择的任何模型使用。当你将它连接到 OpenRouter 时,你就能通过一个 API 密钥访问来自 70 多家提供商的 400 多个模型,同时享有自动故障转移和单一账单。

首先需要澄清一点:Hermes Agent 与 Hermes 模型系列(Hermes 3 和 Hermes 4)是 Nous Research 同一生态系统中不同的部分。Hermes Agent 是应用,而 Hermes 3 和 Hermes 4 是它可以运行于其上的语言模型。本指南将解释这一区别,然后带你完成完整的设置和路由配置。

简而言之

  • Hermes Agent 是 Nous Research 的开源自主 CLI 智能体。Hermes 3 和 Hermes 4 模型是独立的;该智能体可以运行在两者之一上,也可以通过网关运行在任何模型上。
  • 基础设置的默认模型是 ~anthropic/claude-sonnet-latest。openrouter/auto 和 openrouter/pareto-code 是针对特定用例的可选路由模式。
  • 大多数配置要求模型至少具有 64K 上下文 token。较小的窗口可能会被拒绝,因为系统提示词加上工具 schema 会将其填满。在选择之前,请在 openrouter.ai/models 查看上下文长度。
  • 一个 OpenRouter 密钥就能让该智能体访问来自 70 多家提供商的 400 多个模型,并为受支持的模型提供自动故障转移,因此单个提供商宕机不会中断会话。同一个密钥可用于 任何编码智能体或 AI 工具。
  • 路由配置、回退链和辅助模型卸载位于 ~/.hermes/config.yaml。标题生成和视觉等侧任务可以运行在比主循环更便宜的模型上。
  • 运行该智能体是免费的(采用 MIT 许可证);你只需为其消耗的模型 token 付费。当前计费详情请参见 openrouter.ai/pricing。

什么是 Hermes Agent?(以及它不是什么)

围绕 Hermes 的许多混淆源于这样一个事实:Nous Research 既创建了一个智能体,也创建了一个同名的语言模型系列。Hermes Agent 是一个命令行应用,而 Hermes 3 和 Hermes 4 是可以作为该智能体后端的语言模型。

当人们搜索“Hermes 3”、“Hermes 4”或“Hermes 4 405B”时,他们通常是在找这些语言模型。Hermes Agent 是应用,而 Hermes 3 和 Hermes 4 是可用作其后端的模型。

智能体与模型:区分说明

Hermes AgentHermes 3 / Hermes 4
它是什么自主 CLI 智能体(一个应用)语言模型(大脑)
开发者Nous ResearchNous Research
运行方式安装 CLI,将其指向一个模型通过提供商以模型 ID 调用
许可证开源(MIT)Nous Research 模型权重,遵循其自身条款
关系需要一个模型来思考可以作为 Hermes Agent 运行于其上的模型后端

Hermes Agent 实际能做什么

Hermes Agent 内置 40 多个工具,用于网页搜索、浏览器自动化和图像理解等任务。它还包含一个消息网关,可连接到 20 多个平台,包括 Telegram、Discord、Slack、WhatsApp、Signal 和 Matrix。

它与典型聊天界面的不同之处在于其持久记忆系统。它可以跨会话记住信息,因此你不必每次开始新对话时都重复项目细节或上下文。

该代理在运行位置上也很灵活。你可以将其部署在本地机器上,也可以使用 Docker、SSH、Daytona、Modal 和 Singularity 等环境。

为什么要将 Hermes Agent 与 OpenRouter 搭配使用?

如果你曾经使用过多个 AI 提供商,你就知道事情会变得多快就一团糟。每个提供商都有自己的账户、API 密钥、计费设置和模型目录。OpenRouter 让你通过一个 API 密钥和计费账户即可访问来自 70 多个提供商的 400 多个模型。

OpenRouter 已经是 Hermes Agent 最受欢迎的后端。截至 2026 年 6 月,Hermes Agent 在 OpenRouter 的 应用排名中按总 token 使用量位列第一,处理了超过 17 万亿个 token。该集成被广泛使用、经过充分测试,并已在大规模场景中得到验证。

没有网关使用 OpenRouter
每个提供商一个账户、密钥和账单一个密钥即可使用 70 多个提供商的 400 多个模型
当提供商出现 5xx 错误或限流时手动重试自动故障转移,会话中途生效,无需运维工作
在某些提供商处为失败的调用付费失败的请求不计费
每个提供商仪表盘有单独的使用视图一个活动仪表盘覆盖所有模型
提供商标价加上你自己的加价计算无加价;目录价格加上平台费用

你可以通过更改一个字符串来切换模型。代理所做的一切都通过你在 openrouter.ai/activity 的使用视图集中跟踪。

Diagram of a Hermes Agent request routed through OpenRouter: Provider A serves the request, and if it fails, OpenRouter falls back to Provider B

OpenRouter 会自动在提供商之间进行负载均衡,并在提供商返回 5xx 错误或触及速率限制时切换,因此当某个提供商宕机时,长时间运行的代理任务不会中断。失败请求的计费行为由 零完成保险覆盖。

设置:将 Hermes Agent 连接到 OpenRouter

如果你还没有安装 Hermes,请从以下命令开始:

curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

它适用于 Linux、macOS、WSL2 和 Termux。通过原生 PowerShell 的 Windows 支持仍处于早期测试阶段。

安装完成后,将 Hermes Agent 连接到 OpenRouter 只需 2 个步骤:创建 API 密钥,然后配置 Hermes 使用它。配置完成后,Hermes Agent 会通过 OpenRouter 进行身份验证,并使用你在配置中指定的模型 slug 执行所有任务。

上下文长度是一个硬性约束。大多数设置至少需要 64K token 的上下文,如果窗口更小,代理可能会拒绝启动。

在任何对话开始之前,系统提示和工具 schema 已经消耗了上下文窗口的很大一部分。你可以在 openrouter.ai/models 查看任何模型支持的上下文大小。

推荐:交互式设置

OpenRouter cookbook 建议从交互式模型选择器开始:

hermes model

这会引导你选择提供商并配置模型。Hermes CLI 仍在积极演进中,因此请参考最新的集成 cookbook 以了解确切流程;交互步骤可能会因版本而异。

Hermes Agent terminal showing the interactive provider picker with OpenRouter selected

选择模型时,请确保它至少有 64K 上下文。推荐的起始选项通常是 ~anthropic/claude-sonnet-latest。你可以在 openrouter.ai/models 按上下文长度筛选模型,以便在继续之前确认。

成功的设置很容易识别。运行 hermes chat 后,你应该会看到 Hermes Agent 提示符显示你连接的提供商和所选模型。

如果出现 401 错误或“provider not found”提示,通常意味着 API 密钥没有正确保存,或者 provider 名称有拼写错误。重新运行设置命令通常就能解决。

快捷方式:直接配置路径

如果你想跳过交互式设置,直接保存 API 密钥并立即开始聊天:

hermes config set OPENROUTER_API_KEY sk-or-...
hermes chat --provider openrouter --model '~anthropic/claude-sonnet-latest'

将 sk-or-... 替换为你实际的 OpenRouter API 密钥。这会保存密钥并使用 ~anthropic/claude-sonnet-latest 别名启动聊天。~ 前缀告诉 OpenRouter 解析到该系列中的最新模型。

当你以编程方式配置 agent 并希望避免交互式设置流程时,这种方法很有用。

手动配置(高级)

密钥存储在 ~/.hermes/.env 中,而模型和 provider 设置位于 ~/.hermes/config.yaml 中。压缩、辅助模型以及其他高级选项等功能直接在 config.yaml 中配置。

将你的 API 密钥添加到 ~/.hermes/.env,并从环境变量或密钥管理器中加载它。不要将其提交到版本控制中:

OPENROUTER_API_KEY=<your-api-key>

将模型和 provider 放入 ~/.hermes/config.yaml:

model:
  provider: openrouter
  default: ~anthropic/claude-sonnet-latest

当你对配置进行版本控制或以编程方式启动 agent 时,这种方法很方便。

选择模型

为 Hermes Agent 选择模型时,最重要的要求是上下文长度。大多数配置需要至少 64K tokens 才能正常运行。

上下文窗口较小的模型通常无法启动,因此在选择模型之前,请前往 openrouter.ai/models,按上下文长度筛选,并确保你的选择支持至少 64K tokens。

模型 ID 的工作原理

OpenRouter 模型 ID 使用 provider/model-name 格式。~ 前缀是一种路由快捷方式:它告诉 OpenRouter 自动解析到某个模型系列的最新可用版本,而不是将你锁定在特定版本上。

模型 ID解析结果
~anthropic/claude-sonnet-latest最新的 Claude Sonnet 别名(基础设置的默认值)
~google/gemini-flash-latest最新的 Gemini Flash 别名(便宜、快速,适合辅助任务)
deepseek/deepseek-v4-flashDeepSeek 的快速聊天模型(性价比高)
openrouter/auto在整个目录中自动路由,由市场对每种任务类型的支出份额驱动

你可以在 models 页面 浏览完整目录,并按上下文长度、价格和功能进行筛选。对于本指南中的工作流,低于 64K 的模型不太可能运行。

当你不想选择时的自动路由

openrouter/auto 是一种可选的路由模式。它会根据 OpenRouter 社区在过去 7 天窗口内对这类任务的总体支出,自动为每个请求挑选一个强大的模型。如果你没有偏好的模型,只想在不做任何基准测试的情况下获得可靠结果,这是一个很好的起点。

当你需要更多控制时,下面的路由部分提供了更细粒度的选项。

Provider 路由、回退与辅助模型

一旦 Hermes Agent 连接成功,~/.hermes/config.yaml 中的路由就决定了成本、可靠性以及如何处理故障。

该文件中的 3 个主要控制项(provider 路由、回退链和辅助模型卸载)相互独立,因此你可以混合搭配使用。

概括来说:模型选择决定哪个任务发送给哪个模型;provider_routing 决定哪个 provider 实际执行请求;如果该 provider 失败,fallback_providers 会接管并重新路由请求,而不会中断会话或丢失上下文。

Provider 路由控制

provider_routing 部分控制由哪个 provider 处理每个请求:

字段控制内容示例值
sort优化维度throughput、price、latency
onlyprovider 允许列表[anthropic]
ignoreprovider 阻止列表[novita]
order显式 provider 优先级[anthropic, google]
data_collectionprovider 是否可以记录提示deny

将 data_collection: deny 设置为防止你的提示词被提供商记录。其他允许的值请参阅提供商路由文档。

:nitro 和 :floor 后缀是 sort 设置的请求级快捷方式。:nitro 映射到 sort: throughput,为该特定请求优先考虑速度,而 :floor 映射到 sort: price,选择最便宜的可用提供商。这些仅覆盖该单次调用的 provider_routing,当你想要临时更改行为而不编辑配置文件时非常有用。

回退链

当主模型失败时,fallback_providers 设置会生效。每个条目是一个提供商和模型的配对;当其中一个触发时,Hermes 会在会话中途切换到它,而不会丢失你的对话。

fallback_providers:
  - provider: openrouter
    model: ~anthropic/claude-sonnet-latest
  - provider: openrouter
    model: ~google/gemini-flash-latest

如果主模型出错,请求会路由到下一个条目,Hermes Agent 会保持其记忆和上下文完整。对于一个运行数小时的 agent 来说,这就是短暂的提供商故障和会话死亡之间的区别。

辅助模型

辅助模型处理诸如生成标题、处理视觉请求和执行压缩等侧任务。这能让你的主模型专注于实际的推理和编码任务。

auxiliary:
  title:
    provider: openrouter
    model: ~google/gemini-flash-latest
  vision:
    provider: openrouter
    model: ~google/gemini-flash-latest
  compression:
    provider: openrouter
    model: ~google/gemini-flash-latest

对于生成对话标题等简单任务,没有理由使用像 Claude Sonnet 这样的高成本模型。将这些任务卸载到更便宜的模型,例如 Gemini Flash,可以降低成本,同时保持主工作流程不变。

一个很好的经验法则:将辅助任务指向你为每项工作所信任的最便宜的模型。

使用 Pareto Code 路由器降低成本

如果你想在不手动测试和比较模型的情况下控制成本,openrouter/pareto-code 让 OpenRouter 自动选择仍满足最低质量门槛的最便宜的模型:

model:
  provider: openrouter
  model: openrouter/pareto-code

openrouter:
  min_coding_score: 0.65

启用此功能后,OpenRouter 会为每个编码任务选择满足你所选阈值的最低成本模型。该集成会自动处理请求格式,因此你无需自己管理路由逻辑。

编码分数范围从 0.0 到 1.0,值越高意味着模型越强大但也越昂贵。一个好的起点是 0.65:

  • 对于速度与成本比精度更重要的日常编辑,降低它
  • 对于正确性比节省 token 更重要的复杂重构,提高它

叠加廉价选项

openrouter/pareto-code 控制主编码循环,而 auxiliary 处理标题、视觉和压缩等侧任务。它们协同工作,你也可以将它们与 :floor 路由结合使用,以进一步节省成本。

OpenRouter 还在多个提供商中提供超过 25 个免费模型。如果你选择一个具有 64K+ 上下文的免费模型,你可以为业余使用运行低成本甚至零成本设置,同时将 Pareto 路由保留给真正需要更高质量模型的任务。在 openrouter.ai/pricing 查看当前定价和免费层可用性。

监控使用情况和故障排除

agent 使用的所有内容都通过单个 API 密钥,这意味着所有活动都在一个地方可见。你可以在 openrouter.ai/activity 跟踪所有 Hermes Agent 会话的请求、成本和 token 使用情况,并可按模型和时间范围进行筛选。

常见错误和修复

大多数设置问题分为 2 类:

  1. 如果 Hermes 完全找不到你的 API 密钥,问题出在本地。这通常意味着密钥从未保存到 ~/.hermes/.env。
  2. 如果密钥存在但身份验证仍然失败,问题出在账户端。密钥可能无效、已过期,或者你的 OpenRouter 账户可能没有剩余额度。
问题修复
“无 API 密钥” / 找不到提供商验证 ~/.hermes/.env 中是否包含该密钥,或重新运行设置命令
401 / 403 错误在 openrouter.ai/keys 检查密钥有效性,并确认你的余额
模型无响应验证 ~/.hermes/config.yaml 中的模型 ID 是否与 openrouter.ai/models 上的有效 provider/model-name 匹配
启动时的上下文错误切换到上下文至少为 64K 的 OpenRouter 模型

如果某个模型在其他配置中可用,但在 Hermes Agent 中拒绝启动,通常是 64K 上下文要求所致,而非配置错误。请换用其他模型,而不是调试 YAML。

如果你正在探索其他终端原生 agent,OpenRouter 还为 OpenClaw 提供了 cookbook 集成,这是一个使用相同后端的多平台聊天 agent。

常见问题

Hermes Agent 与 Hermes 3 / Hermes 4 模型是同一个吗?

不是。Hermes Agent 是 Nous Research 开发的开源自主 CLI 应用;Hermes 3 和 Hermes 4 是同一团队推出的独立模型系列。你可以通过 OpenRouter 使用 Hermes 模型或任何模型作为后端来运行 Hermes Agent。

Hermes Agent 免费吗?

该 agent 是开源的(MIT),可免费运行。你只需为通过提供商使用的模型 token 付费。当前费率(包括免费层模型)请见 openrouter.ai/pricing。

在 OpenRouter 上应该为 Hermes Agent 使用什么模型?

从 ~anthropic/claude-sonnet-latest 开始:它是基础设置中记录的默认模型,并满足 64K 上下文要求。运行起来后,openrouter/auto 会自动路由到强大的模型,无需你选择,而 openrouter/pareto-code 专门针对编码任务优化成本。

我需要单独的提供商账户吗?

对于大多数受支持的模型,不需要。一个 OpenRouter 密钥即可让 Hermes Agent 访问来自 70 多家提供商的 400 多个模型,并具备自动故障转移。

如果你在某个特定模型上遇到访问错误,请查看该模型在 openrouter.ai/models 上的页面;某些模型需要提供商特定的资格。大多数情况下,切换到其他模型即可解决问题。

为什么 Hermes Agent 在启动时拒绝我的模型?

大多数配置要求至少 64K 上下文 token;较小的窗口可能无法容纳系统提示词和工具 schema。请切换到上下文更大的模型。可在 openrouter.ai/models 按上下文长度筛选以寻找候选模型。

提供商定价没有加价。当前平台费用和计费详情(包括如何处理失败请求)请见 openrouter.ai/pricing。

来源:OpenRouter:Announcements(RSS) · openrouter.ai