OpenRouter 发布 advisor 工具,让任意模型在生成中途咨询更强模型
Advisor: Give Any Model a Lifeline to a Smarter One
OpenRouter 推出 openrouter:advisor 服务端工具,执行模型在生成中途遇到难题时可调用更强的 advisor 模型获取指导,双方均可选目录中任意厂商的模型。
原文给出 advisor 工具的用法、计费方式和与单厂商方案的差异,读者可据此评估是否替换现有请求配置。
将 openrouter:advisor 添加到你的 tools 数组中,你的模型就能在生成过程中向更强的模型求助。当执行器遇到艰难决策、卡住,或想在完成前做一次合理性检查时,它会带着提示调用顾问。顾问进行思考,将指导作为工具结果返回,执行器则带着更好的信息继续推进。
两个角色都是开放的:OpenRouter 上的任何模型都可以作为执行器,任何提供商的任何模型都可以作为顾问。让 Gemini 执行器咨询 Claude,或让 GPT 执行器咨询 DeepSeek。配对由你选择。
在 chatroom 中试用,或阅读文档获取完整 API 参考。
{
"model": "openai/gpt-4o-mini",
"messages": [{ "role": "user", "content": "Design a rate limiter for a distributed API gateway." }],
"tools": [
{
"type": "openrouter:advisor",
"parameters": { "model": "anthropic/claude-fable-5" }
}
]
}67 倍价差,选择性咨询
Claude Fable 5 每百万输入 token 收费 10 美元。GPT-4o Mini 每百万收费 0.15 美元。这是 67 倍的差距。
大多数请求不需要前沿级别的推理。中端模型就能毫无问题地处理大部分工作负载。但涉及架构决策、模糊边缘情况或多步推理链的那 10-20%,正是更便宜的模型会栽跟头的地方。
顾问工具有选择性地填补这一缺口。你的快速模型主导全局。当它遇到真正困难的事情时,就呼叫支援。你只为需要前沿思考的时刻支付前沿价格。
在一次包含 50 次工具调用的智能体编码会话中,也许有 2-3 次是顾问咨询。其余都以 mini 价格运行。你削减了每次会话的成本,同时保持了高质量上限。
服务端执行,一次工具调用
顾问在生成期间于服务端运行。你的模型像调用任何其他工具一样调用它:传入一个 prompt 描述它需要什么帮助,然后拿回顾问的文本作为工具结果。模型随后自己写出最终答案,并参考该建议。顾问是顾问,不是代笔。
有四件事值得了解:
-
任何提供商的任何模型都可以作为顾问。在工具配置中用
parameters.model固定它(模型目录中的任何模型都可以),或让执行器在每次调用时选择。使用~anthropic/claude-fable-latest始终解析到最新的 Fable。 -
顾问是单轮的。它从自己的咨询中返回聚焦的指导,不会运行嵌套的工具循环。如果你需要一个携带工具的子智能体,请改用
openrouter:subagent。 -
递归被阻止。每个内部顾问调用都带有一个
x-openrouter-advisor-depth标头,并且顾问工具会从子调用中剥离,以防止无界嵌套。咨询次数也按请求设有上限,以限制成本。 -
顾问有记忆。在后续请求中重放对话记录(包含顾问工具调用和结果),每个顾问都会重建其先前的咨询,因此后续问题会建立在顾问已经说过的内容之上。记忆是按顾问独立的(你的安全审查员和你的架构师各自保留自己的线程),并且适用于 Chat Completions、Responses 和 Anthropic Messages。完整细节。
命名顾问
对于复杂的工作流,你可以配置一组专家。每个顾问添加一个 openrouter:advisor 条目,每个都有自己的名称、模型和指令:
{
"tools": [
{
"type": "openrouter:advisor",
"parameters": {
"name": "security-reviewer",
"model": "anthropic/claude-fable-5",
"instructions": "You are a security engineer. Find vulnerabilities."
}
},
{
"type": "openrouter:advisor",
"parameters": {
"name": "architect",
"model": "openai/gpt-5.5",
"instructions": "You are a systems architect. Prioritize simplicity and scalability."
}
}
]
}执行器会看到每个顾问都有一个独立的工具,只需一个 prompt 就能调用适合任务的那个。认证流程审查会路由到带有安全人设的 Claude Fable;架构问题则交给 GPT-5.5。名称可以使用字母、数字、空格、下划线和连字符(“Lead Architect”可以),并且在各个条目中必须唯一。一个条目可以省略 name 以充当默认顾问。
建议也可以流式输出。在 advisor 条目上设置 "stream": true,就能在 advisor 撰写建议时增量获取它。在 Responses API 中,这意味着建议在传输过程中会产生 response.output_text.delta 事件;完成后的输出项仍然携带完整文本,因此忽略增量的使用方不会看到任何差异。(Chat Completions 会忽略该标志,Messages API 的流式支持将很快跟进。)
与其他 advisor 工具的比较
一些提供商在自己的 API 中提供了类似的 advisor 概念,但它被限制在其模型家族内部:执行器和 advisor 都必须来自同一供应商,通常来自固定的配对矩阵,有时还处于 beta 门槛之后。OpenRouter 的 advisor 消除了这些限制,并额外增加了一些功能:
- 任意模型、任意提供商,双方皆可。执行器和 advisor 都可以是 目录 中数百个模型中的任意一个:廉价的开放权重执行器咨询前沿模型,Gemini 执行器咨询 Claude,或者 Claude 执行器从自身模型家族之外的 GPT-5.5 获取第二意见。
- 具名 advisor 阵容。在单个请求中配置多个具有各自模型和指令的专家,并让执行器将每个问题路由到合适的专家。单供应商版本只提供一个未命名的 advisor。
- 单轮咨询。每个 advisor 直接向执行器返回聚焦的指导。对于携带工具的子代理,请使用
openrouter:subagent。 - 跨 API 格式可用,无 beta 门槛。同一工具可通过 Chat Completions、Responses 和 Anthropic Messages 使用(三者均支持跨请求记忆),并且已正式可用。无需 beta 标头,无需申请账户团队访问权限。
如果你已经通过我们的某个兼容 API 外壳使用提供商原生的 advisor,切换到 openrouter:advisor 即可打开完整目录,而无需更改请求的其余部分。
计费
Advisor token 按 advisor 模型 的费率计费,与执行器分开。如果你的执行器是 GPT-4o Mini(每百万 token $0.15/$0.60),而 advisor 是 Claude Fable 5(每百万 token $10/$50),则每个模型的 token 按各自的价格计费。两者都会显示在你的 活动页面 上。
开始使用
在你的 tools 数组中添加一行:
{ "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } }模型会自行决定何时使用它。大多数请求不会触发咨询;触发咨询的请求会因此变得更好。阅读完整文档 了解参数、具名 advisor、跨请求记忆等更多内容。对于携带工具的子代理,请使用 openrouter:subagent。
来源:OpenRouter:Announcements(RSS) · openrouter.ai