跳到正文
原文
xAI:News(网页)·· 2 小时前精选AI 评分71

xAI 发布 Grok 4.1 Fast 与 Agent Tools API

Grok 4.1 Fast and Agent Tools API Bringing the next generation of tool-calling agents to the xAI API Nov 19, 2025

AI 导读

xAI 在 API 上推出 Grok 4.1 Fast 和 Agent Tools API。Grok 4.1 Fast 是主打工具调用的模型,具备 2M token 上下文窗口。

推荐理由

官方同时给出 τ²-bench、Research-Eval 等基准分数和完整定价,读者可据此比较该模型在工具调用场景的成本与性能。

正文 · AI 翻译

你好,我想把当前的预订升级为行政套房。

好的,请稍等,我帮您查找预订信息……

正在查找您的账户……

正在搜索可用房间……

正在将预订升级为行政套房……

好的,全部完成。您现已预订行政套房——祝您入住愉快!

谢谢!

行动计划

1

识别客人

2

检查可用性

3

升级预订

今天,我们很高兴推出 xAI API 的两项强大的新功能:

  • Grok 4.1 Fast,我们最好的工具调用模型,拥有 2M 上下文窗口。它能准确、快速地推理并完成智能体任务,在客户支持和金融等复杂的现实世界用例中表现出色。
  • Agent Tools API,让智能体能够访问实时 X 数据、网络搜索、远程代码执行等。

两者结合,Grok 4.1 Fast 和 Agent Tools API 使开发者能够构建专注于工具调用和智能体搜索的生产级智能体。


为现实世界而训练

我们专门为现实世界的企业用例构建了 Grok 4.1 Fast。

通过在模拟环境中进行 RL 训练,Grok 4.1 Fast 接触到了涵盖数十个领域的各种工具。这种多样化的训练使 Grok 4.1 Fast 在 τ²-bench Telecom 上表现出色,这是一个评估现实世界客户支持场景中智能体工具使用的具有挑战性的基准。

最先进的工具调用

随着开发者构建越来越强大的自主智能体,这些智能体能够进行长期规划并独立运行,模型必须在提供智能的同时不牺牲速度和成本。

Grok 4.1 Fast 就是我们的答案:一个将前沿工具调用性能与极快推理和成本效益相结合的模型。

*Gemini 3 Pro 的分数是独立评估者提供的估计值,有待官方结果。

智能体模型的一个常见挑战是,随着上下文长度的增加,性能会下降。我们使用长时程强化学习训练 Grok 4.1 Fast,并高度重视多轮场景,确保在其完整的 200 万 token 上下文窗口中保持一致的性能。

Agent Tools API

我们还推出了 Agent Tools API,这是一套强大的服务器端工具,使 Grok 4.1 Fast 能够作为完全自主的智能体运行。

只需几行代码,开发者就能让 Grok 浏览网页、搜索 X 帖子、执行代码、检索上传的文档等。

python

这些工具完全在 xAI 的基础设施上运行,因此开发者不再需要管理 API 密钥、速率限制、沙箱或检索管道。Grok 会决定何时以及如何使用它们,通常会在多轮中并行调用多个工具,直到它拥有交付最终答案所需的一切。

功能齐全的工具集

Agent Tools API 是一个多功能套件,可让您显著扩展我们基础 Grok 模型的能力。主要功能包括:

深度研究的最佳智能体

实时信息检索和深度研究是 Grok 4.1 Fast 的核心优势。凭借我们与 X 生态系统的原生集成以及强大的网页浏览能力,由 xAI API 驱动的搜索智能体在具有挑战性的智能体搜索基准上处于最先进水平。

Research-Eval RekaFRAMESX Browse*
分数平均成本分数平均成本分数平均成本

Grok 4.1 Fast

Agent Tools API
63.9$0.04687.6$0.04856.3$0.091

GPT-5

45.5$0.10786.0$0.05824.2$0.198

Claude Sonnet 4.5

41.2$0.06585.0$0.07814.6$0.126

Gemini 3 Pro

55.9-90.9-26.5-

*X Browse 是一个内部基准测试,用于评估智能体在 X 上的多跳搜索和浏览能力。

Grok 4.1 Fast 在事实性方面树立了新标准,与 Grok 4 Fast 相比将幻觉率降低了一半,同时在 FActScore 评估中仍能达到与 Grok 4 相当的性能。

开始构建

我们在 API 上发布两个 Grok 4.1 Fast 变体:

  • grok-4-1-fast-reasoning 用于最大化智能
  • grok-4-1-fast-non-reasoning 用于即时响应

输入定价

输入 token

$0.20 / 100 万 token

缓存输入 token

$0.05 / 100 万 token

输出定价

输出 token

$0.5 / 100 万 token

工具调用

低至 $5 / 1000 次成功调用

我们迫不及待想看到你构建的作品。请在 X 上与社区分享你的创作和反馈!

来源:xAI:News(网页) · x.ai