xAI 发布 grok-code-fast-1:面向智能体编码的高速推理模型
Grok Code Fast 1 We're thrilled to introduce grok-code-fast-1, a speedy and economical reasoning model that excels at agentic coding. Aug 28, 2025
xAI 发布全新架构推理模型 grok-code-fast-1,主打智能体编码场景,SWE-Bench-Verified 全子集得分 70.8%,定价为每百万输入 token $0.20、输出 token $1.50、缓存输入 token $0.02。
官方给出了定价、SWE-Bench-Verified 得分和缓存命中率等具体数据,读者可以据此评估它在日常编码工作流中的性价比。

快速的日常主力
虽然如今的模型无疑非常强大,但它们往往并不像是专为智能体编程工作流打造的,在这种工作流中,推理与工具调用的循环会慢得令人沮丧。作为智能体编程工具的重度用户,我们的工程师看到了打造一个更轻快、更灵敏、并针对我们日常任务优化的解决方案的空间。
我们从零开始构建 grok-code-fast-1,从全新的模型架构入手。为了打下坚实的基础,我们精心汇集了一个富含编程相关内容的预训练语料库。在后训练阶段,我们整理了反映真实世界拉取请求和编程任务的高质量数据集。
在整个训练过程中,我们与发布合作伙伴紧密合作,在他们的智能体平台内不断打磨和优化模型的行为。grok-code-fast-1 已熟练掌握 grep、终端和文件编辑等常用工具,因此在您喜爱的 IDE 中应该会如鱼得水。
我们已与部分发布合作伙伴携手,限时免费提供 grok-code-fast-1,包括 GitHub Copilot、Cursor、Cline、Roo Code、Kilo Code、opencode 和 Windsurf。
快如闪电
我们的推理和超级计算团队开发了多项创新技术,大幅提升了服务速度,打造出独一无二的灵敏体验——在你还没读完思考轨迹的第一段时,模型就已经调用了数十个工具。我们还投入了提示缓存优化,在与发布合作伙伴配合使用时,缓存命中率经常超过 90%。
多面手程序员
grok-code-fast-1 在整个软件开发技术栈中都极为多才多艺,尤其擅长 TypeScript、Python、Java、Rust、C++ 和 Go。它能在极少监督下完成常见编程任务,从构建从零到一的项目、对代码库问题给出有见地的回答,到进行精准的缺陷修复,皆可胜任。
经济之选
我们将 grok-code-fast-1 设计得广泛可及,定价为:
- 每百万输入 token $0.20
- 每百万输出 token $1.50
- 每百万缓存输入 token $0.02
grok-code-fast-1 旨在在开发者每天面对的任务中大放异彩,在性能与成本之间取得引人注目的平衡。它的优势在于以经济、紧凑的形态提供强劲性能,使其成为快速且高性价比地处理常见编程任务的多面手之选。
方法
TPS 指标是通过直接测量各模型提供商 API 的响应生成速度计算得出的,仅考虑最终响应 token。
- Gemini 2.5 Pro、GPT-5 和 Claude Sonnet 4:使用各自的公开 API 测量。
- Grok Code Fast 1 和 Grok 4:使用 xAI API 测量。
- Qwen3-Coder:托管在 DeepInfra 上,采用低精度(fp4),这会降低响应质量。
我们采用整体方法来评估模型性能,将公开基准测试与真实世界测试相结合。在 SWE-Bench-Verified 的完整子集上,grok-code-fast-1 使用我们自己的内部测试框架得分 70.8%。
虽然像 SWE-Bench 这样的基准测试能提供有价值的见解,但我们发现它们并不能完全反映真实世界软件工程的细微之处,尤其是智能体编程工作流中的终端用户体验。
为了指导我们的模型训练,我们将这些基准测试与常规的人工评估相结合,由经验丰富的开发者对模型在日常任务中的端到端表现进行评分。我们还构建了自动化评估来追踪行为的关键方面,帮助我们在设计中权衡取舍。
在开发 grok-code-fast-1 时,我们专注于可用性和用户满意度,并以真实世界的人工评估为指导。最终成果是一个被程序员评价为在日常编码任务中快速且可靠的模型。
面向所有人的 Grok Code
限时活动,我们很高兴在独家发布合作伙伴处免费提供 grok-code-fast-1。以下是我们的发布合作伙伴对这款模型的评价,该模型最近以代号 sonic stealth 发布。
该模型可通过 xAI API 普遍获取,定价为每 100 万输入 token 0.20 美元,每 100 万输出 token 1.50 美元,每 100 万缓存输入 token 0.02 美元。
未来几周可以期待什么
上周,我们以代号 sonic 悄然发布了 grok-code-fast-1。在此 stealth 阶段,我们的团队密切关注社区渠道,并部署了多个新的模型检查点以回应反馈。
随着我们推进这个新模型系列,我们很高兴能根据您的输入快速迭代。我们高度重视开发者社区的支持,并鼓励您自由地分享所有反馈,无论正面还是负面。
我们将专注于为 grok-code-fast-1 提供持续更新,改进将在几天内而非几周内到来。一个支持多模态输入、并行工具调用和扩展上下文长度的新变体已在训练中。
阅读 grok-code-fast-1 模型卡。我们期待看到您构建的作品!
来源:xAI:News(网页) · x.ai