跳到正文
原文
Hugging Face:Blog(RSS)·· 2026-08-25精选AI 评分66

IBM 发布 Granite 4.2 推理模型系列并详解构建过程

Granite 4.2 LLMs: How They're Built

AI 导读

IBM Granite 团队发布 Granite 4.2 推理模型系列,包含 3B、8B、30B 三个 dense 版本,基于 Granite-4.1 基座(约 15T tokens 预训练,上下文扩展到 512K),经 SFT 和多阶段 GRPO 强化学习训练,8B 和 30B 额外经历 SWE、终端、搜索三类真实环境 agentic RL。

推荐理由

官方完整披露了从预训练、SFT 到多阶段 GRPO 强化学习的训练细节,读者可以据此了解推理模型的完整构建流程。

来源:Hugging Face:Blog(RSS) · huggingface.co