Hugging Face:Blog(RSS)·· 2026-08-25精选AI 评分66
IBM 发布 Granite 4.2 推理模型系列并详解构建过程
Granite 4.2 LLMs: How They're Built
AI 导读
IBM Granite 团队发布 Granite 4.2 推理模型系列,包含 3B、8B、30B 三个 dense 版本,基于 Granite-4.1 基座(约 15T tokens 预训练,上下文扩展到 512K),经 SFT 和多阶段 GRPO 强化学习训练,8B 和 30B 额外经历 SWE、终端、搜索三类真实环境 agentic RL。
推荐理由
官方完整披露了从预训练、SFT 到多阶段 GRPO 强化学习的训练细节,读者可以据此了解推理模型的完整构建流程。
来源:Hugging Face:Blog(RSS) · huggingface.co