热点事件持续更新
Prime Intellect发布INTELLECT-2分布式RL模型
2 篇报道1 个报道来源13 小时前更新
先了解这件事
AI 综述
2026年9月30日,Prime Intellect 发布 INTELLECT-2,称其为首个通过全球分布式强化学习训练的 32B 参数推理模型。据该公司介绍,该模型在异步、异构的分布式算力网络上完成训练,在数学与编码基准上的性能较 QwQ-32B 有所提升。同日后续报道进一步称,该模型以 QwQ-32B 为基座,采用 GRPO 与可验证奖励进行训练,并强调这是全球首个 32B 参数的无许可分布式强化学习训练,任何人可贡献异构算力。目前事件仍处于发布阶段,除上述发布信息外,尚无更多后续进展披露。
AI 根据报道生成 · 12 小时前更新
最新进展9月30日 23:28
同日报道补充:INTELLECT-2以QwQ-32B为基座,用GRPO和可验证奖励训练,任何人可贡献算力。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- Prime IntellectPrime Intellect 发布 INTELLECT-2:首个全球分布式强化学习训练的 32B 推理模型
Prime Intellect 发布 INTELLECT-2,以 QwQ-32B 为基座,用 GRPO 和可验证奖励进行全球首个 32B 参数的无许可分布式强化学习训练,任何人可贡献异构算力。
- Prime Intellect精选Prime Intellect 发布 INTELLECT-2:首个通过全球分布式强化学习训练的 32B 模型
Prime Intellect 发布 INTELLECT-2,称其为首个通过全球分布式强化学习训练的 32B 参数推理模型,在异步、异构的分布式算力网络上训练,性能较 QwQ-32B 在数学与编码基准上有提升。
本事件热度走势
当前热度 7·可比范围峰值 10(10月1日 00:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。