Prime Intellect(网页)·· 13 小时前AI 评分60
Prime Intellect 发布 INTELLECT-2:首个全球分布式强化学习训练的 32B 推理模型
AnnouncementsAPR 15TH, 2025INTELLECT-2: The First Globally Distributed Reinforcement Learning Training of a 32B Parameter Model
AI 导读
Prime Intellect 发布 INTELLECT-2,以 QwQ-32B 为基座,用 GRPO 和可验证奖励进行全球首个 32B 参数的无许可分布式强化学习训练,任何人可贡献异构算力。
来源:Prime Intellect(网页) · primeintellect.ai