Cursor 联创 Aman Sanger 表示,团队在基于 perplexity 的评测中对比多个基座模型后选定 Kimi k2.5 作为 Composer-2 的基座,随后进行继续预训练和高算力 RL(4 倍规模扩展),结合 Fireworks 的推理与 RL sampler 使 Composer-2 达到前沿水平。他承认博客最初未提及 Kimi 基座是失误,下次会修正;此前 Kimi 官方已祝贺 Cursor 发布 Composer 2,并说明其通过 Fireworks 托管的 RL 与推理平台以授权商业合作方式接入。
Cursor 联创亲述 Composer-2 的模型来源与训练路径,读者可据此了解强基座加 CPT 和 RL 如何组合成前沿编码模型。
我们在基于困惑度的评估中评估了许多基础模型,Kimi k2.5 被证明是最强的!
之后,我们进行了持续预训练和高算力 RL(4 倍规模扩展)。
强大的基础模型、CPT 和 RL,再加上 Fireworks 的推理和 RL 采样器,使 Composer-2 达到前沿水平。
一开始没有在我们的博客中提到 Kimi 基础模型是个疏忽。我们会在下一个模型中修正这一点。
恭喜 @cursor_ai 团队推出 Composer 2! 我们很自豪看到 Kimi-k2.5 提供基础。看到我们的模型通过 Cursor 的持续预训练与高算力强化学习训练被有效集成,正是我们乐于支持的开放模型生态系统。 注:作为授权商业合作的一部分,Cursor 通过 @FireworksAI_HQ 的托管强化学习与推理平台访问 Kimi-k2.5。
原文
Congrats to the @cursor_ai team on the launch of Composer 2! We are proud to see Kimi-k2.5 provide the foundation. Seeing our model integrated effectively through Cursor's continued pretraining & high-compute RL training is the open model ecosystem we love to support. Note: Cursor accesses Kimi-k2.5 via @FireworksAI_HQ ' hosted RL and inference platform as part of an authorized commercial partnership.
来源:Aman Sanger · x.com