跳到正文
原文
Ahead of AI(RSS)· Sebastian Raschka, PhD·· 2025-12-30AI 评分66

Sebastian Raschka 年度回顾:2025 年大语言模型的进展、问题与预测

The State Of LLMs 2025: Progress, Problems, and Predictions

AI 导读

Sebastian Raschka 发布 2025 年 LLM 年度回顾,认为这一年由 RLVR 与 GRPO 驱动的推理模型主导,DeepSeek R1 展示了强化学习可培养推理行为且后训练成本远低于预期(约 500 万美元量级,另有在 V3 基础上训练 R1 约 $294,000 的估计)。

来源:Ahead of AI(RSS) · magazine.sebastianraschka.com