跳到正文

#开源生态

今日 13 条
9月30日周三
  1. MiniMax:Blog(网页)72

    MiniMax 发布 M2.7:SWE-Pro 得分 56.22%,展示模型自进化工作流

    MiniMax 发布 M2.7 模型,已在 MiniMax Agent 和 API 平台全面可用。该模型在 SWE-Pro 得分 56.22%(接近 Opus 4.6),VIBE-Pro 55.6%,Terminal Bench 2 57.0%,GDPval-AA ELO 1495 为开源模型最高,MM Claw 准确率 62.7%。

    推荐理由:官方给出了各基准的具体分数和自进化工作流细节,读者可以据此与同档模型做直接比较。

  2. LMSYS:Blog(Chatbot Arena 团队)63

    SGLang-Diffusion 发布两个月:速度较初版提升至 2.5 倍,新增 ComfyUI 集成与 LoRA 支持

    LMSYS Chatbot Arena 团队复盘 SGLang-Diffusion 自 2025 年 11 月初发布两个月来的进展,当前版本(docker tag: lmsysorg/sglang:dev-pr-17247)比初版快最多 2.5 倍,在 NVIDIA GPU 上较其他方案最高快 5x。

    推荐理由:官方复盘发布两个月来的优化成果,速度较初版提升至 2.5 倍,并新增 ComfyUI 集成和 LoRA 支持,读者可评估是否迁移现有图像视频生成工作流。

  3. LMSYS:Blog(Chatbot Arena 团队)68

    SGLang 与 Miles 发布对 DeepSeek-V4 的 Day-0 推理与 RL 训练支持

    LMSYS 的 SGLang 与 Miles 团队宣布对 DeepSeek-V4(1.6T Pro、284B Flash)提供 Day-0 推理和 RL 训练支持,是首个在发布日同时服务与训练该模型的开源栈。

    推荐理由:LMSYS 团队详述了为 DeepSeek-V4 混合稀疏注意力等新架构所做的推理与 RL 训练优化,附基准数据。

  4. LMSYS:Blog(Chatbot Arena 团队)72

    SGLang 和 Miles 实现 NVIDIA Nemotron 3 Ultra Day-0 支持

    SGLang 和 Miles 宣布对 NVIDIA Nemotron 3 Ultra 提供 Day-0 支持。该模型为开源 MoE 混合 Transformer-Mamba 架构,总参数 550B、激活 55B,上下文最长 1M tokens,支持 NVFP4 与 BF16 权重,面向长程自主智能体优化。

    推荐理由:原文给出架构、部署配置和 RL 训练细节,读者可以据此评估该模型在长程智能体场景的可用性。

  5. LMSYS:Blog(Chatbot Arena 团队)26

    LMSYS 公布 2026 博士奖学金首位获得者 Will Lin

    LMSYS 宣布 2026 博士奖学金首位获得者为 Will Lin,表彰其对开源 AI 基础设施的持续贡献,奖学金最高 5 万美元用于学费。Will Lin 是 UC San Diego 六年级博士生,主导开源扩散生成框架 FastVideo,该项目已获 3.7k+ GitHub stars,并被 NVIDIA Dynamo 集成为后端。

  6. LMSYS:Blog(Chatbot Arena 团队)63

    SGLang 与 Miles 为 Qwen3.8-2.4T-A95B 提供 Day-0 支持

    SGLang 团队宣布与 Qwen、阿里百炼、NVIDIA 和 AMD 合作,在 SGLang 和 Miles 中于发布当日支持 Qwen3.8-2.4T-A95B,这是千问最大的开源模型,总参数 2.4T、每 token 激活 95B。

    推荐理由:原文给出 Qwen3.8 混合注意力架构的推理支撑细节和实测性能数字,读者可据此评估新模型在自建推理栈上的部署可行性。

  7. Liquid AI 模型与工程博客(网页)30

    Liquid AI 官方 FAQ:LFM 模型不提供自托管 API,开源权重与 LEAP 平台部署说明

    Liquid AI 表示目前不提供自托管 API,其 LFM 模型可通过 playground(免费限速)和 OpenRouter(付费更高限额)使用,全部模型可在 Hugging Face 直接下载。多数模型支持通过 LEAP 平台定制与部署,并提供本地推理与定制两套软件栈。年营收不超过 $10M 的组织可获商业使用豁免,超过则需联系销售团队定制定价。

  8. Liquid AI 模型与工程博客(网页)17

    Liquid AI 黑客松:用 LFM2.5 等模型挑战端侧 AI

    Liquid AI 公布其黑客松系列活动回顾与日程,开发者围绕 Liquid Foundation Models 构建端侧应用。已举办的 6 场活动覆盖东京、旧金山及线上,涉及 LFM2.5、LFM2.5-VL、LFM2-VL 与 LEAP,可在 AMD Ryzen AI PC、AMD NUC 及 iOS、Android 应用上部署。目前日历上暂无新黑客松,可留邮箱等待通知。

  9. Liquid AI 模型与工程博客(网页)65

    Liquid AI 发布端侧基础模型 LFM2,含 0.35B、0.7B 和 1.2B 三个版本

    Liquid AI 发布新一代 Liquid Foundation Models(LFM2),定位市场上最快的端侧生成式 AI 基础模型,采用混合架构,包含 10 个双门控短程卷积块和 6 个分组查询注意力块。

    推荐理由:官方博客给出了 LFM2 的架构细节、CPU 推理对比和训练方法,读者可以据此评估它在端侧部署中的实际取舍。

  10. Liquid AI 模型与工程博客(网页)53

    Liquid AI 发布 LFM2-ColBERT-350M 多语言晚交互检索模型

    Liquid AI 发布 LFM2-ColBERT-350M,一个基于 LFM2 骨干的晚交互检索模型,支持用一种语言存储文档、用其他语言查询检索。在扩展的 NanoBEIR 多语言基准上,其跨语言检索能力显著优于 150M 参数的 GTE-ModernColBERT-v1,尤其在德语、阿拉伯语、韩语和日语上;尽管模型体积更大,查询和文档编码吞吐与对方相当。

  11. Liquid AI 模型与工程博客(网页)66

    Liquid AI 发布 LFM2.5-8B-A1B 端侧 MoE 模型,128K 上下文主打工具调用

    Liquid AI 发布 LFM2.5-8B-A1B 端侧 MoE 模型,上下文窗口从 32,768 扩展到 128K tokens,预训练从 12T 增至 38T tokens,词表翻倍到 128,000 以提升非拉丁文字的编码效率。

    推荐理由:官方详细给出上下文、训练管线和实测基准,读者可以据此评估这款端侧 MoE 模型是否适合本地 Agent 工作流。

  12. Fireworks AI(网页)83

    Kimi K3 开源发布并上线 Fireworks:2.8T 参数、Day-0 推理与训练支持

    月之暗面的 Kimi K3 以开源权重发布,共 2.8T 总参数、104B 激活参数、896 专家、1M 上下文,并在 Fireworks 上线 Day-0 推理与训练。

    推荐理由:原文汇总了 K3 的参数规格、多项第三方基准成绩和与 Opus 5 的成本对比,读者可据此评估开源模型在自有工作流中的可行性。