跳到正文

#模型发布

今日 43 条
1月28日周三
1月27日周二
1月23日周五
1月21日周三
1月16日周五
1月14日周三
  1. 美团 LongCat:HuggingFace 新模型66

    美团 LongCat 发布 LongCat-Flash-Thinking-2601 推理模型

    美团发布 LongCat-Flash-Thinking-2601,总参数 560B、激活 27B 的 MoE 大推理模型,权重以 MIT License 开源。更新通过环境扩展与多环境强化学习、噪声课程训练强化智能体能力,并新增 Heavy Thinking Mode,在智能体搜索、工具调用等基准上取得有竞争力的成绩,已在 SGLang、vLLM 支持部署并上线 longcat.ai。

12月18日周四
  1. Noam Shazeer76

    Noam Shazeer 宣布 Gemini 3 Flash 正式上线,称其将 Gemini 3 的 Pro 级推理能力压缩到延迟、效率和成本接近 Flash 级别的更精简模型中。他表示这是自己目前最喜欢使用的模型,延迟接近真实对话且智能深度不减。模型已在 API、Gemini App 和 Search 中可用,详情见 https://bit.ly/4pTo5YU。

    推荐理由:作者本人官宣发布,说明新模型如何在更低延迟和成本下保留 Pro 级推理能力及可用入口。

12月17日周三
12月16日周二
12月13日周六
12月9日周二
  1. Mistral AI:News(网页)72

    Mistral AI 发布 Devstral 2(123B)与 Devstral Small 2(24B)编码模型及 Mistral Vibe CLI

    Mistral AI 发布开源编码模型 Devstral 2(123B,修改版 MIT 许可)和 Devstral Small 2(24B,Apache 2.0),并推出开源命令行编码助手 Mistral Vibe CLI。

    推荐理由:官方公布了两档开源编码模型的参数规模、SWE-bench Verified 成绩和定价,并说明各自部署门槛,可据此评估实际选用成本。

12月5日周五
  1. 美团 LongCat:HuggingFace 新模型54

    美团 LongCat 发布图像编辑模型 LongCat-Image-Edit

    美团 LongCat 发布图像编辑模型 LongCat-Image-Edit,为 Longcat-Image 的编辑版本,支持中英双语编辑。官方称其在开源图像编辑模型中达到 SOTA,支持全局编辑、局部编辑、文本修改和参考引导编辑,能保持未编辑区域的布局、纹理、色调和主体身份一致,适合多轮编辑。

12月4日周四
12月3日周三
  1. Mistral AI:News(网页)80

    Mistral 发布 Mistral 3 系列:含 Mistral Large 3 与 Ministral 3 小模型,全部 Apache 2.0 开源

    Mistral 发布新一代模型系列 Mistral 3,包括 Mistral Large 3(41B 激活、675B 总参数的 MoE 模型)和 Ministral 3 的 3B、8B、14B 三种小模型,全部以 Apache 2.0 许可开源。

    推荐理由:官方发布了完整模型规格、开源许可和部署路径,读者可以据此评估这批开源模型在自己的场景中是否可用。

10月25日周六
  1. 美团 LongCat:HuggingFace 新模型61

    美团 LongCat 发布 13.6B 开源视频生成模型 LongCat-Video

    美团 LongCat 团队发布 13.6B 参数的开源视频生成基础模型 LongCat-Video,统一支持文生视频、图生视频和视频续写三类任务。模型在 Video-Continuation 上预训练,可生成长达数分钟的视频而不出现色彩漂移或质量下降,并通过粗到细策略和 Block Sparse Attention 在数分钟内生成 720p、30fps 视频。

10月24日周五
10月23日周四
10月17日周五
10月9日周四
9月23日周二
9月21日周日
  1. 通义 QwenAudio:原创语音项目68

    阿里云 Qwen 团队发布全模态模型 Qwen3-Omni

    阿里云 Qwen 团队发布端到端全模态大语言模型 Qwen3-Omni,可理解文本、音频、图像和视频,并能实时生成语音。项目链接:https://github.com/QwenLM/Qwen3-Omni

    推荐理由:作者以官方身份说明 Qwen3-Omni 的模态覆盖和实时语音生成能力,可帮助读者判断其适用场景。

9月19日周五
9月11日周四
8月29日周五
7月25日周五
7月15日周二
7月11日周五
7月3日周四
  1. 上海人工智能实验室 InternLM:原创项目35

    InternLM 推出 POLAR:基于策略判别学习的预训练可扩展高性能奖励模型

    上海人工智能实验室 InternLM 项目发布 POLAR,一种通过策略判别学习(Policy Discriminative Learning)训练的奖励模型,具备预训练、可扩展、高性能特性。该方法将奖励建模转化为区分不同策略的判别任务,以支撑大规模强化学习训练。

6月10日周二
5月30日周五
5月28日周三