跳到正文

#开源生态

今日 17 条
9月20日周日
  1. Qwen65

    Qwen 官方宣布 Qwen-Image-2.1 已获得 ComfyUI 支持,开放权重,单一 7B checkpoint 同时支持生成和编辑。引用内容提到该模型支持原生 2K 图像生成、单次最多基于 10 张参考图进行指令编辑,以及带 alpha 通道的 RGBA 输出。

    引用ComfyUI@ComfyUI

    Qwen-Image-2.1 is now supported in ComfyUI! Open weights. One 7B checkpoint that generates and edits. → Image generation at native 2K → Instruction editing from up to 10 reference images in a single pass → RGBA output, alpha included

    推荐理由:正文点出该模型已在 ComfyUI 支持,读者可以据此更新本地图像生成与编辑工作流。

9月19日周六
9月18日周五
9月17日周四
  1. Unsloth AI67

    Unsloth 发布更新的 Unsloth Docker 镜像,可免设置地在本地训练和运行 500+ 模型,提供新 GUI 和 notebooks 两种工作流,依赖已预装,支持 NVIDIA 和 AMD。指南见 https://unsloth.ai/docs/get-started/install/docker ,代码见 https://github.com/unslothai/unsloth 。

    引用Unsloth AI@UnslothAI

    Introducing Unsloth Desktop 🦥 The first desktop app to run and train models locally. • Open-source. Runs on Mac, Windows and Linux • Supports MLX, diffusion image/video, audio, GGUF • Connect Claude Code and Codex to local LLMs • 50% more accurate, self-healing tool calls + sandboxed code exec • Works for CPU + multiGPU setups - NVIDIA, AMD, Intel, Mac • Train models 2× faster with 70% less VRAM • Private web search, deep research, RAG, MCP and exports (NVFP4, GGUF) • Use Unsloth’s OpenAI-compatible API and cloud models • Securely deploy LLMs remotely and access anywhere Unsloth Desktop is now available on http://unsloth.ai and GitHub. GitHub: https://github.com/unslothai/unsloth Blog and Guide: https://unsloth.ai/docs/desktop

    推荐理由:原文给出免配置的本地训练运行入口和适用硬件范围,读者可以据此评估是否替换现有部署流程。

9月16日周三
  1. 蚂蚁 inclusionAI:HuggingFace 新模型62

    蚂蚁 inclusionAI 开源 Realtime-Venus 9B 全双工音视频交互系统

    蚂蚁 inclusionAI 发布 Realtime-Venus,一个支持主动音视频交互、异步委托和可打断全双工对话的开源系统,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点。

    推荐理由:模型卡给出了 Realtime-Venus 的架构组成、全双工与异步委托能力及完整用法,读者可以据此评估它在实时音视频交互场景的可用性。

  2. Together AI 研究与产品博客(RSS)53

    Together AI 详解从闭源模型迁移到开源模型的策略

    Together AI 发布从闭源模型迁移到开源模型的指南,称采用托管服务可将迁移周期从数月到数年缩短为数周到数月。方法分发现、评估、适配、决策、生产五步,核心是用真实流量回放而非通用基准做评估,并按系统提示词、推理参数、上下文工程、微调四个杠杆迭代适配;文中提到部分客户迁移后成本最多降低 70%,可用 10% 流量的金丝雀部署开始上线。

  3. Hugging Face:Blog(RSS)62

    Hugging Face 发布 ALTK-Evolve 一致性指南与 Consistency Analyzer,将智能体一致性差距减半

    IBM Research 与 Hugging Face 在 ALTK-Evolve 中推出一致性指南和 Consistency Analyzer,用于诊断和改善智能体重复运行的不稳定性。

    推荐理由:原文给出一致性差距的量化诊断方法与开源实现,读者可据此评估和改进智能体在重复运行下的可靠性。

9月15日周二
  1. NVIDIA Blog(RSS)42

    费城儿童医院如何用开源 NVIDIA AI 实现儿童心脏建模与手术模拟

    费城儿童医院(CHOP)基于开源医学影像框架 MONAI 构建心脏建模服务,将原本需 4 小时的建模流程缩短至数秒,并已用于复杂心室间隔缺损手术规划。全美超 20 家儿童医院开展心脏建模项目,波士顿儿童医院建模支持其过半心脏手术、约每年 500 例,CHOP 今年预计完成约 200 例。

  2. MiniMax (official)36

    H3 越来越快了。⚡️ @sgl_project + VDN-H3 现在让 MiniMax H3 在 8× B200 上突破 2 倍实时去噪——预热后端到端 9.0s 生成 14.4s 的 768p 视频,未测得质量下降。 开放模型通过开放生态持续进化。🚀

    引用SGLang@sgl_project

    SGLang-Diffusion with VDN-H3 now generates 14.4s of 768p video in just 9.0s 🚀 On 8× B200, 8 step denoising takes just 6.9s, reaching over 2× real time. The 9.0s figure covers the full generation request after warmup. No measured quality regression versus dense 50-step H3 across 103 test prompts. 🧵

9月14日周一