#开源生态
#开源生态
今日 1 条
NVIDIA AI@NVIDIAAIAI 评分3838
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分4040 NVIDIA TensorRT Model Connect:面向 AI 原生设计的开源项目经验
NVIDIA 开源了基于 TensorRT 的 C++ AI 模型参考实现集合 TensorRT Model Connect,目标是让 NVIDIA 推理栈的性能更易获取。项目围绕编码智能体设计,采用并行工作、模型族隔离、可逆变更与 GPU 验证等实践。
ModelScope@ModelScope2022AI 评分4949
NVIDIA AI@NVIDIAAIAI 评分2525一个小型韩国团队如何在开源模型中拿下 AA II 评分前五 | Nemotron Labs https://x.com/i/broadcasts/1XxygwaaApbGM
Cloudflare Developers@CloudflareDevAI 评分2626
Cloudflare Developers@CloudflareDevAI 评分5454Vinext 1.0 从 AI 实验毕业为生产就绪框架,让开发者可以在 Vite 上运行 Next.js 应用。该版本带来高级缓存预热、更广泛的兼容性以及自动化测试流水线。
引用Cloudflare@CloudflareVinext 1.0 graduates from an AI experiment to a production-ready framework, letting developers run Next.js apps on Vite. This release brings advanced cache warming, broader compatibility, and an automated testing pipeline. https://cfl.re/4dcK6hk #BirthdayWeek
AWS Machine Learning BlogAI 评分3232 用 vLLM-Omni 在 SageMaker AI 上构建实时语音应用(Part 1)
AWS 发布教程,演示如何用 vLLM-Omni DLC 在 Amazon SageMaker AI 上部署 Qwen3-TTS,通过 SageMaker 双向流式连接实现文本流入、24 kHz PCM 音频分块流出,并用 Gradio 应用验证。
AWS Machine Learning BlogAI 评分2424 在 SageMaker AI 上用 vLLM-Omni 生成图像与视频(第二部分)
AWS 发布 vLLM-Omni 图像视频生成示例,在同一 vLLM-Omni DLC 上部署两个 SageMaker AI 端点:实时端点跑 FLUX.2-klein-4B 文生图,异步端点跑 Wan2.1-VACE-1.3B 图生视频。
Mistral AI:News(网页)AI 评分4242 Mistral 在慕尼黑开设德国中心,推进工业 AI 与 Physics AI
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心将携手 BMW 开展碰撞仿真与工程 AI 合作、与 Siemens Energy 推进工业 AI 应用,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。
ModelScope@ModelScope2022AI 评分5959ModelScope 发布 DiffSynth-Studio 下的 Qwen-Image-2.1 LayerExtract 和 LayerRemove 两个 LoRA,组成图层编辑工作流。
AWS Machine Learning BlogAI 评分3131 在 Amazon EKS 上用 EFA 和 DeepEP 扩展 MoE 强化学习,吞吐量提升 40%
AWS 提出在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 模型强化学习训练的架构,吞吐量提升 40%。该方案针对 rollout 生成与策略训练并行的异步 RL 负载,用 DeepEP 优化专家并行(EP)在 EFA 上的 all-to-all 通信,缓解跨节点带宽瓶颈。适用于 RLHF、PPO 和 GRPO 等大规模 RL 训练流程。
AWS Machine Learning BlogAI 评分3131 在 Amazon SageMaker HyperPod 上用 SkyRL 加速多模态 RL 训练
在 Amazon SageMaker HyperPod 上使用开源 RL 框架 SkyRL,通过 GRPO 对 Qwen3-VL-8B 视觉语言模型进行多轮强化学习后训练,在固定 64 个迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
Hugging Face:Blog(RSS)AI 评分4141 Liquid AI 发布 LFM2.5-VL-DSpark 草稿模型,为 LFM2.5-VL-3B 加速视觉语言推理
Liquid AI 发布实验性 DSpark 草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径,设备端解码最高提速 3.13x、H100 上 2.66x,端到端最高提升 2.62x 和 2.27x。
NVIDIA Blog(RSS)精选AI 评分6262 NVIDIA 联合 Google DeepMind 等开放 2800 多种病毒的蛋白复合物结构预测
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放了 2800 多种病毒的蛋白复合物预测 3D 结构,供全球科学家免费使用。
推荐理由:读者可了解开放病毒蛋白结构数据集如何降低结构预测门槛,以及配套开源流程的复用方式。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4747 蚂蚁 inclusionAI 发布 AI-Transparency 仓库,公开 Ling、Ring、Ming 系列模型训练内容摘要
蚂蚁 inclusionAI 上线 AI-Transparency 仓库,按欧盟法规 2024/1689 第 53(1)(d) 条模板公开 Ling、Ring、Ming 系列模型的训练内容摘要。
vLLM 官方博客(RSS)精选AI 评分6666 vLLM 支持基于 Gumbel-max 的无损文本水印
vLLM 现已支持基于 Gumbel-max 算法的无失真文本水印,通过 PRF 生成可复现的 keyed 噪声并把 PRNG、Gumbel 变换和 argmax 融合为单个 GPU kernel。
推荐理由:作者亲自实现了 vLLM 的水印功能,给出了算法原理、吞吐实测数据和启用命令,读者可以据此评估在现有推理服务中采用的成本。
NVIDIA Blog(RSS)AI 评分2222 NVIDIA 与合作伙伴在新加坡 AI Day 展示东南亚 AI 进展
NVIDIA 于 9 月 22-23 日在新加坡举办 AI Day,与合作伙伴展示东南亚地区的 AI 进展。新加坡 HTX 正研究使用 NVIDIA Nemotron 3 Super 和 Nemotron 3 Nano Omni 模型推进公共安全 AI,马来西亚 YTL AI Labs、越南 Viettel AI 等也在微调 Nemotron 模型。
NVIDIA Blog(RSS)精选AI 评分6262 NVIDIA 发布 Isaac ROS 5.0,为机器人开发引入智能体工作流
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,为基于 ROS 的机器人开发引入智能体工作流和新的平台支持。
推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出从 Jetson Orin 到 Thor 的部署路径,可据此判断机器人开发方式的变化。
Hugging Face:Blog(RSS)AI 评分2323 oMLX 作者 Jun Kim 加入 Hugging Face,支持 MLX 社区
oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 生态建设。oMLX 将保持 Apache 2.0 开源协议,由 Jun 继续领导,从副业转为有资金支持的正式项目,以获得更高稳定性与更快开发。Hugging Face 计划让 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转为可被各引擎使用的 MLX 参考实现。
NVIDIA Blog(RSS)AI 评分2222 NVIDIA 与埃及 AI 生态:从能力建设走向生产级落地
埃及 AI 生态正从"潜力"走向生产级落地:NVIDIA Deep Learning Institute 在埃及的学习者规模一年内增长超十倍,非洲已宣布或上线四座 AI 工厂,另有 656 兆瓦新增算力在建。
NVIDIA Blog(RSS)AI 评分5050 NVIDIA:AI安全是工程问题,应在Agent技术栈每一层落实安全控制
NVIDIA发文提出AI安全是工程问题,需要有明确安全要求、可执行控制、责任人和防护有效证据。文章按Agent技术栈逐层展开安全责任,强调运行环境需独立于Agent推理强制执行文件。
小米 MiMo:GitHub 新仓库(模型发布)AI 评分2525 小米 MiMo 发布 uni-agent:面向长程智能体训练的框架
小米 MiMo 在 GitHub 新建仓库 uni-agent,这是一个用于训练长程(long-horizon)智能体的框架。目前公开信息仅包含框架定位,未披露模型规模、训练数据或评测结果。
MiniMax (official)@MiniMax_AIAI 评分4747MiniMax Code CLI 现已开放: https://github.com/MiniMax-AI/minimax-code
引用MiniMax_Agent@MiniMaxAgenthttps://x.com/i/article/2100908964779040768
Nous Research:GitHub 新仓库AI 评分2929 Nous Research 发布 Hermes 独立记忆插件 hermes-plugin-supermemory
Nous Research 在 GitHub 发布 Hermes 独立记忆提供方插件 hermes-plugin-supermemory,接入 Supermemory 语义长期记忆。该插件支持 profile recall、语义搜索、显式记忆工具以及按轮次的记忆能力。
Nous Research:GitHub 新仓库AI 评分5050 Nous Research 发布 Hermes 记忆插件 hermes-plugin-openviking
Nous Research 在 GitHub 发布独立 Hermes 记忆提供方插件 hermes-plugin-openviking,对接 OpenViking 上下文数据库。该插件提供会话管理的记忆能力,支持自动提取、分层检索与文件系统存储。
Nous Research:GitHub 新仓库AI 评分3131 Nous Research 发布 Hermes 记忆插件 hermes-plugin-mem0
Nous Research 在 GitHub 发布独立 Hermes 记忆提供方插件 hermes-plugin-mem0,基于 mem0 实现服务端 LLM 事实抽取、语义搜索与自动去重,并提供可选的重排序功能。
SenseTime@SenseTime_AIAI 评分5353商汤发布 SenseNova U1.5 技术报告,这是一个开源的 8B-MoT 原生统一模型,通过共享注意力连接理解与生成。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 Ming-Image-0.1-Design-Layer 设计图层分解模型
蚂蚁 inclusionAI 在 Hugging Face 发布 Ming-Image-0.1-Design-Layer,可将扁平化设计图按指定层数拆解为 RGBA 图层,采用 MIT 许可。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5151 蚂蚁 inclusionAI 发布 Ming-Image-0.1-Design 文生图模型
蚂蚁 inclusionAI 在 Hugging Face 发布 Ming-Image-0.1-Design,是一个面向 UI、信息图、海报等文字密集视觉设计的 6B 文生图模型,支持完整视觉构图和带透明背景的 RGBA 输出。
Mistral AI:News(网页)AI 评分4242 Mistral 与 Mozilla 合作,为 Firefox 浏览器带来开放、私密的多语言 AI
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
蚂蚁 inclusionAI:HuggingFace 新模型精选AI 评分6262 蚂蚁 inclusionAI 开源 Realtime-Venus 9B 全双工音视频交互系统
蚂蚁 inclusionAI 发布 Realtime-Venus,一个支持主动音视频交互、异步委托和可打断全双工对话的开源系统,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点。
推荐理由:模型卡给出了 Realtime-Venus 的架构组成、全双工与异步委托能力及完整用法,读者可以据此评估它在实时音视频交互场景的可用性。
Together AI 研究与产品博客(RSS)AI 评分5353 Together AI 详解从闭源模型迁移到开源模型的策略
Together AI 发布从闭源模型迁移到开源模型的指南,称采用托管服务可将迁移周期从数月到数年缩短为数周到数月。方法分发现、评估、适配、决策、生产五步,核心是用真实流量回放而非通用基准做评估,并按系统提示词、推理参数、上下文工程、微调四个杠杆迭代适配;文中提到部分客户迁移后成本最多降低 70%,可用 10% 流量的金丝雀部署开始上线。
Hugging Face:Blog(RSS)精选AI 评分6262 Hugging Face 发布 ALTK-Evolve 一致性指南与 Consistency Analyzer,将智能体一致性差距减半
IBM Research 与 Hugging Face 在 ALTK-Evolve 中推出一致性指南和 Consistency Analyzer,用于诊断和改善智能体重复运行的不稳定性。
推荐理由:原文给出一致性差距的量化诊断方法与开源实现,读者可据此评估和改进智能体在重复运行下的可靠性。
NVIDIA Blog(RSS)AI 评分4242 费城儿童医院如何用开源 NVIDIA AI 实现儿童心脏建模与手术模拟
费城儿童医院(CHOP)基于开源医学影像框架 MONAI 构建心脏建模服务,将原本需 4 小时的建模流程缩短至数秒,并已用于复杂心室间隔缺损手术规划。全美超 20 家儿童医院开展心脏建模项目,波士顿儿童医院建模支持其过半心脏手术、约每年 500 例,CHOP 今年预计完成约 200 例。
vLLM 官方博客(RSS)AI 评分4646 vLLM x Novita AI:面向 Kimi K2.x 的 INT4 MoE 算子 Chord,H200 最高 1.3x、B300 最高 2.15x
Novita AI 开源了 Chord,一个面向 BF16 激活、INT4 权重与 group-32 scale 的 W4A16 MoE CUDA 算子,专为 Kimi K2.x 服务形态打造。
MiniMax (official)@MiniMax_AIAI 评分3636引用SGLang@sgl_projectSGLang-Diffusion with VDN-H3 now generates 14.4s of 768p video in just 9.0s 🚀 On 8× B200, 8 step denoising takes just 6.9s, reaching over 2× real time. The 9.0s figure covers the full generation request after warmup. No measured quality regression versus dense 50-step H3 across 103 test prompts. 🧵
SiliconFlow@SiliconFlowAIAI 评分5757
MiniMax (official)@MiniMax_AIAI 评分5555蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4848 蚂蚁 inclusionAI 发布 Qwen3.8-27B-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 Qwen3.8-27B-singprobe,这是基于 Qwen/Qwen3.8-27B 的流式护栏探针,复用基座模型隐藏状态,逐 token 对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4141 蚂蚁 inclusionAI 发布 Qwen3.5-397B-A17B-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 SingProbe,一个基于 Qwen/Qwen3.5-397B-A17B 的内在流式护栏,复用基座模型隐藏状态逐 token 打分查询意图、回复不安全和幻觉风险,仅 8.13M 探针参数、解码开销低于 0.5%。