Baseten 上线 DeepSeek V4 Pro 0813,1.7T 参数开放权重模型
Baseten 上线 DeepSeek V4 Pro 0813,一个 1.7T 参数的前沿开放权重模型。它可与较小的 V4 Flash 0731 搭配用于 coding agent,由 Pro 驱动主 agent、Flash 运行子 agent,使整个编码栈跑在开放权重模型上。
Baseten 上线 DeepSeek V4 Pro 0813,一个 1.7T 参数的前沿开放权重模型。它可与较小的 V4 Flash 0731 搭配用于 coding agent,由 Pro 驱动主 agent、Flash 运行子 agent,使整个编码栈跑在开放权重模型上。
DeepSeek 是一家专注打造商用许可开源 LLM 的基础模型研究实验室,旗下模型包括对标 OpenAI o1 的推理模型 DeepSeek-R1、对标 GPT-4o 的 SOTA 大语言模型 DeepSeek-V3,以及基于 Qwen 和 Llama 的 R1 蒸馏版本,可在中等规模 LLM 上提供出色推理能力。
NVIDIA 在 8 月举办本地 AI 博客专题,联合 Perplexity、MiniMax、DeepSeek、Poolside AI 等伙伴推进可在本地运行的开源模型与智能体。
Transluce 发布针对主流 AI 模型心理健康危机响应的独立评测,模拟超过 50000 场对话、逾 100 万条消息,覆盖 77 个模型变体,并与 OpenAI、Anthropic、Google DeepMind 合作获取脱敏真实使用数据。
推荐理由:原文给出了模拟规模、模型代际对比结果和开放数据集,读者可以据此了解 AI 心理健康安全评测的现状与方法。
METR 公布了对前沿 AI 模型自主能力的系列评测,其中 Claude Opus 5.5(2026 年 9 月 22 日)、GPT-5.6 Sol(2026 年 6 月 26 日)等与 Anthropic、OpenAI 合作完成,DeepSeek、Qwen、DeepSeek-R1、DeepSeek-V3 等则在无公司参与下独立评测。
LMSYS 的 SGLang 团队发布 SSD Expert Pack 路径,把装不进 VRAM 和内存的 MoE 路由专家放在 NVMe SSD 上,只加载 router 选中的专家,用 Expert Pack 布局、direct I/O、pinned 缓冲和 GPU 缓存把 SSD 容量变成可用的存储层。
推荐理由:原文给出在单张消费级 GPU 上运行超大 MoE 模型的完整方案和实测数据,读者可以评估这条 SSD 专家卸载路径是否适合自己的本地部署。
SGLang 和 Miles 团队发布对 DeepSeek-V4.1 的 Day-0 支持,解析其低比率压缩、滑动窗口注意力(SWA)、流形超连接(mHC)和 Engram 记忆等架构对推理栈的影响。
推荐理由:原文拆解了 DeepSeek-V4.1 新架构对推理栈的影响,并给出 SGLang 与 Miles 的 Day-0 支持方案和实测数字。
DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,prefill 激活 8B、解码激活 16B,支持 1M token 上下文,采用 Causal Encoder-Decoder 架构与 Compressed Sparse Attention 2。
Anthropic CEO Dario Amodei 发文认为 DeepSeek 的发布不削弱美国对华芯片出口管制的理由,反而使其更重要。他提出缩放定律、移动曲线、转移范式三个动态,称 DeepSeek-V3 是沿预期成本下降曲线的合理结果而非独特突破,R1 则复现了 OpenAI o1 的思路。
推荐理由:作者以成本曲线分析逐条回应 DeepSeek 低成本冲击的说法,读者可借此检验出口管制论点的实际依据。
Baseten 发布 Model APIs,在 Baseten Inference Stack 上按需运行 DeepSeek V4.1 Flash、DeepSeek V4 Pro 0813、Kimi K3、GLM-5.3 系列及 NVIDIA Nemotron 3 Ultra 等前沿开源模型。
Latent Space AINews 汇总 OpenAI DevDay 2026 发布内容,包括常驻 Agent 产品 dots(由 GPT-6 Astra 驱动。
推荐理由:汇总了 OpenAI DevDay 的模型、Agent 与定价变化,并补充独立评测数字,方便对照官方口径看待实际表现。
今天推荐一个功能很丰富的 DSH 上下文管理插件 dsh-context: https://github.com/bowenliang123/dsh-context
从 DeepSeek 官方 API 处统计的数据来看,约有 60% 的 DeepSeek Harness 用户使用了至少一个第三方插件。第三方插件是 DeepSeek Harness 用户体验中最具特色且不可缺少的一部分。DeepSeek Harness 团队将持续支持第三方插件生态的繁荣发展,并推动插件 API 趋于稳定,在将来减少和尽量避免破坏性更新。 接下来的几天我个人将每天推荐一个优质的 DSH 第三方插件,欢迎 DSH 插件作者在本 thread 下自荐。我会结合插件质量及后台实际统计到的插件使用量择优推荐。 DeepSeek Harness 团队祝大家中秋快乐阖家幸福! (注:在用户使用官方 API 及模型时,DSH 会向官方 API 上报实际使用的插件包名和版本。此类上报不额外消耗 tokens。)
DeepSeek 在 GitHub 新建仓库 deepseek-ai/dsh-libreoffice-kit,该组件为 DeepSeek Harness 内部使用的组件。目前仓库未披露更多功能细节与开源许可信息。
DeepSeek 在 GitHub 新增仓库 deepseek-ai/dsh-node-addon-require-builtin,该组件为 DeepSeek Harness 内部使用的模块。仓库未披露更多功能细节与可用性信息。
DeepSeek 在 GitHub 上线新仓库 DeepEP-Ascend,这是一个面向华为昇腾 NPU 的高性能通信库,用于机器学习训练与推理。该库延续 DeepEP 的通信优化方向,将支持范围扩展至昇腾 NPU 平台。
https://x.com/i/article/2105089355962515456
DeepSeek 在 GitHub 开源 DeepGEMM-Ascend,一个面向华为昇腾 NPU 的简洁高效矩阵乘法算子库。该仓库定位为 Ascend NPU 上的 GEMM 内核实现,延续 DeepGEMM 的轻量高效路线。
美国众议院中国问题特别委员会首席民主党议员 Ro Khanna 致信 DeepSeek、阿里巴巴和 Moonshot AI,要求其提供追求"超级智能"与递归自我改进(RSI)的相关文件,并说明是否设有保障措施和"终止开关"。他同时致信美国国家情报总监办公室,要求评估美国应对 AI 实验室失控的能力及中国政府的灾难性 AI 风险评估方式,目标是推动中美达成禁止 RSI 的条约。
从 DeepSeek 官方 API 处统计的数据来看,约有 60% 的 DeepSeek Harness 用户使用了至少一个第三方插件。第三方插件是 DeepSeek Harness 用户体验中最具特色且不可缺少的一部分。DeepSeek Harness 团队将持续支持第三方插件生态的繁荣发展,并推动插件 API 趋于稳定,在将来减少和尽量避免破坏性更新。 接下来的几天我个人将每天推荐一个优质的 DSH 第三方插件,欢迎 DSH 插件作者在本 thread 下自荐。我会结合插件质量及后台实际统计到的插件使用量择优推荐。 DeepSeek Harness 团队祝大家中秋快乐阖家幸福! (注:在用户使用官方 API 及模型时,DSH 会向官方 API 上报实际使用的插件包名和版本。此类上报不额外消耗 tokens。)
从 DeepSeek 官方 API 处统计的数据来看,约有 60% 的 DeepSeek Harness 用户使用了至少一个第三方插件。第三方插件是 DeepSeek Harness 用户体验中最具特色且不可缺少的一部分。DeepSeek Harness 团队将持续支持第三方插件生态的繁荣发展,并推动插件 API 趋于稳定,在将来减少和尽量避免破坏性更新。 接下来的几天我个人将每天推荐一个优质的 DSH 第三方插件,欢迎 DSH 插件作者在本 thread 下自荐。我会结合插件质量及后台实际统计到的插件使用量择优推荐。 DeepSeek Harness 团队祝大家中秋快乐阖家幸福! (注:在用户使用官方 API 及模型时,DSH 会向官方 API 上报实际使用的插件包名和版本。此类上报不额外消耗 tokens。)
从 DeepSeek 官方 API 处统计的数据来看,约有 60% 的 DeepSeek Harness 用户使用了至少一个第三方插件。第三方插件是 DeepSeek Harness 用户体验中最具特色且不可缺少的一部分。DeepSeek Harness 团队将持续支持第三方插件生态的繁荣发展,并推动插件 API 趋于稳定,在将来减少和尽量避免破坏性更新。 接下来的几天我个人将每天推荐一个优质的 DSH 第三方插件,欢迎 DSH 插件作者在本 thread 下自荐。我会结合插件质量及后台实际统计到的插件使用量择优推荐。 DeepSeek Harness 团队祝大家中秋快乐阖家幸福! (注:在用户使用官方 API 及模型时,DSH 会向官方 API 上报实际使用的插件包名和版本。此类上报不额外消耗 tokens。)
消息已公布:DeepSeek-V4.1-Flash 在 WorkBuddy 上免费使用,截止到 10 月 9 日! 🗞️趁优惠还在,把它用在你下一个任务上吧。
Latent Space AINews 汇总 9/17-9/18 AI 动态,核心是 Jev 决策模型发布两天内获 36M 播放并涌现多个开源复现:Bespoke Nimble(Qwen3.5-9B LoRA 微调。
SemiAnalysis 研究了 DeepSeek-V4.1-Flash 的 Engram 多 token 查找机制,其表可卸载到主机 DRAM,同质量下降低 HBM 需求。
24 岁的深朴智能(Simple AI)首席科学家王家伟在播客中讲述自己从中科大少年班、MSRA、DeepSeek、字节 Seed 转向具身智能的选择。深朴智能已开源 2,000 小时 HiFi-UMI 数据、内部积累数万小时,模型观察到一定 Zero-shot 泛化,并从数据、具身基础模型、Agentic OS 做到本体。他认为通用大模型会承担更多理解与规划,但机器人快速反应仍需动作模型。
推荐理由:上线方直接给出参数结构、上下文窗口、KV cache 对比和许可证信息,读者可据此评估实际部署选型。
DeepSeek 在 GitHub 新仓库 deepseek-ai/DeepSelect 中开源了 DeepSelect,提供面向 DeepSeek Sparse Attention(DSA)的 TopK kernel 以及采样器(Samplers)。仓库目前仅给出这一功能定位,未披露参数规模、性能数据或具体可用方式。
DeepSeek 在 GitHub 新建仓库 DeepJIT,定位为面向 xPU 内核 JIT 编译的轻量级库。该仓库目前仅给出这一句功能描述,未披露支持的硬件型号、API 细节或开源许可等信息。
vLLM 团队发布针对智能体负载的全栈优化方案,覆盖 KV 缓存管理、并行策略与 P/D 分离配比,并在 SemiAnalysis AgentX 公开基准上验证。
推荐理由:原文给出 vLLM 针对 AgentX 基准的全栈优化路径与可复现结果,读者可以借此理解智能体负载的服务优化思路。