跳到正文

NVIDIA 英伟达

英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力市场的风向。

最新精选

第 1–20 条 · 共 22 条
9月30日周三
  1. LMSYS:Blog(Chatbot Arena 团队)72

    SGLang 和 Miles 实现 NVIDIA Nemotron 3 Ultra Day-0 支持

    SGLang 和 Miles 宣布对 NVIDIA Nemotron 3 Ultra 提供 Day-0 支持。该模型为开源 MoE 混合 Transformer-Mamba 架构,总参数 550B、激活 55B,上下文最长 1M tokens,支持 NVFP4 与 BF16 权重,面向长程自主智能体优化。

    推荐理由:原文给出架构、部署配置和 RL 训练细节,读者可以据此评估该模型在长程智能体场景的可用性。

  2. LMSYS:Blog(Chatbot Arena 团队)63

    SGLang 与 Miles 为 Qwen3.8-2.4T-A95B 提供 Day-0 支持

    SGLang 团队宣布与 Qwen、阿里百炼、NVIDIA 和 AMD 合作,在 SGLang 和 Miles 中于发布当日支持 Qwen3.8-2.4T-A95B,这是千问最大的开源模型,总参数 2.4T、每 token 激活 95B。

    推荐理由:原文给出 Qwen3.8 混合注意力架构的推理支撑细节和实测性能数字,读者可据此评估新模型在自建推理栈上的部署可行性。

  3. Tomer Tunguz 博客(VC 分析)77

    Google Cloud Q2 2026 营收增长 82% 至 248 亿美元,增速趋同 NVIDIA 数据中心业务

    Google Cloud 2026 年 Q2 营收 248 亿美元,同比增长 82%,超出 223 亿美元的市场预期,增速与 NVIDIA 数据中心业务趋于一致。

    推荐理由:作者用财报数据拆解 Google Cloud 增速与 NVIDIA 数据中心业务趋同的来源,并对比 AWS 利润率变化,提供了一个理解云厂商 AI 需求的视角。

  4. Tomer Tunguz 博客(VC 分析)72

    Tomer Tunguz 分析微软转售前沿模型:Azure 增长 43% 但利润结构与订单集中度承压

    Tomer Tunguz 分析三大云厂商增速分化:Azure 上季度增长 43%、全年收入超 1000 亿美元,Google Cloud 增长 82%,AWS 增长 28%。

    推荐理由:作者以三家云厂商的财报数据对比自建与转售前沿模型的经济结构,指出微软积压订单对 OpenAI 的集中依赖,提供了一个理解云厂商资本开支差异的框架。

  5. Tomer Tunguz 博客(VC 分析)70

    Tomer Tunguz 分析 AI 模型公司的每兆瓦收入与模型工厂逻辑

    文章引用 Dylan Patel 等人的观点分析 AI 模型公司按兆瓦计的单位经济:基础算力成本约 $10-15M/MW,Anthropic 2026 年收入达 $50M/MW,实现首个盈利季度,收入 $10.9B、营业利润 $559M。

    推荐理由:文章用每兆瓦收入和毛利数据拆解 AI 模型公司的单位经济,并解释推理利润如何反哺训练的工厂模式。

  6. LMSYS:Blog(Chatbot Arena 团队)76

    千问团队开源 Qwen3.8-Flash-Next,SGLang 提供 day-0 支持

    千问(Qwen)团队开源 Qwen3.8-Flash-Next,一个多模态 MoE 模型,被视为 Qwen4 架构的早期预览。模型总参数 125B 加 51B N-gram Embedding,每 token 激活 6B,48 层中含 36 层 GDN 线性注意力和 12 层 QSA 稀疏注意力,MoE 使用 512 专家 top-10 路由。

    推荐理由:原文给出该模型混合架构细节和 SGLang 的 day-0 推理支持数据,读者可以据此评估长上下文部署的实际收益。

  7. clem 🤗78

    Hugging Face CEO Clément Delangue 发文称在 NVIDIA 收购消息后收到数千条求职私信,因无法自动分析,需几天才能看完。他表示未获回复不代表负面评价,目前只聚焦特别匹配的人选,建议其他人通过 https://apply.workable.com/huggingface 申请具体职位,并称期待与更多人合作推动开源 AI。

    引用clem 🤗@ClementDelangue

    getting acquired by @nvidia = hugging face can now hire people we couldn't as a small startup and give them a decade to make open-source AI win! if you're one of them, my dms are open

    推荐理由:Hugging Face CEO 亲自回应招聘进展,说明收到的申请规模和未获回复者的正式申请渠道。

9月29日周二
9月24日周四
9月22日周二
9月3日周四
  1. Jensen Huang94

    NVIDIA 宣布收购 Hugging Face。Jensen Huang 表示开放模型可强化安全与网络安全、加速创新与扩散并支持主权,让开发者、初创、大学、行业和国家都能构建、定制并受益于 AI,并称 NVIDIA 将成为 Hugging Face、其社区和开放模型未来的好归宿,官方详情见 https://blogs.nvidia.com/blog/nvidia-to-acquire-hugging-face/。

    推荐理由:作者亲述收购立场,并给出官方博客链接,读者可借此了解其对开放模型生态价值的判断。

8月17日周一
  1. Jensen Huang83

    NVIDIA 宣布与 SB Energy 合作,在俄亥俄州 Portsmouth 的 PORTS-Pike 技术园区锁定土地、电力与厂房(LPS)产能,供 OpenAI 建设和运营 AI 工厂,初始部署预计提供 4.25GW 容量,可支持多代 NVIDIA 系统升级,每代约对应 150 万块 GPU、1500亿至2000亿美元 NVIDIA 收入。

    推荐理由:NVIDIA 首方说明担保结构与规模边界,读者可据此评估这一模式的商业逻辑与风险敞口。

7月29日周三
7月22日周三
  1. vLLM 官方博客(RSS)68

    vLLM 预告 Kimi K3 生产级支持:2.8T 参数、1M 上下文与 KDA 前缀缓存方案

    vLLM 发布 Kimi K3 生产级支持的预览博客,正与 Moonshot AI、NVIDIA、AMD 等推进最终集成,计划在 2026 年 7 月 27 日权重发布时提供 day-0 开源服务,包括模型实现、Docker 镜像和部署方案。

    推荐理由:vLLM 团队详解 KDA 混合架构带来的前缀缓存改造与内核优化,对部署混合注意力模型的工程团队有可迁移参考价值。