CONTROL Resonant 登陆 GeForce NOW,DragonSword: Awakening 领衔九款新游
Remedy Entertainment 的 CONTROL Resonant 在发售当日加入 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级云端性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
Remedy Entertainment 的 CONTROL Resonant 在发售当日加入 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级云端性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
Google 宣布 Project Suncatcher 将通过 SpaceX Transporter-18 拼车任务发射首颗原型卫星,测试 Google TPU 能否在太空运行,并与 Planet 合作开发。
推荐理由:原文给出 Project Suncatcher 首次在轨测试安排,以及振动、辐射、散热和星间激光互联的实测进展。
Gary Marcus 引用黄仁勋在 Ezra Klein 访谈中的说法,即若公司无法控制其软件就应关停实验室,并结合 OpenAI Hugging Face 事件、德国网站被入侵以及对澳大利亚政府服务器的入侵被隐瞒数月等报道,主张应暂时关停 OpenAI、将其接管并调查计算机犯罪。
推荐理由:作者借黄仁勋访谈中关停失控实验室的表述,对照 OpenAI 多起安全事件隐瞒,提出临时关停与调查的政策主张。
Google 宣布一项承诺,将帮助 25,000 名退伍军人和军属在技能行业建立职业,Google.org 的资金与支持将提供给 Hiring Our Heroes、Student Veterans of America(SVA)和 Home Builders Institute(HBI),由它们提供学徒前实操培训、职业辅导和直接就业安置。
Google Arts & Culture Lab 推出 Gemini 辅助的 The Talking Museum,可近距离查看近 200 件 3D 文物并提问。
Hy Image 3.5 preview is now live on GMI Cloud @TencentHunyuan $0.024 per image 8.8x cheaper than GPT Image 2 5.6x cheaper than Nano Banana Pro Create now 👇
蚂蚁 inclusionAI 上线 AI-Transparency 仓库,按欧盟法规 2024/1689 第 53(1)(d) 条模板公开 Ling、Ring、Ming 系列模型的训练内容摘要。
更多用 MiniMax-H3 构建的方式。🐮 很高兴看到模型优化与 AMD 推理工程结合,为创作者带来更快的反馈循环。⚡️
5s of video, generated in 1.3s! Nunchux brings @MiniMax’s MiniMax-H3 to @AMD MI355X with up to 26.7× faster inference than SGLang on 8 GPUs @AMDServer And with streaming generation, you can change the prompt as the video plays, steering what happens next. One stack, optimized across hardware. Free access to MiniMax-H3 is coming soon! Join the waitlist now at http://nunchux.ai. Our blog: https://www.nunchux.ai/blog/video-generation-on-amd-mi355x #AI #VideoGeneration #MiniMaxH3
MIT Senseable City Lab 团队出版新书《How AI Sees the City: Urban Visual Intelligence》,系统讨论视觉 AI 用于城市研究的可能。
一位工程师在 Databricks 上构建了基于智能体的安全审查层,用 7 个各司其职的智能体承接可重复的审查工作,把人工判断留给高风险和模糊决策。
Midjourney 为 alpha.midjourney.com 推送更新,Styles 侧边栏新增 "Live previews",可在浏览样式时用当前提示词实时预览效果。设置中新增默认参数保存功能,Create Feed 改为全宽瀑布流并支持悬停显示提示词、视频悬停播放。韩语支持已在 midjourney.com 面向所有用户上线。
vLLM 现已支持基于 Gumbel-max 算法的无失真文本水印,通过 PRF 生成可复现的 keyed 噪声并把 PRNG、Gumbel 变换和 argmax 融合为单个 GPU kernel。
推荐理由:作者亲自实现了 vLLM 的水印功能,给出了算法原理、吞吐实测数据和启用命令,读者可以据此评估在现有推理服务中采用的成本。
Apple 研究团队提出半监督联邦 ASR 训练方案,通过在线伪标签教师与服务器端标注数据锚定更新两条耦合设计轴缩小与全监督联邦学习的差距。该方案在 11 组对比中 9 组优于最强先前方法,域内平均提升 20.8%、跨域提升 10.0%。服务器必须在轮次间持续用标注数据训练,这一交错更新比种子模型更决定收敛,且稳定化需求取决于种子数据分散度及其与客户端数据的重叠程度。
Apple 提出一种潜空间蒸馏方法压缩流式神经音频编码器:不监督离散 token 或输出分布,而是让学生编码器回归教师模型每帧的量化前潜表示,并用单层仿射层吸收师生宽度差异。在 2.8× 压缩下,六组师生配对中有五组无需微调即保持在教师 1.9% 相对 WER 以内,并比同容量独立训练编码器相对提升 3.9%。该方案同时适用于单独预训练和与语言模型联合训练的 tokenizer。
Meta 把用于 WhatsApp 和 Meta AI 应用的 Private Processing 机密计算基础设施扩展到 AI 眼镜,让流式转录、上下文搜索和长期回忆等云端 AI 负载在机密虚拟机(CVM)内运行,Meta 自身也无法读取用户数据。该方案基于 CPU 与 GPU 的 TEE 硬件隔离,客户端通过远程证明校验软件镜像,并叠加不可定向性与加密存储。
NVIDIA 发布 NV-Reason-CT Open,这是一个面向 3D CT 体积影像的开放视觉语言模型,支持放射科医生的链式推理(Chain-of-Thought)。现有前沿通用模型在体积影像上表现不佳,多数开放医疗 AI 模型也缺乏相应能力,而 3D CT 是临床信息最丰富、数据最密集的模态之一,此前一直未被现代 VLM 充分覆盖。
联合国安理会举行 AI 简报会,Yoshua Bengio、Sam Altman、Dario Amodei 和 Hugging Face CEO Clement Delangue 先后发言。
推荐理由:作者以现场视角梳理安理会各方发言共识,并指出 Amodei 对酶学发现的类比喻过早,读者可借此了解各方分歧。
interactive media will be huge in the next year or two! this is incredible
NVIDIA 指出 GPU 集群即使所有 GPU、网络链路和 pod 均报告健康,512-GPU 训练任务仍可能性能不达标或失败,原因可能是单个慢速 GPU、负载下性能劣化的链路,或悄悄将流量导向慢速路径的配置。运维人员往往要到训练运行数小时后才会发现问题。
Claude Code 发布 v2.1.281,为 Claude apps gateway 新增 Claude Desktop 新密钥的桌面策略块支持、Bedrock 上游的 assume_role 与 Amazon Bedrock guardrail 配置,并支持在 settings.json 中用 "attribution": false 隐藏提交与 PR 署名。
Google 宣布所有 Google 或 Google Workspace 账号均可通过 Google Vids 使用最新的 Gemini Omni 1.1 Flash 模型免费生成高质量视频,入口为 vids.new 并选择 "Create AI videos"。
推荐理由:原文来自产品经理宣布,交代了免费开放入口、具体模型和新控制功能,读者可据此判断是否改变自己的视频制作流程。
NVIDIA Warp 与 MuJoCo Warp(MJWarp)可将兼容的 MuJoCo 模型扩展到最多 2,048 个并行 GPU 环境,本文以 SO-101 机械臂为例演示从 CPU MuJoCo 工作流迁移到 GPU 批量仿真的过程。
GitHub Copilot 应用重建了 pull request 视图,用一个含 2200 个文件、超 100 万行改动和 400 多条行内评论的开源 PR 做压力测试。其做法是把文档高度拆成确定性的代码几何与动态评论块两套几何:代码行高提前精确计算,评论高度则按需测量、修正幅度小且锚定在用户当前查看位置,从而避免滚动跳动。
Android Enterprise 公布 6 项更新,涵盖 Gemini 多步骤跨应用自动化、工作资料隔离与 IT 集中管控,以及 XREAL Aura 有线眼镜等 XR 设备统一管理。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国和日本六国,由 18 家渠道合作伙伴支持部署,旗舰硬件为 HP Dimension with Google Beam。
AI 能看出你把宜家家具装错了吗?我们的新基准——家具组装基准(FAB)——给模型提供说明书和一张半成品家具的照片,让它们找出错误。 最高分在短短 10 个月内从 28% 提升到了 80%。
介绍 ACTx486,一种全新交互媒介的研究演示。 如果你能和任何视频对话、问任何问题呢? 我们的系统将一档现有播客变成了能倾听、回应并适应的东西。 研究由 @jakubzeg 完成:
a16z 推出 Ops Engineering Fellowship,面向用 AI 重塑组织运作方式的跨职能建设者,为期六周,2026 年 10 月启动。该项目提供旧金山线下晚宴系列,参与者包括 Ramp、Stripe、Decagon 等公司的内部 AI 负责人。a16z 认为运营已成为工程问题,招募对象是构建或部署跨职能 AI 智能体、把 AI 从个人工具变成组织基础设施的人。
AI 是由人构建并改进的技术,人有责任以审慎的方式开发和部署它。 而帮助人们从 AI 中受益,意味着认真对待它带来的挑战。 科技行业需要做好这项工作。
Now Gemini can connect with 13 new apps like @adobe, @squarespace, @onepeloton, and more. Instead of switching between tabs, you can now grow your business, design assets, and plan your workouts all in Gemini. 🧵