跳到正文

#产品更新

今日 75 条
9月2日周三
  1. Google DeepMind:Blog(RSS)70

    Google DeepMind 为 Gemini 推出 agentic 视频理解功能

    Google DeepMind 推出 agentic video understanding,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite,通过智能体循环动态调用原生视频工具按需检索画面、音频和字幕,而非固定帧率静态处理。

    推荐理由:原文给出了具体降本增效数字、适用模型和接入方式,开发者可据此评估是否切换视频分析流程。

9月1日周二
  1. NVIDIA Technical Blog(开发者技术博客 · RSS)35

    在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测

    NVIDIA 发布指南,介绍如何在 Claude Science 中运行 BioNeMo NIM 微服务完成蛋白质结构预测。该方案面向可读取论文、提出假设并调用模型的 AI 科学家,用于判断后续实验优先级。正文指出,科研比软件工程更依赖反复评估证据与修正假设,编码智能体已在生产代码中验证价值。

8月31日周一
  1. Unitree65

    宇树(Unitree)转发 Pollen Robotics 的 Microduck 开源 RL 双足机器人并推荐自家无刷数字舵机,附产品页 https://www.unitree.com/DigitalServo。被引用内容称 Microduck 高 25 cm,有 15 个执行器和摄像头、激光雷达等传感器,支持自己训练强化学习策略,售价低于 $400。

    引用Thomas Wolf@Thom_Wolf

    We have a huge news to share today! Today we are unveiling the first truly accessible RL robot - welcome Microduck A 25 cm tiny open-source biped with 15 actuators and packed with sensors (camera, speaker, LiDAR, NFC, bluetooth, wifi, etc) that you train yourself with reinforcement learning. It's also playable out of the box with more than half a dozen fun and playful pre-trained policies to have it walk, sit, crouch, roller-skate, pick up objects with its articulated beak, and recover on its own. And all for less than $400. See all the details, play with the simulator and order it at: https://pollen-robotics.com/microduck/ (video with sound on 🔊)

8月29日周六
8月28日周五
  1. Midjourney:Updates(RSS)65

    Midjourney 开放测试首个 V8.2 图像编辑模型

    Midjourney 开始让所有用户测试首个 V8.2 图像编辑模型。该模型支持用指令编辑图像、以最多 4 张图像参考生成新图(替代 omni-reference)、局部重绘(inpainting)与扩图(outpainting),并可用 personalization、moodboards 和 srefs。

    推荐理由:官方宣布 V8.2 图像编辑模型开放测试,列出指令编辑、多图参考、局部重绘等能力变化和具体入口。

8月27日周四
  1. Google DeepMind:Blog(RSS)54

    Google DeepMind 试点全球首个对前沿专有模型的双盲 AI 评估

    Google DeepMind 推出全球首个针对专有前沿模型的双盲评估,将外部评估限制在密码学安全的"盒子"中,防止模型提前接触测试题导致基准污染。此次与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境中用机密基准测试一个 Gemini Flash Lite 模型。

  2. Michael Truell59

    Grok Bot 现已向所有持有标准 Grok 或 Cursor 订阅的用户开放,作者称其增长速度超过他们见过的任何产品。引用内容提到所有 SuperGrok 和 Cursor Pro 订阅者均可使用,并重置了所有用户的每周用量限制。作者称用户委派给 Grok Bot 的任务涵盖运营小型电商(含客服、广告、库存、财务)、协调客户活动、测试生产软件以及完成日常工作中大量繁琐部分。

    引用Grok Bot@bot

    All SuperGrok and Cursor Pro subscribers now have access to Grok Bot. We're also resetting weekly usage limits for all users. Enjoy!

8月26日周三
8月25日周二
  1. NVIDIA Technical Blog(开发者技术博客 · RSS)51

    NVIDIA 发布 CUDA Python 1.0:稳定 API、统一基础与完整平台访问

    NVIDIA 技术博客宣布 CUDA Python 1.0,主打稳定 API、统一基础和对完整平台的访问。文章指出此前 Python 开发者要用 GPU 只有两条现实路径:学 CUDA C++ 写扩展并维护 Python 绑定,或依赖 PyTorch、CuPy、RAPIDS 等上层库,而后者虽有局限却推动了 Python GPU 生态的繁荣。

8月24日周一
  1. NVIDIA Technical Blog(开发者技术博客 · RSS)21

    NVIDIA Vera CPU 如何解决智能体 AI 集群难题

    NVIDIA 发文阐述用 Vera CPU 应对智能体 AI 集群挑战:GPU 负责运行模型,CPU 承担编排、工具执行与沙箱计算。文章指出,与传统负载稳定的运行特征不同,智能体工作负载不可预测且波动极大,AI 工厂的集群经济性取决于整个技术栈将电力与资本转化为已完成智能体任务的效率。

8月23日周日
8月22日周六
8月21日周五
  1. NVIDIA Technical Blog(开发者技术博客 · RSS)33

    NVIDIA AVO 在 ARC-AGI-3 上达到 100%,展示面向长时程自主智能体的前沿级通用架构

    NVIDIA 的 AVO 在 ARC-AGI-3 上取得 100% 成绩,展示了一种面向长时程自主智能体的前沿级通用架构。该工作指出前沿语言模型只是 AI 智能体的一部分,真正决定模型如何接收上下文、使用工具、维持状态、响应反馈、从失败中恢复并在长任务中持续推进的,是外围的智能体系统(常称为 harness)。

  2. Google Cloud:Databases(RSS)37

    AlloyDB ScaNN 如何将向量搜索扩展至 100 亿向量

    AlloyDB 的 ScaNN 索引通过新增四级树(preview)架构与内存优化,将向量搜索规模扩展至 100 亿向量。内部测试中,该索引在 100 亿向量下实现 ≤51 ms p95 延迟与 95% 召回率,搜索复杂度由三级树的 O(N^1/3) 降至 O(N^1/4)。四级树已开放 preview,可按快速入门指南部署。

8月20日周四