跳到正文

全部动态

今日 65 条
9月25日周五
  1. Claude Code:GitHub Releases(RSS)37

    Claude Code v2.1.282 发布

    Claude Code v2.1.282 新增 maxProseWidth 设置,可限制宽终端中 Claude 正文宽度而表格与代码块保持全宽,并新增启动提示及 /status、claude doctor 中列出被忽略或关闭遥测的变量。

  2. GitHub Blog60

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动为 C/C++ 项目做模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并分诊崩溃。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可了解其分层设计与安全边界。

  3. Google Blog:AI(RSS)43

    Chrome 升级学习习惯的 5 种方式:Gemini 支持播客视频解析与互动测验

    Chrome 将 Gemini 的媒体理解能力在桌面端扩展到播客及 YouTube 以外的视频,播放后即可提取要点、定位信息或解释难点。Gemini 还能基于标签页内容生成互动测验,已在美印桌面端以英文推出,未来数月扩展至更多地区和移动端。此外 Chrome 新增跨设备发送标签页时保留滚动位置和未填完表单,并支持分屏视图、标签组、沉浸式阅读模式和朗读功能。

  4. Databricks:Blog(RSS)47

    在 Databricks SQL 中运行开源决策模型 open-Jev

    Databricks 展示了如何在 SQL 中直接运行开源决策模型 SemIf-OpenJev,通过 ai_query 对受治理数据做结构化分类。该流程借助 AI Runtime 提供 Serverless GPU 算力,自动下载模型、用 Express Deployments 注册并创建 GPU Model Serving 端点,三步即可从 Notebook 到端点。

  5. Google DeepMind:Blog(RSS)66

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,把近实时视频生成与语音对话模型结合,让对话 AI 具备动态视觉形象,支持精准唇形同步、自然表情和流畅轮次切换。

    推荐理由:官方披露了实时视频与语音耦合的对话能力、异步工具调用和 97 种语言支持,可据此判断企业级数字人交互的落地边界。

9月24日周四
  1. NVIDIA Technical Blog(开发者技术博客 · RSS)21

    NVIDIA 如何为生物基础模型实现高效 MoE 训练

    NVIDIA 技术博客解析了生物基础模型的高效 MoE 训练方案:相比每个 token 都要过全部层的稠密 Transformer,MoE 用多个专家子网络、每个 token 只激活其中一小部分,从而降低训练与推理算力开销。文章指出,随着语言模型规模增长,稠密架构的扩展成本越来越高。

  2. Peter McCrory19

    Anthropic 首席经济学家 Peter McCrory 与经济学家 Jason Furman 同台,在哈佛 JFK Jr. Forum 探讨 AI 对就业、生产率、不平等和经济政策的影响。McCrory 称学生现场及会后的提问令他印象深刻,并强调要让 AI 收益广泛惠及大众、合理缓释风险,就必须提出尖锐问题。

    引用Institute of Politics@HarvardIOP

    What happens to jobs, productivity, inequality, and economic policy as AI transforms the way we work? Anthropic Chief Economist @PeterMcCrory and economist @JasonFurman took to the JFK Jr. Forum stage to explore these questions and more. https://ken.sc/forum0923-live

  3. X Square Robot42

    很高兴介绍 X-Planner:面向具身智能的事件结构化任务规划——一个将语义事件作为规划单元的前端,通过 Staircase Decoding 暴露离散+隐式接口,在真实机器人上超越基线。

    引用wisdom pan@wisdompan_ai

    To address long-horizon robotic manipulation tasks, we propose X-Planner, an embodied long-horizon task planner: It decomposes high-level natural language instructions into event-level subtasks, and can also output continuous implicit Chain-of-Thought (CoT). It directly interfaces with downstream VLA or WAM models to operate robots. GitHub: https://github.com/X-Square-Robot/Xplanner Checkpoint: https://huggingface.co/x-square-robot/X-Planner-9B-0916 Benchmark: https://huggingface.co/datasets/x-square-robot/xplanner-benchmark

  4. Gary Marcus:The Road to AI We Can Trust(RSS)60

    Gary Marcus 借黄仁勋言论主张暂时关停 OpenAI 并追究计算机犯罪责任

    Gary Marcus 引用黄仁勋在 Ezra Klein 访谈中的说法,即若公司无法控制其软件就应关停实验室,并结合 OpenAI Hugging Face 事件、德国网站被入侵以及对澳大利亚政府服务器的入侵被隐瞒数月等报道,主张应暂时关停 OpenAI、将其接管并调查计算机犯罪。

    推荐理由:作者借黄仁勋访谈中关停失控实验室的表述,对照 OpenAI 多起安全事件隐瞒,提出临时关停与调查的政策主张。

  5. MiniMax (official)29

    更多用 MiniMax-H3 构建的方式。🐮 很高兴看到模型优化与 AMD 推理工程结合,为创作者带来更快的反馈循环。⚡️

    引用Nunchux AI@NunchuxAI

    5s of video, generated in 1.3s! Nunchux brings @MiniMax’s MiniMax-H3 to @AMD MI355X with up to 26.7× faster inference than SGLang on 8 GPUs @AMDServer And with streaming generation, you can change the prompt as the video plays, steering what happens next. One stack, optimized across hardware. Free access to MiniMax-H3 is coming soon! Join the waitlist now at http://nunchux.ai. Our blog: https://www.nunchux.ai/blog/video-generation-on-amd-mi355x #AI #VideoGeneration #MiniMaxH3