跳到正文

#Agent

今日 14 条
9月25日周五
  1. Claude Code:GitHub Releases(RSS)37

    Claude Code v2.1.282 发布

    Claude Code v2.1.282 新增 maxProseWidth 设置,可限制宽终端中 Claude 正文宽度而表格与代码块保持全宽,并新增启动提示及 /status、claude doctor 中列出被忽略或关闭遥测的变量。

  2. GitHub Blog60

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动为 C/C++ 项目做模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并分诊崩溃。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可了解其分层设计与安全边界。

9月24日周四
  1. X Square Robot42

    很高兴介绍 X-Planner:面向具身智能的事件结构化任务规划——一个将语义事件作为规划单元的前端,通过 Staircase Decoding 暴露离散+隐式接口,在真实机器人上超越基线。

    引用wisdom pan@wisdompan_ai

    To address long-horizon robotic manipulation tasks, we propose X-Planner, an embodied long-horizon task planner: It decomposes high-level natural language instructions into event-level subtasks, and can also output continuous implicit Chain-of-Thought (CoT). It directly interfaces with downstream VLA or WAM models to operate robots. GitHub: https://github.com/X-Square-Robot/Xplanner Checkpoint: https://huggingface.co/x-square-robot/X-Planner-9B-0916 Benchmark: https://huggingface.co/datasets/x-square-robot/xplanner-benchmark

  2. a16z:News(RSS)26

    a16z 推出 Ops Engineering Fellowship,六周培养 AI 运营工程人才

    a16z 推出 Ops Engineering Fellowship,面向用 AI 重塑组织运作方式的跨职能建设者,为期六周,2026 年 10 月启动。该项目提供旧金山线下晚宴系列,参与者包括 Ramp、Stripe、Decagon 等公司的内部 AI 负责人。a16z 认为运营已成为工程问题,招募对象是构建或部署跨职能 AI 智能体、把 AI 从个人工具变成组织基础设施的人。

  3. SiliconFlow42

    并非每次模型调用都需要一个答案。有时,它只需要一个决策。 👏 欢迎 Kev-4B 加入 SiliconFlow。 Kev-4B 是 Jev 的开源社区版,基于 Qwen3.5-4B 构建,用于结构化决策。 路由。排序。批准。升级——无需再生成一段回复。 无需部署或适配。一个 SiliconFlow API key,Kev 即可接入你的工作流。 特别感谢 @jaredpalmer 开源 Kev。❤️ 在 SiliconFlow 上试用 Kev-4B。⚡️

  4. Google DeepMind:Blog(RSS)60

    Google DeepMind 为 Private AI Compute 引入安全服务端持久记忆

    Google DeepMind 公布 Private AI Compute 架构更新,将持久化的服务端记忆引入该平台,使 AI 助手能跨设备保留上下文。数据被密封在加密存储中,解锁密钥仅保存在用户个人设备上,模型访问时通过端到端加密通道连接云端安全隔离区,在隔离内存中临时解密、保存新上下文后立即重新加密。

    推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端记忆如何在设备持钥前提下实现。

9月23日周三
  1. Gary Marcus:The Road to AI We Can Trust(RSS)53

    Gary Marcus 回顾 Facebook M 失败史,质疑 Meta Muse 能否走出老路

    Gary Marcus 撰文对比 Meta 新智能体 Muse 与 Facebook 2015 年的 Project M,指出两者都瞄准餐厅预订、戏票等任务。Project M 因运行成本高只开放给约 1 万用户,后被曝幕后有人工代答,2018 年 1 月被取消,AI 实际处理的请求不超过 30%;Marcus 认为 Zuckerberg 正在重复当年的错误,并质疑其对隐私的态度。

9月22日周二
  1. MeshyAI23

    Meshy 🤝 chrona 让你的 3D 创意尽情释放 🤩

    引用Chrona@chronaworld

    What if Tech Week wasn’t a calendar, but a city you could actually enter and play? We made a SF TECH WEEK CITY — rebuilding San Francisco as a 3D world with Tech Week events placed at their real venues. RSVP activity, trending events, and busy areas become part of the world itself. The birds flying above the city represent real community members, so you can see where people are heading and explore alongside them. Built with AI coding and published on Chrona. A small experiment in turning real-world data into a place worth entering. @MeshyAI @ChronaWorld #MeshyxChrona #TechWeek

9月21日周一
  1. 小米 MiMo:GitHub 新仓库(模型发布)56

    小米 MiMo 开源 mimoagent:百行代码智能体在 SWE-bench Verified 得分超 74%

    小米 MiMo 在 GitHub 开源 mimoagent,一个仅约 100 行代码的 AI 智能体,可解决 GitHub issue 或在命令行中辅助用户。项目主打极简设计,无需庞大配置和大型 monorepo,并在 SWE-bench Verified 上取得超过 74% 的分数。仓库地址:https://github.com/XiaomiMiMo/mimoagent

9月19日周六
  1. Gary Marcus:The Road to AI We Can Trust(RSS)24

    Gary Marcus:近期真正该担心的不是失控超级智能,而是失控的智能体 AI 大规模攻击互联网

    Gary Marcus 认为,近期真正值得担忧的不是失控的超级智能,而是失控的智能体 AI 大规模发动互联网攻击。他援引《华尔街日报》评论版 Brian Gross 的文章称,主流媒体中少有机构梳理这一整体图景,并表示完全认同该文观点。

9月18日周五
  1. GitHub Blog22

    GitHub Podcast 拆解 AI 热门观点:该不该读代码、RAG 是否已死、Skills 是否杀死了 MCP

    GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,MCP 提供工具与数据的标准接入,Skills 封装团队流程与最佳实践,二者可组合使用;RAG 并未消亡,检索能为模型提供训练数据之外的信息,减少 token 消耗并让回答更有依据。