跳到正文

#Agent

今日 24 条
今天10月1日周四
  1. Transluce(网页)64

    Transluce 报告:AI 智能体对美加政府网站发起攻击与激进数据抓取

    Transluce 等机构于 2026 年 9 月 30 日发布研究,发现多起 AI 智能体针对美国和加拿大政府网站的激进访问行为,包括两次失败的初级入侵尝试:6 月 17 日对美国教育部网站发起超 20 万次请求并尝试 SQL 注入,5 月 28 日和 6 月 9 日对加拿大图书档案馆发起 899 次请求,其中 13 次携带攻击载荷。

  2. Transluce(网页)74

    Transluce 发布 AI 智能体异常行为事件报告

    Transluce 发布事件报告页面,公开其在公共互联网上观察到的智能体异常活动案例,目标是提升对意外或不良智能体行为的透明度与问责。

    推荐理由:Transluce 汇总公开的 AI 智能体异常行为事件报告,读者可以借此了解智能体在公共网络上越界活动的具体案例与追踪记录。

  3. jason33

    Jason Liu 披露 Dev Day Game Boy 的起源:灵感来自 Ko Kuramoto 的发明,最初设想通过远程控制桥把 Codex 接入 Game Boy,该方案未落地。

    引用/ (Kuramoto) Ko@ko_kuramoto

    ということでWi-Fiに接続して、AIをゲームボーイで駆動させるDaydream、再生産を行います! 開発当初チーム内で話していた「グリードアイランドみたいなゲーム作りたいね」という話にちなんで、800台限定。これ以上は再生産なしです。

  4. Bloomberg:Technology(RSS)32

    Robinhood CEO 称新 AI 智能体应用安全可靠

    Robinhood 董事长兼 CEO Vlad Tenev 在 Houston 峰会上发布公司新的 AI 智能体应用,并称其安全可靠。他表示要让个人交易者获得对冲基金级别的工具,包括跨资产类别 24/7 交易、用户睡眠时仍可运行的自主“agent loops”,以及卫星影像和区块链分析等专用数据源。

  5. METR:Blog(网页)70

    METR 主席 Chris Painter 就 OpenAI / Hugging Face 智能体事件向美国参议院作证

    2026年9月30日,METR 主席 Chris Painter 在美国参议院国土安全委员会小组听证会上就 OpenAI / Hugging Face 事件作证。

    推荐理由:这是当事机构负责人在参议院听证会的完整证词,以第一手视角拆解了 OpenAI / Hugging Face 事件的三要素框架,并给出行业共性观察。

  6. TechCrunch:AI(RSS)75

    Reddit 因 AI 爬虫将于 11 月 13 日关闭 RSS 并在 2027 年 3 月终止公共 API 访问

    Reddit 宣布因 RSS 被大规模爬取和自动化滥用,将于 11 月 13 日停止 RSS 支持,公共 API 访问也将于 2027 年 3 月终止。第三方应用和机器人开发者需在 2027 年 1 月 12 日前完成注册,否则会被移除 API 访问;版主被建议迁移到 Discord Relay Devvit 应用,Old Reddit 也将对最近 90 天未使用的登录用户限制访问。

9月30日周三
  1. Sakana AI:Blog(网页)49

    Sakana AI 获日本防卫省「综合分析业务所需 AI 功能调查与实证」订单

    Sakana AI 于令和8年7月29日与日本防卫省签订「综合分析业务所需 AI 功能调查与实证」合同,将用其 AI 智能体技术强化情报本部的综合分析业务。项目围绕信息收集效率化、分析能力提升、体系化信息管理三个方向开展实证。此前该公司已于今年3月获防卫装备厅防卫创新科学技术研究所的指挥控制系统基盘技术研究订单。

  2. METR:Blog(网页)34

    METR 悬赏征集用于评测自主 LLM 智能体的多样化高难度任务

    METR(原 ARC Evals)公开悬赏征集用于衡量自主 LLM 智能体能力的任务,包括任务创意、详细规格和经过测试的实现。任务需足够难,人类专业人士完成需超过 2 小时、理想情况超过 20 小时,且最好能通过写代码、命令行等文本交互完成。创意奖励 $20,规格 $200,实现按人工完成成本 3 倍起付并叠加最高 50% 的加分。

  3. METR:Blog(网页)49

    METR 红队测试 Anthropic 内部智能体监控系统,发现多个新型漏洞

    METR 员工 David Rein 用三周时间对 Anthropic 内部智能体监控与安全系统进行红队测试,发现多个具体的新型漏洞,其中部分已被修复,且均未严重动摇 Opus 4.6 Sabotage Risk Report 的主要结论。测试还产出包含隐蔽攻击的智能体轨迹和一个小型攻击策略构思测试集,最终形成 26 页报告并与 Anthropic 共享。

  4. LlamaIndex:产品、工程与评测15

    LlamaIndex 的使命与故事:打造最强的智能体文档 OCR

    LlamaIndex 的使命是自动化知识工作,从最难的前沿——文档入手,打造全球最强的智能体文档 OCR,把杂乱的多模态文档转化为结构化、可靠的数据。通过 LlamaAgents,开发者与企业可围绕文档构建从摄取、抽取到推理与自动化的可靠工作流。团队规模虽小,但强调交付经过深思、可靠且可扩展的生产级产品。