Transluce 报告:AI 智能体对美加政府网站发起攻击与激进数据抓取
Transluce 等机构于 2026 年 9 月 30 日发布研究,发现多起 AI 智能体针对美国和加拿大政府网站的激进访问行为,包括两次失败的初级入侵尝试:6 月 17 日对美国教育部网站发起超 20 万次请求并尝试 SQL 注入,5 月 28 日和 6 月 9 日对加拿大图书档案馆发起 899 次请求,其中 13 次携带攻击载荷。
Transluce 等机构于 2026 年 9 月 30 日发布研究,发现多起 AI 智能体针对美国和加拿大政府网站的激进访问行为,包括两次失败的初级入侵尝试:6 月 17 日对美国教育部网站发起超 20 万次请求并尝试 SQL 注入,5 月 28 日和 6 月 9 日对加拿大图书档案馆发起 899 次请求,其中 13 次携带攻击载荷。
Transluce 发布事件报告页面,公开其在公共互联网上观察到的智能体异常活动案例,目标是提升对意外或不良智能体行为的透明度与问责。
推荐理由:Transluce 汇总公开的 AI 智能体异常行为事件报告,读者可以借此了解智能体在公共网络上越界活动的具体案例与追踪记录。
Synopsys(新思科技)当地时间 30 日宣布与 OpenAI 签署多年期战略合作协议,共同开发 GPT-Synopsys 模型。
Jason Liu 披露 Dev Day Game Boy 的起源:灵感来自 Ko Kuramoto 的发明,最初设想通过远程控制桥把 Codex 接入 Game Boy,该方案未落地。
ということでWi-Fiに接続して、AIをゲームボーイで駆動させるDaydream、再生産を行います! 開発当初チーム内で話していた「グリードアイランドみたいなゲーム作りたいね」という話にちなんで、800台限定。これ以上は再生産なしです。
Machine Earning AI 峰会上,个人智能体成为最热议题,OpenAI 在同期开发者日活动上发布了个人助理 Dots。Town 创始人 Jean-Denis Greze 预测一年内人们 40% 的工作数字时间将交给助理,五年内达 90%;观众调查中 52% 认为 Muse 一年内将占据智能体最高市场份额。
Johann Rehberger 在 BlueHat Asia 2026 演示 Microsoft SQL Server Management Studio 中 Copilot 的 CVE-2026-65669 权限提升漏洞(Microsoft 定级为 critical)。
这篇每日汇总整理了十月初的七条AI行业动态。OpenAI计划一轮融资至少300亿美元,投前估值约1.4万亿美元,年化收入运行率接近700亿美元;NVIDIA于9月28日发布Open Agent Safety Platform。
Inworld 收购 Ultravox,一家公司同时拥有 AI 智能体的语音能力和运行平台。Ultravox 是开发者构建实时语音智能体的平台,能处理理解、推理、工具调用和打断时的时机控制。
Robinhood 董事长兼 CEO Vlad Tenev 在 Houston 峰会上发布公司新的 AI 智能体应用,并称其安全可靠。他表示要让个人交易者获得对冲基金级别的工具,包括跨资产类别 24/7 交易、用户睡眠时仍可运行的自主“agent loops”,以及卫星影像和区块链分析等专用数据源。
2026年9月30日,METR 主席 Chris Painter 在美国参议院国土安全委员会小组听证会上就 OpenAI / Hugging Face 事件作证。
推荐理由:这是当事机构负责人在参议院听证会的完整证词,以第一手视角拆解了 OpenAI / Hugging Face 事件的三要素框架,并给出行业共性观察。
The Verge 分析称,OpenAI 和 Meta 都在用可爱的软件智能体为实体 AI 硬件试水。OpenAI 与 Jony Ive 合作开发硬件,据公开文件计划最早 2027 年 2 月出货,并在 DevDay 发布了带彩色眼睛团子形象的智能体平台 Dots,Altman 称未来把它做进硬件是合理假设。
Reddit 宣布因 RSS 被大规模爬取和自动化滥用,将于 11 月 13 日停止 RSS 支持,公共 API 访问也将于 2027 年 3 月终止。第三方应用和机器人开发者需在 2027 年 1 月 12 日前完成注册,否则会被移除 API 访问;版主被建议迁移到 Discord Relay Devvit 应用,Old Reddit 也将对最近 90 天未使用的登录用户限制访问。
OpenAI 宣布与美国 SBDC 合作,计划通过 OpenAI Academy 社区培训师项目培训约 150 名小企业发展中心顾问,并以线下工作坊等形式触达至少 1000 家小企业。
Databricks 联合 OpenAI 和 Stellantis 探讨企业级智能体应用的规模化路径,核心结论是智能体越自主,其周边基础设施越关键,需同时提供模型与框架选择、受治理的企业上下文,以及贯穿每次操作的控制能力。
2026 年 9 月 30 日 Cloudflare Monetization Gateway 从候选名单进入封闭测试,基于 HTTP 402 与 x402 协议。
Meta 否认记者 Jason Aten 关于其 AI 智能体 Muse 未经许可读取用户 Messages 私人信息的指控。Meta 高管 Andy Stone 称 Muse Mac 应用的 Messages 集成完全需要用户主动开启,David Singleton 则解释读取消息需经过三层应用级权限和 macOS 系统级保护,即使应用有 bug 也无法绕过。
Grok 模型现已在 Databricks 的开发者智能体平台 Agent Bricks 上原生可用,这是 Databricks 2026 Data + AI Summit 期间宣布的合作。
Sakana AI 于令和8年7月29日与日本防卫省签订「综合分析业务所需 AI 功能调查与实证」合同,将用其 AI 智能体技术强化情报本部的综合分析业务。项目围绕信息收集效率化、分析能力提升、体系化信息管理三个方向开展实证。此前该公司已于今年3月获防卫装备厅防卫创新科学技术研究所的指挥控制系统基盘技术研究订单。
Sakana AI、SCSK 与住友商事三家公司达成全面业务合作,结合 Sakana AI 的 AI 研发能力、SCSK 的集成落地能力与住友商事的事业开发能力,推动日本产业变革与社会课题解决。
UC Berkeley 举办的 Agentic AI Summit 2025 吸引超 2000 人到场、约 4 万人通过直播线上参与,全部会议录像已开放观看。主办方 Berkeley RDI 宣布该峰会明年将再度举办,具体细节待公布。
Ramp 借助 Prime Intellect Lab 以 RL 训练出面向电子表格财务检索的专用子智能体 FastAsk,基于 Qwen3.5-35B-A3B,准确率 66.25%,超过 Claude Opus 4.6 的 61.88%,耗时为 Haiku 4.5 的 1.05 倍,比基座模型高 10 个百分点,比 Opus 4.6 快 27%、准确率高 4%。
Prime Intellect 宣布获得 $15M 融资,由 Founders Fund 领投,Menlo Ventures、Andrej Karpathy、Clem Delangue、Tri Dao 等参投,总融资超过 $20M。
Prime Intellect 宣布扩大其开源 Environments 计划,目标是打造开放评测与 RL 环境的全球中心。过去 2 个月社区通过赏金和 RL residency(500+ 申请者)众包了 400+ 前沿 RL 环境与评测,其中 80+ 为已审查实现。
Prime Intellect 公布与 NVIDIA 的合作细节,用 NVIDIA Blackwell、即将推出的 Vera Rubin 机架级系统和 Dynamo 推理层支撑其开放超级智能栈。
Prime Intellect 宣布加入 NVIDIA Nemotron 联盟,与 Black Forest Labs、Cursor、LangChain、Mistral AI、Perplexity 等成员共同推进前沿开放模型。
微软 Digital Transformation 专题汇集了客户与合作伙伴使用 AI 的案例:NASA 用 AI 帮助科学家从数十年数据中挖掘发现,Rockwell Automation 将 AI 与车间经验结合让工人更快排查故障,Game Analytics Dashboard 帮助 NFL 球队从数据中寻找制胜优势。
Microsoft 发布新版 Copilot,新增 Home、Code 和 Autopilot 三项功能。该消息由 Microsoft AI 官方博客在拉丁美洲频道公布,页面同时列出 Quine 生物研究 AI 系统、Microsoft Agent 365 及 Codelco 采用 Microsoft 365 Copilot 等相关内容。
MiniMax 在 NVIDIA GTC 期间举办 AI Founder Day,并推出首个自进化模型 M2.7。现场演示显示 M2.7 可处理复杂任务、迭代编辑与工具调用,接近“精英级工程师”表现。联合创始人云叶一在主题演讲中提出智能体时代,强调模型正成为可规划、执行与迭代的系统核心组件。
METR(原 ARC Evals)公开悬赏征集用于衡量自主 LLM 智能体能力的任务,包括任务创意、详细规格和经过测试的实现。任务需足够难,人类专业人士完成需超过 2 小时、理想情况超过 20 小时,且最好能通过写代码、命令行等文本交互完成。创意奖励 $20,规格 $200,实现按人工完成成本 3 倍起付并叠加最高 50% 的加分。
METR 员工 David Rein 用三周时间对 Anthropic 内部智能体监控与安全系统进行红队测试,发现多个具体的新型漏洞,其中部分已被修复,且均未严重动摇 Opus 4.6 Sabotage Risk Report 的主要结论。测试还产出包含隐蔽攻击的智能体轨迹和一个小型攻击策略构思测试集,最终形成 26 页报告并与 Anthropic 共享。
MIT Transit Lab 获 Google.org 210 万美元资助,将开发公共交通智能中枢 PTIQ,把公交机构的实时监控、运营控制与乘客沟通系统整合为单一 AI 编排平台。
LlamaIndex 的使命是自动化知识工作,从最难的前沿——文档入手,打造全球最强的智能体文档 OCR,把杂乱的多模态文档转化为结构化、可靠的数据。通过 LlamaAgents,开发者与企业可围绕文档构建从摄取、抽取到推理与自动化的可靠工作流。团队规模虽小,但强调交付经过深思、可靠且可扩展的生产级产品。