METR 与 RAND 的 Canary 项目获 The Audacious Project 约 3800 万美元资助
The Audacious Project 为 METR 与 RAND 合作的 Canary 项目促成约 3800 万美元资助,其中约 1700 万美元将支持 METR 的工作。Canary 专注于开发和部署评估方法,以监测 AI 系统的危险能力。METR 将用这笔资源评估前沿 AI 系统作为自主智能体的能力,并支持企业、政府及研究伙伴运行这些测试。
The Audacious Project 为 METR 与 RAND 合作的 Canary 项目促成约 3800 万美元资助,其中约 1700 万美元将支持 METR 的工作。Canary 专注于开发和部署评估方法,以监测 AI 系统的危险能力。METR 将用这笔资源评估前沿 AI 系统作为自主智能体的能力,并支持企业、政府及研究伙伴运行这些测试。
METR 发布博文,介绍其保护非公开模型访问和专有信息的保密与安全措施,包括六级保密分级、动物代号(如 playful-panda)指代非公开模型、Slack 与文档前缀标注,以及 FIDO2 认证、VPN 加 SSO、私有 VPC 和 SIEM 监控等控制。这些措施帮助 METR 获得 SOC 2 Type I 认证,相关做法截至 2026 年 2 月 17 日有效。
METR 在近 6 个月获得约 7100 万美元资助承诺,用于研究自主能力、追踪递归自我改进、评估监控系统、开展风险评估和调查 AI 事件等项目。METR 表示未接受前沿 AI 公司资助,也不接受其员工捐赠,但这些公司为其评测、研究和工程提供大量免费 token。
MIT Transit Lab 获 Google.org 210 万美元资助,将开发公共交通智能中枢 PTIQ,把公交机构的实时监控、运营控制与乘客沟通系统整合为单一 AI 编排平台。
LlamaIndex 正在招聘,邀请人才加入其不断壮大的团队。文中列出公司文化原则:目标导向、信息透明、快速辩论与行动、以钢人化思维假设他人善意,以及主动优于被动。文中还强调做正确的事比做安全的事更重要,并对 AI 保持热情。
LlamaIndex 的使命是自动化知识工作,从最难的前沿——文档入手,打造全球最强的智能体文档 OCR,把杂乱的多模态文档转化为结构化、可靠的数据。通过 LlamaAgents,开发者与企业可围绕文档构建从摄取、抽取到推理与自动化的可靠工作流。团队规模虽小,但强调交付经过深思、可靠且可扩展的生产级产品。
Liquid AI 公布 upcoming events 日程,将在全球科技行业活动上亮相,时间覆盖 2026 年 10 月 6 日、10 月 14 日、10 月 23–24 日、10 月 23–25 日以及 2027 年 3 月 7–10 日。官方表示,若你也会到场,可与其取得联系。
Liquid AI 发布 LFM2.5-VL-DSpark,用于在边缘设备及更广场景加速视觉语言模型。该模型属于 LFM2.5 系列,此前同系列已推出 LFM2.5-DSpark,实现从 H100 到 MacBook 最高 3.2 倍推理加速。
Liquid AI 开放 18 个研究与工程岗位,包括 ML 研究工程师、GPU 性能工程师、分布式训练工程师、多模态音频、推理系统与 GPU 基础设施等方向,工作地点为旧金山、波士顿、远程或混合办公。另有 4 个应用岗(后训练、音频、视觉、RecSys)和 1 个产品与监管副总法律顾问岗。所有 LFM 模型均可免费下载、运行和微调。
Liquid AI 是一家效率优先的基础模型公司,由 MIT CSAIL 分拆出的四位创始人 Ramin Hasani(CEO)、Mathias Lechner(CTO)、Alexander Amini(CSO)和 Daniela Rus 创立,目标是构建在各规模上都高效、通用、对齐且可信的 AI 系统。其产品强调算力与成本优化,可在任意设备和媒介上部署智能。
Liquid AI 上线 Discord 社区服务器,目前显示 507 人在线、4,879 名成员。该服务器提供文字与语音频道,支持自定义反应、嵌入内容和机器人,用户可随时进出频道而无需通话或邀请。
Liquid AI 公布其黑客松系列活动回顾与日程,开发者围绕 Liquid Foundation Models 构建端侧应用。已举办的 6 场活动覆盖东京、旧金山及线上,涉及 LFM2.5、LFM2.5-VL、LFM2-VL 与 LEAP,可在 AMD Ryzen AI PC、AMD NUC 及 iOS、Android 应用上部署。目前日历上暂无新黑客松,可留邮箱等待通知。
Instagram 宣布其独立 Edits 应用新增 AI 创作助手,可调取用户账号的点赞、观看、留存和分享等数据,回答热门趋势、内容表现差异等问题,并给出选题、脚本、文案、音频等方面的建议。
据 The Information 报道,Google 启动试点计划,按内容对 AI Overviews、AI Mode 和 Gemini 的贡献程度向出版商付费,约 100 家出版商参与。一位早期加入的出版商一年获得超过 100 万美元,另一位加入数月的获得约 5 万至 6 万美元。该计划推出之际,Google 正面临出版商诉讼及英国和欧盟监管机构对其 AI 搜索影响流量的审查。
Meta 发布 Muse AI 智能体,宣称可帮用户处理邮件、在线购物等任务,用户需交出数据甚至信用卡才能使用。此后 Meta 宣布了类似电子宠物的 Muse Charm 配件、面向企业的 Muse Enterprise Platform、Mac 应用和智能眼镜支持,并修补了一个可让攻击者控制该智能体的漏洞;Amazon 屏蔽了 Muse 智能体。
Goodfire AI 发布 Silico 平台使用条款,界定客户访问和使用其 AI/ML 模型理解、测试、评估、改进、引导、监控与对齐平台的权利义务。条款明确 Customer Materials、Goodfire IP、Usage Data、Workflow Data 等定义,并授予客户非独占、不可转让的内部业务使用权。
柏林初创公司 Restate 获 2000 万美元 A 轮融资,由 Singular 领投,Redpoint Ventures 和 Capital One Ventures 参投。
Cerebras Systems CEO 兼联合创始人 Andrew Feldman 将在 TechCrunch Disrupt 2026 的 Disrupt Stage 发表“Can AI Keep Scaling?
斯坦福 Marlowe 超算配备 248 块 NVIDIA H100 GPU、31 个计算节点,横跨全部七所学院服务 190 多个研究组,30 天平均分配率 95%,累计交付 315 万 GPU-hours。
Phylo 在 Fireworks 上部署开源权重模型,实现月环比用户增长 2 倍、成本降低 60%,大部分流量已转向开源模型,首 token 时间约减半。其 Biomni Lab 是首个集成生物学环境,智能体单次任务可运行数小时至数天、调用数百次工具,新开源模型可在 24 小时内上线生产。
Cursor 宣布通过 AIUC-1 智能体安全、安全性和可靠性认证,认证由 Schellman 开展独立审计,并在数千个场景中对智能体进行对抗性测试,覆盖 IDE 和云端智能体的规则、钩子和 Auto-review 等防护措施。
Epoch AI 提供联系表单,用户可就研究问题或请求填写姓名、邮箱、主题和留言,主题选项包括 General、Consultations、Press、Data、Math、Careers。该页面还引导用户了解其定制研究与咨询服务,并可通过订阅获取最新动态。
Epoch AI 推出按主题组织的导航页面,汇总 AI 发展轨迹各领域的数据、图表与分析。内容覆盖训练算力、硬件、算法与能源等驱动力,AI 在基准测试和真实任务中的能力进展,以及 AI 对经济、劳动力和全球力量格局的影响。
Epoch AI 建议捐赠者通过 every.org 进行捐赠,所有款项将以非限制性捐赠形式转交给 Epoch AI,平台不向 Epoch 收费,但部分捐赠类型可能扣除交易手续费。Epoch Artificial Intelligence, Inc. 的使命是开展并传播关于人工智能发展轨迹与影响的科学研究,以支持更好的政策与决策。
Epoch AI 开放定制研究合作,可承接 AI 趋势报告、模型评测、数据收集与基准开发等项目,曾与 OpenAI 合作开发 FrontierMath、与 Google DeepMind 合著 Rosetta Stone 论文、与 EPRI 联合发布 AI 电力需求研究。
Epoch AI 是一家成立于 2022 年的非倡导性研究非营利机构,追踪 AI 进展驱动因素、评测 AI 能力并预测其对经济与社会的影响,合作方包括英国科学、创新与技术部、Google DeepMind、OpenAI 和 EPRI。
Epoch AI 正在招聘研究员/高级研究员、基准测试软件工程师、设计负责人、IT 与安全专员、网站产品经理、招聘专员,以及新媒体系的短视频制作人和撰稿编辑。研究员岗位旨在加深社会对 AI 能力及其发展轨迹的理解,基准测试工程师将负责运行和维护评测基础设施并参与开发全新 benchmark。此外还开放特殊项目助理等意向申请通道。
Epoch AI 公开其资金来源与合作方名单,仅列出 7 万美元以上的捐赠,包括 Coefficient Giving、Survival & Flourishing Fund、Jaan Tallinn、Leopold Aschenbrenner 等;合作方涵盖 Google DeepMind、OpenAI、Anthropic、xAI、英国科学创新与技术部及 METR 等。
Epoch AI 公布其团队构成,由 CEO Jaime Sevilla 和 COO María de la Lama 领导,成员包括多名高级研究员、研究工程师、软件工程师及数据科学家。团队设有董事会与顾问委员会,并称其研究受 OpenAI、DeepMind 及各国政府人士关注。
Epoch AI 是一家独立非营利机构,成立于 2021 年,最初由志愿者收集和分析数百个机器学习模型的数据,2022 年发布训练算力趋势论文后正式组建团队。该机构系统追踪 AI 训练算力、推理算力扩展、ML 硬件、投资、GPU 集群与 AI 数据中心等数据,并开展独立模型评测,创建了 FrontierMath 基准。
Epoch AI 测算,自 2023 年以来,达到同等 AI 性能水平的成本在数学、科学和技巧类游戏五项基准上平均每季度下降约 47%,约合每年 13 倍,降速超过电力、算力、电池和 DNA 测序的历史降幅。该机构还指出,美国 GDP 增长因统计遗漏 Nvidia 在美国产生的收入而被低估约 0.3 个百分点,到 2028 年这一缺口可能扩大至 2 个百分点。
Epoch AI 数据显示,arXiv 数学预印本中承认使用 AI 的比例从 2026 年 4 月的 4% 升至 8 月的 25%,其中 6% 称 AI 有实质性研究贡献。美国成年人中每周至少 6 天使用 AI 的比例在六个月内从 8% 升至 19%。Epoch AI/Ipsos 调查还显示,67% 从事计算机、工程和科学工作的 AI 用户使用雇主提供的 AI。
Epoch AI 分析显示,自 2024 年年中以来,最大 AI 数据中心 IT 电力容量纪录每 10 个月翻一番。2025 年第四季度全球 AI 数据中心总电力容量约达 30 GW,相当于纽约州峰值用电量。GPU 约占前沿 AI 数据中心电力消耗的 40%。
Epoch AI 的 AI Data Centers 数据库已覆盖 86 个站点、约占全球 AI 算力的 44%,并同步更新了界面与全球覆盖范围。其研究显示,自 2024 年中期以来,最大 AI 数据中心的 IT 电力容量纪录每 10 个月翻一番;一座典型 1GW AI 数据中心需 380 亿美元前期 CapEx 和 9 亿美元年 OpEx。
Epoch AI 更新了覆盖 170 多款 AI 加速器的机器学习硬件数据,并发布报告估算华为 2026 年 AI 算力产量不足 Nvidia 的 4%,若无法获得外国内存,2028 年份额可能降至约 1%。其 AI 数据中心探索器现已覆盖 86 个站点、约占全球 AI 算力的 44%,同时贸易数据分析显示 2024–25 年存在约 30 亿美元芯片经马来西亚流入中国的迹象。
Epoch AI 评估,受美国出口管制限制最关键扩产手段,华为 2026 年 AI 算力产量不足 Nvidia 的 4%,若无法获得外国存储,2028 年这一份额可能降至约 1%。该机构还估计,截至 2025 年约有 29 万至 160 万 H100 等效算力(中位数 66 万)被走私至中国,约占中国总算力的三分之一。
Epoch AI 的财务数据库用财报与公司披露估算 AI 芯片的算力、功耗与支出,并追踪超大规模厂商的 AI 建设融资。其测算显示,微软、亚马逊、Alphabet、Meta、Oracle 的合计现金资本开支预计在 2026 年 Q3 超过经营现金流;HBM 占 AI 芯片组件成本的 63%,高于 2024 年 Q1 的 52%。
Epoch AI 更新了其 AI 公司数据库,涵盖前沿 AI 主要参与者的收入、融资、员工和算力数据,并推出 AI Chip Users Explorer,首次展示五家领先实验室的算力使用估算(以 Nvidia H100-equivalents 计)。
Epoch AI 数据显示,自 2026 年 1 月以来,最强开源权重模型平均落后前沿闭源模型约 4 个月,即 8 个 ECI 分。该机构此前测得这一差距在 2025 年 10 月约为 3 个月。其 IKEA 家具组装基准上,AI 模型得分 10 个月内从 28% 升至 80%,开源权重模型落后闭源约 7 个月。
Epoch AI 的公开数据库已追踪 1950 年至今超过 3600 个机器学习模型,并发布多项扩展性研究。其测量显示 GPT-5.6 Terra 和 Sol 的首次 token 延迟随上下文长度呈二次增长,而 Claude Sonnet 5 和 Opus 5 接近线性。此外,全球 AI 芯片内存带宽年增 4.1 倍,2025 年 Q4 已达约 7000 万 TB/s。