全部AI 动态
全部动态
今日 395 条
🚨 AI News | TestingCatalog@testingcatalogAI 评分2222
Rohan Paul@rohanpaul_aiAI 评分4040引用Rulin Shao@RulinShao‼️The Bitter Lesson for context management: Giving LMs unrestricted control over their context beats human-designed SOTA! Introducing 🩵Context Language Models (CLMs)🩵 - Natively manage their own context - Treat context as a file - Learn policies in CLM weights, no harness
Rohan Paul@rohanpaul_aiAI 评分4949Google AI:DEV 作者专属(RSS)AI 评分4949 我拆开自己卖 5 美元的表格数了数:51 个公式,没有一个算 GPA
我把自己 5 美元的 Student Planner 表格解压成 XML 审计后发现,全工作簿共 51 个公式,SUMPRODUCT 出现 0 次,也没有任何 4.0 制换算,所谓"GPA 计算器"只是 Semester 表 F20 一个 AVERAGEIFS 平均公式,Credits 列仅作 ">0" 筛选条件而非权重。
Google AI:DEV 作者专属(RSS)AI 评分3838 智能体开始互相调用,却没人给它们开收据:Double-Oh 谈 agent-to-agent 的身份、授权与审计层
智能体框架正竞相实现 agent 互相调用,但今天的 agent-to-agent 调用只是 HTTP 上未签名的字符串,被调用方无从确认调用者身份、授权范围和实际执行结果。
Google AI:DEV 作者专属(RSS)AI 评分3737 我如何构建一个为 regex 绘制 Railroad 图并检测 ReDoS 的 VS Code 扩展
开发者发布 VS Code 扩展 Ghost Regex,用 Ctrl+Alt+R 打开面板,可将正则表达式渲染为带语义配色的 Railroad 图,并检测嵌套量词等 ReDoS 风险并给出修复建议。
Google AI:DEV 作者专属(RSS)AI 评分5757 Reton 开发者分享用 Interswitch llms.txt 改变 API 集成方式的实践
Reton 钱包创始人 Gabriel R Mogaji 分享如何用 Interswitch 发布的 llms.txt(docs.interswitchgroup.com/llms.txt)和文档 URL 加 .md 得到 Markdown 页面的约定,在 Cursor 中接入 Quickteller VAS 账单支付。
Google AI:DEV 作者专属(RSS)AI 评分5353 VEKTOR v1.9.8 发布:新增 Library 阅读器、80 多种格式转换和 Faraday 安全层
VEKTOR Memory 发布 v1.9.8,将本地优先的 AI 智能体记忆系统整合进单一 SDK,新增 Library 阅读模式、支持 80 多种格式转换的 Convert 标签页,以及会先请求用户批准的 Faraday 安全层。
Google AI:DEV 作者专属(RSS)AI 评分2929 产品图背景移除预设:2026 年的治理与例外处理
产品图背景移除应采用命名、带版本的转换预设来保证可复现,仅对无复用价值的孤立图片走直接处理。预设作为可审计、可下线的策略,需将源图、衍生输出与异步任务状态分开存储,并记录归属与生命周期。直接处理须限制可改参数、绑定源资产 ID 与请求方,并保留幂等键与人工复核,避免一次性例外变成未受控的策略分支。
Nathan Lambert@natolambertAI 评分2020很高兴看到 Google 用 Gemini 4 给人们带来惊喜。前沿领域有更多实验室,对消费者(竞争)和世界(减少权力集中)都是好事。期待看到它在真实场景中的表现。
AK@_akhaliqAI 评分2222LEGO-Anything 面向3D场景重建的编程智能体 论文:https://huggingface.co/papers/2609.36380

AK@_akhaliqAI 评分1616Omni-IO Skills 让你的智能体原生全能 论文:https://huggingface.co/papers/2609.31847

AK@_akhaliqAI 评分2626LongLive-Plug 面向视频生成的一次性通用蒸馏 论文:https://huggingface.co/papers/2609.38154

DogeDesigner@cb_dogeAI 评分5858
Runway@runwaymlAI 评分2828在一场深度问答中,Runway Research 团队探讨了实时模型、生成式界面以及机器人技术的下一步。

IT之家(RSS)AI 评分6868 谷歌发布 Gemini 4 Argon,DeepSWE 测试 77.9% 超 Claude Opus 5.5
谷歌于 9 月 30 日发布 Gemini 4 Argon,称其为迄今最先进的 AI 模型,重点面向长流程软件工程、企业知识工作和网络安全防御,单次输出上限约 100 万 tokens。
Arena.ai@arenaAI 评分4747引用vivago.ai (HiDream)@vivago_aiNew HiDream models just landed in vivago R1 Studio 🚀 Introducing: • HiDream-O1 Image 2.0 • HiDream-O1 Editing 1.5 • HiDream-O1 Video All three models are now available in vivago R1 Studio - bringing the latest HiDream image generation, editing, and video capabilities directly into your creative workflow. New models. New possibilities. Go make something the internet can’t ignore. 🔥
DogeDesigner@cb_dogeAI 评分4040
Dongxi 东锡 NLP@dongxi_nlpAI 评分3131
dex@dexhorthyAI 评分4141引用andre --dangerously-skip-permissions@andrezfuAgents write application code, but you still get paged at 2am when it breaks. We wanted to know whether AI could handle that part of the job too. Introducing Incident Arena: a benchmark that puts coding agents on call! Check out our paper & full dataset release below!
Runway@runwaymlAI 评分4343
Rohan Paul@rohanpaul_aiAI 评分6161Latent Space(RSS)AI 评分7171 Latent Space DevDay 访谈:Ari Weinstein 谈 Computer Use 巨变,OpenAI 一周内推出 Decisions API
Latent Space 在 OpenAI DevDay 当天发布访谈,OpenAI Computer Use 负责人 Ari Weinstein 称 Computer Use 已与数月前“180 度不同”。
The Decoder:AI News(RSS)精选AI 评分7676 Google 发布 Gemini 4 Argon,基准成绩逼近 OpenAI 和 Anthropic 但未明显领先
Google 发布新前沿模型 Gemini 4 Argon,是 Gemini 3.1 Pro 之后七个多月来的首款前沿模型。
推荐理由:文章汇总了独立测试与价格细节,读者可以据此比较 Gemini 4 Argon 与竞品的实际表现和成本。
Newcomer 新闻长文(RSS)AI 评分3636 Machine Earning AI 峰会:智能体商务与个人智能体的早期乐观情绪
Machine Earning AI 峰会上,个人智能体成为最热议题,OpenAI 在同期开发者日活动上发布了个人助理 Dots。Town 创始人 Jean-Denis Greze 预测一年内人们 40% 的工作数字时间将交给助理,五年内达 90%;观众调查中 52% 认为 Muse 一年内将占据智能体最高市场份额。
Simon Willison 博客AI 评分4040 Photo Scrubber:本地人脸模糊与元数据清除工具
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,全部在本地运行。
Bloomberg:Technology(RSS)AI 评分3434 Redpoint Ventures 的 Brescia 谈 Micron 第四季度业绩与 AI 前景
Redpoint Ventures 董事总经理、GitHub 前 COO Erica Brescia 在 Bloomberg "The Close" 节目中与 Romaine Bostick 讨论 Micron 第四季度业绩及 AI 前景。Micron 第四季度业绩超出已抬高的预期并高于指引,第一季度展望也高于市场预估。Brescia 就 AI 行业能否延续爆发式增长发表看法。
Bloomberg:Technology(RSS)AI 评分2525 Next Legacy 的 Ryan Nece 谈运动员投资的兴起
Next Legacy 的 Ryan Nece 在 Bloomberg "The Close" 节目中谈退役后如何配置资本,并回应是否把资金全部投入 AI。他表示采用多元化策略,通过基金中的基金和直接投资两个方向布局,已投资 Krizner 和 OpenAI 等公司。其客户包括高净值个人、运动员、网红,以及基金会、非营利组织和捐赠基金等传统机构投资者。
Bloomberg:Technology(RSS)AI 评分1818 Bloomberg《The Close》9 月市场回顾与 Micron 的 AI 热潮
Bloomberg《The Close》节目播出“September Market Recap & Micron’s AI Boom”,聚焦 Micron 在 AI 热潮中的表现与 9 月市场收官行情。
Johann Rehberger / Embrace The Red(RSS)AI 评分7575 SQL Copilot 只读绕过漏洞 CVE-2026-65669 可让低权限用户提权至 sysadmin
Johann Rehberger 在 BlueHat Asia 2026 演示 Microsoft SQL Server Management Studio 中 Copilot 的 CVE-2026-65669 权限提升漏洞(Microsoft 定级为 critical)。
Artificial Analysis 完整文章(网页)精选AI 评分7979 Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三
Artificial Analysis 评测 Google DeepMind 新模型 Gemini 4 Argon,其在 Artificial Analysis Intelligence Index 得 53 分,追平 GPT-6 Astra(max),高于 GPT-6.1 Sol(52),为 Google 超 7 个月来首个高于 Flash 档的专有模型。
推荐理由:第三方评测给出了智能指数、单位任务成本、幻觉率等多项横向数据,可用于比较 Gemini 4 Argon 与竞品的实际表现。
Apple Machine Learning Research(RSS)AI 评分4545 Apple 提出 SCLATE:面向持续学习智能体训练与评估的执行底座
Apple 研究团队提出 SCLATE,一个让基准测试与未经修改的智能体各自通过适配器向同一开放事件调度器注册事件的执行底座,用混合模拟时钟把长达一个月的场景压缩到数小时。
Google AI:DEV 作者专属(RSS)AI 评分4646 优化 Pull Request 评审:AI 辅助开发中如何平衡代码量与效率
AI 辅助开发让 PR 规模从过去几百行膨胀到 3200 行以上,评审者在 200-500 LOC 后认知疲劳加剧,容易漏掉 AI 生成代码中的边界情况与低效问题。文章指出 AI 生成代码 → 更大 PR → 认知过载 → 缺陷漏检 → 代码质量下降的因果链,并建议以 500 LOC 为阈值拆分 PR。
Google AI:DEV 作者专属(RSS)AI 评分5656 十月初AI行业七件事:OpenAI寻求1.4万亿美元估值、NVIDIA发布Open Agent Safety Platform、Google以Skills取代Gems
这篇每日汇总整理了十月初的七条AI行业动态。OpenAI计划一轮融资至少300亿美元,投前估值约1.4万亿美元,年化收入运行率接近700亿美元;NVIDIA于9月28日发布Open Agent Safety Platform。
Google AI:DEV 作者专属(RSS)AI 评分4949 Google Ads 在 Asset Studio 中集成 Veo 图生视频,加速 Demand Gen 与 PMax 创意制作
Google Ads 已将 Veo 图生视频能力集成进 Asset Studio,广告主可上传最多 3 张静态图片,每张生成一段最长 10 秒的独立视频,并通过广告模板打包为可投放素材。
Google AI:DEV 作者专属(RSS)精选AI 评分6666 TensorFlow.js 浏览器端超分优化:一次新张量形状为何耗时 8-17 秒,以及如何消除 40 秒页面冻结
作者分享在浏览器端用 TensorFlow.js on WebGL 做照片超分(不上传图片)的优化过程:初版用 UpscalerJS,1.2 MP 照片需 60-110 秒并冻结页面约 40 秒。
推荐理由:作者用自己浏览器端超分项目的实测数字,拆解了 WebGL 上张量形状触发着色器重编译等坑和对应修法。
Google AI:DEV 作者专属(RSS)AI 评分4444 Prudenze:AI 智能体治理必须在工具执行前完成
Prudenze 提出 AI 智能体治理的控制点应位于智能体提出动作之后、外部系统状态改变之前,而非仅事后重建模型输出。该模型将决策拆分为身份、授权、策略、证据时效、执行与可追溯六个问题,并在边界处给出 PERMIT、BLOCK 或 ESCALATE 三种结果。证据时效被细分为 CURRENT、STALE_REASONING 和 UNVERIFIABLE 三种状态,在每次执行前重新校验关键依赖。
Google Blog:AI(RSS)AI 评分5252 CDC 评估显示 Google AI 流感住院预测模型在 2025-26 赛季排名第一
CDC 宣布,在 2025-26 流感季 FluSight 39 个合规模型中,Google AI 构建的流感住院预测模型与实际观察到的住院数据吻合度最佳。FluSight 每周汇集政府、行业和学术团队对美国当周及未来三周住院人数的预测,用于沟通州级医疗服务需求。该预测使用了生成优化算法的 AI 工具 ERA,相关研究已发表于《Nature》,ERA 技术现已向受信任测试者开放。
Demis Hassabis@demishassabisAI 评分4040
DogeDesigner@cb_dogeAI 评分3434Grokipedia v0.3 概览: - 精选文章 - 搜索建议 - 文章 - 收听 / 分享 - 编辑历史 - 切换模式 - 建议编辑 - 最多阅读文章 - 实时在线编辑 - 建议文章
