跳到正文
10月1日 · 周四

当前热点

完整榜单
  1. 1Google DeepMind 发布 Gemini 4 Argon 前沿模型166 热度新
  2. 2OpenAI 发布 GPT-6.1 Sol 并在 Bedrock 上线79 热度
  3. 3OpenAI发布主动助手Dots59 热度
  4. 4白宫超级智能协议签署与争议50 热度
  5. 5Gemini 4 Argon 智能指数追平 GPT-6 Astra46 热度新

最新精选

今天10月1日周四
  1. Google AI:DEV 作者专属(RSS)66

    TensorFlow.js 浏览器端超分优化:一次新张量形状为何耗时 8-17 秒,以及如何消除 40 秒页面冻结

    作者分享在浏览器端用 TensorFlow.js on WebGL 做照片超分(不上传图片)的优化过程:初版用 UpscalerJS,1.2 MP 照片需 60-110 秒并冻结页面约 40 秒。

    推荐理由:作者用自己浏览器端超分项目的实测数字,拆解了 WebGL 上张量形状触发着色器重编译等坑和对应修法。

  2. Artificial Analysis 完整文章(网页)79

    Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三

    Artificial Analysis 评测 Google DeepMind 新模型 Gemini 4 Argon,其在 Artificial Analysis Intelligence Index 得 53 分,追平 GPT-6 Astra(max),高于 GPT-6.1 Sol(52),为 Google 超 7 个月来首个高于 Flash 档的专有模型。

    最新进展10月1日 05:48Gemini 4 Argon (High) 在 Arena 榜单表现优异

    推荐理由:第三方评测给出了智能指数、单位任务成本、幻觉率等多项横向数据,可用于比较 Gemini 4 Argon 与竞品的实际表现。

  3. Google DeepMind:Blog(RSS)77

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 宣布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向可信网络防御者开放,再逐步扩展至开发者、企业和消费者。

    推荐理由:原文给出定价、1M 输出上限和多项基准成绩,读者可据此评估该模型在编码与防御性网络安全上的实际表现。

  4. METR:Blog(网页)70

    METR 主席 Chris Painter 就 OpenAI / Hugging Face 智能体事件向美国参议院作证

    2026年9月30日,METR 主席 Chris Painter 在美国参议院国土安全委员会小组听证会上就 OpenAI / Hugging Face 事件作证。

    推荐理由:这是当事机构负责人在参议院听证会的完整证词,以第一手视角拆解了 OpenAI / Hugging Face 事件的三要素框架,并给出行业共性观察。

  5. Google AI:DEV 作者专属(RSS)75

    一次 Agent 重构事故复盘:二十个正确改动如何掩盖了错误的假设

    作者复盘充电站地图去重任务的事故:一个由 Agent 编写、重构后测试全部通过的去重任务,因测试数据自造而未取自真实数据(9269 对重复记录中运营商名称仅 1 对匹配),导致约三分之一注册表站点在 100 米内存在重复显示,重构 78 分钟后被无审阅合并。

    推荐理由:作者以真实去重事故为底,给出从审代码转向审概念与真实数据的可迁移复核清单。

  6. Aravind Srinivas69

    Perplexity CEO Aravind Srinivas 宣布向所有人开放 Computer 的邮箱任务功能,无需 Perplexity 账号,限时免费执行所有通过邮箱委派的任务。用户将邮件发送、转发或抄送到 computer@perplexity.com,智能体会在后台完成任务并保留邮件上下文;每个任务以正常会话形式运行,可在网页和移动端查看,审计记录与应用内任务一致。

    引用Perplexity@perplexity_ai

    Computer now works in email. Send, forward, or cc computer@perplexity.com on any thread. Every email task runs as a normal session in Computer, viewable on web and mobile, with the same audit trail as any task in the app.

    推荐理由:Perplexity 开放无需账号的邮箱入口并限时免费,读者可以据此评估把任务转给 Computer 智能体执行的可行性。

  7. OpenAI:官网动态(RSS · 排除企业/客户案例)70

    OpenAI 发布 GPT-6.1 Sol

    OpenAI 发布 GPT-6.1 Sol,定位接近 Astra 的智能水平,面向编码、计算机操作和专业工作场景,价格为其标准 API 输入和输出 token 价格的五分之一。

    最新进展10月1日 02:42GPT-6.1 Sol在Code Arena WebDev榜单表现及成本效率分析

    推荐理由:原文点出 GPT-6.1 Sol 的定位与价格对比,读者可以据此判断它在编码等场景的成本取舍。

  8. OpenAI:官网动态(RSS · 排除企业/客户案例)77

    OpenAI 披露并阻断一起有组织的对抗性模型蒸馏攻击

    OpenAI 披露已识别并阻断一起试图提取其模型 protected reasoning 的有组织攻击,最早活动出现在 7 月第一周。攻击者通过跨会话复制加密推理内容并请求解密转写等方式操纵模型交互,未入侵加密或数据库。

    推荐理由:OpenAI 官方复盘了一次模型蒸馏攻击的细节、归因和应对措施,读者可以借此了解针对 protected reasoning 的新型攻击手法。

  9. Anthropic:Research(发表成果 · 网页)69

    Anthropic 研究测算机器人对各类工作的暴露度,驾驶和仓储岗位最靠前

    Anthropic 发布机器人职业暴露研究,用 Claude 对约 19,000 项工作任务评分,发现机器人目前可完成美国 74% 的体力任务、占 34% 工时,但仅在有限环境中,且只在 0.3% 的任务上具备成本竞争力。

    推荐理由:报告用当前机器人能力测度职业暴露,给出了成本竞争力等量化门槛,可帮助读者评估哪些体力工作更早受影响。

  10. Google AI:DEV 作者专属(RSS)73

    工程师复盘十个月围绕 Claude Code 搭建守护框架的经验与教训

    一位工程师复盘十个月为 Claude Code 逐步搭建 hooks、门禁和守护框架的经历,核心结论是“仪表会撒谎”,提示词只是请求,真正有效的是代码边界。

    推荐理由:作者用十个月的真实失败数据说明提示词为何挡不住模型,并给出可复用的 Claude Code hooks 种子。

  11. Google Blog:AI(RSS)66

    Gemini 全球上线 skills 功能,将逐步取代 Gems

    Google 将 skills 功能直接推向 Gemini 聊天的全球用户,并将在未来几周内面向 Google Workspace 商业、企业、非营利和教育客户开放。

    推荐理由:官方公告说明了 skills 的使用方式、可用范围和 Gems 退出时间表,用户可据此安排迁移。

9月30日周三
  1. xAI:News(网页)73

    xAI 完成 200 亿美元 E 轮融资,超出 150 亿美元目标

    xAI 宣布完成 E 轮融资,规模从原定 150 亿美元上调至 200 亿美元,投资方包括 Valor Equity Partners、Stepstone Group、Fidelity、Qatar Investment Authority、MGX、Baron Capital Group,以及战略投资方 NVIDIA 和 Cisco Investments。

    推荐理由:官方融资公告列出了投资方、资金用途与 2025 年关键进展,可作为了解 xAI 算力与产品布局的一手材料。

  2. xAI:News(网页)62

    xAI 发布 Grok Imagine API,主打高质量低延迟视频生成与编辑

    xAI 发布 Grok Imagine API,一套覆盖视频生成与视频编辑的统一 API 套件,称其为迄今最强的音视频生成模型。

    推荐理由:官方宣布 Grok Imagine API 上线,附 Artificial Analysis 文生视频排名第一及延迟对比,可据此评估其在视频生成工作流中的位置。

  3. xAI:News(网页)79

    xAI 官宣加入 SpaceX,SpaceX 宣布收购 xAI

    xAI 官方页面于 2026 年 2 月 2 日发布消息称,SpaceX 宣布已收购 xAI,xAI 将加入 SpaceX。页面未披露交易金额或更多细节,仅提供指向完整公告的链接。

    推荐理由:来自 xAI 官方页面的合并公告,可作为 SpaceX 收购 xAI 这一动向的一手信源。

  4. xAI:News(网页)66

    xAI 发布 Voice Agent Builder 测试版:无需代码即可在 Grok Voice 上搭建生产级语音智能体

    xAI 宣布 Voice Agent Builder 进入测试版,这是一个运行在 Grok Voice 上的无代码平台,官方称约两分钟即可配置出可用的语音智能体。

    最新进展9月30日 23:42xAI 发布 Grok Voice Think Fast 1.0 语音模型

    推荐理由:官方给出了完整功能、τ-voice Bench 排名和每分钟计费细节,读者可以据此评估它替代多 API 拼接语音方案的可行性。

  5. xAI:News(网页)62

    xAI 推出 Custom Voices,可克隆声音用于 Grok TTS 和 Voice Agent API

    xAI 推出 Custom Voices,录制约一分钟自然语音即可在两分钟内克隆声音,并可在 Grok Text to Speech 和 Voice Agent API 中使用。自定义声音继承全部 TTS 能力(speech tags、多语言输出、REST 与 WebSocket 流式),不额外收费。声音需通过口令朗读和说话人嵌入比对的两阶段验证,无法从已有录音克隆,也无法克隆他人声音。

    推荐理由:xAI 官方说明克隆流程、验证机制和 API 覆盖范围,读者可据此评估在语音应用中的可用性。

  6. xAI:News(网页)70

    Grok 推出 Connectors 深度集成,并支持自定义 MCP 服务器

    xAI 发布 Connectors,把常用应用深度接入 Grok,现已在 Grok Web、iOS 和 Android 上线。

    推荐理由:官方公告列出了各连接器的具体读写能力和入口路径,读者可据此评估哪些工具接入 Grok 后能省去复制粘贴。

  7. xAI:News(网页)68

    xAI 为 Grok 推出 Skills 功能

    xAI 推出 Skills 功能,教 Grok 一次即可在所有对话中记住偏好和工作流,内置 Word、演示文稿、表格、PDF 和 Skill Creator 等技能,无需设置。用户可通过对话或上传文件自定义技能,自己的版本优先于内置版本。Skills 已在 Grok 4.3 上的 grok.com、iOS 和 Android 上线。

    推荐理由:官方公告写明了 Skills 的内置能力、自定义方式和可用平台,读者可据此判断是否纳入自己的工作流。

  8. xAI:News(网页)70

    Grok Build 全量开放:网页与移动端所有套餐可用

    xAI 宣布 Grok Build 在网页、iOS 和 Android 上向所有套餐开放,用户在 Grok 对话中描述应用、游戏、网站或仪表盘即可生成可运行版本。

    最新进展9月30日 23:42xAI推出Grok Build编程代理早期测试版

    推荐理由:原文列出了从 Early Beta 到全量开放的发布与分享、Remix、自定义域名等具体变化,读者可据此判断是否纳入自己的应用搭建流程。