推荐理由:官方公布 API 缓存命中输入价格降至原价十分之一,并给出各型号具体单价,可据此估算构建成本变化。
全部AI 动态
全部动态
今日 77 条
DeepSeek@deepseek_ai精选AI 评分6666
Steve Yegge:Medium(RSS)AI 评分6161 Steve Yegge 宣布 Gas City v1.0.0 发布,将 Gas Town 重构为多智能体编排 SDK
Gas City 本周发布 v1.0.0,由 Julian Knutsen 和 Chris Sells 基于 Steve Yegge 的构想开发,将 Gas Town 整个栈重构为可组合的声明式 SDK,用于搭建自主协作的 agent 团队(即所谓 dark factory)。
Alibaba:GitHub 新仓库AI 评分2929 阿里巴巴开源 obz-cli:多后端可观测性 CLI
阿里巴巴在 GitHub 发布 obz-cli,一个面向 metrics、logs、traces 的多后端可观测性 CLI,提供统一接口并适配 AI Agent 使用。该工具将多种可观测性数据源的查询整合到同一命令行界面中。
OpenAI:Alignment 研究博客(RSS)AI 评分4646 OpenAI 开源思维链可监控性评估数据集与参考代码
OpenAI 开源了其思维链可监控性研究的部分数据集与参考代码,包括评估套件中的多数数据集、可监控性指标 g-mean 2 的计算代码,以及一种新的交叉拟合过滤策略。
Google Research精选AI 评分6969 Google Photos Auto frame 上线 3D 视角重排功能,可改变照片拍摄视角
Google 宣布其新方法已在 Google Photos 的 Auto frame 功能中上线,用 ML 模型估计 3D 点图和相机参数,再用生成式扩散模型补全新视角下原先未拍到的内容,实现拍摄后的视角重排。方法分 3D 场景与相机估计、生成式修补两阶段,可自动调整人像构图并校正广角前置镜头的透视畸变,对含人物的合格照片提供单次操作的备选 rendition。
推荐理由:原文拆解了 3D 场景估计与生成修补的两阶段方法,读者可以理解这种视角重排与普通生成式修图的区别。
browser-use:GitHub 新仓库AI 评分2828 browser-use 发布 browsercode:浏览器原生智能体框架
browser-use 在 GitHub 上线新仓库 browsercode,定位为浏览器原生(browser-native)的智能体框架。该仓库目前仅给出这一句描述,未披露模型支持、参数规模或可用性细节。
browser-use:GitHub 新仓库AI 评分5050 browser-use 开源 browser-harness-js 自愈式浏览器 harness
browser-use 在 GitHub 发布新仓库 browser-harness-js,定位为可自愈(self-healing)的浏览器 harness,用于让 LLM 完成任意任务。
OpenAI:GitHub 新仓库AI 评分2323 OpenAI 发布 privacy-filter 仓库
OpenAI 在 GitHub 新建 privacy-filter 仓库,目前仅公开仓库名,未披露模型规模、benchmark 分数或可用方式。
browser-use:GitHub 新仓库AI 评分4040 browser-use 推出 desktop 桌面应用
browser-use 发布 desktop 桌面应用,将浏览器智能体能力带入桌面端。该仓库名为 browser-use/desktop,目前仅披露应用名称 Browser Use Desktop App,具体功能、支持平台与可用性尚未公布。
browser-use:GitHub 新仓库AI 评分4242 browser-use 发布 go-harnessless:基于 Go 重写的 Chrome DevTools Protocol 桥接
browser-use 发布 go-harnessless,用 Go 重写 harnessless,实现基于守护进程的 Chrome DevTools Protocol 桥接。该项目借助 goroutine、channel 和 sync.RWMutex 支持并发浏览器自动化。
browser-use:GitHub 新仓库AI 评分5151 browser-use 开源 browser-harness:让 LLM 完成任意任务的自愈式 harness
browser-use 在 GitHub 发布新仓库 browser-use/browser-harness,定位为一个自愈式 harness,使 LLM 能够完成任意任务。材料仅含仓库简介,未提供更多功能细节。
OpenAI Developers(RSS)精选AI 评分6565 OpenAI 扩展 Codex 能力:可操作 Mac 应用并承接持续任务
OpenAI 发布视频介绍 Codex 的能力更新。Codex 现在可以操作 Mac 上的应用、连接更多工具、生成图像、从之前的操作中学习、记住用户的工作偏好,并承接持续和可重复的任务。
推荐理由:OpenAI 官方列出 Codex 的能力更新方向,读者可以据此了解它在 Mac 应用操作和持续任务上的变化。
OpenAI:GitHub 新仓库AI 评分2828 OpenAI 发布 homebrew-tools:OpenAI CLI 的 Homebrew 安装源
OpenAI 在 GitHub 新建 homebrew-tools 仓库,为 OpenAI CLI 提供 Homebrew 安装方式。仓库描述为“Homebrew for the OpenAI CLI”,目前正文未披露更多功能细节。
OpenAI:GitHub 新仓库AI 评分4646 OpenAI 开源 euphony:在浏览器中可视化 harmony 聊天数据与 Codex 会话
OpenAI 发布开源项目 euphony,可在浏览器中可视化 harmony 聊天数据与 Codex 会话。该仓库以 openai/euphony 形式托管于 GitHub,具体功能细节与使用方式尚未在现有信息中展开。
Google ResearchAI 评分4848 Google 推出 Vantage:用生成式 AI 评估未来技能
Google 发布研究实验 Vantage,通过生成式 AI 在模拟环境中创建对话,评估高中和大学生的未来技能,现已上线 Google Labs 并开放英文注册。Vantage 与纽约大学合作开发,由 Executive LLM 动态引导对话、AI Evaluator 依据评分标准打分,188 名 18-25 岁美国测试者的研究显示其评分与人类专家一致。
Alibaba:GitHub 新仓库AI 评分2626 阿里巴巴开源 aiconfigurator:面向分离式 Dynamo 图的离线优化工具
阿里巴巴在 GitHub 新建 aiconfigurator 仓库,用于对分离式 Dynamo 图进行离线优化。该仓库为 fork 版本,所有改动计划以上游 PR 形式贡献回主项目。
Alibaba:GitHub 新仓库AI 评分4040 阿里巴巴开源 Harbor:智能体评测与 RL 环境框架
阿里巴巴在 GitHub 发布 Harbor 框架,用于运行智能体评测以及创建和使用 RL 环境。该仓库为贡献用 fork,所有改动计划提交上游 PR。
Together AI 研究与产品博客(RSS)AI 评分6464 Together AI 发布 EinsteinArena,智能体协作将 11 维 kissing number 下界推至 604
Together AI 发布 EinsteinArena,一个让智能体在开放科学问题上互动、讨论和竞争的平台,含实时 API、验证器和公开排行榜,并完全开源。截至 2026 年 4 月 11 日,平台上的智能体已取得 11 项新 SOTA,包括将 11 维 kissing number 下界从 AlphaEvolve 的 593 推进到 604,该结果由多个智能体在 48 小时内接力优化协作完成。
browser-use:GitHub 新仓库AI 评分4545 browser-use 推出 video-use:用编程智能体剪辑视频
browser-use 在 GitHub 上线新仓库 video-use,主打用编程智能体(coding agents)编辑视频。该仓库目前仅给出这一句功能描述,未披露支持的模型、参数规模或可用方式。
Alibaba:GitHub 新仓库AI 评分5555 阿里巴巴开源 loongsuite-js:为 AI 编程智能体提供 OpenTelemetry 埋点插件
阿里巴巴在 GitHub 开源 loongsuite-js,为基于 JavaScript 的 AI 编程智能体提供 OpenTelemetry 埋点插件。它可以从 Claude Code 和 OpenClaw 采集 traces、工具调用和 LLM 指标,无需修改代码。
Google ResearchAI 评分3838 Google 推出 PaperVizAgent 与 ScholarPeer 两个学术 AI 智能体
Google 发布两个学术智能体框架:PaperVizAgent 用于生成论文配图,ScholarPeer 用于自动同行评审。PaperVizAgent 由检索、规划、风格、可视化和评审五个智能体协作,在 0-100 分评测中总分 60.2,超过 GPT-Image-1.5、Nano-Banana-Pro、Paper2Any 等基线,是唯一超过 50.0 人类基线的框架。
Sierra:Blog(RSS)AI 评分5252 Sierra 推出首个 Level 1 PCI 合规的 AI 智能体支付能力
Sierra 发布面向 AI 智能体的支付功能,成为首个 Level 1 PCI 合规的对话式 AI 平台,并获 Visa Global Service Provider Registry 验证。
OpenAI:GitHub 新仓库AI 评分3636 OpenAI 开源 openai-imagegen-demo:基于 Image API 的 Next.js 照相亭应用
OpenAI 在 GitHub 新建仓库 openai-imagegen-demo,这是一个用 OpenAI Image API 构建的 Next.js 照相亭(Photobooth)应用。仓库以 demo 形式展示该 Image API 的实际调用方式,目前未披露更多功能细节。
Sierra:Blog(RSS)AI 评分4242 Sierra 推出 Linnaeus 与 Darwin 搜索模型,解决率最高提升 16 个百分点
Sierra 发布两款自研搜索模型 Linnaeus(检索)与 Darwin(重排序),称其解决率最高提升 16 个百分点。Linnaeus 直接基于完整对话检索,recall@5 提升 20%、recall@30 约 95%,每次搜索延迟最多降低约 800ms;Darwin 负责重排序,兼顾精度与成本。Sierra 智能体每天执行超 200 万次搜索,P90 延迟与搜索成本均下降超 75%。
Steve Yegge:Medium(RSS)AI 评分6262 Steve Yegge 发布 Gas Town 与 Beads 1.0.0,Gas City 进入 alpha 测试
Steve Yegge 宣布 Gas Town 和 Beads 同日发布 v1.0.0。Gas Town 上线 3 个月获 13k GitHub stars,已进入维护模式一个月以上;Beads 上线约 5 个月跨过 20k stars,在完成向嵌入式 Dolt 的迁移后达到 v1.0。后续重点转向 Gas City,目前处于 alpha 测试并计划快速 GA。
Alibaba:GitHub 新仓库AI 评分2121 阿里巴巴开源 loongsuite-semantic-conventions-genai,定义 GenAI 语义约定
阿里巴巴在 GitHub 新建仓库 loongsuite-semantic-conventions-genai,用于定义 GenAI 的语义约定(Loongsuite GenAI Semantic Conventions)。该仓库归属 Loongsuite 项目,具体功能与可用性细节尚未在现有信息中披露。
Sierra:Blog(RSS)AI 评分3434 Sierra 推出 Explorer:用 AI 优化 AI 智能体的智能体
Sierra 发布 Explorer,一款与构建智能体的 Ghostwriter 配合、主动指出智能体待修复与改进之处的"智能体优化智能体"。它像 ChatGPT deep research,但研究对象是客户对话,可诊断性能问题、验证假设并预测趋势,每周推送变化简报,并支持一键在 Ghostwriter 中落地建议。
Mistral AI:News(网页)AI 评分5656 Mistral AI 发布 Spaces CLI,为人类与 Agent 共用而设计
Mistral AI 发布 Spaces CLI,一个从内部平台工具演化而来、可脚手架项目、启动开发环境并部署的项目工具。
OpenAI:GitHub 新仓库AI 评分3636 OpenAI 发布 codex-plugin-cc,可在 Claude Code 中调用 Codex
OpenAI 在 GitHub 新建仓库 openai/codex-plugin-cc,让用户在 Claude Code 中调用 Codex 来审查代码或委派任务。该插件打通了两个 AI 编程工具之间的调用链路。
Google DeepMind:Blog(RSS)精选AI 评分6464 Google DeepMind 推出由 Gemini 驱动的 AI 指针交互
Google DeepMind 发布 AI 指针实验方案,让指针借助 Gemini 理解所指内容与用户意图,并提出保持流、看即说、用 this/that、像素变实体四条交互原则。用户已可在 Google AI Studio 和 Gemini in Chrome 中通过指向加语音操作网页,Googlebook 将推出 Magic Pointer。
推荐理由:原文给出 AI 指针的四条交互原则及其在 Chrome 和 Googlebook 中的落地入口,读者可据此理解指向加语音的新交互方式。
OpenBMB(清华 NLP):GitHub 新仓库AI 评分3131 OpenBMB 发布 ClawXMemory:面向 OpenClaw 的多层级长期记忆插件
OpenBMB 推出 ClawXMemory,一个为 OpenClaw 设计的多层级记忆插件,主打长期上下文能力。该插件通过多层级记忆结构管理长期上下文,具体参数与可用方式尚未在现有信息中披露。
Modem:Blog(RSS)AI 评分4343 Modem 现已接入 Intercom
Modem 面向所有用户上线 Intercom 集成,通过 webhooks 实时将对话、回复、内部笔记、状态变更和 CSAT 评分汇入其 topic 系统,并与 Slack、Discord、GitHub 讨论并列。
OpenBMB(清华 NLP):GitHub 新仓库AI 评分3737 OpenBMB 发布 OmniEvalKit:全模态大模型评测框架
OpenBMB 推出 OmniEvalKit,一个面向全模态大语言模型的评测框架,聚焦音频与音视频理解。基于该框架可快速复现 benchmark、接入自有模型或数据集,并与其他开源模型进行公平对比,MiniCPM-o 即使用该框架完成评测。
Sierra:Blog(RSS)AI 评分5050 Sierra 推出 Ghostwriter 智能体,转向 Agents as a Service
Sierra 发布 Ghostwriter,一个能构建智能体的智能体,用户通过自然语言、SOP、通话记录等输入即可生成覆盖语音、聊天、邮件及 30 多种语言的 production-ready 客服 Agent。
Google ResearchAI 评分5050 Google 推出 Vibe Coding XR:用 Gemini 和 XR Blocks 加速 AI + XR 原型开发
Google 发布 Vibe Coding XR 工作流,结合 Gemini 的长上下文推理与基于 WebXR、three.js、LiteRT.js 的 XR Blocks 框架,可将自然语言在 60 秒内转化为可运行的 Android XR 应用。
Mistral AI:News(网页)精选AI 评分6666 Mistral AI 发布首个语音合成模型 Voxtral TTS
Mistral AI 发布首个文本转语音模型 Voxtral TTS,参数量 4B,支持英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语 9 种语言。
推荐理由:官方给出与 ElevenLabs 的对比数据、延迟指标和开源入口,读者可以据此评估它对语音智能体工作流的适配度。
Modem:Blog(RSS)AI 评分3737 Modem 新增 PostHog 集成,可用自然语言查询产品分析数据
Modem 面向所有用户上线 PostHog 集成,连接后其智能体可通过 API 实时查询产品分析、功能开关和 A/B 实验数据。用户用自然语言提问,智能体自动生成查询并返回事件计数、漏斗、留存、HogQL 趋势及实验统计显著性结果,还可与 Modem 的 topic 数据交叉比对。
Together AI 研究与产品博客(RSS)AI 评分5555 Together AI 微调服务新增工具调用、推理与视觉模型支持,训练吞吐最高提升 6×
Together AI 扩展 Together Fine-Tuning,新增工具调用、推理和视觉语言模型(VLM)微调支持,训练栈升级后支持 100B+ 参数模型,吞吐最高提升 6×,数据集支持最大 100GB。
Mistral AI:News(网页)AI 评分4747 Mistral AI 推出 Forge:面向企业构建前沿级定制模型
Mistral AI 推出 Forge,让企业基于自有专有知识训练前沿级 AI 模型,支持预训练、后训练与强化学习全流程。Forge 同时支持 dense 与 MoE 架构,并可按需支持多模态输入,模型可运行在企业自有基础设施内以保留控制权。该平台以智能体优先设计,Mistral Vibe 等自主智能体可用其微调模型、寻找最优超参数、调度任务并生成合成数据。
Google ResearchAI 评分5858 Google 在 Flood Hub 上推出基于 AI 的城市山洪预报
Google 宣布在 Flood Hub 上推出城市山洪预报,可提前最多 24 小时预测城市山洪风险,属于 Google Earth AI 家族并支持 Crisis Resilience 工作。