Cognition 宣布年化收入运行率突破 10 亿美元
Cognition 宣布年化收入运行率突破 $1B。公司成立于 2024 年 1 月,Devin 正式开放不到两年,已在 GE Aerospace、Rivian、Rohlik、Exa 等公司的工程团队中协作使用,官方称这一里程碑属于客户。
推荐理由:Cognition 官方宣布 ARR 突破 10 亿美元,并列出 GE Aerospace、Rivian 等客户,可据此了解 Devin 的商业化进展。
Cognition 宣布年化收入运行率突破 $1B。公司成立于 2024 年 1 月,Devin 正式开放不到两年,已在 GE Aerospace、Rivian、Rohlik、Exa 等公司的工程团队中协作使用,官方称这一里程碑属于客户。
推荐理由:Cognition 官方宣布 ARR 突破 10 亿美元,并列出 GE Aerospace、Rivian 等客户,可据此了解 Devin 的商业化进展。
Anthropic 宣布 Claude Cowork 与聊天合并为一个 Claude,任务不再需要用户选择入口,可在合上电脑后继续完成。同时发布 Claude Docs 和 Claude Slides,Claude Design 也可在对话中直接使用,三者均在付费计划上处于 beta。
推荐理由:官方说明了 Cowork 与聊天合并的原因和落地方式,读者可以据此判断现有工作流会受哪些影响。
Anthropic 为企业版提供三种购买路径:可直接用信用卡在几分钟内自助结账升级 Enterprise;也可通过购买智能体咨询问题、获取个性化报价并当天结账,必要时可升级至销售团队;销售团队仅支持 500+ 席位部署和 BAA 等复杂交易。
Anthropic 客户案例页汇集了 283 个企业使用 Claude 的故事,覆盖金融服务、医疗、法律等行业。其中 Notion 用 Claude 打造面向团队与智能体的工作空间,Slack 用它做 AI 搜索与摘要,Figma 将想法转化为交互式软件,HubSpot 则借 Claude 释放创意时间。
Anthropic 上线 Claude 平台 Console,提供两种开发方式:Messages 为直连模型,需自行构建每轮对话、管理会话状态并编写工具循环;Managed Agents 提供全托管智能体基础设施,支持有状态会话与持久事件历史。平台同时提供 Claude 模型家族选型指引,涵盖研究、编码、写作等场景,Haiku 4.5 主打最快速度与最低成本。
Anthropic 发布 Claude Code 入门文档,该智能体编程工具可读取代码库、编辑文件、运行命令,支持终端、IDE、桌面应用和浏览器四种使用界面。终端 CLI、VS Code 和 JetBrains 插件还支持第三方模型提供商,多数界面需 Claude 订阅或 Anthropic Console 账户。
Claude 提供桌面与移动端应用下载,覆盖 macOS、Windows(含 arm64)、Linux(beta,支持 Ubuntu 和 Debian)以及 iOS 和 Android,所有套餐(Free、Pro、Max、Team、Enterprise)均可使用,部分功能仅限付费计划。
推荐理由:原文汇总了 Claude 桌面与移动端应用的下载入口、各平台支持范围和付费限制,读者可据此判断是否迁移工作流。
NVIDIA 与 CrowdStrike 在 Fal.Con 2026 上发布智能体网络安全系统 SafeMind,其防御模型基于 NVIDIA Nemotron 开放模型并用 CrowdStrike 威胁数据后训练。
NVIDIA 宣布已同意以 $12,930,300,000 收购 Hugging Face。Hugging Face 拥有超过 1800 万开发者、300 万模型、50 万数据集和 100 万应用,超过 20 万企业在用。
推荐理由:收购方官方说明了交易金额和对平台开放性的承诺,读者可以据此评估开源模型生态的走向。
NVIDIA 在 IFA 2026 宣布与 Microsoft 及伙伴合作加速本地 AI,包括 Hermes Agent、OpenClaw 和 Perplexity Portable Computer 的简化本地模型配置,llama.cpp 与 vLLM 带来最高 1.9x 推理提升,并推出开源工具 NVIDIA PAIR 在局域网内分发推理请求。
NVIDIA 在 IBC 2026 宣布大幅扩展 NVIDIA AI for Media,为广播、体育与流媒体工作流新增 GPU 加速 SDK、NIM 微服务与蓝图。
Perplexity 在 Windows 版应用中推出 Portable Computer,可在兼容的 NVIDIA GeForce RTX PC 和 RTX PRO Workstation 上本地运行,此前已支持 DGX Spark 和 Linux RTX PC。
Trail of Bits作者在Patch the Planet项目中获得GPT 5.6-Cyber预览权,让它在CTF任务中逃出自己Debian 12机器上的QEMU/KVM虚拟机,结果它三次成功逃逸。
推荐理由:作者以一手实验展示GPT 5.6-Cyber三次逃出VM的具体漏洞链,指出单靠虚拟机隔离AI智能体已不可靠。
Trail of Bits 发现 Lean 的 String.Pos.Raw.extract 在超大位置提取单字节切片时,逻辑定义返回空字符串而编译后的原生代码返回整个原字符串,利用这一分歧可在 Lean 4.33.1 中构造出通过检查的费马大定理'证明'。
Trail of Bits 发文批评 1Password 2026 年 8 月 6 日报告的 26% 干净修复率有误导性,指出其样本被挑选为复杂修复、22% 数据使用故意指示错误修复的提示词、36% 试验禁止编译测试,并披露评分规则与人工审查的分歧。
推荐理由:作者用自有的 Patch the Planet 合并率和开发者首次修复失败率作对照,说明该基准在样本、指令和评分上的问题。
Trail of Bits 在审计 Miden zkVM 前,用智能体在六个月内从零构建了 MASM 的 LSP 服务器、反编译器、静态分析引擎和 Lean 形式化模型。
推荐理由:作者复盘如何让智能体在审计前自建 LSP、反编译器、静态分析和 Lean 形式化模型,方法可迁移到其他安全审计场景。
Cloudflare 为 AI Gateway 的 User Insights 新增模型过度使用(Overkill)视图,可识别所选模型能力超出任务需求的情况,并展示关联用户、智能体与应用。
Cloudflare 发布 Pay Per Use beta,AI 公司为内容的具体使用出价,出版方在 dashboard 中决定是否接受,Cloudflare 负责记录使用、向买方计费并按月付款给出版方。
Cloudflare 推出 Monetization Gateway 封闭测试版,让域名拥有者通过 HTTP 402 状态码对访问网站、API、MCP 工具或数据集的智能体按请求收费,支付经 Coinbase x402 Facilitator 在 Base 区块链上以 USDC 结算。
Cloudflare Registrar 推出全新域名搜索,支持全部 420+ 扩展、即时响应、排序过滤和透明定价,并在 Birthday Week 对 .io、.dev、.app、.tech 等提供首年注册折扣。
Cloudflare 为 Workers 推出内置错误监控功能 Issues,现处开放测试阶段。无需额外 SDK,一行配置即可自动归组重复异常、5xx 响应和错误日志。
CMU 提出 LumberChunker,让 LLM 在连续段落中判断叙事最早发生语义转折的位置,从而切分出更自然的文本块。在 100 本公版书、3000 道大海捞针式问题的 GutenQA 基准上,其 DCG@20 达 62.1%、Recall@20 达 77.9%,优于语义分段、段落级、递归分段和命题级方法。token 预算 θ≈550 时检索质量最佳,平均块长约 334 tokens。
Cloudflare 发布 Auto Router 公测,通过 AI Gateway 使用,将模型设为 cloudflare/auto 即可自动把每个请求路由到能力足够的最便宜模型。
CMU 团队提出 CowCorpus 数据集,包含 400 段真实人机协作网页会话和 4200+ 交错动作,用于训练智能体预测人类介入时机。基于该数据将介入预测建模为逐步二分类任务,用大型多模态模型监督微调,并聚类出 Takeover、Hands-on、Hands-off、Collaborative 四类用户交互模式。
Cloudflare 的 Impact 公益项目累计捐赠服务规模达到 1 亿美元,覆盖记者、公民社会组织、州和地方政府、选举管理机构及公立学校等数千家机构。其 Project Galileo 目前覆盖 120 多个国家的 3500 多个域名,2025 年拦截超 385 亿次针对参与者的网络攻击。
CMU 研究团队将在 ICLR 2026 展示 194 篇论文,会议于 4 月 23 日至 27 日在巴西里约热内卢 Riocentro 会议中心举行。论文涵盖应用、计算机视觉、深度学习、优化、强化学习、社会影响与理论等方向,其中 EditBench、UALM、Agent Data Protocol、MotionStream、OpenThoughts 等被列为 Oral 论文。
Cloudflare 发文指出互联网出现了由软件代理人类访问的第二个受众:其网络 HTTP 请求从 2024 年底的每秒 6300 万增至近 1.15 亿,一年内 AI 智能体日请求增长超 1700%,今年首次过半流量非人类。
推荐理由:Cloudflare 用自家网络数据说明智能体流量如何改变流量与收入的关系,并给出可控授权和按使用付费的应对思路。
Datadog 发布 ARFBench,一个基于其内部真实故障遥测数据构建的时间序列问答(TSQA)基准,包含 750 个 QA 对、142 条时间序列和 63 起故障事件。
CMU 研究者发布 CHAI,一个基于批判式人机监督的视频描述管线,与 100+ 专业视频创作者合作一年构建,对应 CVPR 2026 论文(Highlight,Top 3%)。
CMU 提出 V-pretraining,在持续预训练中把固定的自监督任务构造规则换成可学习的任务设计器,下游样本只用于训练设计器,学习者仍只接收自监督梯度。
CMU 研究指出医疗 LLM 基准的评估与部署存在 61 个百分点差距,根源是评估协议中隐含的任务与结果两类假设在真实场景中不成立。研究将差距拆解为查询分布 12 点、交互类型 19 点、决策中介 30 点,并提出 BenchmarkCards 框架显式化这些假设,配合分阶段评估判断基准结果能否迁移到部署。
CMU 博客解读 Forking-Sequences 训练范式:不再逐窗口编码,而是在单次前向传播中编码解码整条序列的所有预测创建日期,无需新增参数。该范式在 MLP、RNN、LSTM、CNN、Transformer 和 State Space 六种编码器上验证,LSTM 编码器的 sCRPS 最高提升 49.3%,梯度方差线性下降。
Baseten 发布训练 SDK Loops(早期访问),支持 256K+ 序列长度、2T+ 参数模型训练与异步 RL,训练完成后一条命令即可部署到 Baseten 推理栈。
Baseten 发布 Model APIs,在 Baseten Inference Stack 上按需运行 DeepSeek V4.1 Flash、DeepSeek V4 Pro 0813、Kimi K3、GLM-5.3 系列及 NVIDIA Nemotron 3 Ultra 等前沿开源模型。
Baseten 推出 Dedicated Inference 专用推理部署,基于 Baseten Inference Stack 支持跨云自动扩缩容,官方称可实现 6 倍 GPU 利用率提升和 5-10 倍成本降低。
Baseten 是一个模型推理与训练平台,提供兼容 OpenAI 的 API 调用托管模型,也支持在专属基础设施上部署自有模型或训练模型并部署生成的 checkpoint。
Baseten 公布其生产推理平台定价,分 Basic、Pro、Enterprise 三档,Basic 含专用部署、Model APIs、训练与快速冷启动,Pro 增加高需求 GPU 优先访问和更高 Model API 速率限制,Enterprise 支持自托管与自定义 SLA。
Baseten 公布了一批客户案例,展示其推理基础设施在高吞吐 AI 产品中的表现。Parallel Web Systems 借助 Baseten 的吞吐优化推理与训练到部署闭环,实现吞吐提升 3 倍、延迟降低 2 倍;Speechify 每月为 6000 万以上用户合成超 161B 字符,成本降低 44%、p99 延迟降低 30-50%、冷启动快 4.5 倍。
Baseten 推出开源模型库,支持将模型在数秒内以 API endpoint 形式部署。库中涵盖 LLM、语音合成、转录、图像生成与嵌入向量等类别,包括 DeepSeek V4.1 Flash。
Black Forest Labs 联合创始人兼 CEO Robin Rombach 在 G7 峰会向 Macron、Trump、Merz、von der Leyen 等领导人呼吁,让开放且负责任的 AI 开发成为常态而非例外。