Baseten 发布 Dedicated Inference 与 Model APIs 服务等级协议(SLA)
Baseten 公布适用于 Dedicated Inference 和 Model APIs 的服务等级协议,承诺每月 System Availability 不低于 99.9%,按月度监控记录计算。未达标时客户可申请服务补偿,单月补偿上限为当月应付费用的 40%,且需自行发邮件申请。该 SLA 不适用于客户自托管部署的服务。
Baseten 公布适用于 Dedicated Inference 和 Model APIs 的服务等级协议,承诺每月 System Availability 不低于 99.9%,按月度监控记录计算。未达标时客户可申请服务补偿,单月补偿上限为当月应付费用的 40%,且需自行发邮件申请。该 SLA 不适用于客户自托管部署的服务。
Baseten Labs, Inc. 发布服务条款,界定其作为推理平台提供方的角色与责任边界。条款明确 Baseten 仅提供基础设施、部署、优化与编排服务,不控制 Customer Model 或 Third-Party Products 的设计、训练与输出,也不承担其准确性、安全性、偏见或合规责任。AI 系统开发、部署与分发的法律合规责任由 Customer 承担。
Baseten 提供 Baseten Inference Stack,用于构建产品级或内部编码智能体,并支持高性能、可扩展、低成本地部署和推理 AI 模型,可运行在 Baseten 云端或用户自有环境。页面引导用户联系其产品专家了解具体方案。
Cognition 整个平台已进入 FedRAMP Class D (High) In-Process 并列入 FedRAMP Marketplace,使联邦环境中的工程团队可用上自主云端 AI 软件工程师 Devin。
Baseten 正在招聘跨学科团队,构建其所谓的“推理云”(Inference Cloud),认为 AI 的未来是数百万个专用模型嵌入各类产品,而推理决定性能、可靠性、延迟与经济性。Abridge、Cursor、Lovable、Notion、OpenEvidence 等公司已依赖 Baseten 支撑生产环境的 AI 工作负载。
Cognition 与 Windsurf 合并一年后,Devin 已从初级工程师成长为可调度、管理其他 Devin 的中高级水平,并能通过 computer use 自测、自验证和自动修复。
Cohere Labs 的 Research Scholars 计划旨在寻找新一代机器学习人才,目前该项目申请通道已关闭。官方建议有意者加入其 Open Science 社区,与团队和社区成员协作。
Baseten 面向 AI 初创公司推出 Startup Program,提供最高 25,000 美元 Dedicated Inference 或 Training 额度,以及最高 2,500 美元 Model APIs 额度。申请者须为 AI 为核心业务的种子轮到 A 轮公司、成立不满 5 年,且此前未获得过 Baseten 额度。入选者还可获得数小时响应支持、跨云自动扩缩容与 GTM 支持。
Cognition 宣布收购 TierZero,TierZero 团队 Anhang 和 Yun 加入 Cognition,其自动化(automations)工作将被引入 Devin。Cognition 表示,双方希望让工程师减少处理线上故障的时间,把更多精力投入构建。
Baseten 为生产级 AI 推理提供全栈工程能力,覆盖模型开发、服务、编排、可观测性与底层优化,目标是在真实流量下兼顾吞吐、延迟与可靠性。其基础设施支持跨云跨区域 99.99% 可用性,并通过内核、量化、批处理、路由与硬件选型等逐层调优,按模型与流量定制配置而非套用通用预设。公司 2019 年由工程师创立,以前向部署工程师(FDE)与客户在真实流量下共同调优,从原型一路做到生产规模。
Cognition 宣布与美国能源部(DOE)签署谅解备忘录,加入被称为“美国 AI 曼哈顿计划”的 Genesis Mission,该计划于 2025 年 11 月由行政命令启动,目标是十年内让美国科研生产力翻倍。
Baseten 上线 Trust Center,集中公开其安全、隐私与合规资料,涵盖 SOC 2、ISO 27001:2022、HIPAA、CCPA、GDPR、PCI DSS 等认证与问卷文档。该页面同时列出子处理商名单,近期新增 Mistral AI、Global AI、Parallel AI、QumulusAI 和 Argentum AI,分别用于云算力与网页搜索。
Cognition 宣布收购 The Interaction Company of California,即个人智能体应用 Poke 的开发团队。Poke 是一款通过短信主动与用户互动的个人智能体,近三个月用户与它交换了超过 1 亿条消息,也是唯一获准在 Apple Messages 上原生发短信的 AI 智能体。
LTM 与 Cognition 达成合作,将在其全球客户群和网络安全业务中部署 AI 软件工程师 Devin,服务超 260 家客户,包括 26 家 Fortune 500 企业和全球前 5 大银行。
Baseten 正在与多元化的技术与解决方案合作伙伴生态协作,推进 AI 能力边界。该公司表示持续探索推动创新、促进 AI 社区发展的机会,并邀请有合作意向的伙伴与其联系共建。
Baseten 每周为 OpenEvidence 支撑数十亿次定制、微调 LLM 调用,向全美各大医疗机构提供高风险医疗信息。Baseten 称其可靠性与大规模深度支持已足以承担这一有时关乎生死的任务。此外,Baseten 与合作伙伴将说话人识别智能层直接前置到构建下一代 Voice AI 的开发者面前。
Baseten 每周为 OpenEvidence 支撑数十亿次定制、微调的 LLM 调用,向全美各大医疗机构提供高风险医疗信息。其可靠性投入被证明足以承担这一有时关乎生死的任务,同时 Baseten 将说话人识别层直接前置给构建下一代 Voice AI 的开发者。
Trail of Bits 与 OpenAI Daybreak 合作发起 Patch the Planet,用 GPT-5.5-Cyber 和 Codex 等前沿模型为关键开源项目找漏洞并完成修复。
推荐理由:原文给出第一周具体产出数字和维护者应对 AI 报告的方法,读者可以了解安全工作重心向修复端的转移。
Trail of Bits 在与 OpenAI 合作的 Patch the Planet 项目中,将 GPT-5.5-Cyber 通过 Codex 的 /goal 命令指向 zlib,模型在一天内自主搭建了覆盖十几个入口点的 fuzzing 实验,包括 ASan/UBSan 构建、种子语料和编译期变体构建,并发现多个问题正在进行协调披露。
推荐理由:一线安全团队实测 GPT-5.5-Cyber 自主搭建 zlib fuzzing 实验室,给出 harness 构建细节和报告有效性规则等可迁移经验。
Baseten 面向模型实验室推出 Frontier Gateway,可在数天内发布带认证、密钥管理、限流和用量计费的白标 API,由 Baseten Inference Stack 驱动。模型还可上架 Baseten Model Library 供开发者发现和调用,并享受 SOC 2、HIPAA、GDPR 合规及 99.99% 可用性 SLA。
心资本创始合伙人韩彦在 SuperReturn Asia 2026 演讲中判断,2026 至 2028 年是中国硬科技的早期投资窗口:技术信号清晰、IPO 退出回暖,但早期资本尚未充分回流。
ARC Prize 发布上线 24 小时的首日更新:社媒累计浏览 67.5 万,登顶 Kaggle 竞赛榜,已有 700 名 Kaggle 参赛者、70 次提交,当前最高分 18%。
ARC Prize 通讯宣布 Jack Cole、Mohammed Osman 和 Michael Hodel 在 ARC-AGI 私有评测集上创下 39% 的首个新纪录。
ARC Prize 社区通讯披露,Aditya Advani 团队凭 ARC-AGI-Pub 项目在旧金山 AGI House 黑客松拿下第三名。ARC-AGI-Pub 排行榜已上线,官方为其设立 15 万美元验证基金,该榜不计入 ARC Prize 2024 且无奖金。Kaggle 参赛者增至 6,539 人、434 支队伍,每日提交上限从 5 次降至 3 次以抑制过拟合。
ARC Prize 社区通讯宣布 Team MindsAI(Jack Cole、Michael Hodel、Mohammed Osman)以 41% 的新 SOTA 成绩首次突破 ARC-AGI 40% 大关。
ARC Prize 竞赛今年还剩 86 天,MindsAI 仍以 43% 位居榜首。François Chollet 在 AGI-24 大会上就 AGI 的定义、测量与构建发表演讲,Vladimir Iglovikov 团队则在 Llamathon 活动上用 Llama 模型尝试 ARC Prize 解法。
ARC Prize 推出 Daily Puzzle,每天 UTC 12 点从 ARC-AGI 任务中选出一道作为当日谜题,玩家可分享解题用时与尝试次数。MindsAI 团队在突破 40% 门槛三天后把分数提升到 43%,目前已有超 700 支队伍、近 4000 次提交。
ARC Prize 2024 赛程过半,ARC-AGI 世界纪录提升 13%,达到 46%,由 Jack Cole 与团队 MindsAI 连续第三次刷新。Kaggle 参赛者已超 11,000 人,目前有 4 支队伍得分超过 30%。
Martin Scorsese 成为 Black Forest Labs 顾问,并已用 FLUX 进行电影分镜创作。他表示该工具能更清晰高效地把脑海中的画面分享给美术指导、艺术设计和摄影指导,在前期制作中加快进度而不牺牲质量与工艺。Black Forest Labs 称其视觉智能模型可同时服务叙事者、建筑师、设计师与工程师,并预告将推出新的 FLUX 模型。
ARC Prize 发布 2024 竞赛三个月更新:ARC-AGI 基准仍未被攻破,SOTA 从 34% 升至 46%(MindsAI 通过测试时微调语言模型达成),Kaggle 上有 921 支队伍、7,368 次提交。
Envato 与 Black Forest Labs 合作,将 FLUX 模型接入其创意平台,FLUX 已占平台图片生成总量的约 25%,累计生成超 5100 万张图片。FLUX.2 发布当天即上线生产环境,其在写实、电影感和产品图场景中比同类模型高出约 10%,下载率高出平台均值 16%。平台按任务智能路由请求,其中素材变体生成可在 8 秒内输出 5 张图片。
ARC Prize 启动 2024 美国大学巡回宣讲,将走访斯坦福、MIT、UC Berkeley 等十余所高校,联合 AI 学生与研究者推进开放 AGI 进展。联合创始人 Mike Knoop 和 François Chollet 将现场讲解 ARC-AGI 的历史、动机、技术路径与未来方向。10 月 24 日另设一场面向公众的线上活动,内容与校内场次相同。
ARC Prize 团队本月走访了 13 所美国大学,与超过 1,500 名学生和教授交流 AGI 进展并推广 ARC Prize。团队还将于明天举办线上活动,由 ARC-AGI 创作者 François Chollet 讲解可能攻克 ARC 并赢得大奖的技术路径。
Databricks 年化经常性收入达 69 亿美元,同比增长 80%,Snowflake 约 53 亿美元、增长 34%,两者差距从 3 月的 4.9 亿美元扩至 16 亿美元。
ARC Prize 2024 Kaggle 竞赛代码提交已于 11 月 10 日截止,共 1,451 支队伍提交 19,423 份代码方案,Kaggle 与 ARC Prize 团队已启动排行榜验证。论文提交截止 11 月 12 日,开源截止 11 月 24 日,仅开源方案有资格获奖并进入排行榜,获奖者将于 12 月 6 日公布。ARC Prize 2025 竞赛计划于明年第一季度启动。
Theory 宣布与 Kleiner Perkins、Redpoint、Sequoia 共同投资 Sail Research 的 A 轮。Sail 做异步推理,把请求分发到 DeepSeek、Qwen、Kimi、GLM 等开源模型并按任务选最便宜可用的模型,其 GLM-5.1 每 token 成本比 Anthropic Haiku 低 6 倍。
Anthropic 发布 Claude 认证咨询与系统集成合作伙伴名单,并开放 Claude Partner Network 加入。
Anthropic 试点让 Stanford SALT Lab、Oxford 和 METR 三个外部团队通过隐私保护工具 Anthropic Insights,独立分析约 25 万段 2026 年 4-5 月的 Claude.ai 或 Claude Code 对话,并公开各项目汇总数据和意向表单。
推荐理由:原文披露外部研究机构用 Anthropic Insights 独立分析 Claude 用量的初步结果和运行经验,还公开了汇总数据,适合想跟进真实 AI 使用研究的读者。
Anthropic 整理了一份使用 Claude 构建产品的企业清单,涵盖编程工具、网络安全、商业智能与数据分析等类别。清单收录了 Cursor、Devin、Bolt.new、Databricks、Elastic 等产品,其中 Blitzy 用 Claude 关系映射整个代码库并调度数千个专用智能体,Ellipsis 已安装于超 67,000 个代码仓库、平均提升工程效率 20%。
ARC Prize 宣布转型为 501(c)(3) 非营利基金会,2024 年联合负责人 Greg Kamradt 出任主席并加入董事会。ARC-AGI-2 基准与论文将于 2025 年第一季度末发布并用于 2025 年赛事,ARC-AGI-3 已在开发中;2024 年赛事有超过 1400 支队伍提交 1.7 万份方案,基金会还计划与前沿实验室合作并在 1 月中旬启动募资。