Anthropic 推出 Claude in Chrome 浏览器扩展,向付费用户开放
Anthropic 推出 Claude in Chrome 扩展,面向所有付费计划开放,可读取当前登录页面并代替用户点击、输入和填写表单。
推荐理由:官方产品页说明了 Claude in Chrome 的能力边界、三种访问方式和安全机制,读者可据此判断是否将其纳入自己的浏览器工作流。
Anthropic 推出 Claude in Chrome 扩展,面向所有付费计划开放,可读取当前登录页面并代替用户点击、输入和填写表单。
推荐理由:官方产品页说明了 Claude in Chrome 的能力边界、三种访问方式和安全机制,读者可据此判断是否将其纳入自己的浏览器工作流。
Anthropic 推出 Claude Security,面向 Claude Enterprise 开放公测,用 Claude Mythos 5.1 扫描代码库,对发现结果做对抗性验证并给出建议补丁,所有补丁需人工审核批准。
Anthropic 发布 Claude Science,一款面向科学家的 AI 工作台应用,目前为 macOS、Windows 和 Linux 上的公开 beta,面向 Pro、Max、Team 和 Enterprise 计划。
推荐理由:官方产品页列出可复现分析、60+ 科学数据库连接和 HPC 计算管理等具体能力,读者可据此判断它对科研工作流的影响。
CoreWeave 在 Fully Connected 大会上宣布 NVIDIA Vera Rubin NVL72 系统上线 CoreWeave Cloud,并计划提供面向智能体的 NVIDIA Vera CPU,同时发布连接训练、评估与改进的 CoreWeave Forge。
Google Cloud 将原生 TPU 支持集成进 vLLM,并以 Qwen3-Embedding-8B 为目标模型完成多项优化,支持 4K+ token 文本与 15K+ token 多模态输入的嵌入推理。
Google Cloud 的 Gemini Enterprise 开发者体验(DevEx)Program 以"冲刺"方式按真实开发者路径实测产品,本轮聚焦智能体治理,梳理出从配置受治理的智能体身份、注册 Agent Registry、绑定 Agent Gateway,到执行策略与内容安全、验证端到端拦截的 5 步工作流。
Google 宣布 Agent Development Kit(ADK)for Kotlin 1.0 正式 GA,与 ADK 1.0 Core 功能完全对齐,并新增 Android 端侧扩展。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成的实体蛋白上验证,同时在实验室测试中保持蛋白的生物功能。
推荐理由:原文给出水印在湿实验中不影响蛋白功能、并开放代码与权重的关键细节,读者可据此评估其对生物安全筛查的实际价值。
作者发布开源包 @teaql/ai-sdk,把显式声明的业务能力白名单转换成原生 Vercel AI SDK 工具,替代让模型直接生成 SQL 的通用做法。
Google 发布 SynthID Bio,可将不可感知、可验证的水印直接嵌入 AI 设计的蛋白质序列和预测的 3D 结构中,同时保持其生物功能。在针对目标蛋白的实验室测试中,加水印的设计在性能与自然多样性上与未加水印版本相当。该技术旨在为生物安全提供溯源层,并维护开放科学数据库的完整性。
用 PixVerse 插件把你的音乐变成 MV 或音乐可视化视频 告诉你的 AI 智能体你想要的情绪、风格和视觉效果 让它用 PixVerse 把想法呈现在屏幕上
Computer can create interactive 3D diagrams to help you visualize things like furniture assembly.
Zyphra 推出 Zyphra Cloud,提供面向长周期智能体系统的推理服务,包含 Serverless Inference 与 Dedicated Inference Capacity 两种模式。
Preferred Networks 推出企业 AI 平台 PreferredAI Work Suite,支持在平台内或连接的外部存储中存放数据,帮助团队利用内部知识并自动化日常业务任务。
Preferred Networks 的金融团队基于机器学习与深度学习技术,研发面向金融行业的 AI 解决方案,覆盖市场低效识别、投资组合配置与衍生品对冲等场景。
World Labs 团队在官网发布 Generating Worlds 一文,分享其向持久、可导航 3D 世界推进的早期进展,用户可在浏览器中探索这些世界。材料仅标题可用,正文未抓取成功,更多细节以原文为准。
World Labs 发布空间智能模型更新,并推出有限访问的 Marble 测试预览,用户可在 marble.worldlabs.ai 用图像或文本提示生成可自由导航的 3D 世界。
World Labs 宣布其多模态世界模型 Marble 正式全面开放,此前两个月仅向小范围 beta 用户开放。
World Labs 发布 World API,这是其多模态世界模型 Marble 的公开接口,可将文本、单张图像、多图、360° 全景和视频生成为可导航的 3D 世界。
World Labs 于 7 月 21 日收购机器人仿真公司 SceniX,并发布 real-to-sim-to-real(R2S2R)引擎,把一个物理任务重建为可控制、可复用的对齐仿真世界。
Every 公布订阅定价:月付 $30,年付 $288(合 $24/月),All Access 年付 $625,含 OpenAI、Anthropic、Cursor、Notion、Google 等提供的 $9,000+ 额度与折扣。
Every 上线帮助中心,集中介绍其生态系统与账户基础信息,涵盖写作助手 Spiral、自动文件整理工具 Sparkle、邮件 AI 幕僚长 Cora 和语音听写工具 Monologue。页面还包含 All Access 套餐与 Builder Pack 的说明,以及 Every 首届 AI 大会 Thesis: 2027 的相关文章。
Baseten 的 login.baseten.co 部署入口当前显示 Cloudflare 安全验证页,提示正在验证访问者是否为恶意机器人,验证成功后等待 login.baseten.co 响应。页面标注 Ray ID a433ed62bbdce06d,性能与安全由 Cloudflare 提供。
Qwen3.6 27B 出现在 Baseten Base Labs 的模型研究内容中,原始标题仅给出该模型名称。正文为一段 chat.completion 格式的 API 返回示例,包含 38 个 prompt_tokens、145 个 completion_tokens,合计 183 个 tokens,模型字段为空,未披露更多参数或评测信息。
Qwen3.5 122B-A10B 是出现在 Baseten Base Labs 模型研究页面中的模型标识。相关页面仅展示了一段 chat.completion 格式的 API 返回示例,其中 model 字段为空,completion_tokens 为 145、prompt_tokens 为 38、total_tokens 为 183,未披露该模型的参数规模、上下文长度或可用性等具体信息。
Baseten 模型库新增阿里云 Qwen 系列模型,涵盖 Qwen3.5 35B-A3B、Qwen3.5 122B-A10B、Qwen3.6 27B、Qwen3 Coder 480B、Qwen3 VL 235B 等 LLM,以及 Qwen Image、Qwen3 TTS 12Hz、Qwen 3 ASR 1.7B 和 Qwen3 系列嵌入与重排序模型。
Qwen3 8B Embedding 是一个文本嵌入模型,输入文本后输出一维嵌入向量,常用于聚类等下游任务并配合向量数据库使用。该模型部署时量化为 FP8,需 Nvidia 较新 GPU 支持,如 H100、H100_40GB、B200 或 L4,量化可选但能提升效率。客户端代码可通过 pip 安装,也可使用 OpenAI embeddings 客户端。
Baseten 提供 NVIDIA Nemotron 3 Diarization 的三种预设方案,该模型支持最多 8 个说话人、可按请求配置延迟档位(0.32 秒到 30 秒 buffer),是 Streaming Sortformer v2.1 的后继,采用 OpenMDW 1.1 许可证允许商用。
创意工作室 Afterimage 用真实拍摄素材测试了 GPT-6 Astra 的视觉特效能力,包括替换移动镜头中的餐盘、在布鲁克林街景中添加建筑、让巨型游行花车出现在手持 iPhone 素材的窗外。部分镜头成功,部分失败,但团队最终开始构思此前不敢尝试的特效。此前 Opus 4.6 只能写确定性 Python 脚本做基础瑕疵与物体移除,Gemini Omni 虽能生成改动但缺乏精细控制。
Baseten 推出基于 Whisper Large V3 的优化实时转录管线,支持可配置的部分转录更新频率、高并发音频流下稳定的实时延迟,以及多语言转录的自动语言检测。
Whisper Large V3 Turbo 已在 Baseten 上线,面向实时笔记、内容字幕和客服等实时语音场景,支持部分转录更新频率可配置、高并发音频流下延迟稳定,以及多语言转录的自动语言检测。
Every 发布 Compound Engineering 技能包(当前版本 v3.30.1),通过 brainstorm、plan、work、simplify、review、compound 六步循环让编码智能体把学到的经验写入 docs/solutions/,供后续任务复用。
Every 推出语音效率应用 Monologue,将任意应用内的语音听写、语音笔记和无机器人会议转录整合为一。支持 Mac、iPhone、iPad 和 Apple Watch,提供 100+ 语言、Mac 离线本地转录、自定义词典,并可通过 MCP、API 和 CLI 让 AI 智能体访问已保存的笔记。Monologue Pro 定价 $15/月或 $144/年,亦包含在 Every 订阅中。
Every 成立 Product Studio,通过内部写作、播客、产品与咨询项目的正向反馈循环孵化新想法,并与驻场创业者(EIR)合作打造 AI 产品。用户可注册获取产品早期访问权限。
Baseten 发布 Qwen3-TTS-12Hz 流式文本转语音模型,支持十种主要语言、3 秒参考音频快速克隆音色,并可依据文本内容调整语气、节奏和情感表达。模型支持流式与非流式生成,收到单个字符即可输出首个音频包,提供 0.6B 和 1.7B 两个 Base 版本模型卡,页面附有基于 WebSocket 的完整调用脚本,可进行语音管理和 PCM 流式合成。
Baseten Base Labs 推出 MARS8-Flash 语音生成模型,支持流式输出音频,默认输出格式为 flac,也可选 wav、adts 或无头 PCM。
Canopy Labs 推出 Orpheus TTS(Orpheus v1),为其 Orpheus TTS 的继任模型,需以约 83 tokens/秒生成才能实现实时流式输出。该实现支持流式生成,在 H100 MIG GPU 上可支持 16 路并发实时流(可变流量)、24 路并发实时流(稳定流量),以及 128 路并发非实时生成以进行低成本批处理。
Microsoft 在西雅图和 Redmond 的发布活动上宣布新 Copilot,将聊天、代码、Office 和名为 Autopilot 的常驻智能体合并到一个界面,取代此前分开的消费者与工作聊天应用。
Baseten 模型库现已提供 DeepSeek V4.1 Flash、GLM-5.3 Fast、GLM-5.3、GLM-5.3-Flash 和 Kimi K3 等热门模型,可部署在 API 端点后直接调用。