Introducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
#产品更新
#产品更新
今日 0 条
Arena.ai@arenaAI 评分6262引用Claude@claudeaiSuno:Blog(网页)精选AI 评分6060 Suno 发布 v5.5,推出 Voices、Custom models 和 My Taste
Suno 发布 v5.5 模型,同时推出 Voices、Custom models 和 My Taste 三项个性化功能。
推荐理由:原文给出 Voices 的验证与隐私细节和两项新个性化功能,读者可以判断这些能力如何改变自己的创作流程。
Prime Intellect(网页)AI 评分5757 Prime Intellect 整合 23 个任务集,提供约 365,000 个 SWE、终端与搜索智能体 RL 环境
Prime Intellect 发布 research-environments,为 23 个开源智能体任务集提供统一 taskset API,涵盖约 198,000 个软件工程任务、约 28,600 个终端任务和约 137,600 个搜索任务,总计约 365,000 个环境,配套约 135,000 个预构建任务镜像。
LMSYS:Blog(Chatbot Arena 团队)AI 评分5858 SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning
SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning,这是一款可定制的开源模型,总参数 30B、每 token 仅激活 3B,上下文最长 100 万 token,由 Nemotron 3 Ultra 蒸馏而来。
Baseten Base Labs:模型研究AI 评分5858 Baseten 上线 Qwen3-TTS-12Hz 语音合成模型部署
Baseten 发布 Qwen3-TTS-12Hz 流式文本转语音模型,支持十种主要语言、3 秒参考音频快速克隆音色,并可依据文本内容调整语气、节奏和情感表达。模型支持流式与非流式生成,收到单个字符即可输出首个音频包,提供 0.6B 和 1.7B 两个 Base 版本模型卡,页面附有基于 WebSocket 的完整调用脚本,可进行语音管理和 PCM 流式合成。
The Decoder:AI News(RSS)精选AI 评分8181 OpenAI 发布 GPT-6.1 Sol,以五分之一成本接近 GPT-6.1 Astra
OpenAI 发布 GPT-6.1 Sol,因安全问题推迟的旗舰 GPT-6.1 Astra 不按计划上线,Sol 作为更便宜的替代方案推出,OpenAI 称其在 agentic coding、计算机使用和办公任务上接近 Astra,成本约五分之一。
推荐理由:原文汇总了 GPT-6.1 Sol 的定价与多项基准对比数据,读者可以据此判断它与 Astra、Claude 的成本性能权衡。
OpenRouter@OpenRouter精选AI 评分7171推荐理由:原文给出具体价格与能力对比,读者可以据此判断它在大语言模型选型中是否值得替换现有方案。
Microsoft Research 博客(RSS)精选AI 评分6666 微软研究院推出面向生物学复杂性的 AI 研究系统 Quine
微软研究院推出 Quine,一个面向生物学复杂性的 AI 研究系统,由生物学世界模型和连接模型、科学工具、文献与研究者的交互式 harness 两部分组成。该系统与 Broad Institute 合作用于胰腺导管腺癌研究,预测并排序数千种化合物以推动肿瘤细胞状态转变,最高排名化合物在湿实验中产生了最大的预期转变,从缩小化合物搜索空间到选出候选验证仅用一个周末。
推荐理由:微软研究院公开 Quine 的多模态世界模型与实验闭环设计,读者可了解 AI 参与生物实验设计与验证的具体路径。
ModelScope@ModelScope2022AI 评分5959ModelScope 发布 DiffSynth-Studio 下的 Qwen-Image-2.1 LayerExtract 和 LayerRemove 两个 LoRA,组成图层编辑工作流。
Latent Space(RSS)AI 评分6262 Runway 推出 WorldPrompt:实时世界模型的工程实现
Runway 本月早些时候发布 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并提出新的输入格式 WorldPrompt,可固定环境部分要素(包括首帧)后生成带时间戳的事件序列,事件还能实时提示。
Logan Kilpatrick@OfficialLoganKAI 评分6565
NVIDIA Blog(RSS)AI 评分5454 NVIDIA Vera Rubin NVL72 首次参加 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7x
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上达 2.5x,分别使用 vLLM 搭配 NVIDIA Dynamo 和 TensorRT-LLM。
ViggleAI@ViggleAIAI 评分5353
Google DeepMind:Blog(RSS)精选AI 评分8080 Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组 90 亿个单核苷酸变异预测
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部约 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上。
推荐理由:AlphaGenome Atlas 把 90 亿个单核苷酸变异的预测结果做成可检索资源,读者可了解其数据规模与在罕见病研究中的验证案例。
Mark Chen@markchen90精选AI 评分8181引用Sam Altman@samamajor price cuts today: *80% drop for GPT-5.6 Luna, now $0.20 per million input tokens and $1.20 per million output *20% drop for GPT-5.6 Terra, to $2/$12 *GPT-5.6 Sol gets Fast mode in the API, up to 2.5x the speed for 2x the price, same intelligence
推荐理由:OpenAI 首席研究官转述官方降价信息,读者可以据此更新 GPT-5.6 系列的 API 用量成本。
Google DeepMind:Blog(RSS)精选AI 评分6161 Google DeepMind 发布 Gemini 3.1 Flash TTS,新增 audio tags 精细语音控制
Google DeepMind 发布文本转语音模型 Gemini 3.1 Flash TTS,提升语音质量、表现力与可控性。
推荐理由:官方给出了模型能力细节、榜单成绩和开放入口,读者可以判断它对语音应用开发的实际改动。
通义 QwenAudio:原创语音项目精选AI 评分7070 Qwen-Image 开源:支持复杂文字渲染与精确图像编辑的图像生成基础模型
QwenLM 发布 Qwen-Image,一个图像生成基础模型,主打复杂文字渲染和精确图像编辑能力,代码发布在 GitHub(https://github.com/QwenLM/Qwen-Image)。