一组 Claude Sonnet 5.5 的早期实验。 @_re_pete 用 Sonnet 5 与 Sonnet 5.5 做的秋叶模拟器对比。
#模型发布
#模型发布
今日 43 条
Claude@claudeaiAI 评分2525
Thariq@trq212AI 评分6464引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
AWS Machine Learning Blog精选AI 评分6262 AWS 上线 Claude Sonnet 5.5,主打低成本编码与知识工作
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,定位为更高效、单任务成本更低的 Sonnet 模型,适合范围明确的编码与知识工作。
推荐理由:文章给出 Sonnet 5.5 在 Bedrock 上的能力定位与调用方式,读者可据此判断它适合承接哪类持续运行的编码任务。
Charlie Holtz@charlieholtzAI 评分7171引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
ClaudeDevs@ClaudeDevs精选AI 评分7979
引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
推荐理由:原文给出 Sonnet 5.5 相对 Sonnet 5 的速度、成本和适用场景,读者可据此判断是否切换日常 Claude Code 任务。
Artificial Analysis@ArtificialAnlys精选AI 评分7878推荐理由:评测方给出了 Sonnet 5.5 的得分、token 用量与成本对比,读者可以据此判断它相对 Opus 5.5 的性价比。
Boris Cherny@bcherny精选AI 评分6666
引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
推荐理由:作者以 Claude Code 修复 bug 的视频演示新模型编码能力,可借此直观感受 Sonnet 5.5 相对上代的实际表现。
Dongxi 东锡 NLP@dongxi_nlpAI 评分7171Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 家族的第二款模型。官方称相比 Sonnet 5 是明确升级,速度快超过 30%,多数工作成本最多降低 30%。
引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
Anthropic@AnthropicAI精选AI 评分7373Anthropic 官宣 Claude Sonnet 5.5 上线,是 Claude 5.5 家族的第二款模型。相比 Sonnet 5,速度提升超过 30%,多数工作的成本最高降低 30%。
引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
推荐理由:Anthropic 官方发布 Claude Sonnet 5.5,原文给出速度提升与降价幅度,读者可据此比较是否升级迁移。
Claude@claudeai精选AI 评分7878Claude 发布 Claude Sonnet 5.5,是 Claude 5.5 家族的第二款模型。官方称其相比 Sonnet 5 是明显升级,速度提升超过 30%,多数任务成本最高降低 30%。

推荐理由:官方直接给出速度和成本的具体变化幅度,读者可以据此对比现有 Claude 模型选择升级。
The Decoder:AI News(RSS)精选AI 评分8282 Anthropic 发布 Claude Sonnet 5.5,基准接近 Opus 5.5 且单任务成本最多低 30%
Anthropic 发布 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,输出速度提升超过 30%,单任务成本最多降低 30%,在多项基准上接近 Opus 5.5。
推荐理由:对比 Sonnet 5.5 与 Opus 5.5、Sonnet 5 的基准与定价,可看清中端模型在编码任务上的跃升与成本取舍。
OpenRouter@OpenRouterAI 评分3030
OpenCode@opencodeAI 评分4545
Kling AI@Kling_aiAI 评分5454可灵(Kling)宣布 Kling 4.0 将于10月发布,Kling 4.0 Flash 现已对 Ultra 年付订阅用户开放。

Hugging Face:Blog(RSS)精选AI 评分7171 H 公司发布 Holo4 系列智能体模型,含 27B 稠密与 35B-A3B MoE 两个版本
H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,两者均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
推荐理由:Holo4 同时给出两种尺寸、跨 GUI 与 MCP 的统一接口和公开轨迹,读者可据此比较开源智能体与闭源前沿的成本差距。
ModelScope@ModelScope2022AI 评分5151
MiniMax (official)@MiniMax_AIAI 评分4444引用MiniMax_Agent@MiniMaxAgentMiniMax's latest text model, M3.1-Flash-Preview, debuts today on MiniMax Code. Built for everyday development, it's fast, reliable, and ready for real work, from quick bug fixes to full features.
Meituan LongCat@Meituan_LongCatAI 评分3535引用OpenCode@opencodeLongCat-2.5-Preview is now free on OpenCode for two weeks - 1M Context - Multi-modal - Zero Data Retention
AK@_akhaliqAI 评分5151
ViggleAI@ViggleAIAI 评分4343引用Yun Chen@t_muxviggle-turbo for Qwen-Image-2.1 isn't just faster — for most prompts, it's just as good as base.
karminski-牙医@karminski3AI 评分6060引用Meituan LongCat@Meituan_LongCatLongCat-2.5-Preview is now live. 1.6T parameters. ~48B active. A 1M-token context window. Natively multimodal. Built to take on long-horizon tasks. From terminals and browsers to GUIs, spreadsheets, and design tools. Try it now: 🚀 API: https://longcat.ai/platform/ 💬 Chat: https://longcat.ai/chat/
Meituan LongCat@Meituan_LongCatAI 评分6161上海人工智能实验室 InternLM:原创项目AI 评分2626 上海人工智能实验室发布 InternLM/Intern-Decision 多模态决策模型
上海人工智能实验室推出 InternLM/Intern-Decision,一个快速多模态决策模型。该模型以多模态决策为核心定位,强调快速响应能力,具体参数规模、benchmark 分数与开放方式尚未在现有信息中披露。
Google DeepMind:Blog(RSS)精选AI 评分6666 Google DeepMind 发布 Gemini 3.8 Live with Live Avatar
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,把近实时视频生成与语音对话模型结合,让对话 AI 具备动态视觉形象,支持精准唇形同步、自然表情和流畅轮次切换。
推荐理由:官方披露了实时视频与语音耦合的对话能力、异步工具调用和 97 种语言支持,可据此判断企业级数字人交互的落地边界。
Odyssey@odysseymlAI 评分4747推出 Agora-2,我们的下一代多智能体世界模型。 Agora-2 支持最多 20 个人类和智能体在同一共享环境中互动,全部实时模拟。 我们的多人研究预览版现已开放体验!

Hugging Face:Blog(RSS)AI 评分4141 Liquid AI 发布 LFM2.5-VL-DSpark 草稿模型,为 LFM2.5-VL-3B 加速视觉语言推理
Liquid AI 发布实验性 DSpark 草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径,设备端解码最高提速 3.13x、H100 上 2.66x,端到端最高提升 2.62x 和 2.27x。
OpenBMB@OpenBMBAI 评分4545FIT-GGUF 为 MiniCPM5-2B 提供可控尺寸的混合精度量化,开发者 @Scorp1o_117 据此构建了 4 个 GGUF 变体,体积从约 1.14 GiB 到 1.46 GiB。
Tencent Hy@TencentHunyuanAI 评分3030引用GMI Cloud@gmi_cloudHy Image 3.5 preview is now live on GMI Cloud @TencentHunyuan $0.024 per image 8.8x cheaper than GPT Image 2 5.6x cheaper than Nano Banana Pro Create now 👇
Ant Ling@AntLingAGIAI 评分5050通过我们的 Day0 合作伙伴 @novita_labs,畅享市面上最佳的文本到图像 UI/UX 设计模型 🤠🥰
引用Novita AI@novita_labsMing-Image-0.1-Design from @AntLingAGI is now available via Novita on @OpenRouter. Launching as a Day-0 partner ⚡ 🎁 Free for 14 days. A text-to-image model built for graphic-design output and legible text rendering.
Ant Ling@AntLingAGIAI 评分3333NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分3939 NVIDIA 推出 NV-Reason-CT Open 3D CT VLM,面向放射科医生链式推理
NVIDIA 发布 NV-Reason-CT Open,这是一个面向 3D CT 体积影像的开放视觉语言模型,支持放射科医生的链式推理(Chain-of-Thought)。现有前沿通用模型在体积影像上表现不佳,多数开放医疗 AI 模型也缺乏相应能力,而 3D CT 是临床信息最丰富、数据最密集的模态之一,此前一直未被现代 VLM 充分覆盖。
Google AI@GoogleAIAI 评分6464
Google DeepMind@GoogleDeepMindAI 评分5252
Google DeepMind:Blog(RSS)精选AI 评分7171 Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与深度创作控制,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:两款 TTS 模型给出语音克隆、逐行导演与多语言覆盖的具体能力,可据此判断语音生成工作流的变化。
ViggleAI@ViggleAIAI 评分5050引用Hugging Apps@HuggingAppsQwen-Image-2.1 in 4 steps is here ⚡ @ViggleAI distilled Qwen-Image-2.1 into a 4-step turbo model, 6× faster, and holds up side by side with the full model ▶️ on Spaces https://hf.co/spaces/Viggle/Qwen-Image-2.1-viggle-turbo
Qwen@Alibaba_QwenAI 评分6161
swyx@swyxAI 评分2828引用Sholto Douglas@_sholtodouglasalso important news we fixed the writing
Qwen@Alibaba_QwenAI 评分5959引用Arena.ai@arenaQwen-Image-2.1 by @Alibaba_Qwen just landed as the #1 open source model in the Image Edit Arena and Text-to-Image Arena! With 1367 pts in the Image Edit Arena, Qwen-Image-2.1 took the #1 spot among open. It landed #16 overall, just 3 pts from GPT-Image-1.5-high-fidelity at #15. See the leaderboard for the Text-to-Image arena below. Congrats to the @Alibaba_Qwen team on this contribution to the open source ecosystem!
Ant Ling@AntLingAGIAI 评分4646引用Vals AI@ValsAIAnt Group’s Ling 3.0 Flash Fin is a finance-specialized open-weight model that delivers strong financial analysis at budget-model pricing. On Finance Agent v2, it scores 54.9% at just $0.045 per task.
Simon Willison 博客精选AI 评分8484 Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 和 GPT-6 Luna 掀起新一轮价格战
Anthropic 于9月22日发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 Luna 价格降至 $0.10/M 输入、$0.50/M 输出,为 GPT-5.6 Luna 的一半;GPT-6 Sol 同样减半至 $2/$10。
推荐理由:作者用自己实测的价格表和 pelican 测试对比了三款新模型,还发现 Opus 5.5 max 会想满输出上限,可直接参考。