SGLang-Diffusion with VDN-H3 now generates 14.4s of 768p video in just 9.0s 🚀 On 8× B200, 8 step denoising takes just 6.9s, reaching over 2× real time. The 9.0s figure covers the full generation request after warmup. No measured quality regression versus dense 50-step H3 across 103 test prompts. 🧵
全部AI 动态
全部动态
今日 46 条
MiniMax (official)@MiniMax_AIAI 评分3636引用SGLang@sgl_projectSemiAnalysis 长文 RSS(RSS)AI 评分5757 SemiAnalysis 实测 Vera Rubin NVL72 智能体推理:每美元 TCO 吞吐最高约 67 倍于 GB300
SemiAnalysis 在自建 AgentX 智能体推理基准上发布 Rubin 平台首批经核验的实测结果,称在 170 TPS、自有 TCO 口径下,Vera Rubin NVL72 相比 GB300 Dynamo TRTLLM 实现约 67 倍的总吞吐;在更常见的 60-100 TPS 区间为 1.4-3 倍。
Ant Ling@AntLingAGIAI 评分3434Ling-3.0-flash-Fin 现推出三个量化版本:FP8、FP4 和 INT4。 如果你在构建真实金融工作流,可以选择最契合你基础设施、内存和效率需求的版本。🧵
MiniMax (official)@MiniMax_AIAI 评分5555通义 QwenAudio:原创语音项目AI 评分4848 通义 Qwen-Image-2.1 发布:Qwen 最强开源图像生成模型
通义(Qwen)发布开源图像生成模型 Qwen-Image-2.1,官方称其为 Qwen 目前最强的开源图像生成模型。该模型已在 QwenLM 项目下开源,具体参数规模与评测分数尚未在原文中披露。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4848 蚂蚁 inclusionAI 发布 Step-3.7-Flash-singprobe 流式安全探针
蚂蚁 inclusionAI 基于 stepfun-ai/Step-3.7-Flash 推出内置流式护栏 SingProbe,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4848 蚂蚁 inclusionAI 发布 Qwen3.8-27B-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 Qwen3.8-27B-singprobe,这是基于 Qwen/Qwen3.8-27B 的流式护栏探针,复用基座模型隐藏状态,逐 token 对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4141 蚂蚁 inclusionAI 发布 Qwen3.5-397B-A17B-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 SingProbe,一个基于 Qwen/Qwen3.5-397B-A17B 的内在流式护栏,复用基座模型隐藏状态逐 token 打分查询意图、回复不安全和幻觉风险,仅 8.13M 探针参数、解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4545 蚂蚁 inclusionAI 发布 gpt-oss-120b-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 SingProbe,一个基于 openai/gpt-oss-120b 的流式护栏探针,复用基座模型隐藏状态,在生成每个 token 时对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4545 蚂蚁 inclusionAI 发布 MiniMax-M2.7-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 MiniMax-M2.7-singprobe,这是基于 MiniMaxAI/MiniMax-M2.7 的流式安全探针,仅 6.17M 参数,复用基座模型隐藏状态逐 token 输出 8 类意图、不安全与幻觉评分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5050 蚂蚁 inclusionAI 发布 GLM-5.3-singprobe:基于 GLM-5.3 的流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 GLM-5.3-singprobe,这是一个基于 zai-org/GLM-5.3 的流式安全探针,复用基座模型隐藏状态,逐 token 输出查询意图、回复不安全和幻觉风险评分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5050 蚂蚁 inclusionAI 发布 SingProbe 探针,基于 Qwen3.6-35B-A3B 实现逐 token 流式安全防护
蚂蚁 inclusionAI 在 Hugging Face 发布 SingProbe,一个构建在 Qwen/Qwen3.6-35B-A3B 之上的轻量流式安全防护探针,复用基座模型隐藏状态在每个 token 上打分查询意图、回复不安全性与幻觉风险。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4747 蚂蚁 inclusionAI 发布 Qwen3.6-27B-singprobe 流式安全探针
蚂蚁 inclusionAI 开源 Qwen3.6-27B-singprobe,一个基于 Qwen/Qwen3.6-27B 的流式安全探针,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5151 蚂蚁 inclusionAI 发布 SingProbe:基于 Qwen3.5-122B-A10B 的流式安全防护探针
蚂蚁 inclusionAI 发布 SingProbe,这是一个构建在 Qwen/Qwen3.5-122B-A10B 之上的轻量级流式安全防护探针,复用基座模型生成时的隐状态,在每个 token 上输出 8 类查询意图、响应不安全度和幻觉风险评分,探针参数仅 6.17M,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 Qwen3.5-35B-A3B-singprobe 流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 Qwen3.5-35B-A3B-singprobe,一个基于 Qwen/Qwen3.5-35B-A3B 的流式安全探针,仅 4.2M 参数,复用基座模型隐藏状态逐 token 输出 8 类意图、不安全与幻觉风险评分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4545 蚂蚁 inclusionAI 发布 Qwen3.5-27B-singprobe 流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 Qwen3.5-27B-singprobe,这是基于 Qwen/Qwen3.5-27B 的流式护栏探针,复用基座模型隐藏状态,逐 token 输出查询意图、回复不安全和幻觉风险评分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 Qwen3.5-9B-singprobe 流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 Qwen3.5-9B-singprobe,一个基于 Qwen/Qwen3.5-9B 的流式护栏探针,复用基座模型隐藏状态,逐 token 对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5252 蚂蚁 inclusionAI 发布基于 Qwen3.5-4B 的流式护栏探针 SingProbe
蚂蚁 inclusionAI 发布 SingProbe,一个构建在 Qwen/Qwen3.5-4B 之上的内在流式护栏探针,复用基座模型隐藏状态在每个 token 上输出查询意图、响应不安全度和幻觉风险评分。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 Qwen3.5-2B-singprobe 流式安全探针
蚂蚁 inclusionAI 推出基于 Qwen/Qwen3.5-2B 的流式护栏探针 SingProbe,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 Qwen3.5-0.8B-singprobe 流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 Qwen3.5-0.8B-singprobe,一个基于 Qwen/Qwen3.5-0.8B 的流式安全探针,复用基座模型隐藏状态,逐 token 输出查询意图、回复不安全和幻觉风险三类评分,仅 2.23M 探针参数、解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4747 蚂蚁 inclusionAI 发布 Qwen3-8B-singprobe:基于 Qwen3-8B 的流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 Qwen3-8B-singprobe,这是一个基于 Qwen/Qwen3-8B 的内在流式护栏,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4848 蚂蚁 inclusionAI 发布 SingProbe:基于 Qwen3-4B-Instruct-2507 的流式安全探针
蚂蚁 inclusionAI 发布 SingProbe,一个构建在 Qwen/Qwen3-4B-Instruct-2507 上的内在流式护栏,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4848 蚂蚁 inclusionAI 发布 Qwen3-0.6B-singprobe 流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 Qwen3-0.6B-singprobe,一个基于 Qwen/Qwen3-0.6B 的内在流式护栏,复用基座模型隐藏状态,逐 token 对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5454 蚂蚁 inclusionAI 发布 SingProbe:基于 Llama-3.2-1B-Instruct 的流式安全护栏探针
蚂蚁 inclusionAI 在 Hugging Face 发布 SingProbe 探针,基于 meta-llama/Llama-3.2-1B-Instruct 构建,复用基座模型隐藏状态在每个 token 上输出查询意图、回复不安全性与幻觉风险评分。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 Llama-3.1-8B-Instruct-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 SingProbe,一个基于 meta-llama/Llama-3.1-8B-Instruct 的内在流式护栏,复用基座模型隐藏状态逐 token 打分查询意图、回复安全性与幻觉风险,仅增加不到 0.5% 解码开销。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5252 蚂蚁 inclusionAI 发布 Hy3-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 Hy3-singprobe,一个构建在 tencent/Hy3 上的轻量流式安全探针,复用基座模型隐藏状态在每个 token 上评分查询意图、回复不安全性和幻觉风险。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5151 蚂蚁 inclusionAI 发布基于 gpt-oss-20b 的流式安全探针 SingProbe
蚂蚁 inclusionAI 在 Hugging Face 发布 SingProbe,这是一个基于 openai/gpt-oss-20b 的轻量流式安全探针,在生成过程中复用基座模型隐状态,逐 token 输出查询意图、回答不安全度和幻觉风险三类分数。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4848 蚂蚁 inclusionAI 发布 GLM-5.2-singprobe 流式安全探针
蚂蚁 inclusionAI 基于 zai-org/GLM-5.2 推出内置流式护栏 SingProbe,复用基座模型隐藏状态,在生成时逐 token 对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 SingProbe:基于 gemma-4-E4B-it 的流式安全探针
蚂蚁 inclusionAI 在 HuggingFace 发布 gemma-4-E4B-it-singprobe,这是一个基于 google/gemma-4-E4B-it 的流式安全探针,复用基座模型隐藏状态逐 token 输出 8 类意图、不安全与幻觉评分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4949 蚂蚁 inclusionAI 发布 gemma-4-31B-it-singprobe 流式安全探针
蚂蚁 inclusionAI 发布 SingProbe,一个基于 google/gemma-4-31B-it 的内在流式护栏,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4646 蚂蚁 inclusionAI 发布 SingProbe:基于 gemma-4-26B-A4B-it 的流式安全探针
蚂蚁 inclusionAI 发布 SingProbe,一个构建在 google/gemma-4-26B-A4B-it 上的内在流式护栏,复用基座模型隐藏状态逐 token 打分,探针参数仅 5.67M,解码开销低于 0.5%。
Mustafa Suleyman@mustafasuleymanAI 评分3131MAI-Transcribe-2 在 Open Router 上 5 天达到 100 万次请求!它是全球最快、最准确、最便宜的转录模型!
Ant Ling@AntLingAGIAI 评分3838Ling-3.0-flash-VL 两项更新: - 现已在 OpenRouter 上线,提供两周免费访问 - FP4 和 INT4 量化版本现已开源 通过 API 试用或自行部署——由你选择。
SiliconFlow@SiliconFlowAI精选AI 评分7070推荐理由:上线方直接给出参数结构、上下文窗口、KV cache 对比和许可证信息,读者可据此评估实际部署选型。
Tianyi Cui@tianyiAI 评分3939
Unitree@UnitreeRoboticsAI 评分6262
Ant Ling@AntLingAGIAI 评分4444现在你可以在 Hugging Face 上体验 Ling 的 VL 模型了,由我们的 day0 合作伙伴 @novita_labs 提供支持
引用Novita AI@novita_labs🤗 Novita now supports Ling-3.0-flash-VL on @huggingface. 🎁 Free for 14 days. • 124B total parameters · 5.5B active parameters per token • Native image and video understanding • Built for multimodal reasoning and agentic workflows
DeepSeek:GitHub 新仓库AI 评分3333 DeepSeek 开源 DeepSelect:面向 DSA 的 TopK kernel 与采样器
DeepSeek 在 GitHub 新仓库 deepseek-ai/DeepSelect 中开源了 DeepSelect,提供面向 DeepSeek Sparse Attention(DSA)的 TopK kernel 以及采样器(Samplers)。仓库目前仅给出这一功能定位,未披露参数规模、性能数据或具体可用方式。
Ahead of AI(RSS)AI 评分7070 Sebastian Raschka 解析 GPT-6 Astra 与循环 Transformer 及隐藏推理链传闻
Sebastian Raschka 撰文点评 OpenAI 新发布的 GPT-6 Astra,认为它是其迄今用过最强的模型,在 3D 渲染、动画和计算机使用上提升尤其明显,并详解计算机使用训练流程(据报道 OpenAI 采购数万台 Mac mini/Mac Studio 作为 macOS 训练环境)。
OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分6161 OpenAI 发布 GPT-6 Astra:面向工作场景的新一代模型
OpenAI 发布 GPT-6 Astra,定位为面向商务的最强模型。该模型具备高级推理和计算机使用能力,写作与设计判断也更强。
推荐理由:官方发布了面向商务场景的新模型,点出推理、计算机使用和写作设计判断三项能力方向。