NVIDIA Technical Blog(开发者技术博客 · RSS)· Michelle Horton·· 2026-08-27AI 评分65
阿里发布 Qwen3.8-Flash-Next 权重,预览 Qwen4 架构
Experiment with Qwen3.8-Flash-Next on NVIDIA GB300 NVL72 for Agentic Coding
AI 导读
阿里巴巴发布 Qwen3.8-Flash-Next 模型权重,作为即将到来的 Qwen4 架构的预览,供开发者实验和评估。该模型是多模态混合专家(MoE)模型,主模型 125B 参数,附加 51B N-gram embeddings,每 token 激活 6B 参数;原生上下文窗口 262,144 token,可扩展至 1M token。
来源:NVIDIA Technical Blog(开发者技术博客 · RSS) · developer.nvidia.com