摘要由 AI 生成
阿里巴巴于 2026 年 8 月 26 日通过 NVIDIA Developer Blog 宣布发布 Qwen3.8-Flash-Next 模型的权重文件。该多模态混合专家(MoE)模型包含 125B 参数的主模型和 51B 的额外 N-gram 嵌入,每 token 激活 6B 参数。模型原生支持 262,144-token 上下文窗口,并可扩展至 1M tokens。目前,开发者可在 NVIDIA GB300 NVL72 集群上对该模型进行实验和评估,旨在预览即将推出的 Qwen4 架构。
关键实体KEY ENTITIES
AlibabaQwen3.8-Flash-NextQwen4
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
信号强度SIGNALS
关键词热度
- Alibaba1
- Qwen3.8-Flash-Next1
- Qwen41
全部报道(1)SOURCES
↗
阿里巴巴发布 Qwen3.8-Flash-Next 模型权重,供开发者预览并评估即将推出的 Qwen4 架构。该多模态混合专家(MoE)模型包含 125B 参数主模型和 51B 额外 N-gram 嵌入,每 token 激活 6B 参数,原生支持 262,144-token 上下文窗口并可扩展至 1M tokens。开发者可在 NVIDIA GB300 NVL72 集群上对该模型进行实验。