智迹闻AuraTracer
EN

EVENT DOSSIER

在 NVIDIA GB300 NVL72 上测试 Qwen3.8-Flash-Next 用于代理式编程

2026-08-27 01:07 大模型 🔥 28.9 事件热度
1家信源
1天持续发酵
28.9事件热度
3个提及
摘要由 AI 生成

阿里巴巴于 2026 年 8 月 26 日通过 NVIDIA Developer Blog 宣布发布 Qwen3.8-Flash-Next 模型的权重文件。该多模态混合专家(MoE)模型包含 125B 参数的主模型和 51B 的额外 N-gram 嵌入,每 token 激活 6B 参数。模型原生支持 262,144-token 上下文窗口,并可扩展至 1M tokens。目前,开发者可在 NVIDIA GB300 NVL72 集群上对该模型进行实验和评估,旨在预览即将推出的 Qwen4 架构。

相关事件RELATED EVENTS
关键实体KEY ENTITIES
AlibabaQwen3.8-Flash-NextQwen4

报道态势 · 每日报道量LANGUAGE SPLIT

实体关系
Alibaba × Qwen3.8-Flash…1Alibaba × Qwen41Qwen3.8-Flash-Next × Qw…1

信号强度SIGNALS

关键词热度
  • Alibaba1
  • Qwen3.8-Flash-Next1
  • Qwen41

全部报道(1)SOURCES

N NVIDIA Developer Blog en 2026-08-27 01:07

在 NVIDIA GB300 NVL72 上尝试使用 Qwen3.8-Flash-Next 进行代理式编程

阿里巴巴发布 Qwen3.8-Flash-Next 模型权重,供开发者预览并评估即将推出的 Qwen4 架构。该多模态混合专家(MoE)模型包含 125B 参数主模型和 51B 额外 N-gram 嵌入,每 token 激活 6B 参数,原生支持 262,144-token 上下文窗口并可扩展至 1M tokens。开发者可在 NVIDIA GB300 NVL72 集群上对该模型进行实验。