智迹闻AuraTracer
EN

EVENT DOSSIER

使用 `Serve Qwen3.8-2.4T-A95B`,这是一个2.4T参数模型,支持在NVIDIA GB300 NVL72上实现可配置的推理功能。

2026-08-13 02:23 大模型 🔥 30.9 事件热度
1家信源
1天持续发酵
30.9事件热度
4个提及
摘要由 AI 生成

阿里巴巴于 2026 年 8 月 12 日通过 NVIDIA Developer Blog 宣布其最大开源模型 Qwen3.8-2.4T-A95B(Qwen3.8-Max)的公开权重。该模型拥有 2.4T 总参数,其中每 token 激活参数为 95B。它采用细粒度混合专家(MoE)架构,结合全注意力与线性注意力机制,支持高达一百万 tokens 的上下文窗口及相应输出长度,旨在为开源生态提供接近前沿的能力。

相关事件RELATED EVENTS
关键实体KEY ENTITIES
AlibabaGB300NVIDIAQwen3.8-2.4T-A95B

事件框架EVENT FRAME

产品发布

Alibaba Qwen3.8-2.4T-A95B 发布开源大模型,参数达 24 万亿

报道态势 · 每日报道量LANGUAGE SPLIT

实体关系
Alibaba × GB3001Alibaba × NVIDIA1Alibaba × Qwen3.8-2.4T-…1GB300 × NVIDIA1GB300 × Qwen3.8-2.4T-A9…1NVIDIA × Qwen3.8-2.4T-A…1

信号强度SIGNALS

关键词热度
  • Alibaba1
  • Qwen3.8-2.4T-A95B1
  • NVIDIA1
  • GB3001

全部报道(1)SOURCES

N NVIDIA Developer Blog en 2026-08-13 02:23

Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72

阿里巴巴发布其最大开源模型 Qwen3.8-2.4T-A95B(Qwen3.8-Max)的公开权重,该模型拥有 2.4T 总参数和每 token 95B 激活参数。它采用细粒度混合专家(MoE)架构,结合全注意力与线性注意力机制,支持高达一百万 tokens 的上下文窗口及相应输出长度,旨在为开源生态带来接近前沿的能力。