摘要由 AI 生成
2026 年 8 月 17 日,NVIDIA 在其开发者博客中宣布利用 NVIDIA Model Optimizer 开发了基于 QAD(量化感知训练)的 Nemotron 3.5 Lightning NVFP4 模型。此前于 2026 年 6 月 26 日,NVIDIA 已发布过利用相同工具创建的 Nemotron 3 Ultra NVFP4 检查点。这两项进展均旨在通过 NVIDIA Model Optimizer 提升模型的量化精度与推理效率。
关键实体KEY ENTITIES
NVIDIANemotron 3Nemotron 3.5 Lightning NVFP4
事件框架EVENT FRAME
当前状态
NVIDIA 已发布 Nemotron 3.5 Lightning NVFP4 及 Nemotron 3 Ultra …
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
整合时间线UNIFIED TIMELINE
-
2026-06-26
发布 Nemotron 3 Ultra NVFP4 检查点
NVIDIA 发布 Nemotron 3 Ultra 模型检查点,采用创新的 4 位浮点数(NVFP4)量化格式以优化长上下文窗口下的权重传输效率。
-
2026-08-17
发布 Nemotron 3.5 Lightning NVFP4
NVIDIA 发布 Nemotron 3.5 Lightning NVFP4 检查点,基于 NVIDIA Model Optimizer 开发,在保留精度的同时将吞吐量提升最高 4 倍,并将模型压缩至 22GB(原全精度为 66GB)。
信号强度SIGNALS
关键词热度
- NVIDIA2
- Nemotron 3.5 Lightning NVFP41
- Nemotron 31
全部报道(2)SOURCES
↗
NVIDIA 发布 Nemotron 3 Ultra 模型检查点,采用其创新的 4 位浮点数(NVFP4)量化格式以优化长上下文窗口下的权重传输效率。该 NVFP4 格式是随 NVIDIA Blackwell 架构引入的新技术,旨在将模型权重压缩至更小的数据格式以提升性能。此次 Nemotron 3 Ultra 检查点由 NVIDIA Model Optimizer 工具生成,利用上述量化方案解决大模型在长上下文场景下的高效移动问题。
↗
NVIDIA 发布 Nemotron 3.5 Lightning NVFP4 检查点,在保留精度的同时将吞吐量提升最高 4 倍,并将模型压缩至 22GB(原全精度为 66GB)。该检查点基于 NVIDIA Model Optimizer 开发,旨在帮助开发者针对延迟、速度、内存和计算目标定制 Nemotron 系列模型。