NVIDIA 发布 Nemotron 3.5 Lightning:30B 总参数、3B 激活
NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4
NVIDIA 发布 Nemotron 3.5 Lightning 30B-A3B-NVFP4,采用混合 Mamba-2、MoE 与注意力架构,支持 1M 上下文和推测解码。
一分钟读懂
NVIDIA 发布 Nemotron 3.5 Lightning 30B-A3B-NVFP4,采用混合 Mamba-2、MoE 与注意力架构,支持 1M 上下文和推测解码。
模型总参数约 30B、每 token 激活约 3B,并提供 NVFP4 权重。
仅激活约 3B 参数的长上下文模型面向高吞吐 Agent 推理,显示开放模型正在围绕单位任务成本做更激进的架构优化。
这件事情本身是什么
模型总参数约 30B、每 token 激活约 3B,并提供 NVFP4 权重。
架构混合 Mamba-2、MoE 与注意力,加入 MTP / 推测解码以提升吞吐。
模型使用 OpenMDW 1.1 许可证,不能笼统写成无条件开源。
