热点事件 历史事件
作者实测 Nemotron 3.5 Lightning 在 Jetson 上以 NVFP4 加 DSpark 为最快推测解码配置,SpeedBench 各类负载吞吐 123.01–138.02 output tokens/s
先了解这件事
报道摘要NVIDIA 发布教程,讲解在 Jetson 上部署新一代开放推理模型的方法,以 Nemotron 3.5 Lightning 和 Qwen3.8-27B 为例。
报道时间线
沿着报道,了解事件的不同侧面。
显示 1 篇全部报道,最新在前
- NVIDIA 讲解如何在 Jetson 上部署和优化推理模型
NVIDIA 发布教程,讲解在 Jetson 上部署新一代开放推理模型的方法,以 Nemotron 3.5 Lightning 和 Qwen3.8-27B 为例。