热点事件 历史事件

作者实测 Qwen3.8-27B 在 Jetson 上以 NVFP4 加 DFlash2 为最快推测解码配置,SpeedBench 各类负载吞吐 27.69–34.44 output tokens/s

1 篇报道1 个精选信源

先了解这件事

报道摘要

NVIDIA 发布教程,讲解在 Jetson 上部署新一代开放推理模型的方法,以 Nemotron 3.5 Lightning 和 Qwen3.8-27B 为例。

摘自 NVIDIA Technical Blog:Agentic AI / Generative AI

报道时间线

沿着报道,了解事件的不同侧面。

显示 1全部报道最新在前
  1. NVIDIA Technical Blog:Agentic AI / Generative AI官方一手精选
    NVIDIA 讲解如何在 Jetson 上部署和优化推理模型

    NVIDIA 发布教程,讲解在 Jetson 上部署新一代开放推理模型的方法,以 Nemotron 3.5 Lightning 和 Qwen3.8-27B 为例。