按该来源的展示范围,站内仅提供摘要。
前往原站阅读(在新标签页打开)NVIDIA 发布开源推理模型 Nemotron 3 Ultra,vLLM 提供 Day-0 支持
AI 导读
NVIDIA 发布开源模型 Nemotron 3 Ultra,采用 Hybrid Transformer-Mamba MoE 架构,总参数 550B、激活 55B,上下文最长 1M token,主打长时程自主智能体工作流,vLLM 提供 Day-0 支持。
vLLM 官方博客(RSS)
精选
61
AI 编辑部评分,满分 100NVIDIA 发布开源推理模型 Nemotron 3 Ultra,vLLM 提供 Day-0 支持
NVIDIA 发布开源模型 Nemotron 3 Ultra,采用 Hybrid Transformer-Mamba MoE 架构,总参数 550B、激活 55B,上下文最长 1M token,主打长时程自主智能体工作流,vLLM 提供 Day-0 支持。
推荐理由
原文给出架构细节、部署配置和与 GLM 5.1、Kimi K2.6、Qwen3.5 的基准对比,读者可据此评估其在长时程智能体工作流中的适用性。
来源:vLLM 官方博客(RSS)· vllm.ai