Ollama 博客 4小时前 · 2026-09-02 17:19:45 · 0 阅读
NVIDIA Nemotron 3 Ultra 上线 Ollama 云端
NVIDIA Nemotron 3 Ultra 现已上线 Ollama 云端。这是 NVIDIA 推出的 5500 亿参数(55B 激活)开源模型,专为长周期、智能体工作流打造,能在数百次工具调用中保持快速且实惠的性能。
图 1:在智能体生产力、代码和指令遵循的基准测试中,Nemotron 3 Ultra 在开源模型中表现领先。
图 2:在开源模型中,Nemotron 3 Ultra 处于最具吸引力的象限,兼具领先准确率和领先吞吐量。
模型亮点
- **专为长周期智能体打造**:针对智能体编排、代码助手、深度研究和跨数百步骤的复杂企业工作流进行了调优。
- **100 万 Token 上下文**:无需丢失上下文,即可将整个代码库、长工具历史和研究轨迹纳入视野。
- **前沿推理,高效能**:总参数 550B,每 Token 仅激活 55B,并针对 NVFP4 进行了优化——这是 NVIDIA 的 4 位浮点格式,能将模型压缩至更少内存并提升运行速度。
快速开始
下载 Ollama,然后使用你喜欢的工具运行 Nemotron 3 Ultra。 **Claude Code**ollama launch claude --model nemotron-3-ultra:cloud
**Hermes Agent**
ollama launch hermes --model nemotron-3-ultra:cloud
**OpenClaw**
ollama launch openclaw --model nemotron-3-ultra:cloud
**通用对话**
ollama run nemotron-3-ultra:cloud
查看 更多集成方式。
性能基准
在智能体生产力、指令遵循和长上下文任务方面,Nemotron 3 Ultra 准确率领先,同时吞吐量也处于领先地位——相比其他领先的开源模型,可节省高达 30% 的成本。
图 1:在智能体生产力、代码和指令遵循的基准测试中,Nemotron 3 Ultra 在开源模型中表现领先。
图 2:在开源模型中,Nemotron 3 Ultra 处于最具吸引力的象限,兼具领先准确率和领先吞吐量。
图 3:Nemotron 3 Ultra 可节省高达 30% 的成本,并处于成本效率前沿的最优位置。
参考
- NVIDIA Nemotron 3 Ultra 博客
- Ollama 模型页面
原始来源: Ollama 博客