品玩

科技创新者的每日必读

打开APP
关闭

NVIDIA发布开源模型Nemotron 3.5 Lightning

8月12日

品玩8月12日讯,据英伟达官方消息,NVIDIA近日推出开源模型Nemotron 3.5 Lightning,专为长时间运行的AI智能体执行层设计,旨在以更低成本和延迟处理高频任务。

该模型为300亿参数的混合专家(MoE)架构,激活参数仅30亿。通过混合专家路由机制,每次仅调用部分参数,实现大模型能力与小模型计算成本的平衡。模型采用推测解码、量化等技术,并针对OpenClaw、Hermes Agent等智能体框架优化训练,在保持高精度的同时,输出速度达同类模型的4倍。

NVIDIA同步推出NeMo Switchyard库,可智能分配任务至最合适的模型,实现复杂规划与高频执行的分工协作。该模型支持在DGX Spark、Jetson及GeForce RTX 5090等设备本地部署,并兼容Ollama、llama.cpp等主流工具。

目前,模型权重、训练数据及配方已按OpenMDW-1.1协议开源,开发者可通过Hugging Face、ModelScope等渠道获取。

取消 发布

下载品玩App,比99.9%的人更先知道关于「英伟达」的新故事

下载品玩App

比99.9%的人更先知道关于「英伟达」的新故事

iOS版本 Android版本
立即下载
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测