英伟达近日正式发布了一款全新的开源人工智能模型——Nemotron 3.5 Lightning,进一步扩展了其Nemotron 3系列模型的应用范围。这款模型拥有300亿参数,采用混合专家(MoE)架构,专为大型多智能体系统中的特定任务设计,旨在推动智能体应用向更智能、更高效的方向发展。
与同类模型相比,Nemotron 3.5 Lightning在输出速度方面表现尤为突出,能够实现最高4倍的提升。这一优势使得智能体任务的整体完成效率提高了30%,为开发者提供了更快速、更灵活的解决方案。无论是处理复杂任务还是优化实时响应,该模型都展现出强大的竞争力。
在部署灵活性方面,Nemotron 3.5 Lightning同样表现优异。它支持直接在本地AI系统上运行,兼容NVIDIA RTX PC、NVIDIA DGX Spark、NVIDIA DGX Station以及NVIDIA Jetson等设备。同时,该模型还可无缝扩展至企业级应用场景,覆盖边缘AI设备、NVIDIA RTX PRO工作站、数据中心及云端环境,满足不同规模和需求的使用场景。
目前,Nemotron 3.5 Lightning已通过多个平台开源,开发者可通过以下链接获取模型资源:Hugging Face(https://huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4)、ModelScope(https://modelscope.ai/collections/nv-community/Nemotron-35-Lightning)、OpenRouter(https://openrouter.ai/nvidia/nemotron-3.5-lightning:free)以及NVIDIA官方平台(https://build.nvidia.com/nvidia/nemotron-3.5-lightning-30b-a3b)。这一举措将进一步推动AI技术的开放与协作,为全球开发者提供更多创新可能。




