首页 > 教程攻略 > 热点新闻 >英伟达发布5500亿参数开源模型,推理速度最高提升5倍

英伟达发布5500亿参数开源模型,推理速度最高提升5倍

来源:互联网 时间:2026-08-24 19:32:19

在人工智能智能体日益成为企业运营核心助手的背景下,模型效率与成本成为关键制约因素。英伟达最新发布的开源模型,旨在为这一领域带来显著的性能突破。

英伟达发布5500亿参数开源模型,推理速度最高提升5倍

英伟达近日正式推出了Nemotron 3 Ultra模型,这是一个拥有

5500亿参数

的混合专家模型。官方数据显示,与同级别的主流前沿开源模型相比,该模型在推理速度上实现了

最高5倍的提升

,同时使用成本

最高可降低30%

。这一进步旨在为代码开发、科研以及企业业务流程中的长效运行智能体,提供更强大且经济高效的智能支持。

模型适配与平台整合

为了加速企业应用,Nemotron 3 Ultra已经完成了针对主流智能体平台与调度框架的后置训练和适配。这意味着企业可以便捷地将其集成到现有的智能体管理生态中。具体支持的框架包括Hermes Agent、LangChain Deep Agents、OpenClaw、OpenHands以及OpenCode等,覆盖了从任务编排到代码生成的多种应用场景。

企业级应用案例与成效

目前,基于Nemotron模型的新一代长效人工智能智能体已经在多家企业平台落地。网络安全公司CrowdStrike利用该模型构建专用智能体,实现了对系统漏洞的

不间断排查、风险等级划分以及配置错误修复

,不仅提升了抵御网络攻击的速度,也显著减轻了安全团队的人工运维压力。

另一家公司Palantir则将Nemotron模型集成到其前线部署工程师人工智能平台中,使智能体能够自主执行复杂任务。同时,平台通过持续学习智能体的交互数据,不断迭代优化,从而构建出更贴合特定业务需求、甚至能在物理隔离环境中运行的企业级系统。

发布计划与获取方式

据悉,Nemotron 3 Ultra模型预计将于

6月4日

正式对外提供。用户可以通过Hugging Face、ModelScope、OpenRouter以及英伟达官方开发者网站build.nvidia.com,以NVIDIA NIM™微服务的形式获取。此外,该模型也将通过广泛的英伟达云合作伙伴生态系统、推理平台以及主流云服务提供商进行分发,以降低企业的使用门槛。