tradingkey.logo
搜索

英伟达推出Nemotron 3.5 Lightning 筹备万亿参数Nemotron4大模型

金吾财讯2026年8月11日 14:35
facebooktwitterlinkedin

金吾财讯 | 英伟达(NVDA)持续扩充Nemotron开放大模型产品矩阵,正式发布Nemotron 3.5 Lightning,该模型为300亿参数专家混合模型,被视作同类当中效率领先的长期代理AI工作负载模型,用于打造更智能高效的AI代理应用。同步开源NeMo Switchyard智能路由库,可部署于主流代理工具,无需改写应用程序,即可将请求调度至适配能力的模型,实现对PC、工作站、数据中心、云端多场景AI部署的灵活管控。

据媒体报道,英伟达正在研发系列中规模最大的Nemotron4,最大版本目标参数规模或将达到一万亿,约为Nemotron3 Ultra的两倍,该项目参与研发人员数量将超过前代。今年3月英伟达组建Nemotron联盟,集结全球AI实验室共同推进开放前沿模型,Nemotron4将以此联盟成果作为研发基础。不过行业对比显示,万亿参数规模仍不及部分头部开源模型,英伟达同时看重压缩技术,挖掘小模型性能潜力。

定位层面,Nemotron4并不追求达到OpenAI、Anthropic闭源顶尖模型的能力,主打企业低成本替代方案。英伟达加大开源模型布局的逻辑在于,开放模型生态扩张能够拉动GPU硬件需求。当前英伟达芯片需求高度依赖头部实验室与云厂商,但部分大客户正在自研AI芯片,构成潜在竞争压力。加速自研开源模型,也让英伟达身处微妙处境,既要和被投资的开源初创企业竞争,也要面对自身大客户内部AI实验室的竞争。

性能测试数据显示,前代Nemotron3Ultra在多项基准测试排名靠后,与全球顶尖模型仍存在差距。Nemotron4尚未敲定最终规格与发布时间,模型训练还需数月周期,内部人员预估或在今年秋季晚些时候完成,也存在进一步延后可能。英伟达表示,布局开放模型是为了让企业、国家能够获取安全可靠的前沿开放底座,以此驱动行业创新。

免责声明:本网站提供的信息仅供教育和参考之用,不应视为财务或投资建议。

推荐文章

tradingkey.logo
风险提示:我们的网站和移动应用程序仅提供关于某些投资产品的一般信息。Finsights 不提供财务建议或对任何投资产品的推荐,且提供此类信息不应被解释为 Finsights 提供财务建议或推荐。
投资产品存在重大投资风险,包括可能损失投资的本金,且可能并不适合所有人。投资产品的过去表现并不代表其未来表现。
Finsights 可能允许第三方广告商或关联公司在我们的网站或移动应用程序的任何部分放置或投放广告,并可能根据您与广告的互动情况获得报酬。
© 版权所有: FINSIGHTS MEDIA PTE. LTD. 版权所有