英伟达推出DGX/RTX重大AI更新:RTX 5090跑200 token/秒 成本大降67%

英伟达发布DGX/RTX系列AI更新,RTX 5090推理超200 token/秒,开源路由库让智能体任务成本降67%。

英伟达推出DGX/RTX重大AI更新:RTX 5090跑200 token/秒 成本大降67%

游民星空

下载游民App,掌握一手游戏情报

英伟达推出DGX/RTX重大AI更新:RTX 5090跑200 token/秒 成本大降67%

快科技 红茶 2026-08-12 12:13
0

快科技8月12日消息,当地时间8月11日,英伟达宣布为DGX与RTX系统推出一系列重大AI更新。

游民星空

经深度适配优化的Meta开源300亿参数稠密架构Muse Glimmer模型,在RTX 5090上的推理速度超过每秒200个token。同期发布的开源模型路由库NeMo Switchyard,可根据任务复杂度、成本和延迟动态选择最优模型,将智能体任务成本降低67%。

游民星空

英伟达还推出一款主打极致效率的开源模型Nemotron 3.5 Lightning。这是一款300亿参数的MoE模型,官方称其token生成速度为同类模型的4倍,智能体任务完成时间缩短30%,并支持在RTX PC、DGX Spark、DGX Station及Jetson平台本地运行。

在视频生成方面,LTX 2.5开源视频模型新增多镜头生成与生成式编辑功能,在英伟达RTX GPU、DGX Spark和DGX Station上实现2倍性能提升与40%显存节省。DGX Spark平台则新增集群组建、资源监控等能力。

游民星空

目前,英伟达RTX平台已全面支持Cosmos 3 Edge、MiniMax-H3、DeepSeek V4-Flash等多款开源模型。

责任编辑:何念穿堂风

APP精彩推荐打开游民APP查看更多

相关内容 打开游民APP查看更多

在线玩推荐更多