英伟达(NVIDIA)为DGX及RTX系统发布了重大更新,以支持诸如Nemotron 3.5、LTX 2.5等新的开放模型。
除了发布Nemotron 3.5 Lightning之外,英伟达还在客户端“AI PC”方面带来了重大更新。这些更新针对英伟达的DGX和RTX平台,通过更快的性能和优化来加速开放AI模型,并为这些平台增添新功能,进一步丰富PC平台体验。

据传AMD将在IFA 2026上发表开幕主题演讲,Jack Huynh将带来包括Ryzen AI MAX 400发布在内的消费端惊喜公告。
以下是今日发布的主要亮点:
利用NVIDIA Sync集群助手扩展DGX Spark —— 将两台或更多系统连接成高速集群,并简化网络配置、工作负载路由和健康监控。
从DGX Spark中获得更多 —— 谷歌Chrome浏览器将以原生ARM64 Linux构建版本登陆,全新的NVIDIA Sync资源监视器将提供单系统或整个集群的实时及历史CPU和GPU视图。
本地运行Meta的Muse Glimmer —— 这款30B开源权重模型针对常驻本地代理进行了优化,在RTX 5090上每秒可生成超过200个词元。
使用LTX-2.5在本地创作高质量视频 —— 这款开放视频模型新增了多镜头生成和生成式编辑功能,在英伟达RTX GPU、DGX Spark和DGX Station上性能提升2倍,内存节省40%。
探索更多由英伟达加速的开放模型 —— 包括Cosmos 3 Edge、MiniMax-H3、Poolside的Laguna S 2.1、DeepSeek-V4-Flash、Thinking Machines Lab的Inkling-Small、Unsloth Desktop和Wan-Animate-2。
从新的开放模型支持开始,英伟达的DGX和RTX平台现已全面支持Cosmos 3 Edge(40亿参数)、MiniMax-H3(330亿参数)、Laguna S 2.1(1180亿参数)、DeepSeek V4-Flash(2840亿参数)、Wan-Animate-2(140亿参数)和Inkling-Small(2760亿参数)AI模型。
英伟达还带来了对Unsloth Desktop的支持,该应用今日上线,以完全开源桌面应用的形式增加了本地模型推理、图像/视频扩散、微调、代理集成、网络研究和代码执行功能。
英伟达的RTX平台(如RTX 5090和RTX PRO 5000 Blackwell)在Wan-Animate-2中分别比苹果M3 Ultra实现了高达26倍和16倍的性能提升,为用户提供了将驱动视频中的动作和面部表情迁移到静态角色图像上的开源权重模型。
谈及生成式AI,LTX-2.5是一款全新的视频生成模型,采用全新的扩散视频解码器,与变分自编码器视频解码器形成互补,通过提供第二条解码路径来提升视频质量,实现更高质量的最终渲染。
在LTX 2.5中,RTX PRO 6000 96GB GPU在创建视频时可提供20%的更快性能和40%的内存节省。用户还可以利用英伟达的NVFP4、FastVideo和ComfyUI来增强文本、图像和视频到视频的生成效果。
Meta还发布了Muse Glimmer,这是其最新的300亿参数开源权重模型,支持12万+上下文视频,专为编码和智能体AI而设计。该模型针对英伟达的RTX和DGX系统进行了优化,同时支持英伟达的Jetson平台,在单张RTX 5090 GPU上可驱动超过200 TPS。Muse Glimmer的一些功能包括:
自定义智能体:使模型适应特定任务、工具、数据和专业领域。
私有数据处理:读取、总结并对本地文件、文档、电子邮件和消息执行操作。
凭据处理:使用应用程序编程接口密钥、认证令牌和其他敏感信息,同时保持推理在设备上进行。
多步骤任务:完成许多顺序工具调用,并从错误或意外结果中恢复。
长时间运行的工作流:将大型项目分解为步骤,跟踪进度,并在上下文完整的情况下恢复中断的会话。
DGX Spark“同步集群”可运行多系统,谷歌Chrome获原生ARM64“Linux”版本
具体到DGX Spark,英伟达有几个重大更新。首先是“NVIDIA同步集群助手”的发布,它使得将多个DGX Spark PC集群在一起变得容易得多,为更大模型增加了内存、推理和计算能力。该功能在Windows和macOS上均可用。
DGX Spark还将获得作为原生ARM64 Linux构建的谷歌Chrome浏览器,可直接从DGX OS上的DGX仪表板安装。此外还有全新的NVIDIA同步资源监视器,可提供单个或集群DGX Spark系统的CPU和GPU使用率的实时和历史视图。
英伟达通过在DGX和RTX平台上提供更快的性能、更智能的优化以及对最新开放AI模型的广泛支持,持续引领AI PC领域。
从将DGX Spark系统集群化以获得更大规模,到运行Meta Muse Glimmer(RTX 5090上每秒超过200词元)等高速本地模型,以及通过LTX-2.5增强视频生成,这些更新为用户提供了更强大、高效、多功能的设备端AI能力,巩固了英伟达在AI PC革命前沿的地位。



