RTX Spark搭载PC

NVIDIA于美国时间9月3日在德国柏林宣布,首款搭载Arm SoC「RTX Spark」的芯片「N1X」的PC将于10月正式上市。同时,Hermes Agent、OpenClaw和Perplexity三款AI代理应用将支持RTX GPU,实现本地模型的一键安装功能。

RTX Spark「N1X」两种配置,10月正式发售

RTX Spark是2026年COMPUTEX上发布的面向Windows PC的处理器,集成了Blackwell世代的RTX GPU与Grace CPU,配备统一内存架构。该芯片不仅能直接运行NVIDIA的AI堆栈,还支持1440p游戏体验和大型3D场景渲染。

「N1X」提供两种配置:高配版配备20核Grace CPU和6144核Blackwell RTX GPU,统一内存容量从24GB到128GB不等,适用于笔记本和迷你PC;低配版则为18核CPU和5120核GPU,内存24GB至32GB,初期仅用于笔记本。两者均以N1X命名,用户可根据核心数量选择。

合作伙伴方面,联想推出了2合1设备「Yoga 9N」,宏碁发布了迷你PC。各地区发售时间由OEM厂商决定,目标是在10月尽可能多地区同步上市。游戏支持方面,gamescom 2026上,EA与Embark Studios确认支持反作弊,游戏如《Apex Legends》、《F1》、《ARC Raiders》和《THE FINALS》均可在RTX Spark平台运行。

AI代理应用实现一键本地AI部署

此前,这些AI代理应用主要依赖云端模型,用户需自行下载和配置本地模型,门槛较高。此次更新后,安装后系统将自动选择最优模型,完成下载与配置,极大简化了使用流程。

Hermes Agent支持RTX GPU和DGX系统,将于9月面向Windows和Linux发布。刚发布2.0版本的OpenClaw也将在9月为Windows版开启一键安装功能。

Perplexity于8月推出了面向DGX Spark的本地代理「Perplexity Portable Computer」,现将扩展至支持Windows和Linux平台的RTX GPU(24GB内存以上)。该应用使用Perplexity自主训练的本地模型,复杂任务自动转至云端处理,适合税务、法律、金融等对数据隐私要求高的场景,实现本地代理与云搜索的无缝切换。

此外,NVIDIA还宣布了推理引擎的优化进展。llama.cpp通过内核优化、推测解码强化和预填充加速,实现最高1.9倍吞吐量提升;vLLM引入新XQA注意力内核,在RTX PRO 6000 Blackwell上提升1.2倍速度,双机DGX Spark配置下最高提升1.4倍。这些优化已集成于llama.cpp、LM Studio、Ollama和vLLM的最新版本中。