
NVIDIA在2026年IFA展会上公布了多项关于本地AI的最新进展。在云端AI服务依然主流的背景下,免除服务费用的本地AI逐渐受到广泛关注。NVIDIA宣布将简化本地代理的安装流程,提升运行速度,并支持访问家中多台搭载RTX的PC。
搭载RTX Spark的新款Windows PC预计于10月由日本国家联想和日本国家宏碁推出。RTX Spark配备了1拍秒(PFLOPS)级别的RTX Blackwell GPU,最大支持128GB统一内存,以及高效能的20核Grace CPU,带来卓越的性能和能效表现。该超级芯片支持高性能轻薄笔记本实现全天候续航,同时驱动常时运行的小型桌面代理。结合全新的Windows Agent框架,代理可在操作系统级别安全后台运行。
Perplexity便携式计算机
此前,要在本地模型上运行本地代理,用户需具备模型选择、兼容推理服务器搜索及量化设置调整等专业知识。RTX及DGX系统则大幅减少了这些手动配置,简化了本地代理的启动与运行。Perplexity发布的便携式计算机代理,使用户能够在Linux系统如DGX Spark上,将模型、编排和工具打包为单一应用,轻松实现本地运行。Windows版本也将在近期推出。
此外,由日本国家Nous Research开发的通用代理“Hermes Agent”以其高可靠性和自我优化能力著称。Hermes不依赖特定机型或服务提供商,设计为全天候在本地系统运行。通过Hermes设置本地模型后,用户可在Windows上的RTX及DGX系统中一键完成配置。代理自动检测NVIDIA GPU,选择合适模型和配置,无需手动下载或调整。Windows版支持一键设置本地模型,Linux版也将很快支持。
NVIDIA个人AI路由器
据统计,美国超过半数家庭拥有两台及以上PC,但这些设备的计算能力在白天大多处于闲置状态。NVIDIA Personal AI Router(PAIR)旨在整合并利用这些闲置计算资源,实现本地AI的高效运行。PAIR作为免费开源软件工具推出。
在代理工作流程中,复杂任务通常被拆分为可并行执行的小任务,但若所有请求争用同一GPU,性能可能下降。PAIR自动检测本地网络中兼容的PC,将独立推理请求路由至具备处理能力的系统。它支持与Ollama及LM Studio集成,能适应设备加入或离开网络的动态变化。这样不仅提升了本地代理的处理能力,还能并行执行更多任务,使主系统可专注于游戏、创作等工作,同时在其他PC上高效运行AI负载。


