日前英伟达在IFA 2026上宣布多项本地AI重大升级。三款主流智能体应用Hermes Agent、OpenClaw和Perplexity Portable Computer将支持Windows一键本地部署。用户无需手动下载模型或调整参数,程序自动检测GPU并完成配置。
在性能提升上,llama.cpp(大语言模型推理框架)最新优化在GeForce RTX 5090上实现最高1.9倍推理吞吐提升。Qwen3.6-27B模型token吞吐量提升50%,Qwen3.6-35B加速达90%。
![]()
与此同时,推理框架vLLM在RTX PRO 6000 Blackwell上实现了20%的速度提升,双DGX Spark集群则达到1.4倍提升。
除了让已有模型跑得更快,英伟达还大幅降低了本地AI的部署门槛。Perplexity Portable Computer将于9月登陆Windows和Linux平台,提供一键本地部署功能,不过需要配备24GB及以上显存的英伟达GPU。
完成本地部署后,用户可在本地完整运行工作流,不消耗积分,必要时才将部分任务提交云端,且上传前需获得用户许可。
![]()
Perplexity只是本次支持一键部署的三款应用之一。Hermes Agent由Nous Research开发,是通用型智能体。配置完成后可调用工具、跨任务保持上下文、跨会话记忆信息并随时间积累可复用技能。OpenClaw号称GitHub最大AI项目,已获超38万星标。
英伟达同步开放NVIDIA PAIR工具测试版。该工具可自动发现家庭局域网内所有兼容PC,将独立推理请求路由至空闲算力设备,实现多机协同推理。此外,PAIR还兼容Windows、macOS和Linux,支持RTX 20系列及更新GPU。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.