RTX 5090用户狂喜!英伟达免费送1.9倍AI性能:本地跑模型再也不用折腾
最新9月4日消息,英伟达在IFA 2026上宣布多项本地AI重大升级。三款主流智能体应用Hermes Agent、OpenClaw和Perplexity Portable Computer将支持Windows一键本地部署。用户无需手动下载模型或调整参数,程序自动检测GPU并完成配置。

在性能提升上,llama.cpp(大语言模型推理框架)最新优化在GeForce RTX 5090上实现最高1.9倍推理吞吐提升。Qwen3.6-27B模型token吞吐量提升50%,Qwen3.6-35B加速达90%。
与此同时,推理框架vLLM在RTX PRO 6000 Blackwell上实现了20%的速度提升,双DGX Spark集群则达到1.4倍提升。

除了让已有模型跑得更快,英伟达还大幅降低了本地AI的部署门槛。Perplexity Portable Computer将于9月登陆Windows和Linux平台,提供一键本地部署功能,不过需要配备24GB及以上显存的英伟达GPU。
完成本地部署后,用户可在本地完整运行工作流,不消耗积分,必要时才将部分任务提交云端,且上传前需获得用户许可。
Perplexity只是本次支持一键部署的三款应用之一。Hermes Agent由Nous Research开发,是通用型智能体。配置完成后可调用工具、跨任务保持上下文、跨会话记忆信息并随时间积累可复用技能。OpenClaw号称GitHub最大AI项目,已获超38万星标。
英伟达同步开放NVIDIA PAIR工具测试版。该工具可自动发现家庭局域网内所有兼容PC,将独立推理请求路由至空闲算力设备,实现多机协同推理。此外,PAIR还兼容Windows、macOS和Linux,支持RTX 20系列及更新GPU。

《RTX 5090用户狂喜!英伟达免费送1.9倍AI性能:本地跑模型再也不用折腾》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
行业竞争压力加剧 铠侠另辟蹊径:推动NAND替代部分DRAM
快科技9月4日消息,铠侠近日公布了一项战略规划,通过增强型NAND闪存技术替代部分DRAM功能,以深化与美国主要科技公司的合作,并应对竞争对手带来的市场压力。铠侠存储技术负责人松寺胜树(Ka... -
字节新一代豆包手机确认采用长鑫内存:国产高速LPDDR5X内存首次量产落地应用
快科技9月4日消息,长鑫存储近日宣布,由字节跳动与中兴通讯联合打造的新一代豆包手机将率先搭载其最高速率达10667Mbps的LPDDR5X内存。官方表示,这是国产高速LPDDR5X内存芯片(速率达10667Mb... -
HBM被降维打击!美国发布垂直堆叠3D-DRAM AI芯片:100TB/s带宽、能效超13.5倍
快科技9月4日消息,美国AI芯片初创d-Matrix近日在Hot Chips 2026上详细介绍了其Raptor 3D-DRAM生成式AI推理加速器。该芯片采用台积电N4逻辑裸片与3D-DRAM面对面堆叠的架构,将内存直接置于计算芯... -
美光吹响反击号角!HBM4产能翻倍直追三星海力士:年底10万片
快科技9月4日消息,美光科技正计划在今年年底前进行大规模设备投资,全力提升最新一代HBM4 12层产品的供应能力。此举意在弥补与三星电子、SK海力士在HBM产能上的差距,抢夺更多市场份额。据悉... -
翻倍式涨价不存在 内存、闪存下半年涨速崩盘:但先别太高兴
快科技9月4日消息,过去一年的内存、闪存大涨价让大家触目惊心,内存价格普遍涨了5-10倍,闪存少说也有3-5倍,但是今年下半年这样动不动就翻倍上涨的局面就不一样了,增速直接崩盘。来自Trend...












