关于ZAKER Skills 合作
财联社-深度 10分钟前

英伟达发力“本地 AI ”!N1X 设备 10 月登场 家庭算力路由器亮相

财联社 9 月 4 日讯(编辑 史正丞)随着轻量化 AI 模型的快速迭代,算力巨头英伟达正在抓紧布局 " 个人本地 AI" 赛道的一系列软硬件产品。

英伟达周四发布公告称,NVIDIA RTX Spark 设备将于今年 10 月开始出货

这款电脑的核心卖点正是英伟达的 N1X 芯片。为了能在本地跑 AI,这款芯片支持最高 128GB 的统一内存,芯片搭载的 Blackwell GPU 能够提供最高每秒千万亿次浮点运算能力。

周四的最新消息也确认,N1X 芯片有两个版本,核心差异依然是内存规格。

其中," 满血 " 版 N1X 芯片配备 6144 个 CUDA 核心的 Blackwell GPU,以及 20 核 Grace CPU,支持 24GB 至 128GB 的统一内存,用于超高端笔记本电脑和桌面紧凑型主机。

另一个规格的 N1X 芯片 GPU 核心降至 5120 个,CPU 核心降至 18 个,同时只支持 24GB 至 32GB 的统一内存。考虑到 32GB 显存只能跑得动约 300 亿参数量的模型,这个版本的配置更像是传统游戏本。

目前仍不清楚 N1X 产品线的定价情况,但鉴于 " 内存浩劫 " 依然笼罩消费电子市场,可以预期下个月上架的新一代 AI PC 势将价格不菲。

随着消费者手上能在本地跑 AI 的设备越来越多,充分利用家庭算力这件事,也被英伟达放上台面

公司周四宣布,推出开源个人 AI 路由器软件 NVIDIA PAIR(Personal AI Router),用来同步家里的 " 一众电脑 ",处理本地 AI 推理任务。

PAIR 可以自动发现同一网络中的兼容电脑,将这些设备连接起来,协同处理本地智能体的算力需求。通过这款软件,英伟达还顺手把苹果算力设备拉进了自己的体系。

据悉,目前兼容设备主要包括搭载英伟达显卡的电脑,包括 RTX 20 系列及之后的显卡,以及 RTX Pro GPU 和 DGX Spark 系统。同时,搭载苹果 M4 或更新芯片的设备也可以使用

这款应用的关键之处在于,它会优先利用家中设备的空闲算力,尽量避免影响设备正在执行的其他任务。英伟达还表示,PAIR 能够随着设备加入或离开网络自动调整计算资源。例如,当用户开始在台式电脑上玩游戏时,PAIR 可以相应减少或停止使用这台电脑的算力。

在媒体简报会上,英伟达产品经理塞斯 · 施奈德表示,公司设想中的 PAIR 用户会拥有一套类似 "MacBook/Windows 笔记本电脑加一台游戏 PC" 的配置。

施奈德还描绘了这样一个场景:父亲拥有一台搭载 Spark 笔记本和一台 DGX Spark 台式机,母亲使用 RTX 5090 笔记本,女儿有一台游戏台式机,儿子则使用 MacBook Pro

施奈德估算,在这个相当极端的案例中,该家庭拥有大约 65 万亿次浮点运算 / 秒(165 TFLOPS)的未充分利用算力。他表示:" 如今散落在千家万户里的这些闲置算力,实际上就是一座免费的词元宝库。"

演示测试中,在使用千问 3.6 35B A3B 模型时,如果仅在一台英伟达 Spark 笔记本上运行,完成一项智能体任务平均需要 18 分钟。

相比之下,由一台 RTX Spark 笔记本、一台 DGX Spark 和一台 RTX 5090 设备组成的三设备 PAIR 集群,平均仅需 8 分 48 秒即可完成,耗时缩短约一半。

除了 PAIR 之外,英伟达还宣布,三款主要的 AI 智能体应用—— Perplexity Portable Computer、Hermes Agent 和 OpenClaw ——将在 Windows 平台上针对英伟达 GPU 提供更简化的本地部署方式

新的安装体验旨在让用户只需点击几下,就能在本地完成 AI 智能体的部署并启动运行,从而减少前期所需的手动配置工作。

除了 PAIR 外,英伟达还宣布,三款主要 AI 智能体应用(Perplexity Portable Computer、Hermes Agent 和 OpenClaw)将获得更简化的本地部署方式。新的安装体验旨在让用户只需点击几下,就能在本地完成 AI 智能体的部署并启动运行

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容