新闻正文
辉达(NVDA-US)正将AI代理商机延伸至开发者桌面,周五(2日)宣布10月23日通过合作品牌推出64GB版DGX Spark,售价4,999美元起,让开发者在自己的设备上运行AI模型与代理。新配置可连接两台设备扩大运算规模,显示辉达除了供应大型AI基础设施,也持续布局本地运算市场。
根据辉达公告,新产品将由宏碁(2353-TW)、华硕(2357-TW)、戴尔(DELL-US)、技嘉(2376-TW)、惠普(HPQ-US)与微星(2377-TW)推出,保留与128GB版本相同的GB10 Grace Blackwell超级芯片、DGX OS及AI软件平台。
AI代理走向本地运算 硬件与软件平台同步布局
辉达表示,64GB版本可在设备上运行最多1,000亿参数的模型,适用于AI代理、推论、微调与数据科学。开发者可让程序编写或研究代理持续运作,处理代码审查、文档分析及多步骤任务,无须每项工作都依赖云端服务。
这项产品的商业意义,在于将AI硬件需求延伸至开发者与研究团队。随着模型与代理应用在本地部署,辉达可通过GB10芯片、网络连接及CUDA软件工具,争取更多任务作流程使用其平台。不过,这是依产品设计观察的市场机会,公司尚未公布新配置的订单或出货预估。
DGX Spark支持Ollama、vLLM及PyTorch等工具,并提供辉达AI代理工具与Nemotron开放模型。月底预计推出的NVIDIA Sync Model Launcher,则将简化模型下载、启动与跨设备配置,降低用户自行设置环境的负担。
本地运算也让开发者能在自己的设备上处理数据,对重视隐私或需要持续运行代理的工作具有吸引力。但购买硬件是否比使用云端更划算,仍取决于使用频率、模型需求与维护成本。
内存容量牵动扩充 售价与实际性能仍是考验
当模型、上下文长度或同时运作的代理数量增加,内存容量就可能成为限制。辉达表示,两台64GB设备可通过内置ConnectX-7网络连接,合计提供128GB内存,支持最多2,000亿参数模型。
图:辉达
NVIDIA Sync Cluster Assistant会侦测连接设备、验证配置并设置网络,用户扩充时无须重新创建整套软件环境。在辉达的Qwen 3.8 27B测试中,两台64GB设备的性能最高达单台的1.7倍,不过这是针对特定模型的测试结果,不代表运行其他AI任务时,也能达到相同的性能提升。
从内存产业角度看,本地AI设备若逐渐普及,可望增加高容量内存的应用需求。辉达既有128GB版DGX Spark采用LPDDR5X统一内存;新64GB配置的具体供应商与采购规模,则未在这份公告中揭露。
因此,产品推出可视为本地AI市场布局的进展,尚不足以推论特定内存业者将大幅受惠。4,999美元起的售价,也意味市场仍须检验开发者是否愿意投入,以及实际性能能否支持长期使用。