HyperAIHyperAI

Command Palette

Search for a command to run...

GPU加速Presto在GB200 NVL72上实现低延迟分析

近日,NVIDIA与开源分布式SQL引擎Presto合作推出GPU加速版Presto,并在NVIDIA DGX B200及GB200 NVL72架构上完成深度性能验证。该方案依托NVIDIA cuDF算法与NVLink 5.0高速互联技术,有效解决超大规模数据集分析查询的高延迟痛点。基准测试显示,在单节点DGX B200配置下,八卡GPU加速的Presto处理TPC-H衍生数据集时,查询延迟较八至十节点CPU集群降低2.5至8.2倍。在扩展至多节点GB200 NVL72集群时,结合IBM Storage Scale并行文件系统,系统通过启用GPUDirect Storage技术实现存储数据直达GPU显存,彻底规避主机内存拷贝与跨节点内存开销。经I/O线程调优、批量交换重组及查询逻辑改写等联合优化后,整体查询运行时间缩短64%。目前,GPU加速版Presto已深度集成至IBM watsonx.data平台并开放技术预览。该方案为交互式分析作业与批量数据任务提供低延迟高吞吐的底层算力支持,标志着企业级大数据处理全面迈向全栈GPU化新阶段。

相关链接