返回行业动态

英伟达与AWS深化合作,推出EC2 G7实例及GPU加速向量搜索

2026/06/24 11:42
查看原文

OmniTools 6月24日消息,英伟达(NVIDIA)与亚马逊云科技(AWS)宣布多项AI基础设施协同升级,旨在推动AI在生产环境中的规模化部署。双方联合推出基于NVIDIA RTX PRO 4500 Blackwell Server Edition GPU的Amazon EC2 G7实例,支持AI推理、图形渲染、空间计算及GPU加速数据分析等多类工作负载。

相较于前代G6实例,G7实例的AI推理性能最高提升4.6倍,图形性能最高提升2.1倍。单实例最多支持8颗GPU、256GB GPU显存、700 Gbps EFA网络及7.6TB本地NVMe SSD存储。该实例目前已通过AWS Deep Learning AMIs、EMR、EKS等服务提供,并即将支持Amazon SageMaker AI。

在检索层,NVIDIA cuVS库已成为Amazon OpenSearch Serverless向量搜索的默认加速引擎。该优化使GPU向量索引速度最高提升10倍,成本降至纯CPU方案的四分之一,支持在不到一小时内构建十亿级向量数据库。此外,AWS已获得NVIDIA GB300平台的Exemplar Cloud认证,标志着其在大规模AI训练工作负载中达到英伟达参考架构的严格性能标准。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部