VMware和 NVIDIA于今日宣布扩展双方的战略合作伙伴关系,帮助成千上万家使用 VMware 云基础架构的企业做好准备,迎接AI时代的到来。
VMware Private AI Foundation with NVIDIA 将使企业能够自定义模型并运行各种生成式 AI 应用,如智能聊天机器人、助手、搜索和摘要等。该平台将作为全集成式解决方案,采用 NVIDIA 提供的生成式 AI 软件和加速计算,基于 VMware Cloud Foundation 构建,并针对 AI 进行了优化。
VMware 首席执行官 Raghu Raghuram 表示:“生成式 AI 与多云可谓珠联璧合。客户的数据无处不在,遍布其数据中心、边缘、云等多处。我们将与 NVIDIA 一同助力企业放心地在数据附近运行生成式 AI 工作负载,并解决其在企业数据隐私、安全和控制方面的问题。”
NVIDIA 创始人兼首席执行官黄仁勋表示:“世界各地的企业都在竞相将生成式 AI 整合到自身业务中。通过与 VMware 扩大合作,我们将能够为金融服务、医疗、制造等领域的成千上万家客户提供其所需的全栈式软件和计算,使其能够使用基于自身数据定制的应用,充分挖掘生成式 AI 的潜力。”
全栈式计算大幅提升生成式 AI 的性能
为更快实现业务效益,企业希望简化并提高生成式 AI 应用的开发、测试和部署效率。根据麦肯锡的预测,生成式 AI 每年可为全球经济带来多达 4.4 万亿美元的增长。
VMware Private AI Foundation with NVIDIA 将助力企业充分利用这一能力,以定制大语言模型,创建供内部使用的更加安全的私有模型,将生成式 AI 作为一项服务提供给用户,并更加安全地大规模运行推理工作负载。
该平台计划提供的各种集成式 AI 工具,将帮助企业经济高效地运行使用其私有数据训练而成的成熟模型。这一建立在 VMware Cloud Foundation 和 NVIDIA AI Enterprise 软件上的平台预计能够提供以下方面的优势:
• 隐私:将通过能够保护数据隐私并确保访问安全的架构,使客户能够在任何数据所在地轻松运行 AI 服务。
• 选择:从NVIDIA NeMo™到Llama 2等,企业在构建和运行其模型的位置上将拥有广泛的选择空间,包括领先的 OEM 硬件配置以及未来的公有云和服务提供商解决方案。
• 性能:近期的行业基准测试表明,某些用例在 NVIDIA 加速的基础设施上运行的性能与裸机性能相当,甚至超过了裸机性能。
• 数据中心规模:虚拟化环境中的 GPU 扩展优化使 AI 工作负载能够在单个虚拟机和多个节点上扩展到最多 16 颗 vGPU/GPU,从而加快生成式 AI 模型的微调和部署速度。
• 更低的成本:将最大程度地利用 GPU、DPU 和 CPU 的所有计算资源以降低总体成本,并创建可在各个团队间高效共享的池化资源环境。
• 加速存储:VMware vSAN Express Storage Architecture 提供性能经过优化的 NVMe 存储,并支持通过 RDMA 实现 GPUDirect® 存储,从而无需 CPU 即可实现从存储到 GPU 的直接 I/O 传输。