快讯资讯
手机优化
系统数码
网络通信人工智能
网站游戏
测评专题
智车

  AI和HPC推动对更高密度的       JVM 内存大对象监控和优    

AI和HPC推动对更高密度的数据中心、新的即服务产

时间:2026-10-08 16:56 来源:未知 人气:

AI和HPC的电力和冷却需求需要专业知识和能力,运营和工程也需要具备专业知识。

正如数据中心发现自己需要处理电力、空间和可持续发展等新问题一样,最新的尖端技术、AI和机器学习给所有这些问题带来了挑战。

这并不是说必须面对的这些问题是新的,而是AI的采用正在以前所未有的速度发生。在一年左右的时间内,托管提供商将需要进行调整,以应对企业对高密度数据中心的新的、更大的需求。

那么,这实际上意味着什么呢?似乎不太可能有一大批客户投资数百万美元购买AI专用硬件,敲响托管提供商的大门,那么数据中心需要提供什么呢?

电力和冷却优先

在基础设施方面,电力和冷却的可用性将是客户首先寻求的。但是,提供商是否需要能够支持整个数据大厅的NVIDIA H100规模的GPU,或者更有可能的是,具有4或8个GPU服务器和适当存储的单个机架就是所需的全部?

当然,对于相对简单的单一AI服务器部署,单机架解决方案可能需要支持50kW或更多。正如我们最近指出的,处理这种工作负载的技术已经在许多设施中到位,但它只是将AI部署到主机托管中的一个起点。

对于提供商和客户来说,现在和未来的中期解决方案是AI即服务解决方案。

换句话说,托管客户大规模AI部署的市场正开始推动需求,因为似乎每个人都有兴趣涉足其中。这意味着,拥有各自云的微软、谷歌、亚马逊甚至甲骨文都将看到客户希望使用其按需配置来测试、评估并潜在地部署云AI服务。

谁将推动这一需求?

但进入提供AI云服务的不仅仅是顶级参与者。在最近的Computex 2023大会上,英伟达特别强调了他们的云合作伙伴,除了四大之外。

Cirrascale就是一个这样的例子,他们最初是作为HPC按需计算的提供商而成名的。他们现在提供他们的AI创新云,该云利用支持基础设施为客户提供评估AI/ML系统的机会。他们对AI托管的承诺反映在客户可供选择的方面。

客户不仅可以选择使用前几代和当前几代NVIDIA AI硬件,该公司还可以托管他们的GraphCloud,利用Graphcore的BOW IPU;Cerebras的AI Model Studio在他们托管的Cerabras云上运行;以及SambaNova的数据流即服务和基础模型。

这是四种领先的加速AI/ML技术,它们不是Google或AWS,这两家公司除了自己的内部设计外,还提供Nvida GPU。Cirrascale也可能是这些相互竞争的技术的唯一来源,在某些情况下,还提供互补技术,甚至在他们的云中提供不同技术的公开定价模型。

Lambda Labs采取了一种略有不同的方法,他们提供五种不同级别的基于Nvidia的托管服务,以及为你的ML硬件和软件堆栈设计的全面托管服务。它们提供专为GPU计算工作负载设计的高密度电源和冷却。此外,他们还可以在你的数据中心或其数据中心内部提供其设计的GPU群集。

更多文章

相关文章

网站导航: | 快讯 | 资讯 | 手机 | 优化 | 系统 | 数码 | 网络通信 | 人工智能

  • 游戏 | 测评 | 专题 | 智车

    合作伙伴:

  • 友情链接(欢迎业界知名网站交换链接)申请友情

    

    声明:本站资源皆来自网络,如有侵权问题,请联系管理员处理!

    Copyright ©2020-2028快知站 版权所有 All rights reserved.

    闽ICP备20010713号-1 闽公网安备 35020602001684号