V-Help
← 全部新闻
人工智能

AWS因AI代理负载增长限制内部CPU使用

AWS因AI代理负载增长限制内部CPU使用

图片: Tom's Hardware

简要回答

AWS因AI代理负载增长导致的资源短缺限制内部CPU使用。

亚马逊云科技(AWS)正在加强对内部计算资源使用的控制。5月,公司与工程师召开会议,要求减少EC2实例上的“浪费性”CPU消耗。目标是在AI技术推动处理器需求激增的背景下,确保为客户提供足够的计算能力。

此前,AWS工程师能够快速部署开发用虚拟机,但现在他们需要等待数天才能访问资源。变化的原因是AI代理所需的计算能力远超传统工作负载。例如,一个用于编码的代理超出预算860%,花费了180万美元用于令牌。

CPU需求增长如此之快,以至于数据中心的GPU与CPU比例接近1:1。英特尔和AMD等公司正积极扩展其AI基础设施处理器产品线。AMD最近推出了用于服务器的Zen 6“Venice”,而英伟达则在推广其基于Arm架构的Vera CPU。

尽管存在短缺,问题主要影响现货实例,而合同计算能力仍然可用。AWS继续使用AMD、英特尔及自研的Graviton5芯片以满足市场不断增长的需求。

常见问题

AWS为什么限制工程师使用CPU?
AWS面临CPU短缺,原因是AI代理负载增长及客户对计算资源的高需求。公司被迫重新分配资源以确保服务稳定运行。
AWS在EC2实例中使用哪些处理器?
AWS使用AMD、英特尔及自研的基于Arm架构的Graviton5芯片。Graviton5是目前公司最强大的CPU。
AI代理如何影响CPU需求?
AI代理需要复杂的计算编排,包括CPU工具调用和GPU操作,导致CPU需求增加。传统的GPU与CPU比例(4:1或8:1)已不再适用。
分享:

Dzen 订阅: /feed/dzen.xml · RSS: /feed.xml

为何可信

本文由 V-Help 编辑部根据一手来源整理,并标注发布日期。

发布: V-Help.ru 新闻编辑部

来源: Tom's Hardware