随着云容量需求趋紧,亚马逊云科技已要求工程师节约计算资源并关闭闲置的EC2实例,压力如今已从AI芯片扩展至传统CPU服务器。据The Information报道,过去通常数小时内就能获得CPU服务器资源的工程师,如今反映需要等待数天,这一不寻常的延迟表明AWS正努力为付费客户保留容量余地。 AWS管理层于5月召集工程师并表示,各团队需要尽一切可能节约算力,以便公司的核心EC2业务能够继续满足客户需求。相关举措包括在今年晚些时候减少内部资源占用,并将未被充分使用的开发实例回收给外部客户。AWS表示,仍能满足绝大多数内部和外部客户的需求,并正与各团队合作以保持EC2利用效率。 这种紧张局面似乎与AI代理的迅速普及有关。随着AI代理在运行中执行任务,以及企业为模型训练准备数据,对通用计算资源的持续需求正在增加。Elendil Labs联合创始人兼董事总经理Jing Xie表示,由于大规模使用AI代理,客户的人均IT支出已翻倍。芯片制造商也在描述AI推理中CPU使用加重的转变:英特尔首席执行官Lip-Bu Tan于4月表示,CPU与GPU的比例为1比4,而英特尔首席财务官David Zinsner于7月表示,该比例已升至接近1比1。 AWS表示,其员工资源指导并未因存储芯片供应紧张而发生变化,但警示信号正在现货实例市场浮现:可打折购买的剩余容量已更难以大批量获得。分析师称,这可能表明AWS供需之间的缺口正在缩小;对于依赖现货容量运行大规模工作负载的企业而言,云成本也可能面临上行压力。类似的资源分配压力也已在其他大型科技公司出现,包括谷歌和微软;在内部AI需求与外部客户需求之间寻求平衡之际,云服务提供商正承受更大压力。