亚马逊云服务(AWS)近日与Meta签署了一项多年期协议,将为Meta提供云基础设施支持。
据彭博社报道,此次合作协议价值数十亿美元。
协议的核心是AWS自主研发的Graviton系列中央处理器。据悉,Meta将购买数千万个Graviton核心的使用权,并可根据需要进一步扩展。这些芯片将用于驱动Meta旗下的AI智能体业务。
AWS于去年12月正式发布了Graviton系列最新产品——Graviton5。该芯片采用三纳米制程工艺,集成了192个核心,并基于Arm Holdings广泛应用的指令集架构(ISA)。
芯片的指令集架构定义了其执行计算任务的"语言",其中的基本指令涵盖算术运算等简单操作。Arm的指令集架构还包含矩阵与向量扩展指令,专为AI工作负载进行了优化。
AWS表示,Graviton5的处理速度比上一代定制CPU提升了25%。性能提升的重要原因之一在于其三级缓存(L3 Cache)容量扩大至原来的五倍。三级缓存是紧邻处理器核心的内存池,通过缩短数据在各电路之间的传输距离,有效降低数据延迟,从而提升整体处理速度。
CPU在AI计算集群中承担多项关键任务:一方面负责协调执行神经网络大量计算的图形处理器(GPU);另一方面,Meta计划在Graviton5上运行的AI智能体也可借助CPU驱动各类工具——即智能体用于自动化任务的第三方应用程序。
Graviton5在设计上与AWS Nitro系统紧密集成。该系统将部分基础设施管理任务从CPU转移至专用加速器,从而为客户应用程序释放更多计算资源。
公有云服务商通常使用同一套基础设施资源同时运行多个客户的工作负载,并通过相互隔离来降低网络安全风险。AWS表示,Graviton5内置了Nitro隔离引擎模块,可验证不同用户的工作负载是否处于有效隔离状态。
Meta基础设施负责人Santosh Janardhan表示:"AWS多年来一直是我们值得信赖的云合作伙伴,扩展至Graviton平台使我们能够以所需的性能和效率,在我们的业务规模下运行AI智能体背后的CPU密集型工作负载。"
此次合作是Meta在过去一个月内披露的第二项重要CPU合作。此前,Meta已宣布采用Arm最新发布的AGI CPU——一款为AI服务器优化的136核处理器,并计划协助Arm设计该芯片的多个后续迭代版本。
Q&A
Q1:AWS Graviton5芯片相比上一代有哪些提升?
A:Graviton5采用三纳米制程工艺,集成192个核心,处理速度比上一代定制CPU提升25%。其三级缓存容量扩大至原来的五倍,有效缩短了数据在处理器核心之间的传输距离,显著降低延迟、提升整体处理速度。此外,Graviton5还支持Arm指令集架构中的矩阵与向量扩展指令,专门针对AI工作负载进行了优化。
Q2:Meta购买AWS Graviton芯片主要用来做什么?
A:Meta购买AWS Graviton5芯片核心使用权,主要用于驱动其AI智能体业务。在AI计算集群中,CPU负责协调GPU执行神经网络计算,同时为AI智能体提供运行工具的算力支持,帮助智能体通过第三方应用程序自动化完成各类任务。
Q3:AWS Nitro系统在Graviton5中起什么作用?
A:AWS Nitro系统是一套硬件与软件模块的集合,与Graviton5深度集成。它将部分基础设施管理任务从CPU转移至专用加速器,为客户应用程序释放更多计算资源。其中,Nitro隔离引擎模块还负责验证不同用户工作负载之间的有效隔离,从而降低网络安全风险。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。