亚马逊公司计划向Anthropic PBC投资最高250亿美元,并为其提供大量额外的计算资源。
双方今日宣布扩大合作,这一合作关系可追溯至三年前。亚马逊此前曾专门为Anthropic内部工作负载构建了一个名为"Project Rainier"的AI集群,并已向这家AI开发公司投入80亿美元。
在新一轮扩展合作框架下,亚马逊将再向Anthropic追加50亿美元投资,并计划在未来某一时间点再追加最高200亿美元。与此同时,Anthropic承诺在未来十年内在亚马逊云科技(AWS)上累计投入超过1000亿美元,并将因此获得最高5吉瓦的算力支持。
Anthropic今日还披露,公司目前已使用超过百万枚AWS定制芯片Trainium2。其中大量芯片部署于AWS专为其搭建的Project Rainier集群内。该集群规模位居全球同类集群前列,已于去年正式投入运营,分布于多个数据中心。
在芯片供应方面,Anthropic将于今年6月底前获得更多Trainium2芯片的使用权限。下半年,AWS还将进一步扩充算力,新增基于Trainium2及性能更强的新一代Trainium3芯片的计算资源。Anthropic表示,上述升级将为其提供接近1吉瓦的算力。
Trainium3于去年12月正式亮相,内置8个核心,综合性能是Trainium2的两倍。开发者可选择将多个核心合并为一个名为LNC(大型逻辑核心)的单一逻辑单元,以加速特定工作负载的处理效率。
AWS将Trainium3部署于自研服务器中,在处理MXFP8数据时,单台服务器最高可提供362 PetaFLOPS的算力。每台服务器搭载144枚加速器,通过名为NeuronSwitch-v1的交换机进行数据交互,该交换机采用定制化设计,带宽是AWS上一代网络设备的两倍。
此次合作还将涵盖AWS即将推出的Trainium4芯片。据AWS介绍,基于该芯片构建的服务器在处理FP4数据时,性能将超过2 ExaFLOPS。Anthropic还将拥有优先使用Trainium4后续更高级AI芯片的权限。
在CPU方面,Anthropic将搭配使用AWS Graviton系列处理器与上述AI加速芯片协同运算。最新一代Graviton芯片配备96个核心,每个核心内置2MB二级缓存。Anthropic计划租用相当于数千万个Graviton核心的CPU算力。
在市场化落地层面,双方计划将"Anthropic原生Claude完整控制台"引入AWS生态。此次整合将使用户能够借助云服务商的账单管理、运营监控及账户管理等功能直接调用Claude系列AI模型,从而避免重复的管理流程。
"与亚马逊的合作将使我们能够持续推进AI研究,同时为客户提供Claude服务,其中包括在AWS上进行开发构建的逾10万名用户。"Anthropic联合创始人兼首席执行官达里奥·阿莫代伊表示。
Q&A
Q1:亚马逊此次向Anthropic投资的总金额是多少?
A:根据双方最新合作协议,亚马逊计划向Anthropic投资最高250亿美元,其中包括即将到位的50亿美元,以及未来计划追加的最高200亿美元。此前,亚马逊已向Anthropic投入80亿美元,双方合作关系已持续三年。
Q2:Anthropic使用的AWS Trainium芯片有哪些型号,各有什么特点?
A:目前Anthropic主要使用三款芯片。Trainium2已部署超过百万枚,大量运行于Project Rainier集群;Trainium3于去年12月发布,拥有8个核心,性能是Trainium2的两倍,单服务器最高提供362 PetaFLOPS算力;即将推出的Trainium4在处理FP4数据时性能将超过2 ExaFLOPS。Anthropic还将有权优先使用Trainium4的后续升级版本。
Q3:Anthropic在AWS上的算力规划是怎样的?
A:Anthropic承诺未来十年在AWS上累计投入超1000亿美元,以换取最高5吉瓦的总算力。近期目标是在Trainium2和Trainium3扩容后,获得接近1吉瓦的算力,同时还将租用相当于数千万个Graviton核心的CPU资源,用于支撑大规模AI研究和模型训练。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。