OpenAI集团公共利益公司周日发布了关于其财务表现和数据中心建设工作的最新信息。
首席财务官Sarah Friar在博客文章中披露,公司年化经常性收入在去年突破了200亿美元。这一数字相比2024年的60亿美元和前年的20亿美元实现了大幅增长。在同一时间段内,OpenAI将其数据中心规模从200兆瓦扩展到约1.9吉瓦。
公司年化收入和计算能力在三年内都增长了约十倍并非巧合。在今日的博客文章中,Friar透露OpenAI将数据中心投资与增长里程碑相关联。"资本是根据真实的需求信号分批投入的,"她解释道,"这让我们能够在有增长的时候积极投入,而不会超出市场应得的未来承诺。"
据这位高管介绍,OpenAI不仅在扩展数据中心基础设施,还在努力提高其成本效益。Friar透露,公司已将推理费用降至每百万Token不到1美元。OpenAI通过混合搭配不同类型的数据中心硬件部分实现了这一目标。
"在能力最重要的时候,我们在高端硬件上训练前沿模型,"Friar写道,"当效率比原始规模更重要时,我们在低成本基础设施上运行高容量工作负载。"
Friar并未详细说明什么芯片为OpenAI的低成本基础设施提供动力。这些硬件可能使用与公司最先进训练集群相同的昂贵顶级图形处理器。最先进的GPU通常是最具成本效益的。例如,英伟达的旗舰Rubin显卡在运行某些推理工作负载时,每Token成本可降至其前代产品的1/10。
寻找降低硬件费用的方法对于OpenAI来说可能会成为更重要的优先事项。去年9月,消息人士告诉The Information,该公司预计2025年底将面临80亿美元的亏损,比原先预期多出15亿美元。据报道,OpenAI的亏损预计今年将增加一倍多,达到170亿美元。
消息人士表示,该公司开发定制芯片和数据中心的努力是其削减基础设施成本的一部分。去年,OpenAI与博通公司签署了100亿美元的合作协议,共同设计AI加速器。另外,它还与软银集团的SB Energy业务合作,基于定制设计建设Stargate数据中心。
Friar的博客文章包含了关于OpenAI长期收入增长计划的暗示。这位高管详细说明她预期人工智能市场将出现新的货币化模式。"许可、基于知识产权的协议和基于结果的定价将分享所创造的价值,"Friar写道。
广告是OpenAI增长策略的另一个组成部分。周五,这家AI服务商宣布计划在ChatGPT提示回应下方显示付费推广。该公司将在美国与有限数量的用户测试其广告系统,然后更广泛地推出。
Friar表示OpenAI的开发路线图还优先考虑AI智能体和其他工作流自动化工具。据这位高管介绍,公司专注于帮助用户自动化跨多个应用程序的任务。另一个优先事项是为模型配备长期使用上下文的能力。
Q&A
Q1:OpenAI的数据中心容量增长了多少?
A:OpenAI的数据中心容量从200兆瓦大幅扩展到约1.9吉瓦,在短短三年内增长了近十倍,这与公司年收入的十倍增长相匹配。
Q2:OpenAI如何降低推理成本的?
A:OpenAI通过混合搭配不同类型的数据中心硬件来降低成本,在能力要求高时使用高端硬件训练前沿模型,在效率更重要时使用低成本基础设施运行高容量工作负载,已将推理费用降至每百万Token不到1美元。
Q3:OpenAI未来的收入增长策略是什么?
A:OpenAI计划通过多种方式实现增长:开发新的货币化模式如许可和基于结果的定价、在ChatGPT中引入广告系统、专注于AI智能体和工作流自动化工具,以及为模型配备长期上下文使用能力。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。