Oracle近期推出了Token套餐的限量试行方案,旨在让智能体AI的定价方式与其实际创造的价值更好地对应。随着先进AI模型与智能体工具逐步进入企业环境,管理层开始面临Token用量持续攀升、AI支出不断增加的双重压力。Token是衡量AI服务使用量并据此计费的基本单位。
Oracle首席执行官Mike Sicilia在本周三举行的2026财年第四季度业绩说明会上向投资者表示,允许客户预先购买Token套餐、并在多个应用之间灵活使用,能够为企业带来更可预期的成本管理体验。他透露,在限量试行阶段已有33名客户选择使用了Token套餐。
"这一切都有助于我们的客户控制成本,并让支出与所产生的价值相匹配。"Sicilia说道。
AI成本问题同样引起了其他技术厂商的关注,它们也希望帮助企业更好地追踪和管控相关支出。
AWS于本周二宣布公开预览其AWS FinOps智能体,该工具专为识别和调查成本异常而设计。与此同时,Flexera本周也推出了Flexera One平台,提供一套AI成本管理功能,能够对跨智能体、模型和计算资源的AI支出实现全面可视化。
在Oracle推出Token套餐的同时,SAP也在持续完善其面向高级服务(包括智能体功能)的AI单元计费机制。SAP全球首席技术官兼首席AI官Philipp Herzig在本周举行的美国银行C-Suite TMT大会上表示,眼下最大的问题在于,用户在构建AI智能体时往往缺乏明确目标或对投资回报率的清晰认识,导致大量Token被低效消耗。
FinOps Foundation执行总监J.R. Storment在本周二的FinOps X大会主题演讲中指出,Token用量的增长正在推动商业模式的深层变革——企业越来越多地看到软件厂商将定价策略从固定费用与许可证模式转向按用量计费的消费模式。
这一转变折射出企业在AI应用上的日趋成熟。Storment表示,供应商不再需要通过AI补贴来吸引企业尝试新模型和新工具。一个典型例子是:OpenAI首席执行官Sam Altman在一场活动中透露,该公司Token消耗量最大的用户每月使用量高达1亿个Token。
"事实证明,你们中有些人在使用最新模型处理一切任务时,作为'推理大户'每月让这些AI实验室承担了高达数万美元的成本。"Storment在主题演讲中说道。
问题的核心在于,技术决策者对自身的Token消耗缺乏全面认知——这些消耗分布在从数据中心到边缘计算的整个技术栈的多个层级。以Shutterstock为例,该公司已要求将所有AI相关成本统一纳入FinOps团队进行管理,以实现更高透明度的支出管控。
此外,Linux基金会与FinOps Foundation本周联合宣布成立Tokenomics Foundation。该组织将汇聚前沿AI模型开发商、大型Token消费者、新兴云服务商及超大规模云计算平台,共同建立用于监控Token使用情况和企业AI成本的标准与框架。
"董事会开始追问的下一个问题是:'这些智能化能力究竟价值几何?为什么如此昂贵?我是否从中获得了足够的回报?'"Storment在主题演讲中如是说。
Q&A
Q1:Oracle推出的Token套餐是什么?对企业有什么帮助?
A:Oracle推出的Token套餐允许企业客户预先批量购买Token,并在多个应用之间灵活使用,从而实现更可预期的AI成本管理。在限量试行阶段,已有33名客户选择了该方案。Oracle CEO Mike Sicilia表示,这一机制有助于客户控制支出,并让费用与实际产生的价值相匹配,避免因Token用量波动带来的预算不确定性。
Q2:AWS FinOps智能体是做什么用的?
A:AWS FinOps智能体是AWS推出的一款成本管理工具,目前处于公开预览阶段。它的主要功能是自动调查和识别云服务中的成本异常情况,帮助企业发现潜在的超支来源。这一工具的推出,反映出越来越多的云厂商开始重视帮助企业客户追踪和管控日益增长的AI使用成本。
Q3:Tokenomics Foundation是什么组织?成立目的是什么?
A:Tokenomics Foundation是由Linux基金会与FinOps Foundation联合发起成立的新组织,成员涵盖前沿AI模型开发商、大型Token消费者、新兴云服务商及超大规模云计算平台。其核心目标是制定统一的标准与框架,用于监控Token使用情况和企业AI成本,推动整个行业在AI计费与成本管理方面实现更高的透明度和规范性。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。