Token滥用时代终结,企业进入Token配给时代。
此前,AI行业鼓励企业将AI预算用到极致,部分公司甚至建立员工排行榜,以鼓励内部AI使用。然而,企业如今意识到,在AI上花费大量资金却收效甚微是多么容易的一件事。
据404 Media报道,咨询巨头埃森哲正试图阻止员工将Token资源消耗在基础任务上,例如将PDF文件转换为演示幻灯片。
值得注意的是,就在不久前,埃森哲还曾警告员工,若不积极使用AI,将"面临错失晋升机会的风险"。此次报道源自一段泄露的内部会议录音,会议涉及埃森哲智能体AI战略负责人Justice Kwak。
Kwak在录音中表示:"我们正处于一个拐点,AI正在实质性地影响成本结构。支出变得越来越难以预测,高层领导——尤其是CFO、COO和CIO层面——仍在追问:我们在AI上的花费究竟有没有产生相应的价值?"
Token成本正在令AI商业模式遭受质疑。近期被称为"AI抛售潮"的市场动荡,已重创多家依赖AI的企业,尤其是存储芯片制造商。AI行业已发展到不能仅靠新鲜感维系的阶段,它必须证明自身的真实价值。
Q&A
Q1:埃森哲为什么要限制员工使用AI?
A:埃森哲发现员工正在将大量Token消耗在将PDF转为幻灯片等低价值基础任务上,导致AI支出快速攀升,却难以产生明显的业务回报。公司高层,包括CFO、COO和CIO,开始质疑AI投入的实际价值,因此开始推行Token使用管控措施,以避免资源浪费。
Q2:什么是Token配给,企业为什么要关注这个问题?
A:Token是大语言模型处理文本的基本计量单位,企业使用AI服务时通常按Token消耗量付费。Token配给是指企业对员工可使用的Token数量进行限制和管控。随着AI使用规模扩大,Token成本已成为企业不可忽视的支出项目,支出的不可预测性促使企业开始精细化管理AI资源。
Q3:"AI抛售潮"对哪些行业影响最大?
A:根据报道,此次"AI抛售潮"对依赖AI的企业冲击较为明显,其中存储芯片制造商受到的影响尤为突出。这一现象反映出市场对AI商业模式可持续性的担忧正在上升,投资者开始重新评估AI相关企业能否将技术投入转化为真实的商业价值。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。