Anthropic公司的AI编程助手Claude Code用户正遭遇高Token消耗和配额提前耗尽问题,严重影响日常开发工作。
Anthropic承认存在问题
Anthropic公司已经承认了这一问题,表示"用户触及Claude Code使用限额的速度远超我们的预期。我们正在积极调查中......这是团队的首要任务。"
一位购买了Claude Pro订阅服务(年费200美元)的用户在公司Discord论坛上反映:"每个星期一就达到上限,星期六才重置,这种情况已经持续几周了......30天里我只能使用Claude 12天。"
Reddit上的Anthropic论坛充满了抱怨声。一位开发者今天表示:"我在1小时的工作中就用完了Max 5套餐的配额,以前可以工作8小时。"Max 5套餐月费为100美元。
配额限制和促销活动结束
导致这一变化有几个可能因素。上周,Anthropic表示将在高峰时段减少配额,工程师Thariq Shihipar称这一变化将影响约7%的用户,同时声称"我们已经实现了很多效率提升来抵消这一影响。"
3月28日也是Claude促销活动的最后一天,该活动在六小时高峰时段之外将使用限额翻倍。
技术漏洞导致Token消耗激增
第三个因素是Claude Code可能存在增加Token使用量的漏洞。一位用户声称,在对Claude Code二进制文件进行逆向工程后,他们"发现了两个独立的漏洞,导致提示缓存失效,静默地将成本增加10-20倍。"一些用户确认降级到旧版本有所帮助。一位用户说:"降级到2.1.34版本产生了非常明显的改善。"
关于提示缓存的文档说明,缓存"显著减少了重复任务或具有一致元素的提示的处理时间和成本。"但是,缓存的生命周期只有五分钟,这意味着短暂休息或几分钟不使用Claude Code,恢复使用时成本会更高。
开发者可以将缓存生命周期升级到一小时,但"1小时缓存写入Token的价格是基础输入Token价格的2倍",文档如此说明。缓存读取Token的价格是基础价格的0.1倍,因此这是优化的关键领域。
不透明的使用限额政策
Anthropic没有明确说明其套餐的确切使用限额。例如,Pro套餐只承诺"每次会话的使用量至少是免费服务的五倍"。标准团队套餐承诺"每次会话的使用量比Pro套餐多1.25倍"。这使得开发者很难知道他们的使用限额是多少,只能通过查看仪表板了解已消耗的配额。
行业普遍问题
类似问题并不罕见。本月早些时候,Google Antigravity的用户也对类似问题提出了抗议。
撇开漏洞不谈,我们看到的是用户和服务提供商之间关于AI开发可接受的定价和使用模式的隐性谈判。用户希望控制成本,而服务提供商需要盈利。供应商的营销策略鼓励开发者将AI插入每个流程(包括某些情况下的自动化工作流程)与可能导致AI工具停止响应的配额系统之间也存在脱节。
一位用户观察到:"对于在自动化工作流程中运行Claude Code的用户:需要明确捕获速率限制错误——它们看起来像通用故障,会静默地触发重试。循环中的一个会话可能在几分钟内耗尽您的每日预算。"
Q&A
Q1:Claude Code遇到了什么问题?
A:Claude Code用户正遭遇高Token消耗和配额提前耗尽问题。用户反映使用限额触及速度远超预期,比如年费200美元的Pro用户30天只能正常使用12天,月费100美元的Max 5用户1小时就用完配额。
Q2:为什么Claude Code的Token消耗突然增加?
A:主要有三个原因:Anthropic在高峰时段减少了配额,影响约7%用户;3月28日Claude促销活动结束,该活动此前在非高峰时段将使用限额翻倍;存在技术漏洞导致提示缓存失效,成本静默增加10-20倍。
Q3:如何解决Claude Code使用限额问题?
A:用户可以尝试降级到旧版本如2.1.34,一些用户反映有明显改善。对于自动化工作流程,需要明确捕获速率限制错误以避免重试耗尽预算。Anthropic表示正在积极调查此问题,这是团队首要任务。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。