在上周的I/O 2026大会上,Gemini应用切换到了基于计算量的使用限制模式。针对用户反馈"限制触发过快"的问题,Google今天宣布了一些调整措施。
新的"计算量消耗"方式采用5小时刷新机制,直到达到周限额为止,这种方法会考虑提示词的复杂程度、使用的工具以及对话长度。Google上周指出,"简单的文本提示消耗的计算量远少于复杂的视频或编程提示"。未来,Google将允许Gemini应用用户购买按需付费的AI积分充值服务。
Gemini负责人Josh Woodward今天分享,在使用Gemini 3.1 Pro时,Google正在"限制单个提示可使用的配额上限,让用户能从Pro模型中获得更多使用次数"。这是为了应对包含大文件的复杂提示快速耗尽限额的问题。
Google澄清,错误请求不会计入限额:"如果请求失败,不会扣除配额。系统错误由我们承担,不是用户的责任。配额仅在成功完成时才会被使用。"
深度研究等重度任务"需要更多计算资源",因此Google将提供"更详细的使用量明细和通知,帮助用户最大化利用限额"。目前,gemini.google.com/usage仪表板仅提供概览信息。
此外,3.1 Flash-Lite提示现在"免费且不计入配额"。Google还指出:
当用户选择特定模型时,系统会在所有后续会话中记住该选择。只有在用户手动调整或触发上限导致自动降级到轻量模型时才会改变。
最后,Google修复了一个漏洞,该漏洞导致"某些用户仅生成一两个Omni视频"就会耗尽配额。Google AI Ultra用户现在的Omni生成次数已翻倍。
我们已修复此问题,并将继续寻找机会增加Omni的使用量。
Q&A
Q1:Google Gemini的新使用限制是如何计算的?
A:Gemini采用基于计算量的使用限制模式,会根据提示词的复杂程度、使用的工具和对话长度来计算消耗。简单文本提示消耗的计算量远少于复杂的视频或编程提示。系统采用5小时刷新机制,直到达到周限额。
Q2:如果Gemini请求失败会扣除配额吗?
A:不会。Google明确表示,如果请求失败不会扣除配额。系统错误由Google承担,用户的配额仅在请求成功完成时才会被使用。
Q3:Google对Gemini使用限制做了哪些调整?
A:Google做了多项调整:限制单个提示的配额上限以增加使用次数;3.1 Flash-Lite提示现在免费且不计入配额;修复了Omni视频快速耗尽配额的漏洞;Ultra用户的Omni生成次数翻倍;未来还将提供更详细的使用量明细和按需付费的AI积分充值服务。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。