Google产品中生成式AI的快速发展有时令人眼花缭乱,即便想避开这些功能也很困难。其中AI概览功能就是一个典型例子。这个AI驱动的搜索体验因经常出错而声名狼藉,不过你可能会注意到一些改进。Google表示,AI概览正在升级到最新的Gemini 3模型,并增加了更多对话功能。
仅在过去一年中,Google就大幅扩展了AI概览在搜索结果顶部出现的频率。如今,这个聊天机器人几乎总能为你的查询提供答案,主要依靠Google的Gemini 2.5系列模型。作为生成式AI模型,Gemini 2.5本身并没有问题,但Gemini 3在各项指标上都表现更佳。
当然,Gemini 3有多个版本,Google不喜欢明确说明搜索中使用的具体版本。Google表示,AI概览会为特定任务选择合适的模型。如果你搜索的是有大量有效信息源的简单内容,AI概览可能会使用Gemini 3 Flash等轻量级模型,而不会消耗大量推理Token。对于复杂的"长尾"查询,它可能会加强思考过程或转向Gemini 3 Pro(针对付费订阅用户)。
必须明确的是,Gemini 3和其他生成式AI系统一样仍可能出错。但它确实比之前的模型更频繁地给出正确答案。轻量级的Gemini 3 Flash模型在知识基准测试中的得分比2.5版本提高了一倍多。既然你真的无法避开AI概览(除非不用Google),那么Google部署更准确的模型至少是个好消息。
作为此次更新的一部分,Google还通过在AI概览和AI模式之间建立桥梁来进一步推广AI模式。Google表示,测试用户更喜欢能够自然地从搜索模式转向对话模式的体验。因此,AI概览将获得将后续问题转交给AI模式的能力。
据Google介绍,这种"流畅"的体验更能满足人们在搜索栏输入内容时的需求——无论是快速获取信息还是进行深度对话。然而,AI模式向传统搜索体验的扩展也将继续把用户从Google日渐被忽视的蓝色链接列表中吸引走。AI模式可能从这些网站抓取内容,但它将用户留在了Google的生态圈中。这就是AI时代的搜索现状。
Q&A
Q1:Gemini 3相比Gemini 2.5有什么改进?
A:Gemini 3在各项指标上都比Gemini 2.5表现更佳。其中轻量级的Gemini 3 Flash模型在知识基准测试中的得分比2.5版本提高了一倍多,能够更频繁地给出正确答案,虽然仍可能出错但准确率显著提升。
Q2:AI概览如何选择不同的Gemini 3模型版本?
A:AI概览会根据查询的复杂程度选择合适的模型。对于有大量有效信息源的简单查询,会使用Gemini 3 Flash等轻量级模型;对于复杂的"长尾"查询,会使用更强大的推理能力或转向Gemini 3 Pro版本(针对付费用户)。
Q3:Google为什么要在AI概览中融入AI模式功能?
A:Google发现测试用户更喜欢能够自然地从搜索模式转向对话模式的体验。通过让AI概览获得将后续问题转交给AI模式的能力,用户可以根据需求选择快速获取信息还是进行深度对话,提供更流畅的搜索体验。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。