上周预告后,Gemini Spark现已在美国向Google AI Ultra订阅用户开放使用。
Gemini Spark是谷歌推出的全天候个人智能体,用于自动化执行任务。在网页端,侧边栏新增了"Spark"标签页,与"Chat"标签页并列。在Android和iOS系统中,Spark显示在搜索聊天和每日简报之间,谷歌标注了"Beta"测试版状态。
目前,Gemini Spark可以接入Google Workspace和其他已连接的应用、个人智能信息、用户已登录的网站、位置信息等。
通过Google Workspace,Gemini Spark可以访问:
日历
云端硬盘、文档、表格和幻灯片
Gmail邮箱
Gemini Spark包含三个核心组成部分。任务是指你希望完成的高层级目标、项目或对象。
计划决定了Gemini Spark何时应该在后台自动运行。这可以是特定的日期时间,也可以是响应某个事件。例如:"每天早上8点(条件),给我提供AI新闻的更新(任务)。"这些计划不同于Gemini聊天体验中的预定操作。
技能,即"一组可重复使用的指令和附加上下文",是最后一个组成部分。可以使用@或/符号来访问技能。
技能教会Gemini如何执行特定任务以及使用哪些工具。你可以指定Gemini Spark在执行任务或计划操作时应使用的技能。Spark也可以在技能与任务相关时自动使用该技能。
总结来说,你需要定义任务(想要什么)、设置计划(何时执行)、提供技能(如何完成)来完成工作。
Gemini Spark的其他使用场景包括:日程管理、信息追踪、内容整理等自动化工作流程。
使用"描述你的任务"输入框,该功能支持上传文件和笔记本。任务线程和工作面板让你可以监控进度,包括计划中的、当前的和已完成的步骤。你可以根据需要接管远程浏览器。
Gemini Spark与Gemini其他功能使用相同的基于计算的使用限制。此外:
你最多可以同时运行15个任务。在发起新请求之前,需要等待任务完成。另外,如果已经有15个任务在运行,计划将不会执行。
Q&A
Q1:Gemini Spark是什么?它有什么功能?
A:Gemini Spark是谷歌推出的全天候个人智能体,用于自动化执行任务。它可以接入Google Workspace、日历、Gmail、云端硬盘等应用,帮助用户自动完成各种工作任务,比如定时获取新闻更新、管理日程、整理信息等。
Q2:Gemini Spark的三个核心组成部分是什么?
A:Gemini Spark包含三个核心部分:任务(你希望完成的目标)、计划(决定何时自动运行,可以是特定时间或响应事件)、技能(可重复使用的指令和上下文,教会Gemini如何执行特定任务)。用户通过定义这三个部分来让Spark自动完成工作。
Q3:Gemini Spark有哪些使用限制?
A:Gemini Spark与Gemini其他功能使用相同的基于计算的使用限制。用户最多可以同时运行15个任务,在发起新请求之前需要等待任务完成。如果已经有15个任务在运行,新的计划将不会执行。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。