如果你在谷歌 Photos 里积累了大量照片却不知该如何利用,现在有了答案。
谷歌于本周三在谷歌 Photos 中推出了全新的 Video Remix 功能,用户只需借助 AI 模板,即可快速将视频片段转化为风格各异、可供分享的艺术作品,实现画面变换、光线调整与风格化处理。Video Remix 依托谷歌的 Gemini Omni AI 模型,可对照片进行筛选、改变光线效果,或为现有视频替换背景。谷歌表示,这项功能旨在帮助用户"从丰富的模板库中创作出充满想象力的风格化记忆"。
Gemini Omni 于今年 5 月的谷歌开发者大会上正式亮相,能够根据用户提示生成图像和视频。尽管市面上已存在多种竞争性的生成式 AI 工具,但这项功能或许能帮助用户为积压已久的大量照片注入新的创意活力。
与从零开始生成内容不同,Video Remix 能够精准识别并提取画面主体,自动替换单调背景,运用电影级光效修正曝光不足的问题,或将个人视频片段转化为 3D 动画、水彩画乃至铅笔素描风格。这项功能专为普通用户设计,依托"一键操作"的 AI 模板库,让复杂的创作过程自动完成,无需任何专业技能。
谷歌将 Video Remix 定位为高级 AI 付费功能,高级视频 AI 编辑所需的云端处理能力设有使用上限。目前,该功能仅向年满 18 周岁并订阅了 Google AI Plus、Pro 或 Ultra 套餐的用户开放,适用国家包括美国、印度、日本、墨西哥和韩国。
该功能位于谷歌 Photos 的"创建"标签页中,并附有多个入门模板供用户选择。
在 AI 图像与视频领域,谷歌 Gemini 正积极与竞争对手争夺付费用户。OpenAI、Anthropic 和 Meta 等竞争对手也持续在各自产品中扩展 AI 图像和视频创作与编辑能力。
本周,Meta 在 Meta AI 应用、Instagram 和 WhatsApp 上推出了名为 Muse Image 的全新图像编辑工具,该工具能够处理更复杂的指令、生成合成照片,并对现有图像进行编辑。
Q&A
Q1:谷歌 Photos 的 Video Remix 功能是什么?
A:Video Remix 是谷歌在谷歌 Photos 中推出的一项新功能,基于 Gemini Omni AI 模型,可将用户的视频片段快速转化为风格化的艺术作品,支持替换背景、调整光线效果,以及将视频转为 3D 动画、水彩或素描等风格,操作简单,一键即可完成。
Q2:Video Remix 功能需要付费才能使用吗?
A:是的,Video Remix 目前属于付费高级功能,仅向订阅了 Google AI Plus、Pro 或 Ultra 套餐、且年满 18 周岁的用户开放。此外,高级 AI 视频编辑的云端处理设有使用上限。目前支持的国家包括美国、印度、日本、墨西哥和韩国。
Q3:Video Remix 和其他生成式 AI 视频工具有什么区别?
A:与 OpenAI、Meta 等竞争对手的工具不同,Video Remix 并非从零生成视频,而是基于用户现有的照片或视频进行再创作,例如提取画面主体、替换背景、修正曝光,或应用特定艺术风格。它更侧重于将个人记忆转化为有创意的视觉内容,操作门槛低,适合普通用户。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。