Google 为 Photos 用户提供对生成式 AI 图片转视频功能更强的控制能力。根据周一发布的更新公告,Google Photos 现已支持文本提示视频生成功能,允许用户描述在将静态图像转换为生动视频时想要看到的具体动作、风格或效果。
文本提示功能将与现有的"细微动作"和"手气不错"选项相结合,这两个选项已在 Google Photos 的图片转视频工具中提供,但都不允许用户输入自己的描述来指导结果。Google 表示,Photos 将提供提示建议"用于即时视频灵感",并且可以编辑文本提示来微调生成的视频结果。
新的文本提示功能仅限于18岁或以上的用户使用。不过,这个年龄限制只适用于 Photos 中的图片转视频工具——文本提示在 Gemini 的相同功能中已经提供了一段时间,并且对13岁或以上的任何用户都可用。添加描述性提示的能力使 Photos 的图片转视频工具更符合竞争对手的 AI 编辑器,如 xAI 的 Grok,该工具曾因被滥用于脱掉真人和儿童照片的衣服而备受关注。
Google Photos 中的生成式 AI 功能并未在所有地区推出,确切的功能可能因地区而异。您可以查看 Google 的支持页面了解当前限制的更多信息。
此次更新还允许 Google Photos 用户在使用图片转视频功能创建的每个视频中默认包含音频,生成的视频无需任何额外编辑即可在线发布。在另一项更新中,Google 为 Gmail 引入了新的 Google Photos 选择器,使得通过电子邮件分享相册、收藏和共享相册中的图像和视频变得更容易。该功能允许您同时选择多张照片和视频,并搜索特定的照片和相册名称。
Q&A
Q1:Google Photos的文本提示视频生成功能是什么?
A:这是Google Photos新增的生成式AI功能,用户可以通过文本描述来指导图片转视频的效果,比如描述想要的动作、风格或特效,让静态图像转换成符合用户期望的动态视频。
Q2:文本提示功能有年龄限制吗?
A:是的,Google Photos中的文本提示图片转视频功能仅限18岁或以上用户使用。不过在Gemini中的相同功能对13岁或以上用户开放,且已经提供一段时间了。
Q3:Google Photos的图片转视频功能在全球都能使用吗?
A:不是的,生成式AI功能并未在所有地区推出,确切的功能可能因地区而异。用户需要查看Google的支持页面了解当前的地区限制信息。
好文章,需要你的鼓励
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。