OpenAI可能正在收缩视频生成业务,但Google却在大力推进其Vids编辑产品的重大AI升级。该公司最新的视频和音频模型现已集成到该工具中,用户可以选择各种可控的智能体出现在生成的视频中。您的作品现在也更容易在YouTube上分享。
Veo 3.1视频生成模型的重大升级
Veo 3.1是Vids升级的最大亮点。Google去年底首先在Gemini中部署了这一更新模型,承诺在真实性和一致性方面有显著改进。虽然Google将Veo定位为电影制作者的工具,但Vids的定位有所不同。Google建议使用Vids中的AI工具来创建动画聚会传单、商业宣传片或视频贺卡。
用户可以免费使用Vids,但如果没有AI订阅,生成的视频数量会受到限制。如果您的账户没有付费AI访问权限,每月只能生成10个视频。AI Pro订阅用户可以获得50个视频,而购买Google昂贵的AI Ultra计划(个人版或企业版)的用户每月可获得1000个视频。与大多数其他Veo实现方式一样,视频长度为8秒,分辨率为720p。
Lyria音乐生成模型增强音频体验
Google最近推出的Lyria音乐创作模型现在也是Vids的一部分。这个AI音乐制作工具的最新版本甚至不需要您输入歌词。您只需告诉机器人您想要什么氛围,它就会创建一个30秒或3分钟的音轨。虽然这不算高艺术,但如果您只是制作动画生日卡片,这可能就足够了。与视频一样,AI订阅用户在AI音乐方面也有更高的限制。
可定制智能体解决一致性问题
一致性始终是生成式系统的一个问题,但Google在Vids中为此提供了解决方案。该工具现在有各种预设的AI智能体,包括写实和卡通风格,您可以将它们添加到视频中。这些角色从一个场景到下一个场景的声音和外观都会保持一致(可选的外观定制),您可以提示智能体说出和做您想要的事情。它们甚至可以与生成视频中的物体进行交互。
便捷的录制和分享功能
Google希望减少摩擦,帮助人们使用Vids,即使他们不使用AI功能。新的Chrome扩展程序让您可以立即录制屏幕或摄像头内容,而无需打开Vids。它具有所有录制工具,可以将您的视频发送到完整的Vids网站进行进一步编辑。
您在Vids中创建的视频,无论是否由AI生成,现在也更容易分享。Vids可以直接在Google的流媒体网站上发布视频,而不是下载后再上传到YouTube。导出的视频默认为私有,允许您根据需要更改分享设置。
所有新功能现在都已在Vids中上线。
Q&A
Q1:Veo 3.1模型有什么特殊功能?
A:Veo 3.1是Google最新的视频生成模型,集成在Vids编辑产品中。它在真实性和一致性方面有显著改进,可以生成8秒长、720p分辨率的视频,适合制作动画聚会传单、商业宣传片或视频贺卡等内容。
Q2:Google Vids的AI智能体有什么作用?
A:Google Vids提供各种预设的AI智能体,包括写实和卡通风格。这些智能体可以解决生成式系统的一致性问题,从一个场景到下一个场景保持相同的声音和外观,用户可以提示它们说话和行动,甚至与视频中的物体互动。
Q3:使用Google Vids需要付费吗?生成限制是什么?
A:Google Vids可以免费使用,但有生成限制。免费用户每月只能生成10个视频,AI Pro订阅用户可获得50个视频,AI Ultra计划用户每月可获得1000个视频。同样的限制规则也适用于Lyria AI音乐生成功能。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。