谷歌正在扩展其Lyria 3音乐制作AI的功能,使其能够创作长达三分钟的音乐作品,并在多个谷歌产品中集成使用。此前,Lyria只能生成30秒的音频片段。Lyria 3 Pro不仅将最大时长增加了六倍,还允许用户针对特定元素进行提示,如前奏、副歌和桥段,从而更好地控制音乐编排。
功能特点与使用方式
Lyria 3 Pro的工作原理与其他流行的音乐生成工具(如Suno和Udio)类似。用户只需描述情绪、风格或乐器配置,系统就能生成相应的音轨。它还可以根据用户的提示生成歌词,甚至可以基于参考照片或视频进行创作。
Lyria 3 Pro的突出特点之一是与其他谷歌产品的深度集成。用户可以直接在Gemini中创建音轨,无需下载专门的应用程序。此外,谷歌还将该模型添加到面向企业客户的Vertex AI、面向开发者的Google AI Studio和Gemini API、面向办公人员的Google Vids,以及最近收购的ProducerAI平台中。扩展的音频时长对ProducerAI用户特别有吸引力,因为该平台是Suno的直接竞争对手。
版权保护与技术安全
能够生成完整歌曲而不仅仅是30秒片段,可能会引发对冒用和版权侵权的担忧。在新闻稿中,谷歌试图缓解这些担忧,表示"Lyria 3和Gemini不会模仿艺术家",并补充说"如果提示中提到某位创作者,模型会将其作为广泛的灵感来源"。谷歌表示,还会检查Lyria 3 Pro的输出内容是否与现有内容重复,以确保AI不会产生侵权材料,并嵌入静默的SynthID水印来识别AI生成的内容。
Q&A
Q1:Lyria 3 Pro相比之前版本有什么重大提升?
A:Lyria 3 Pro将音乐生成时长从30秒大幅提升到3分钟,时长增加了六倍。同时还增加了对特定音乐元素的控制功能,用户可以指定前奏、副歌、桥段等结构,让音乐创作更加精准和完整。
Q2:Lyria 3 Pro如何防止版权侵权问题?
A:谷歌采取了多项措施防范版权问题。首先明确表示模型不会模仿特定艺术家,即使提示中提到创作者也只是作为灵感来源。其次会检查输出内容与现有作品的重复性,最后还会嵌入SynthID水印标识AI生成内容。
Q3:普通用户如何使用Lyria 3 Pro?
A:用户可以直接在Gemini中使用Lyria 3 Pro创建音轨,无需下载专门应用。只需描述想要的音乐情绪、风格或乐器配置,系统就能生成相应音轨。还可以根据照片、视频或文字提示生成歌词和音乐。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。