语音AI公司ElevenLabs推出了其音乐生成模型的全新版本Music v2,该模型能够在一首歌曲中途实现风格切换。公司表示,这一模型专为处理人声和作曲的复杂性而设计。距离该初创公司发布首个版本的音乐生成模型,这次新版本的推出已过去近10个月。
ElevenLabs指出,该模型可以从歌剧无缝切换到重金属再切换回来,能够呈现快速说唱而不失连贯性,还可以在曲目中添加非音乐类音效。借助新模型,艺术家可以选择歌曲的某个部分,通过提示词重新创作该部分,而不影响曲目的其他部分。
此外,艺术家不再局限于生成短片段,而是可以按段落构建歌曲,包括前奏、主歌和副歌,然后将它们拼接在一起。ElevenLabs补充说,该模型在跨语言、歌词、人声和编曲方面的表现更加稳定可靠。
近几个月来,AI实验室一直在竞相发布能够生成专业级音乐的模型。谷歌、Stability AI和Suno也都发布了新的音乐生成模型,具备生成更长、更复杂曲目的能力。在谷歌I/O开发者大会上,谷歌为其Flow Music工具增加了轻松创建翻唱、按段落编辑歌曲以及生成音乐视频的功能。
ElevenLabs强调,新模型基于授权数据构建,并已获得商业使用许可,因此用户可以自由使用生成的曲目。与唱片公司达成协议至关重要,因为其他AI音乐初创公司,如Suno和Udio,都曾因版权问题面临诉讼。
新模型已在ElevenLabs面向营销和品牌团队的ElevenCreative工具上线,同时也在其新推出的用于创作AI生成歌曲的ElevenMusic平台上提供,不久后还将在ElevenAPI上推出。
Q&A
Q1:ElevenLabs的Music v2模型有什么特别功能?
A:Music v2模型可以在一首歌曲中途实现风格切换,比如从歌剧切换到重金属再切换回来。它还能呈现快速说唱而不失连贯性,添加非音乐类音效,并允许艺术家选择歌曲的某个部分进行重新创作而不影响其他部分。此外,艺术家可以按段落构建歌曲,包括前奏、主歌和副歌,然后拼接在一起。
Q2:Music v2模型和其他AI音乐生成工具相比有什么优势?
A:ElevenLabs强调Music v2模型基于授权数据构建,并已获得商业使用许可,用户可以自由使用生成的曲目,不会面临版权问题。这与Suno和Udio等其他AI音乐初创公司因版权问题面临诉讼的情况形成对比,为用户提供了更安全的商业使用保障。
Q3:在哪里可以使用ElevenLabs的Music v2模型?
A:新模型目前已在ElevenLabs面向营销和品牌团队的ElevenCreative工具上线,同时也在其新推出的用于创作AI生成歌曲的ElevenMusic平台上提供。不久后还将在ElevenAPI上推出,为开发者提供更多集成选项。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。