微信公众号悄悄上线AI音色克隆,微信的一小步,却是AI的一大步。
AI音频的东西,在收到一些身边亲近人的语音的时候会产生一些警惕,但是我们家里的老人呢?他们很多人对现在的AI并不是很了解,一旦AI音色克隆放开,很容易就是骗子拿着你4、5秒的音频去发给你的爷爷奶奶舅舅舅妈,骗取他们的信任。
可能你会发现,你听到的不再是那个永远跟其他人一样,相同的男声。
此时,微信可能会用我的声音,来为你朗读出这篇文章。
之所以,我一直在说可能,是因为我虽然在后台设置好了,但是只有这篇新发的文章,我才能知道,我的声音到底有没有生效。
不过,再怎么说,这都是微信的一小步,却是AI的一大步,真的。
意外的发现公众号版本又更新了,更新到了2.29.1,当然版本号无所谓,重要的是,这个设置里面的新功能:朗读音色。
以前是绝对没有这个功能的,作为一个几乎以公众号为生的我,对公众号后台的一点点变动,都会非常的敏感。
点开以后,会有一个系统默认的音色,你可以,创建自己的音色。
点击创建新的音色,就会进入到一个新页面,会让你现场朗读一句话。
甚至会从你的实际文章中,抽取一些片段,来让你读,非常的有意思。
这里我正好也解释一下,为啥现在微信、豆包、kimi等等产品,在做AI音色克隆的时候,都要让你现场读一段文本,再用这段音频去做音色克隆,而不是让你随便上传一段音频呢?
前段时间三只羊AI音频事件,还有AI雷军国庆节在微博上骂了7天等等,我想大家应该都能感受到,AI克隆音色这玩意一旦放开,会有多少跟诈骗相关的风险。
一旦放开,可以随便上传一段音频,最开心的不是你我他,而是骗子。
看我号的读者,应该尚且知道AI音频的东西,在收到一些身边亲近人的语音的时候会产生一些警惕,但是我们家里的老人呢?他们很多人对现在的AI并不是很了解,一旦AI音色克隆放开,很容易就是骗子拿着你4、5秒的音频去发给你的爷爷奶奶舅舅舅妈,骗取他们的信任。
且万一有一些人,如果真的石乐志,克隆一些官员的声音,那...后果基本不敢设想。
所以,现在基本清一色都是这种方式,让你用实时录制的方式,念出文本上的随机的话,还不能念错。
在你读完这段话后,就会嘟嘟嘟的进入克隆的步骤,速度很快,大概十几秒就能完全搞定。
音色基本很完美,跟我声音一样,情绪是TTS的老问题了,不说了,整体质听感上,是还算OK的。
我测试了一下,老的文章还是不会变的,可能只有新的文章,才能支持我的音色。
所以只有这篇发出来,我才能知道,我的音色,来听全文,到底是个什么感觉,以及,到底会不会用我的音色。。。
其实,我脑子里幻想过,公众号到底会怎么接入AI,来帮这个可能是最大的长图文平台赋能。
想过AI创作,想过AI起标题,想过AI搜索,想过AI总结,但是没想到的是,来的第一个,居然是AI音色克隆。
不过其实细想想,也合理。
公众号这个载体,我一直调侃说,我可能是最后给公众号送终的那一批人。
短视频俯瞰众生,短图文在侧不断侵蚀羽翼,身后还有播客虎视眈眈。
长图文,变的越来越像一个日落西山的老人,守着自己的一亩三分地,尽可能的给大家种出最好的果实。
而公众号,作为长图文领域无与伦比的王者,非常坦率的讲,一直有一个在我看来很大的问题,过往很难解决,就是IP化很难。
短视频为什么做一个人的IP,比公众号简单很多?是因为内容载体。
在公众号上,你看到的永远是冷冰冰的文字,即使作者把这段话,写的登峰造极,写的舌灿莲花,你能看到的也依然是文字,是神交。
而短视频呢?你看到的不是文字,是一个具象化的人,你知道他长什么样,哦这个人有点长的有点潦草头发看着总是好久不洗,哦还有一个人带着眼镜总是说话的时候张不开嘴。
而那些内容,更是他亲口念出来的,你看到所有的文字,不是冷冰冰的文字,而是他在读,你听到的除了信息,还有情绪,还有他的笑与泪。
这就是为啥,在短视频上做IP,要比公众号,简单的多。
而这一次更新,我觉得很有趣的一点是,微信公众号这一次的更新,他们把声音,给补上了。
在过往,我们用文字表达思想,用图片传递视觉,现在又多了一个维度,可以用我们自己的的声音来传递情感。
声音终于成为了我们这群做图文内容的人的有机组成部分,而不在只是,机械的朗读。
我乐意看到微信的每一次变化,特别是跟AI有关的更新。
AI,很多时候就像空气一样,只有当你感受不到它,觉得他是我们生活中理所应当的一部分,这时候,AI就算是真正的成功进入每个你我一样的普通人的生活中了。
微信,作为可能是我们国内,最大的超级APP,没有什么,比他跟AI的结合,影响范围更广了。
以后的某一天,可能所有的公众号,都有了自己的专属声音。
0赞好文章,需要你的鼓励
推荐文章
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。