全球最大视频分享平台YouTube近日宣布,将协助名人打击AI生成的深度伪造视频。据好莱坞报道,这家谷歌旗下网站正在向面临容貌被AI媒体复制风险的名人开放一款深度伪造检测工具,该工具已历经两年持续优化。
随着AI工具让用户在自制视频中使用名人形象变得愈发便捷,好莱坞已对各大视频生成平台展开全面抵制。演员和大型制片公司相继联合起来,共同对抗OpenAI旗下已停运的Sora,以及字节跳动旗下的SeeDance 2.0等主要侵权平台。尽管来自名流富贾的压力不断加大,通过AI视频生成指令制作的深度伪造内容依然持续蔓延。
(披露声明:CNET母公司Ziff Davis已于2025年对OpenAI提起诉讼,指控其在训练和运营AI系统过程中侵犯了Ziff Davis的版权。)
YouTube推出的这款深度伪造检测工具旨在遏制这一趋势,至少在其自身平台上起到管控作用。该工具的运作方式与YouTube现有的Content ID系统类似——后者能够自动识别并标记上传至平台的受版权保护内容。
如需加入该计划,名人本人或其经纪人需将其本人形象上传至深度伪造检测工具。该工具随后将扫描平台上的所有内容,并将可能存在侵权嫌疑的AI生成内容标记以供审核。受影响的个人无需注册YouTube账号,即可对未经授权使用其形象的深度伪造视频采取维权行动。
尽管平台可能会应请求删除违规内容,但并不保证所有被标记的视频都会被下架。
YouTube首席商务官玛丽·艾伦·科在接受好莱坞报道采访时表示:"在一些情况下,例如戏仿和讽刺类创作,我们的社区准则允许此类内容继续留存于平台。但如果某人制作的内容是对名人、演员或创作者作品的完整复制,足以影响其正常收入,则属于字面意义上的内容替代,将被纳入下架处理范围。"
从政界人士到娱乐圈名人
这一工具并非全新推出。YouTube早在去年便开始推行,最初在平台上部分头部创作者中试点运行。数月前,该工具进一步向政界人士开放。
此次是迄今为止覆盖范围最广的一次推广,YouTube将用户范围扩展至演员、运动员、音乐人及其他在AI生成视频中频繁被使用形象的名人群体。
据好莱坞报道,YouTube高管透露,在深度伪造检测工具的试点阶段,许多创作者仅申请删除了少量被标记内容,主要集中于负面或带有侮辱性质的媒体内容。
科还暗示,未来版权持有者或许可以选择将AI生成媒体内容货币化,而非直接申请下架,但她表示这一功能目前尚未列入YouTube的规划。她指出,公司目前的核心重点在于为名人及其形象提供"基础层面的责任保障与隐私保护"。
Q&A
Q1:YouTube深度伪造检测工具是如何运作的?
A:该工具的运作方式与YouTube现有的Content ID系统类似,名人或其经纪人需将本人形象上传至工具中,系统随后自动扫描平台内容,将可能存在侵权的AI生成视频标记出来以供人工审核。受影响人员无需注册YouTube账号即可发起维权请求,但平台并不保证所有被标记视频都会被删除。
Q2:YouTube深度伪造检测工具目前向哪些人开放?
A:该工具最初于去年面向平台头部创作者进行试点,随后向政界人士开放。目前已扩展至最广泛的用户群体,包括演员、运动员、音乐人及其他各类名人,覆盖所有面临AI生成内容侵权风险的公众人物。
Q3:被标记的深度伪造视频一定会被YouTube删除吗?
A:不一定。YouTube首席商务官玛丽·艾伦·科表示,戏仿、讽刺等符合社区准则的内容可能会被保留。只有当相关内容构成对名人作品或形象的完整复制,并足以影响其正常收入来源时,才会被纳入下架处理范围。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。