AI搜索初创公司Perplexity已与Getty Images签署了一项多年许可协议,获得在其AI驱动的搜索和发现工具中展示Getty图片的许可。这项协议标志着该公司的重大转变,此前该公司因内容抓取和抄袭指控而备受争议,现在正努力建立更正式的内容合作伙伴关系。
据知情人士透露,Perplexity和Getty Images的合作已超过一年。虽然从未正式宣布,但Getty曾是Perplexity出版商计划的一部分,该计划旨在当出版商内容出现在搜索查询中时与其分享广告收入。
今天的协议是一项新的交易。据消息人士透露,这不是传统的一次性授权交易,因为Perplexity不训练自己的基础模型,但拒绝透露具体条款。
Perplexity与Getty的协议似乎为该初创公司此前使用Getty库存照片的行为提供了合法性。在过去一年中,Perplexity因多家新闻机构的抄袭指控而饱受批评。在一个案例中,该初创公司被指控从《华尔街日报》的文章中提取内容,包括该文章中的Getty照片。
当时,多家媒体质疑Perplexity使用这些图片是否构成版权侵犯。去年有消息人士告诉TechCrunch,Perplexity正在与Getty达成协议,但在多次联系这家图片巨头后,我们无法确认该交易。
最近,Reddit在10月起诉了Perplexity,指控其"工业规模的非法"抓取用户内容并绕过技术措施获取数据。Reddit与OpenAI有数据许可协议。
Perplexity表示,与Getty的协议将帮助其更好地展示图片,并在搜索结果中出现图片时包含指向原始来源的链接和署名。
Getty战略发展副总裁Nick Unsworth表示,该协议"认可了适当归属同意的重要性及其在增强AI驱动产品方面的价值"。
Perplexity内容和出版商合作伙伴关系负责人Jessica Chan在声明中说:"在AI时代,归属和准确性是人们理解世界的基础。我们共同帮助人们通过强大的视觉叙事发现答案,同时确保他们始终知道内容来源和创作者。"
Perplexity对归属的强调是其防御版权指控策略的一部分,该公司辩称其使用出版商内容——包括付费墙后的内容或出版商明确表示不希望被抓取的内容——构成"合理使用",因为公开可获得的事实不受版权保护。
Q&A
Q1:Perplexity与Getty Images的许可协议包含什么内容?
A:该协议给予Perplexity在其AI搜索和发现工具中展示Getty Images图片的许可。当图片出现在搜索结果中时,Perplexity将包含指向原始来源的链接和署名信息,帮助用户了解内容来源和创作者。
Q2:Perplexity为什么需要与Getty Images签署正式协议?
A:Perplexity此前因内容抓取和抄袭指控而备受争议,包括被指控从华尔街日报文章中提取内容和Getty照片。该协议为其此前使用Getty图片的行为提供了合法性,并帮助公司建立更正式的内容合作关系。
Q3:除了Getty Images,Perplexity还面临哪些版权争议?
A:Reddit在10月起诉了Perplexity,指控其进行"工业规模的非法"用户内容抓取并绕过技术措施获取数据。多家新闻机构也对该公司提出了抄袭指控,质疑其对付费墙后内容的使用是否构成版权侵犯。
好文章,需要你的鼓励
PDF协会在欧洲会议上宣布,将在PDF规范中添加对JPEG XL图像格式的支持。尽管Chromium团队此前将该格式标记为过时,但此次纳入可能为JXL带来主流应用机会。PDF协会CTO表示,选择JPEG XL作为支持HDR内容的首选解决方案。该格式具备广色域、超高分辨率和多通道支持等优势,但目前仍缺乏广泛的浏览器支持。
Meta研究团队发现仅仅改变AI示例间的分隔符号就能导致模型性能产生高达45%的巨大差异,甚至可以操纵AI排行榜排名。这个看似微不足道的格式选择问题普遍存在于所有主流AI模型中,包括最先进的GPT-4o,揭示了当前AI评测体系的根本性缺陷。研究提出通过明确说明分隔符类型等方法可以部分缓解这一问题。
Ironclad OS项目正在开发一个新的类Unix操作系统内核,面向小型嵌入式系统,计划支持实时功能。该项目的独特之处在于采用Ada编程语言及其可形式化验证的SPARK子集进行开发,而非常见的C、C++或Rust语言。项目还包含运行在Ironclad内核上的完整操作系统Gloire,使用GNU工具构建以提供传统Unix兼容性。
香港中文大学研究团队开发出CALM训练框架和STORM模型,通过轻量化干预方式让40亿参数小模型在优化建模任务上达到6710亿参数大模型的性能。该方法保护模型原生推理能力,仅修改2.6%内容就实现显著提升,为AI优化建模应用大幅降低了技术门槛和成本。