亚马逊宣布,目前正在部分产品页面测试短格式 AI 驱动的音频产品摘要。音频摘要由亚马逊所谓的 “AI 驱动购物专家” 配音,他们会讨论产品的关键特性、客户评论以及来自全网的信息。
新的 AI 产品摘要可以通过在亚马逊购物 app 中点击 “听听亮点” 按钮进行访问。公司表示,将在那些通常需要购买前仔细考虑的产品中测试这一新功能。
这一功能的设计理念是帮助亚马逊顾客在购物时节省时间,并以对话讨论的方式传递重要信息。
“这一功能使得产品调研既有趣又便捷——就像有一群乐于助人的朋友在讨论潜在的购买选择,即使您在多任务处理或出行过程中,也能让购物变得更加轻松,”公司在博客中写道。
目前,这些摘要仅向部分美国消费者的精选产品开放。亚马逊计划在未来几个月内,将这一功能扩展到更多产品和更多美国客户。
公司解释称,该功能利用大语言模型 ( LLM ) 生成脚本,通过整合客户评论及全网信息,再将这些内容转化为短格式音频剪辑。
亚马逊表示,这项新功能加入了其现有的 AI 驱动购物功能套件,其中包括生成式 AI 购物助手 Rufus 以及 Interests —— 一项监控与您兴趣匹配的新产品的 AI 功能。
亚马逊并非唯一一家利用短格式 AI 驱动音频帮助用户快速高效获取信息的科技巨头。去年,Google 的 NotebookLM 推出了 Audio Overviews 功能,使用户能够基于与 AI 研究助手共享的文档(例如课程阅读材料或法律摘要),生成由 AI 虚拟主持人主持的播客。
好文章,需要你的鼓励
CoreWeave发布AI对象存储服务,采用本地对象传输加速器(LOTA)技术,可在全球范围内高速传输对象数据,无出口费用或请求交易分层费用。该技术通过智能代理在每个GPU节点上加速数据传输,提供高达每GPU 7 GBps的吞吐量,可扩展至数十万个GPU。服务采用三层自动定价模式,为客户的AI工作负载降低超过75%的存储成本。
莫斯科高等经济学院研究员尼古拉·斯克里普科开发了IFEval-FC基准测试,专门评估大语言模型在函数调用中遵循格式指令的能力。研究发现,即使是GPT-5和Claude Opus 4.1等最先进模型,在处理看似简单的格式要求时准确率也不超过80%,揭示了AI在实际应用中的重要局限性。
谷歌DeepMind与核聚变初创公司CFS合作,运用先进AI模型帮助管理和改进即将发布的Sparc反应堆。DeepMind开发了名为Torax的专用软件来模拟等离子体,结合强化学习等AI技术寻找最佳核聚变控制方式。核聚变被视为清洁能源的圣杯,可提供几乎无限的零碳排放能源。谷歌已投资CFS并承诺购买其200兆瓦电力。
上海人工智能实验室联合多家机构推出MinerU2.5文档解析模型,仅用12亿参数就在文本、公式、表格识别等任务上全面超越GPT-4o等大型模型。该模型采用创新的两阶段解析策略,先进行全局布局分析再做局部精细识别,计算效率提升一个数量级。通过重新定义任务标准和构建高质量数据引擎,MinerU2.5能准确处理旋转表格、复杂公式、多语言文档等挑战性内容,为文档数字化提供了高效解决方案。