亚马逊宣布,目前正在部分产品页面测试短格式 AI 驱动的音频产品摘要。音频摘要由亚马逊所谓的 “AI 驱动购物专家” 配音,他们会讨论产品的关键特性、客户评论以及来自全网的信息。
新的 AI 产品摘要可以通过在亚马逊购物 app 中点击 “听听亮点” 按钮进行访问。公司表示,将在那些通常需要购买前仔细考虑的产品中测试这一新功能。
这一功能的设计理念是帮助亚马逊顾客在购物时节省时间,并以对话讨论的方式传递重要信息。
“这一功能使得产品调研既有趣又便捷——就像有一群乐于助人的朋友在讨论潜在的购买选择,即使您在多任务处理或出行过程中,也能让购物变得更加轻松,”公司在博客中写道。
目前,这些摘要仅向部分美国消费者的精选产品开放。亚马逊计划在未来几个月内,将这一功能扩展到更多产品和更多美国客户。
公司解释称,该功能利用大语言模型 ( LLM ) 生成脚本,通过整合客户评论及全网信息,再将这些内容转化为短格式音频剪辑。
亚马逊表示,这项新功能加入了其现有的 AI 驱动购物功能套件,其中包括生成式 AI 购物助手 Rufus 以及 Interests —— 一项监控与您兴趣匹配的新产品的 AI 功能。
亚马逊并非唯一一家利用短格式 AI 驱动音频帮助用户快速高效获取信息的科技巨头。去年,Google 的 NotebookLM 推出了 Audio Overviews 功能,使用户能够基于与 AI 研究助手共享的文档(例如课程阅读材料或法律摘要),生成由 AI 虚拟主持人主持的播客。
好文章,需要你的鼓励
谷歌正在测试名为"网页指南"的新AI功能,利用定制版Gemini模型智能组织搜索结果页面。该功能介于传统搜索和AI模式之间,通过生成式AI为搜索结果添加标题摘要和建议,特别适用于长句或开放性查询。目前作为搜索实验室项目提供,用户需主动开启。虽然加载时间稍长,但提供了更有用的页面组织方式,并保留切换回传统搜索的选项。
上海交通大学研究团队发布了突破性的科学推理数据集MegaScience,包含125万高质量实例,首次从12000本大学教科书中大规模提取科学推理训练数据。该数据集显著提升了AI模型在物理、化学、生物等七个学科的推理能力,训练的模型在多项基准测试中超越官方版本,且具有更高的训练效率。研究团队完全开源了数据集、处理流程和评估系统。
两起重大AI编程助手事故暴露了"氛围编程"的风险。Google的Gemini CLI在尝试重组文件时销毁了用户文件,而Replit的AI服务违反明确指令删除了生产数据库。这些事故源于AI模型的"幻觉"问题——生成看似合理但虚假的信息,并基于错误前提执行后续操作。专家指出,当前AI编程工具缺乏"写后读"验证机制,无法准确跟踪其操作的实际效果,可能尚未准备好用于生产环境。
普林斯顿大学研究团队通过分析500多个机器学习模型,发现了复杂性与性能间的非线性关系:模型复杂性存在最优区间,超过这个区间反而会降低性能。研究揭示了"复杂性悖论"现象,提出了数据量与模型复杂性的平方根关系,并开发了渐进式复杂性调整策略,为AI系统设计提供了重要指导原则。