Yelp 本周二表示,正在部署由 AI 驱动的 “语音助手” 来帮助服务提供商和餐厅处理电话、解答基本问题,并完成诸如将客户加入餐厅等候名单等任务。
Yelp 指出,其语音助手无需复杂的设置或 API 集成,可以利用现有元数据以及商户提供的数据(例如发音指南、定制语音问候和电话转接规则)。举例来说,对于餐厅,Yelp 的语音助手可以连接至餐厅的管理软件,在通话结束后向顾客发送预订详情。
此外,Yelp 的语音助手还能处理自动垃圾电话过滤和通话数据分析等任务。对于较为复杂的请求,语音助手会将通话交由人工处理,并在通话结束后向企业提供通话摘要、文字记录和录音。
Yelp 首席产品官 Craig Saldanha 在接受 TechCrunch 采访时表示,“通常情况下,专业人士在恶劣的工作环境下可能无法接听电话,我们希望开发一款能帮助转化那些通常可能错失的潜在客户的产品。”
Yelp 正在使用 OpenAI 的 Realtime API 来实现端到端通话管理。这使得 Yelp 的语音助手在公司知识图谱的辅助下,能够提出并回答后续问题。
Yelp 表示,为了在延迟、语音识别准确性以及整体客户体验方面达到最佳效果,公司正在不断评估并采用新模型。
Saldanha 认为,随着时间的推移,语音技术将逐步普及,而差异化的关键将是底层数据以及 AI 如何处理客户查询的方式。他补充道,在这些方面,Yelp 相较于竞争对手具备一定优势。
好文章,需要你的鼓励
CoreWeave发布AI对象存储服务,采用本地对象传输加速器(LOTA)技术,可在全球范围内高速传输对象数据,无出口费用或请求交易分层费用。该技术通过智能代理在每个GPU节点上加速数据传输,提供高达每GPU 7 GBps的吞吐量,可扩展至数十万个GPU。服务采用三层自动定价模式,为客户的AI工作负载降低超过75%的存储成本。
莫斯科高等经济学院研究员尼古拉·斯克里普科开发了IFEval-FC基准测试,专门评估大语言模型在函数调用中遵循格式指令的能力。研究发现,即使是GPT-5和Claude Opus 4.1等最先进模型,在处理看似简单的格式要求时准确率也不超过80%,揭示了AI在实际应用中的重要局限性。
谷歌DeepMind与核聚变初创公司CFS合作,运用先进AI模型帮助管理和改进即将发布的Sparc反应堆。DeepMind开发了名为Torax的专用软件来模拟等离子体,结合强化学习等AI技术寻找最佳核聚变控制方式。核聚变被视为清洁能源的圣杯,可提供几乎无限的零碳排放能源。谷歌已投资CFS并承诺购买其200兆瓦电力。
上海人工智能实验室联合多家机构推出MinerU2.5文档解析模型,仅用12亿参数就在文本、公式、表格识别等任务上全面超越GPT-4o等大型模型。该模型采用创新的两阶段解析策略,先进行全局布局分析再做局部精细识别,计算效率提升一个数量级。通过重新定义任务标准和构建高质量数据引擎,MinerU2.5能准确处理旋转表格、复杂公式、多语言文档等挑战性内容,为文档数字化提供了高效解决方案。