谷歌的Gemini应用程序迎来了一项重要更新,终于开始支持音频文件处理功能。这一扩展标志着该AI助手在多媒体内容处理能力上的重要进步。
用户现在可以直接在Gemini应用中上传和处理各种音频文件格式,包括语音记录、音乐片段和其他音频内容。这项新功能使得用户能够更便捷地与AI进行交互,无需再依赖纯文本输入。
此次更新大大拓展了Gemini的应用场景。用户可以上传会议录音让AI进行总结,分析音乐文件获取相关信息,或者通过语音输入更自然地与AI对话。这种多模态的交互方式显著提升了用户体验。
谷歌表示,这项功能的推出是其不断改进AI助手能力的一部分。音频处理功能的加入使Gemini能够更好地理解和响应用户的多样化需求,为用户提供更加智能和全面的服务。
该功能目前正在逐步向全球用户推出,预计将在未来几周内覆盖所有支持地区。用户可以通过更新应用程序来体验这一新功能。
Q&A
Q1:Gemini应用程序新增了什么功能?
A:Gemini应用程序新增了音频文件处理功能,用户现在可以直接在应用中上传和处理各种音频文件格式,包括语音记录、音乐片段和其他音频内容。
Q2:音频功能支持有什么实际用途?
A:用户可以上传会议录音让AI进行总结,分析音乐文件获取相关信息,或者通过语音输入更自然地与AI对话,大大拓展了应用场景。
Q3:这个音频功能什么时候能用?
A:该功能目前正在逐步向全球用户推出,预计将在未来几周内覆盖所有支持地区,用户可以通过更新应用程序来体验。
好文章,需要你的鼓励
Queen's大学研究团队提出结构化智能体软件工程框架SASE,重新定义人机协作模式。该框架将程序员角色从代码编写者转变为AI团队指挥者,建立双向咨询机制和标准化文档系统,解决AI编程中的质量控制难题,为软件工程向智能化协作时代转型提供系统性解决方案。
苹果在iOS 26公开发布两周后推出首个修复更新iOS 26.0.1,建议所有用户安装。由于重大版本发布通常伴随漏洞,许多用户此前选择安装iOS 18.7。尽管iOS 26经过数月测试,但更大用户基数能发现更多问题。新版本与iPhone 17等新机型同期发布,测试范围此前受限。预计苹果将继续发布后续修复版本。
西北工业大学与中山大学合作开发了首个超声专用AI视觉语言模型EchoVLM,通过收集15家医院20万病例和147万超声图像,采用专家混合架构,实现了比通用AI模型准确率提升10分以上的突破。该系统能自动生成超声报告、进行诊断分析和回答专业问题,为医生提供智能辅助,推动医疗AI向专业化发展。