专注于企业级语音合成和对话技术的人工智能平台开发商Deepgram Inc.今日宣布推出专为开发者设计的语音驱动"操作系统"。
这款新工具名为Saga,作为一个通用语音接口,可以直接嵌入开发者环境,让他们仅凭声音就能控制工具和代码。公司表示,这款新助手或副驾驶位于现有工具之上,允许开发者将粗糙的想法转化为AI编码提示,而无需在不同窗口间切换。
现代开发者使用众多不同的工具,通常配备多个显示器,在导入和文件之间跳转来完善他们的想法。他们在试图弄清楚解释器为什么无法看到其工作上下文时引入代码。
Deepgram将这种切换称为生产力上的"静默税",由alt-tab切换、在显示器间查看、在文件间查看、测试并最终部署代码却发现错误弹出所产生。
"你说话的速度比打字快,阅读速度比写作快。现代开发者技术栈尚未以AI作为一流操作模式重新构想,"Deepgram首席执行官兼联合创始人Scott Stephenson表示。"开发者在工具间切换上花费了太多精神能量,而不是用于构建。"
Stephenson表示,通过语音而非仅仅按键重新构想开发过程,开发者可以在电脑前获得完全不同的体验。对于那些在其他环境中长大、习惯于热键操作的人来说,这似乎能高速运转,但语音感觉更自然——尽管在开放式办公室中,这可能会引起一些关注。
根据Deepgram的介绍,Saga能够轻松集成众多AI原生编码环境,包括Cursor和Windsurf,并且可以在Linear、Asana、Jira或Slack等项目管理软件中维护状态更新。用户还可以通过要求它从Google Docs、Gmail或Google Sheets中提取信息来将该信息整合到代码中,或者只是告诉他们需要知道什么,从而将其用于日常任务。
开发者可以向助手表达他们的想法,例如说:"创建一个响应表情符号的Slack机器人。"作为回应,Saga会将他们的想法转换为可与Cursor等工具一起使用的一次性提示。
该工具还可以用于加速文档、工单或描述符的处理,让开发者在漫长编码期结束时快速完成原本繁琐的打字工作。
公司表示,Saga不仅仅是一个助手,而是一个"可编程操作系统",集成到整个工作流程中。为此,Saga通过模型上下文协议(连接AI模型到数据集和工具)和各种标准接口进行交互。这允许团队轻松将其连接到任何设置、开发者环境或集成。
"Saga代表了一个根本性转变——从传统语音助手结束的地方开始,将语音作为接口提供,"Deepgram高级产品经理Sharon Yeh表示。"我们不是要求开发者学习新命令或更改工具。我们为他们提供了一种自然的方式来编排完整的工作流程,通过将语音转化为从想法到执行的最快路径。"
好文章,需要你的鼓励
日本三井商船计划将船舶改造为浮动数据中心,容量可达20-73兆瓦,采用海水或河水直接冷却。该项目预计2027年投入运营,可通过陆地和海底电缆连接互联网交换中心。浮动数据中心的优势在于可根据需求变化移动位置,建设周期仅需一年,无需获取土地。该项目与土耳其Kinetics公司合作,可通过配套电力船供电,解决电网连接问题。
Patronus AI发布突破性研究,构建了首个系统性AI代理错误评估体系TRAIL,涵盖148个真实案例和21种错误类型。研究发现即使最先进的AI模型在复杂任务错误识别上准确率仅11%,揭示了当前AI代理系统在长文本处理、推理能力和自我监控方面的重大局限,为构建更可靠的AI系统指明方向。
随着AI引发投资热潮,每月都有更多初创企业获得独角兽地位。TechCrunch追踪了今年迄今为止成为独角兽的风投支持初创企业。虽然大多数与AI相关,但令人意外的是许多企业专注于其他行业,如卫星公司Loft Orbital和区块链交易网站Kalshi。这些价值超过10亿美元的初创企业涵盖软件开发、机器人技术、医疗健康等多个领域。
这项研究首次从理论和实践证明AI模型可通过模仿生物睡眠-学习周期显著提升性能。研究发现AI训练中存在自发的"记忆-压缩循环",并据此开发了GAPT算法,在大语言模型预训练中实现4.8%性能提升和70%表示效率改善,在算术泛化任务中提升35%,为AI发展指出了注重信息整理而非单纯数据扩展的新方向。