Opera 网页浏览器现在推出了"代理式 AI"功能,用户可以要求内置的 AI 模型执行一系列浏览器操作任务。
这基本上相当于将网页浏览任务委托给一个能力有限但可以处理某些事情的个人助理。虽然作为技术演示可能很有趣,但说实话,这有点夸张。
这个被称为"Browser Operator"的 AI 代理可以完成诸如查找 12 双男士 10 码 Nike 袜子等购物任务。在 Opera 制作的演示视频中(部分内容以 6 倍速播放),展示了用户只需要输入购买内衣的请求,而不是在网页上四处点击。
在给出的示例中,AI 通过浏览器聊天侧边栏完成了八个步骤,代替用户在网页显示窗格中进行点击和导航,最终到达 Walmart 的结账页面,并将两包共六双袜子添加到用户的购物车中,随时可以付款。
当然,你也可以在 15 秒内访问 Walmart 在线商店并点击几下就能完成同样的操作。不过这样一来,你的 AI 代理就失业了,这倒是挺讽刺的。
视频中还展示了其他任务,如查找特定音乐会门票和预订从奥斯陆到纽卡斯尔的机票,播放速度从 4 倍到 10 倍不等,最后由用户授权实际购买。
Browser Operator 的实际运行速度比视频中显示的要慢,不过这对于一个半自动助手来说反而是有帮助的。较慢的节奏允许用户随时介入并接管控制。
Opera Software 的执行副总裁 Krystian Kolondra 在一份声明中说:"30 多年来,浏览器让你能够访问网络,但从未能为你完成具体任务。"这种说法似乎忽视了解析现代 HTML 页面(包含 CSS 和 JavaScript)所需的数十亿个 CPU 周期。
"现在可以了。这与我们之前看到或发布的任何功能都不同。今天我们展示的 Browser Operator 标志着浏览器角色的首次转变,从显示引擎转变为能够为用户执行任务的代理应用程序。"
"现在可以了"实际上意味着"现在部分用户可以使用"—— Browser Operator 目前是一个预览功能,只有部分用户可以访问,尚未普遍可用。当我们在设置和标志菜单中寻找启用选项时,最新的 macOS 版 Opera 和 Opera Developer 版本都尚未支持 Browser Operator。
据该公司称,Browser Operator 将在不久的将来通过公司的 AI 功能发布计划推出。
据 Opera 称,Browser Operator 在本地运行。"它通过不依赖浏览会话的截图或视频捕获,也不依赖云端或虚拟机中运行的浏览器版本来保护用户隐私。"开发者如此声称。
其 Aria 设置页面包含以下警告:"AI 服务不应用于任何法律、医疗或咨询目的。我们建议您保持谨慎并核实事实。"
OpenAI 和 Anthropic 都发布了面向代理的服务,具体包括 OpenAI Operator 和 Anthropic 的 Claude 3.7 和 3.5 Sonnet 计算机使用 API。
令人惊讶的是,《华尔街日报》在 1 月份报道称,一些公司实际上正在使用 AI 代理。
Gartner 上周预测,在未来几年内,AI 代理将在企业运营中发挥重要作用。该 IT 咨询公司表示:"到 2028 年,Gartner 预测 33% 的企业软件应用程序将包含代理式 AI,而 2024 年这一比例不到 1%,至少 15% 的日常工作决策将通过 AI 代理自主完成。"
请记住,Gartner 此前也出现过错误预测。2014 年,Gartner 研究总监 Peter Sondergaard 预测"到 2025 年,三分之一的工作将被软件、机器人和智能机器取代。"仅仅三年后,Gartner 就改口说 AI 创造的工作岗位将多于它消除的岗位。
好文章,需要你的鼓励
Anthropic 发布新API,让Claude AI模型实时搜索网络资讯。开发者可定制搜索策略,构建实时信息应用。
利用人工智能加速学习、自动化重复任务和优化开发流程,企业正用 AI 工具应对开发者技能短缺,推动持续创新和业务增长。
在采访中,Oracle NetSuite 执行副总裁 Evan Goldberg 探讨商业应用中 AI 的发展,从文本生成到自主工具,并展望在 agentic AI 领域与 Oracle Fusion 的合作前景。
PeerGFS 最新版本支持通过 SMB 与 NFS 同时访问同一文件,实现数据在各地存储系统间的实时同步,助力 AI 及医疗等应用场景。