AgentSpec：一种提升 AI 代理可靠性的新方法

新研究提出AgentSpec框架,通过定义结构化规则来提高AI代理的可靠性和安全性。该方法可防止90%以上的不安全代码执行,确保自动驾驶场景合规,消除风险行为,并具有毫秒级开销。AgentSpec有望改善企业环境和自动驾驶等领域的AI代理应用,为未来实现持续可靠的环境代理铺平道路。

AI 代理在安全性和可靠性方面存在问题。尽管代理可以帮助企业自动化更多工作流程，但在执行任务时可能会产生意外行为，缺乏灵活性且难以控制。

多个组织已经对不可靠的代理发出警告，担心部署后的代理可能会忘记遵循指令。

就连 OpenAI 也承认，确保代理可靠性需要与外部开发者合作，因此开放了其 Agents SDK 来帮助解决这个问题。

然而，新加坡管理大学 (SMU) 的研究人员开发了一种解决代理可靠性的新方法。

AgentSpec 是一个特定领域框架，允许用户"定义包含触发器、谓词和执行机制的结构化规则"。研究人员表示，AgentSpec 将使代理只在用户希望的参数范围内工作。

用新方法指导基于大语言模型的代理

AgentSpec 不是一个新的大语言模型 (LLM)，而是一种指导基于 LLM 的 AI 代理的方法。研究人员认为 AgentSpec 可以用于企业环境和自动驾驶应用中的代理。

首次 AgentSpec 测试集成在 LangChain 框架上，但研究人员表示他们设计时考虑了框架无关性，这意味着它也可以在 AutoGen 和 Apollo 生态系统上运行。

使用 AgentSpec 的实验表明，它可以"防止超过 90% 的不安全代码执行，确保自动驾驶法律违规场景下的完全合规，消除具身代理任务中的危险行为，并且运行开销仅为毫秒级"。使用 OpenAI 的 o1 生成的 AgentSpec 规则也表现出色，执行了 87% 的风险代码并在 8 个场景中的 5 个场景中防止了"违法行为"。

目前的方法略显不足

AgentSpec 并非帮助开发者提升代理控制和可靠性的唯一方法。其他方法包括 ToolEmu 和 GuardAgent。初创公司 Galileo 推出了 Agentic Evaluations，用于确保代理按预期工作。

开源平台 H2O.ai 使用预测模型来提高金融、医疗、电信和政府等领域公司使用的代理准确性。

AgentSpec 的研究人员表示，当前的风险缓解方法（如 ToolEmu）能有效识别风险。他们指出"这些方法缺乏可解释性，也没有安全执行机制，使其容易受到对抗性操纵"。

使用 AgentSpec

AgentSpec 作为代理的运行时执行层工作。它在执行任务时拦截代理的行为，并添加由人类设置或通过提示生成的安全规则。

由于 AgentSpec 是一种自定义的特定领域语言，用户必须定义安全规则。这包含三个组件：第一是触发器，规定何时激活规则；第二是检查添加条件；第三是执行，规定违反规则时要采取的行动。

如前所述，AgentSpec 构建在 LangChain 上，但研究人员表示 AgentSpec 也可以集成到其他框架中，如 AutoGen 或自动驾驶车辆软件栈 Apollo。

这些框架通过接收用户输入、创建执行计划、观察结果，然后决定动作是否完成（如果未完成，则规划下一步）来协调代理需要采取的步骤。AgentSpec 在这个流程中添加了规则执行。

论文指出："在执行动作之前，AgentSpec 评估预定义的约束以确保合规性，必要时修改代理的行为。具体来说，AgentSpec 在三个关键决策点上进行干预：动作执行前 (AgentAction)、动作产生观察后 (AgentStep) 和代理完成任务时 (AgentFinish)。这些点提供了一种结构化的干预方式，而不会改变代理的核心逻辑。"

更可靠的代理

像 AgentSpec 这样的方法突显了企业对可靠代理的需求。随着组织开始规划其代理策略，技术决策者也在寻找确保可靠性的方法。

对许多人来说，代理最终将自主且主动地为用户执行任务。环境代理的理念（即 AI 代理和应用程序在后台持续运行并自行触发执行操作）需要代理不偏离其路径且不会意外引入不安全操作。

如果环境代理是代理式 AI 未来的发展方向，那么随着公司寻求使 AI 代理持续可靠，预计将会出现更多类似 AgentSpec 的方法。

来源：VentureBeat

0赞

好文章，需要你的鼓励

AgentSpec：一种提升 AI 代理可靠性的新方法

来源：VentureBeat

2025

03/31

14:58

分享

点赞

数智时代，openGauss Summit 2025即将发布哪些技术创新破局

“算力+储能”深度融合：超智算发布分布式算力超级节点储能解决方案

联想推出DE6600系列：更智能的存储解决方案

创业公司如何在严格监管行业中实现生死攸关的创新

OpenAI发布GPT-5.2-Codex模型，软件工程自动化能力大幅提升

Waterfox浏览器宣布拒绝AI功能，瞄准Firefox忠实用户

TikTok美国业务出售交易将于下月完成

破局AI数据中心安全瓶颈：Fortinet联合NVIDIA引领隔离式加速新航向

智算中心进化论，科华数据如何做到“更懂”

更高负载、更快建设：2026年数据中心六大趋势

Snowflake数据库更新引发全球大规模服务中断

AI编程初创公司Lovable融资3.3亿美元，英伟达等科技巨头支持

人工智能搜索靠得住吗？最新研究揭露惊人真相

ChatGPT 升级更智能：OpenAI 增加内部数据引用功能

Gemini 2.5 Pro 实测：或将成为最实用的推理模型

ChatGPT 的 "GPU 过热" 现象：人们疯狂制作吉卜力风格的 AI 图像

2025 年 CRM 九大趋势：AI 重塑客户关系

数据孤岛如何影响 AI 和智能体

2025 iPad 购买指南：选择合适的 iPad 比你想象的更简单

AI 正在塑造未来：谁将成为下一个万亿美元公司？

苹果 CEO 在深度求索总部所在地会见"新一代开发者"

Windows Longhorn 已成往事，前微软工程师回顾微软操作系统的失败经历

如果您非常迫切的想了解IT领域最新产品与技术信息，那么订阅至顶网技术邮件将是您的最佳途径之一

2025 re:Invent ：亚马逊云科技把Agentic AI生态梳理明白了

电子竞技瞬息万变，Team Liquid的“数据+AI”制胜秘籍

中国移动呼和浩特数据中心：只有高效存力先行，AI才能跑出全力

从“支撑工具”到“智能中枢”，AI原生ERP进化

关注官方公众号

关注官方微博

关注官方喜马拉雅

友情链接

业界热点: