跳到主内容
@wquguru
精选75Hugging Face 每日论文(json_list)论文研究

PolicyGuide:基于工作流图的LLM Agent合规验证

PolicyGuide: From Guarding One Action to Guiding the Whole Workflow for Policy-Compliant LLM Agents

原文
发到 X

客服大语言模型(LLM)代理在代表用户执行操作时,必须遵循组织政策。合规性失败源于两类问题:一是禁止的操作,例如为不符合资格的用户授予变更;二是遗漏的程序性要求,例如身份验证或确认。运行时防护机制可以对高风险操作进行干预,但基于动作局部的检查无法引导代理完成多步骤流程。工作流跟随系统支持既定流程的执行,但其主要目标是确保工作流完成,而非保障代理行为的安全性。PolicyGuide 则将每项领域策略编译为工作流图,并在用户交互边界处调用主动验证器。验证器基于持久化的图状态,协调未完成的请求,并沿符合策略的路径返回针对具体步骤的修复建议。在 τ^2-bench 涵盖的航空、零售和电信领域中,使用 GPT-5.4 代理与验证器进行测试,PolicyGuide 将平均 Pass^4 指标从 0.42 提升至 0.62,其中提升幅度最大的是电信领域(从 0.19 提升至 0.61),该领域的工作流结构最为规范。相同的工作流可迁移至 Claude Sonnet 4.6 和 Gemini 2.5 Pro 代理。补充评估结果显示,在面对对抗性用户时,攻击成功率最低;在作者设计的工作流级验证中,程序合规性最强。

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

另一事件,读法相近