跳转到内容

AI、AGENT 与上下文 · DEFINED TERM

Guardrails 护栏

在模型输入、工具权限和输出结果周围设置可执行的限制与检查。

你可能会这样说“删除文件和发送邮件前必须询问,普通读取可以直接做。”

VISUAL EXAMPLE

先看懂它怎么工作

界面状态示例

等待操作

MECHANISM

运行机制

  1. 输入检查
  2. 权限判定
  3. 执行动作
  4. 输出校验
  5. 记录审计

USE WHEN

适合这样用

高风险工具、合规内容和关键业务流程

NOT FOR

不要这样理解

护栏不能只写在提示词里而没有系统层执行

TELL YOUR AGENT

可直接发给 Agent

请按“Guardrails 护栏”的概念处理这个需求:删除文件和发送邮件前必须询问,普通读取可以直接做。。先说明实现边界,再给出可检查的结果。

ACCEPTANCE

怎么确认它真的做好了

越权操作被阻止,重要动作有确认,误拦截和绕过路径均有测试

OFFICIAL SOURCES

官方来源