策略与规则

以 Markdown 格式查看

Alephant 在 4 个架构层级中提供最多 18 项可配置策略。策略用于管理网关层如何处理请求。

对于智能体和工作流系统,策略的范围比模型访问更广。在活动变得昂贵、有风险或难以审计之前,Alephant 策略即可决定允许使用哪些模型、工具、工作流、付费端点、成员、部门和预算。

策略层级

  1. 系统策略(始终启用)
    • 用于防止灾难性计费错误的硬性限制,例如每日硬停止和基本速率上限。
  2. Pro 策略
    • 可配置的限制,例如 Token 约束、特定模型限制、重试逻辑和基础语义缓存。
  3. Team 策略
    • 成员归因强制执行、团队速率限制和协作护栏。
  4. Enterprise 策略
    • 高级合规功能,包括 PII(个人身份信息)检测、数据驻留要求、IP 允许列表和 SSO 强制执行。

部门覆盖

在 Enterprise 套餐中,可按部门覆盖工作区级策略。覆盖类型包括:

  • 自定义速率限制
  • 模型白名单(例如,限制为特定模型)
  • 自定义预算告警阈值
  • 时间窗口限制(例如,仅允许在工作时间内发起请求)
  • 每次请求的最大 Token 数
  • 并发限制

智能体运行策略

智能体运行策略控制智能体或工作流在执行期间可执行的操作。

常见控制项包括:

  • 工作区、部门、成员、智能体或虚拟密钥范围内的预算限制
  • 速率限制和并发限制
  • 模型允许列表和供应商限制
  • 工具和外部 API 权限
  • 付费端点访问规则
  • 提示词模板限制
  • 针对敏感或高成本操作的审批规则
  • 硬停止、限流、告警或升级行为

策略决策应在日志和运行追踪中可见,以便团队回答某次运行为何被允许、阻止、限流或升级。

告警触发条件

当活动跨越风险阈值时,策略可产生运营告警:

告警类型典型触发条件
预算告警预算用量超过警告或硬停止阈值
用量异常与近期历史相比,请求数或成本激增
配额告警每月请求日志或用量配额接近限制
运营告警错误率、延迟、缓存行为或路由行为发生变化

告警应指向相关的工作区、部门、智能体、成员、虚拟密钥、策略或运行追踪。

付费端点策略

对于已变现的智能体能力,支付验证只是执行控制的一部分。端点策略还可控制:

  • 买方访问权限
  • 每次调用的最高价格
  • 端点速率限制
  • 允许的智能体或工作流
  • 模型和工具权限
  • 预算和利润率护栏
  • 人工审批或审查要求

这使付费端点在执行前受到治理,并可在执行后进行度量。

相关页面