guardrails · observability
护栏与可观测被下沉到路由层:请求在到达模型之前经过策略校验,返回之后再次校验,全过程以 Trace 记录 Agent 规划、检索、工具调用与模型推理的每一个 Span。
策略按阶段生效,命中后可选择阻断、改写或仅告警;所有规则均可按项目覆盖,并支持自定义正则与模型判别器。
| 策略 | 生效阶段 | 命中动作 | 说明 |
|---|---|---|---|
| PII 脱敏 | 输入前 | 改写 | 识别手机号、身份证、邮箱等敏感字段并自动脱敏或拦截。 |
| 提示词注入检测 | 输入前 | 阻断 | 检测越狱与指令注入攻击模式,命中即阻断并记录 Trace。 |
| 敏感词过滤 | 输入前 | 告警 | 自定义关键词库,命中后告警或阻断,支持按项目覆盖。 |
| 内容安全审核 | 输出后 | 阻断 | 对模型输出做毒性与违规内容判别,超标内容替换为安全话术。 |
| JSON Schema 校验 | 输出后 | 改写 | 强制结构化输出符合 Schema,字段缺失或类型不符自动重试。 |
| 幻觉检测 | 输出后 | 告警 | 对回答与引用的一致性打分,低置信度结果标记告警。 |
下面是一次真实 Agent 调用的时间轴示例:总耗时 2.8s,包含规划、检索、模型推理、工具调用与两次护栏校验。
agent.run
Agent
2840ms · 规划并调度全部子任务
guardrail: input
Guardrail
60ms · 输入策略校验(6 策略)
planner · gpt-4o
LLM
640ms · 任务拆解与工具选型
retriever.embed
Retrieval
280ms · 问题向量化与召回
tool: search_docs
Tool
510ms · 检索知识库文档
executor · claude-3.5
LLM
980ms · 生成最终回答
guardrail: output
Guardrail
90ms · 输出审核与 Schema 校验
按模型、项目、用户维度聚合 token、时延、错误率与金额,支持异常自动告警。
把线上 Trace 采样成评估集,版本变更后一键回归,比较质量与成本差异。
OTLP 协议导出到自建 Langfuse、数据仓库或既有 APM,数据归属于你。
billing · subscription
无需预付即可开始调用。当护栏校验与 Trace 量级上升,或需要跨多家提供方统一额度与折扣时,再切换到套餐或多模型 Plan,账单在同一处结算。
适合刚开始接入、调用量较小的团队。
¥0
无月费 · 按用量结算
覆盖目录内全部模型的原生单价
为生产环境打包 Guardrails 与全链路可观测。
即将上线
按月订阅 · 额度每月重置
含护栏校验次数与 Span 计量额度
跨多家提供方统一额度与折扣。
预付
预付额度 · 有效期 12 个月
覆盖多家提供方热门模型
| 能力 | 按量计费 | 护栏与可观测套餐 | 多模型 Plan |
|---|---|---|---|
| 模型目录访问 | 全部 | 全部 | 热门模型 |
| Guardrails 护栏 | — | 全部策略 | 含全部策略 |
| Trace 可观测 | 基础日志 | 30 天留存 | 30 天留存 |
| 自动化评估 | — | 包含 | 包含 |
| 统一折扣 | — | — | 阶梯折扣 |
| 支持 | 社区 | 优先工单 | 专属客服 |
模型费用按各提供方原生口径计价;护栏按校验次数、可观测按 Span 数计量。
套餐与 Plan 的额度按月重置,超量部分自动回落到按量单价,不中断服务。
可随时在控制台升级或降级,按日折算;退订后数据保留 30 天供导出。