模型站
安全检测 · xjp-guard-1
检查一段文本,只返回布尔值:是否有害内容、是否提示词注入、是否允许。
契约
模型 id 为 xjp-guard-1,在 GET /v1/models 里 kind 为 guard。它不是聊天模型,用这个 id 调 /v1/chat/completions 会返回 400。
调用示例
curl https://router.xiaojins.com/v1/workflows/guard \
-H "Authorization: Bearer $XJP_KEY" -H "content-type: application/json" \
-d '{"input": "text to check"}'{"allowed": true, "nsfw": false, "injection": false, "judge_error": false,
"model": "xjp-guard-1", "id": "guard_...", "usage": {"units": 2, "est_tokens": 12}}四个布尔值
nsfw- 文本是有害内容(色情、血腥暴力、明显违法的协助等)。
injection- 文本试图指挥或越狱某个 AI 系统,或试图操纵这次检测本身。
allowed- 仅当 nsfw 与 injection 都为 false 且 judge_error 为 false 时才为 true。
judge_error- 检测没能完成,所以结果按拒绝处理(allowed=false)。HTTP 状态仍是 200,error_code 为 timeout、upstream、parse、unavailable 之一。
响应里永远没有裁判的文字、理由、分数或上游模型名。响应头 x-xjp-guard-version 是提示词版本。
限制
input 必填且不能为空白;出现未知字段或 stream: true 返回 400。超过 8,000 字符的部分在检测前被截掉。调用 15 秒超时。
计费规则
- 按裁判读到的文本量计费。est_tokens 对前 8,000 个字符计数:中文、日文、韩文和全角字符每个算 1 token,其余字符每个算四分之一 token,向上取整。
- units = 1 + ceil(est_tokens / 400),一个单位 0.003 美元。usage.units 与 usage.est_tokens 会报出实际收取的数量。
- 用户积分钱包每单位扣 1 积分。judge_error 不收费。
| 输入 | est_tokens | units | 价格(USD) |
|---|---|---|---|
| 一句英文(48 个字符) | 12 | 2 | 0.006 |
| 英文 2,000 字符 | 500 | 3 | 0.009 |
| 中文 2,000 字符 | 2,000 | 6 | 0.018 |
| 英文 8,000 字符 | 2,000 | 6 | 0.018 |
| 中文 8,000 字符 | 8,000 | 21 | 0.063 |
隐私
你发送的文本会转交给第三方模型服务商做裁判。Router 不保存这段文本和裁判的回复,也不写入日志(日志只保留长度和一个短哈希前缀),只把上面的布尔值还给你。不要发送你无权交给第三方处理方的文本。
中国大陆不可用
大陆(CN)部署没有裁判路由,始终返回 judge_error,error_code 为 unavailable,并带响应头 x-xjp-guard-unavailable: cn。