Watchdog输入安全实验室
每一次 AI 执行,都值得多看一眼

让风险止于输入,
让每一步更安心。

一段输入,可能藏着敏感信息,也可能藏着新的指令。
用一个轻量模型,看见它们之间的边界。

单词元快速判断五级风险识别中英文输入
模型响应等待首次分析每次分析,实时测量
01

试一段输入

内容由你,判断交给模型
从一个场景开始示例内容均为虚构
支持中文与英文,最多 4,000 字0 / 4,000
无需登录 · 每个 IP 每分钟 20 次
02

看见判断

连接模型中

每一次判断,从理解开始。

选择左侧场景,或写下自己的内容。
模型将在这里给出风险评估。

从无明显风险,到严重风险
更小,也可以更专注

为输入边界而训练。

01 / 识别

关注真正的输入风险

敏感数据、凭据泄露、提示注入
与不安全的工具使用意图。

02 / 判断

一个词元,一个风险等级

快速模式直接读取最终位置得分,
省去长文本生成的等待。

03 / 理解

需要时,多看一层细节

关闭快速模式,查看建议动作、
风险类别与命中片段。

关于这个演示

轻量模型,专注输入安全。

这是一个专门针对输入安全训练的模型,关注敏感信息、提示注入、越权与数据泄露风险。每次分析都会展示实际耗时,让速度直观可见。

快速模式

一次推理直接判断风险等级,省去完整报告的生成时间。风险相对得分不等于经过校准的置信度。

完整模式

生成风险类别、建议动作、命中片段与简短说明,等待时间更长。建议动作由模型给出,演示不会执行这些动作。

模型响应时间仅计推理耗时,整体响应时间包含网络往返。这是一个实验性模型,可能出现漏报或误报。输入仅用于本次推理,不写入应用日志。