功能特性

更新时间:
复制 MD 格式

AI安全护栏

功能集

功能

功能描述

参考文档

提示词攻击检测

提示词攻击检测

对提示词攻击进行检测和防护,覆盖提示词注入、提示词泄漏、越狱攻击等不同的风险类型。

-

内容合规检测

大模型输入文本检测

对大模型输入的文本内容进行合规检测,识别涉政、涉黄、偏见、歧视等不良文字内容。

-

大模型输出文本检测

对大模型输出的文本内容进行合规检测,避免不良模型输出带来舆情和监管影响。

-

敏感数据检测

敏感内容检测

对大模型输入和输出中的敏感信息泄漏进行检测,避免个人隐私信息、健康信息对大模型产生舆情和监管危害。

-