AI安全护栏
|
功能集 |
功能 |
功能描述 |
参考文档 |
|
提示词攻击检测 |
提示词攻击检测 |
对提示词攻击进行检测和防护,覆盖提示词注入、提示词泄漏、越狱攻击等不同的风险类型。 |
- |
|
内容合规检测 |
大模型输入文本检测 |
对大模型输入的文本内容进行合规检测,识别涉政、涉黄、偏见、歧视等不良文字内容。 |
- |
|
大模型输出文本检测 |
对大模型输出的文本内容进行合规检测,避免不良模型输出带来舆情和监管影响。 |
- |
|
|
敏感数据检测 |
敏感内容检测 |
对大模型输入和输出中的敏感信息泄漏进行检测,避免个人隐私信息、健康信息对大模型产生舆情和监管危害。 |
- |
该文章对您有帮助吗?