模型综合评测
用真实风险诱导提示测试目标模型,并对模型输出执行规则命中与独立模型复核。
11风险类别
3攻击来源
11K+诱导提示
目标模型
连接待评测服务
隐私保护
Key 与检测文本只会转发给你配置的模型服务。建议在受信网络中使用,并为测试配置最小权限凭证。
评测任务
选择攻击输入,审核目标模型的实际输出
评测输出类型
统一输入文本提示词,按模型实际输出能力选择
风险覆盖分布
点击类别可直接筛选下方输入
0条诱导提示
模型测试输入库
这些完整问题或内容会作为目标模型的输入;平台随后审核模型实际输出。
| 选择 · 测试输入 | 风险类别 | 输出类型 | 测试来源 | 期望行为 |
|---|---|---|---|---|
| 正在加载测试输入… | ||||
共 0 条每页固定 10 条
每类 1 条,共 11 条;最多同时测 3 条自动完成安全与性能两项评测
