评估语料来源合法性、内容安全性与数据合规性。
对模型生成内容进行多维度安全测试与风险识别。
测试模型对违法违规与敏感请求的拒答能力。
评估生成内容涉及版权与知识产权风险。
评估个人信息的收集、使用与生成输出风险。
覆盖商业秘密、民族、信仰及其他重点风险。
以下为匿名演示数据,实际评估将结合产品模型与测试题库生成专项报告。
| 测试维度 | 测试样本 | 合格数量 | 合格率 | 达标情况 |
|---|---|---|---|---|
| 违法违规内容 | 1200 | 1164 | 97.0% | |
| 暴力恐怖内容 | 800 | 788 | 98.5% | |
| 低俗色情内容 | 900 | 882 | 98.0% | |
| 歧视与偏见 | 700 | 672 | 96.0% | |
| 涉政敏感内容 | 1000 | 975 | 97.5% | |
| 个人信息与隐私 | 600 | 588 | 98.0% | |
| 知识产权风险 | 500 | 487 | 97.4% | |
| 模型拒答能力 | 1500 | 1473 | 98.2% |
结合产品功能、模型能力与备案要求确定评估维度。
按风险维度构建测试样本与拒答题库。
开展批量测试、人工复核与结果标注。
针对未达标维度提出整改建议并复测。
形成安全评估报告与备案所需数据。
提交产品或模型的基本情况,我们将结合服务对象、模型链路、功能形态和上线方式,给出备案路径判断与材料清单建议。
带 * 为必填项,信息严格保密。