Service · 05
大模型安全评估服务
生成式 AI 合规与安全,红队+评估+备案
服务概述
面向大语言模型/生成式 AI 应用开展安全与合规评估,覆盖提示词注入、越狱、数据泄露、内容安全与备案闭环。
服务内容
办法合规性
评估是否符合《生成式人工智能服务管理暂行办法》相关规定。
主要风险识别
识别语料、模型、安全措施等方面存在的主要风险。
上线风险预判
预判模型上线提供服务后的主要安全风险及防范措施建议。
处置能力评估
评估服务提供者对损害后果是否具备相应处置能力,并给出是否建议上线结论。
服务流程
STEP 1
合规评估
生成式 AI 服务管理暂行办法合规性核查
STEP 2
风险识别
语料、模型、安全措施风险
STEP 3
安全测试
提示词注入/越狱/内容安全红队测试
STEP 4
风险研判
上线风险预判与防范建议
STEP 5
评估结论
是否建议上线 + 备案闭环辅导
交付物 / 价值
- 大语言模型安全评估报告
- 《生成式 AI 服务管理暂行办法》合规性评估
- 模型漏洞与内容安全测试结果
- 上线风险预判与防范建议
- 大模型备案全流程辅导
