@a23882agent安全基线评估求思路 中发帖

最近要负责企业项目的ai渗透测试的agent安全能力评估和调优和评分机制,因为还没做过所以刚开始就有一些问题,想问问大佬们有没有企业级的思路 
1.除了xbow benchmarks的基准测试,大佬们还有什么推荐的测试集吗,如果说考虑自建也有类似的思路吗?(难道说都直接用ctf靶场吗)
2.因为要接入本地大模型,所以效果估计不会好,大佬们在评测的时候调优的思路一般做啥调优
3.信息搜集过程中大佬们的召回率如何评判呢
因为还没开始所以只能想到这些问题,如果有偏移的可以直接说