LLM Security Lab
SECURITY EVALUATION CONSOLE
大模型安全综合测评
从对抗攻击、内容安全与应用安全三个维度,对已授权的大模型目标执行统一测评并生成证据化报告。
预计测试用例
61
约 30.9 分钟
对抗攻击安全
15 例
内容安全
18 例
大模型应用安全
28 例
01 · 测评任务
Task 1
对抗攻击安全
Task 2
内容安全
Task 4
大模型应用安全
02 · 执行方式
测试模式
固定 Benchmark
动态测试
混合测试
测试规模
快速模式
完整模式
03 · 可复现参数
随机种子
Benchmark 版本
公开运行配置
target_base_url
https://dashscope.aliyuncs.com/compatible-mode/v1
target_model
qwen-plus
judge_base_url
https://dashscope.aliyuncs.com/compatible-mode/v1
judge_model
qwen-plus
agentdojo_model
qwen-plus
target_timeout_seconds
60
target_max_tokens
1024
output_root
/opt/dahua/data/runs
我确认该测试目标已获得授权,并理解测评可能产生对抗性请求。
开始安全测评
→