Benchmark / 实验详情
Jev Prompt Injection 检测 Benchmark
用不同攻击类型检查 Jev 能否把可疑指令拦到人工复核,同时明确它只是 Agent 安全体系中的一层。
发布前检查
这页目前是 Benchmark 方法模板。补齐真实数据集、运行日期、provider、model、统计口径和复现链接后,再公开 F1、延迟与样本数。
按攻击类型拆分结果
把直接覆盖指令、数据窃取、工具操控和正常请求分开统计,公开漏检案例,并保留权限控制与工具隔离。
任何分类模型都不能单独解决 Prompt Injection。Benchmark 分数不等于系统已经安全。