Jev Recipe / 实施步骤

用 Jev 识别垃圾信息并保留人工复核

不要让模型直接删除消息,而是输出明确的 spam 判断和置信度,为隔离、放行与人工检查建立边界。

实现这个决策的 3 个步骤

01提交消息正文与必要的发送者上下文,不要把与判断无关的用户画像全部带入。
02先写清产品自己的垃圾信息定义,再选择 Noul 或三分类 Choice。
03低置信度消息进入隔离区,人工结果回流到测试样本。
schema / 示例
{
  "is_spam": {
    "type": "noul",
    "instructions": "这条消息是否属于垃圾信息?"
  }
}
复制到 Playground 后,先替换成自己的 state 和 criteria。

继续完善这个流程