latitude-dev /
Evaluation & Observabilitylatitude-llm
Latitude 的可选 Jev 预分类器为对话检查打分,并记录检查选择的依据。
GitHub
4,655392
License: MITLanguage: TypeScript最近提交:2026/9/18#evaluation-benchmarks#voice-conversation
JEV 在该架构中的决策位置
判断各项检查的适用性,满足阈值与限流条件时补充检查任务。
核心架构收益
记录模型、阈值、调用时间与选择原因,便于对照原流程。
固定版本源码审校依据
本站人工核验过该仓库的以下固定 commit 源码文件,确认 Jev 决策逻辑的真实接入方式:
latitude-dev/latitude-llm/blob/6b2484c1d74973877fc7d353b8867c7496568d78/packages/domain/flaggers/src/use-cases/run-jev-preclassifier.ts#L1
latitude-dev/latitude-llm/blob/6b2484c1d74973877fc7d353b8867c7496568d78/README.md
latitude-dev/latitude-llm/blob/6b2484c1d74973877fc7d353b8867c7496568d78/fern/README.md
latitude-dev/latitude-llm/blob/6b2484c1d74973877fc7d353b8867c7496568d78/packages/platform/ai-jev/src/jev-shadow-decision-provider.ts
审校说明与基准口径:已核对固定版本 README 与集成源码。
快速克隆仓库
git clone https://github.com/latitude-dev/latitude-llm.git
同分类相关项目推荐(评测与观测)
NiazMorshed2007
jev-review
Evaluation & ObservabilityMITTypeScript
供编码 Agent 使用的本地 MCP 代码质量检查器,返回多个维度的结构化评分。
JEV 在这里做什么
Jev 对正确性、复杂度、测试和安全等维度评分,程序汇总优先改进项。
↳ 可比较两次检查的评分变化,代码修改仍由主 Agent 负责。
#coding-agents#mcp-integrations#evaluation-benchmarks
10✓ 4 处源码证据
查看详情 →AbdelStark
jev-benchmarks
Evaluation & ObservabilityApache-2.0Python
把 Jev 和 GLiNER 放到同一批分类题上,除了答对率,也检查概率靠不靠谱。
JEV 在这里做什么
对固定文本和标签集合做分类,记录每个标签的概率、耗时和失败。
↳ 能看清模型在哪些任务上适合自动处理,在哪些任务上容易过度自信。
#evaluation-benchmarks#classification-ranking
✓ 3 处源码证据
查看详情 →mizchi
jev-playground
Evaluation & ObservabilityMITTypeScript
MoonBit 与 TypeScript 的 Jev 实验集,覆盖棋类、浏览器、命令风险和小型语言。
JEV 在这里做什么
不同实验把候选动作或判断题交给 Jev,再由对应程序执行或记录。
↳ 提供源码、实验记录和部分可离线重放的样例,便于比较决策设计。
#evaluation-benchmarks#games-simulation#browser-automation
✓ 4 处源码证据
查看详情 →