AgentEvalTool/backend/agenteval/evaluation/rules
sinohqb c1a3cdbaa9
All checks were successful
CI / test (pull_request) Successful in 4m5s
fix(rules): 修复代码审查发现的三处规则层缺陷
- response_time: 仅配置 max_ms 时恢复 v0.3 评分语义(最后一轮评分 + 超限线性惩罚),扩展指标共存时才用均值评分
- safety: 移除 moderation API 的黑名单命中跳过守卫,两层安全检查独立执行、发现均上报
- llm_score: 多维度评分添加 Semaphore 并发上限(5),防止维度数多时无限扇出模型请求
2026-08-25 18:13:11 +08:00
..
__init__.py feat: 用户体验指标(放弃率+流畅度评估) 2026-08-25 16:36:28 +08:00
base.py feat(llm_score): 支持多维度独立评分 2026-08-25 14:17:49 +08:00
fluency.py feat: 用户体验指标(放弃率+流畅度评估) 2026-08-25 16:36:28 +08:00
json_schema.py v0.3-s2: 3 个新规则 + 组合逻辑 + 33 个测试 2026-07-17 11:23:22 +08:00
keyword.py v0.3-s1: 规则层异步化 + 工具函数去重 + HTTP 通道 2026-07-17 10:52:32 +08:00
llm_score.py fix(rules): 修复代码审查发现的三处规则层缺陷 2026-08-25 18:13:11 +08:00
response_time.py fix(rules): 修复代码审查发现的三处规则层缺陷 2026-08-25 18:13:11 +08:00
safety.py fix(rules): 修复代码审查发现的三处规则层缺陷 2026-08-25 18:13:11 +08:00
semantic.py feat(models): add centralized model configuration 2026-07-17 20:02:43 +08:00