AgentEvalTool/backend/agenteval/evaluation/rules
sinohqb 21cc6ed407
All checks were successful
CI / test (pull_request) Successful in 4m11s
feat: 用户体验指标(放弃率+流畅度评估)
新增用户体验跟踪能力。

- RunSummary 新增 abandoned_cases 和 abandonment_rate 字段
- 新增 fluency 规则:LLM 评估对话流畅度和自然性(0-10 分)
- 流畅度评估考虑:自然性、重复性、连贯性、响应质量
- 新增 10 项单元测试(676 tests passed)

注:放弃率的实际计算逻辑需要在引擎中集成,本 PR 提供数据模型和规则基础设施。

Closes #26
2026-08-25 16:36:28 +08:00
..
__init__.py feat: 用户体验指标(放弃率+流畅度评估) 2026-08-25 16:36:28 +08:00
base.py feat(llm_score): 支持多维度独立评分 2026-08-25 14:17:49 +08:00
fluency.py feat: 用户体验指标(放弃率+流畅度评估) 2026-08-25 16:36:28 +08:00
json_schema.py v0.3-s2: 3 个新规则 + 组合逻辑 + 33 个测试 2026-07-17 11:23:22 +08:00
keyword.py v0.3-s1: 规则层异步化 + 工具函数去重 + HTTP 通道 2026-07-17 10:52:32 +08:00
llm_score.py feat(llm_score): 支持多维度独立评分 2026-08-25 14:17:49 +08:00
response_time.py feat(response_time): 支持平均延迟和吞吐量指标 2026-08-25 15:03:54 +08:00
safety.py feat(safety): 扩展规则覆盖幻觉、越权和合规检查 2026-08-25 15:30:00 +08:00
semantic.py feat(models): add centralized model configuration 2026-07-17 20:02:43 +08:00