AgentEvalTool/backend/agenteval/evaluation/rules
sinohqb a29f78ff4b
All checks were successful
CI / test (pull_request) Successful in 4m9s
feat(llm_score): 支持多维度独立评分
扩展 llm_score 规则,支持通过 dimensions 参数配置多个评分维度,
每个维度独立评分 0-10 分。

- RuleResult 新增 details 字段存储结构化多维度分数
- 向后兼容:原有 criteria 单维度模式继续有效
- 多维度模式下各维度并行调用 LLM,返回平均分和明细
- 新增 4 项单元测试

Closes #19
2026-08-25 14:17:49 +08:00
..
__init__.py v0.3-s2: 3 个新规则 + 组合逻辑 + 33 个测试 2026-07-17 11:23:22 +08:00
base.py feat(llm_score): 支持多维度独立评分 2026-08-25 14:17:49 +08:00
json_schema.py v0.3-s2: 3 个新规则 + 组合逻辑 + 33 个测试 2026-07-17 11:23:22 +08:00
keyword.py v0.3-s1: 规则层异步化 + 工具函数去重 + HTTP 通道 2026-07-17 10:52:32 +08:00
llm_score.py feat(llm_score): 支持多维度独立评分 2026-08-25 14:17:49 +08:00
response_time.py v0.3-s1: 规则层异步化 + 工具函数去重 + HTTP 通道 2026-07-17 10:52:32 +08:00
safety.py feat(models): add centralized model configuration 2026-07-17 20:02:43 +08:00
semantic.py feat(models): add centralized model configuration 2026-07-17 20:02:43 +08:00