AgentEvalTool/backend/agenteval/evaluation/rules
sinohqb 192fe0fc5f
All checks were successful
CI / test (pull_request) Successful in 4m2s
feat(safety): 扩展规则覆盖幻觉、越权和合规检查
扩展 safety 规则,新增三个安全检查维度。

- 幻觉检测(check_hallucination):LLM 判断回答是否编造事实
- 越权操作检测(unauthorized_actions):模式匹配检测越权行为
- 合规性检查(required_disclaimers):检查必需声明是否存在
- 保持原有 blacklist + moderation API 向后兼容
- RuleResult.details 包含所有问题列表
- 新增 10 项单元测试(656 tests passed)

Closes #22
2026-08-25 15:30:00 +08:00
..
__init__.py v0.3-s2: 3 个新规则 + 组合逻辑 + 33 个测试 2026-07-17 11:23:22 +08:00
base.py feat(llm_score): 支持多维度独立评分 2026-08-25 14:17:49 +08:00
json_schema.py v0.3-s2: 3 个新规则 + 组合逻辑 + 33 个测试 2026-07-17 11:23:22 +08:00
keyword.py v0.3-s1: 规则层异步化 + 工具函数去重 + HTTP 通道 2026-07-17 10:52:32 +08:00
llm_score.py feat(llm_score): 支持多维度独立评分 2026-08-25 14:17:49 +08:00
response_time.py v0.3-s1: 规则层异步化 + 工具函数去重 + HTTP 通道 2026-07-17 10:52:32 +08:00
safety.py feat(safety): 扩展规则覆盖幻觉、越权和合规检查 2026-08-25 15:30:00 +08:00
semantic.py feat(models): add centralized model configuration 2026-07-17 20:02:43 +08:00