All checks were successful
CI / test (pull_request) Successful in 4m11s
新增用户体验跟踪能力。 - RunSummary 新增 abandoned_cases 和 abandonment_rate 字段 - 新增 fluency 规则:LLM 评估对话流畅度和自然性(0-10 分) - 流畅度评估考虑:自然性、重复性、连贯性、响应质量 - 新增 10 项单元测试(676 tests passed) 注:放弃率的实际计算逻辑需要在引擎中集成,本 PR 提供数据模型和规则基础设施。 Closes #26
27 lines
907 B
Python
27 lines
907 B
Python
"""Evaluation rule implementations."""
|
|
|
|
# Import all rules to populate the registry.
|
|
from agenteval.evaluation.rules.base import EvalRule, RuleResult, get_rule, list_rule_types, register_rule
|
|
from agenteval.evaluation.rules.fluency import FluencyRule
|
|
from agenteval.evaluation.rules.json_schema import JsonSchemaRule
|
|
from agenteval.evaluation.rules.keyword import KeywordMatchRule
|
|
from agenteval.evaluation.rules.llm_score import LlmScoreRule
|
|
from agenteval.evaluation.rules.response_time import ResponseTimeRule
|
|
from agenteval.evaluation.rules.safety import SafetyRule
|
|
from agenteval.evaluation.rules.semantic import SemanticSimilarityRule
|
|
|
|
__all__ = [
|
|
"EvalRule",
|
|
"RuleResult",
|
|
"get_rule",
|
|
"list_rule_types",
|
|
"register_rule",
|
|
"FluencyRule",
|
|
"JsonSchemaRule",
|
|
"KeywordMatchRule",
|
|
"LlmScoreRule",
|
|
"ResponseTimeRule",
|
|
"SafetyRule",
|
|
"SemanticSimilarityRule",
|
|
]
|