## 新增功能 - 文件管理模块:分类树 + 文件上传/下载/删除 - 文件上传支持拖拽(Dragger)+ 手动上传(customRequest 模式) ## 页面布局统一(参照评测执行页) - 仪表盘/评测对象/评测场景/评测报告 全部改为全高 flex 布局 - 统一内联页头样式(h2 + 竖线分隔 + 描述) - 表格撑满高度、overflow 处理 - 每页添加刷新按钮 ## Bug 修复 - 分类树操作按钮 hover 不可见(CSS 规则缺失) - 文件上传失败(multipart boundary 缺失) - LLM API 响应 content blocks 数组格式支持(_extract_content_from_api_response) - response_time_max_ms 被静默忽略(隐式规则传空 params) - 空 messages 导致 IndexError 崩溃 - poll_reply 异常中止整个 run(缺 try/catch) - engine finally 未关闭 session - 3 个页面 UTC 时间戳解析偏差 8 小时 ## 后端 - EvalEngine: poll_reply 异常保护、空 dialog 保护、session 关闭 - LLM API 响应解析支持 content-block-array 格式 - 隐式 response_time 规则正确传递 max_ms 参数 ## 前端 - api.ts: 移除手动 Content-Type(让浏览器自动添加 boundary) - Files.tsx: customRequest 替代 beforeUpload、布局优化 - index.css: 分类树 hover 规则 - Targets/Scenarios/Home/Reports: 全高布局改造 - 3 个页面时间戳改用 formatDateTime()(修复 UTC 偏差) Co-Authored-By: Claude <noreply@anthropic.com>
55 lines
1.9 KiB
Python
55 lines
1.9 KiB
Python
"""API routes for statistics and dashboard data."""
|
|
|
|
from collections import defaultdict
|
|
|
|
from fastapi import APIRouter, Depends
|
|
from sqlmodel import Session
|
|
|
|
from agenteval.storage.repository import RunRepository, ScenarioRepository, TargetRepository
|
|
from agenteval.web.deps import get_db
|
|
|
|
router = APIRouter()
|
|
|
|
|
|
@router.get("/dashboard")
|
|
def dashboard(session: Session = Depends(get_db)) -> dict:
|
|
targets = TargetRepository(session).list_all()
|
|
scenarios = ScenarioRepository(session).list_all()
|
|
runs = RunRepository(session).list_all()
|
|
|
|
completed_runs = [r for r in runs if r.status == "completed" and r.summary]
|
|
pass_rates = [r.summary.get("pass_rate", 0) for r in completed_runs if isinstance(r.summary, dict)]
|
|
overall_pass_rate = sum(pass_rates) / len(pass_rates) if pass_rates else None
|
|
|
|
recent_runs = sorted(runs, key=lambda r: r.started_at or "", reverse=True)[:10]
|
|
|
|
return {
|
|
"targets_count": len(targets),
|
|
"scenarios_count": len(scenarios),
|
|
"runs_count": len(runs),
|
|
"overall_pass_rate": overall_pass_rate,
|
|
"recent_runs": [r.model_dump() for r in recent_runs],
|
|
}
|
|
|
|
|
|
@router.get("/trend")
|
|
def trend(days: int = 30, session: Session = Depends(get_db)) -> list[dict]:
|
|
runs = RunRepository(session).list_all()
|
|
completed = [r for r in runs if r.status == "completed" and r.summary and r.started_at]
|
|
|
|
daily: dict[str, list[float]] = defaultdict(list)
|
|
for run in completed:
|
|
date_str = run.started_at.strftime("%Y-%m-%d") if run.started_at else ""
|
|
if date_str and isinstance(run.summary, dict):
|
|
daily[date_str].append(run.summary.get("pass_rate", 0))
|
|
|
|
sorted_dates = sorted(daily.keys())[-days:]
|
|
return [
|
|
{
|
|
"date": d,
|
|
"pass_rate": round(sum(daily[d]) / len(daily[d]) * 100, 1),
|
|
"run_count": len(daily[d]),
|
|
}
|
|
for d in sorted_dates
|
|
]
|