2026-07-27T10:44:42Z - 2026-08-27T10:44:42Z
Overview
4 Releases published by 2 users
Published
v1.2.0
Published
v1.1.1
Published
v1.0.0
Published
v0.8.0
AgentEvalTool v0.8.0
10 Pull requests merged by 1 user
Merged
#36 feat(v1.3.1): Phase 4 场景扩充、延迟优化与 go/no-go 展示(v1.3.1-final)
Merged
#35 refactor(v1.3.1): Phase 3 报告横幅、评分逻辑收敛与成本闭环
Merged
#34 feat(v1.3.1): Phase 2 成本/放弃率/Go-No-Go 基础设施生效
Merged
#33 fix(rules): v1.3.1 Phase 1 修复规则层三处缺陷
Merged
#32 feat: 用户体验指标(放弃率+流畅度评估)
Merged
#31 feat: 成本效率跟踪基础设施
Merged
#30 feat(safety): 扩展规则覆盖幻觉、越权和合规检查
Merged
#29 feat(response_time): 支持平均延迟和吞吐量指标
Merged
#28 feat(report): 上线验收报告 go/no-go 结论
Merged
#27 feat(llm_score): 支持多维度独立评分
24 Issues closed from 1 user
Closed
#26 实现用户体验指标(放弃率+流畅度)
Closed
#25 实现成本效率跟踪(对话级+任务级)
Closed
#22 扩展 safety 规则覆盖幻觉、越权和合规
Closed
#21 扩展 response_time 支持首字延迟和吞吐量
Closed
#24 能力对比报告雷达图和排名调研
Closed
#23 质量监控仪表盘历史趋势调研
Closed
#20 上线验收报告 go/no-go 结论调研
Closed
#19 扩展 llm_score 支持多维度评分
Closed
#18 功能完整性评估方案调研
Closed
#17 平台能力与需求差距分析
Closed
#15 定义报告消费者与决策场景
Closed
#14 定义评估维度清单
Closed
#16 当前平台能力盘点
Closed
#11 release: v1.1.1 收尾发布
Closed
#10 refactor(intelligent-eval): 边界收尾 + ADR(S5, S6, S7)
Closed
#4 test(intelligent-eval): cron_pool 边界(auto-scale 振荡 + stuck 临界)
Closed
#8 refactor(intelligent-eval): 决策/队列逻辑与 DB 解耦(S3)
Closed
#9 refactor(intelligent-eval): Router 逻辑下沉(S2)
Closed
#7 refactor(intelligent-eval): 收敛时段/欠账/严重度领域知识(S1, S4)
Closed
#5 test(intelligent-eval): openclaw_client 单元 + webhook 语义
Closed
#6 test(intelligent-eval): 前端 CronPoolMonitor + router 契约
Closed
#3 test(intelligent-eval): worker 任务竞争与故障链路 e2e
Closed
#2 Refactor: Deepen Campaign Intelligence, Read Model, and Runtime
Closed
#1 Refactor: Deepen evaluation architecture modules
1 Issue created by 1 user
Opened
#13 Wayfinder: AgentEvalTool 价值评估与决策