2026-02-27T10:45:01Z - 2026-08-27T10:45:01Z

Overview

10 Active Pull Requests
25 Active Issues
Excluding merges, 1 author has pushed 262 commits to main and 276 commits to all branches. On main, 696 files have changed and there have been 100081 additions and 21080 deletions.

4 Releases published by 2 users

Published v1.2.0 2026-08-21 09:48:25 +00:00

Published v1.1.1 2026-08-13 06:49:34 +00:00

Published v1.0.0 2026-08-11 06:57:26 +00:00

Published v0.8.0 AgentEvalTool v0.8.0 2026-08-09 05:44:16 +00:00

10 Pull requests merged by 1 user

Merged #36 feat(v1.3.1): Phase 4 场景扩充、延迟优化与 go/no-go 展示(v1.3.1-final) 2026-08-25 18:19:33 +00:00

Merged #35 refactor(v1.3.1): Phase 3 报告横幅、评分逻辑收敛与成本闭环 2026-08-25 18:02:52 +00:00

Merged #34 feat(v1.3.1): Phase 2 成本/放弃率/Go-No-Go 基础设施生效 2026-08-25 10:40:35 +00:00

Merged #33 fix(rules): v1.3.1 Phase 1 修复规则层三处缺陷 2026-08-25 10:22:52 +00:00

Merged #32 feat: 用户体验指标(放弃率+流畅度评估) 2026-08-25 08:40:45 +00:00

Merged #31 feat: 成本效率跟踪基础设施 2026-08-25 08:40:28 +00:00

Merged #30 feat(safety): 扩展规则覆盖幻觉、越权和合规检查 2026-08-25 08:02:06 +00:00

Merged #29 feat(response_time): 支持平均延迟和吞吐量指标 2026-08-25 08:01:44 +00:00

Merged #28 feat(report): 上线验收报告 go/no-go 结论 2026-08-25 06:31:43 +00:00

Merged #27 feat(llm_score): 支持多维度独立评分 2026-08-25 06:31:33 +00:00

24 Issues closed from 1 user

Closed #26 实现用户体验指标(放弃率+流畅度) 2026-08-25 08:40:45 +00:00

Closed #25 实现成本效率跟踪(对话级+任务级) 2026-08-25 08:40:28 +00:00

Closed #22 扩展 safety 规则覆盖幻觉、越权和合规 2026-08-25 08:02:06 +00:00

Closed #21 扩展 response_time 支持首字延迟和吞吐量 2026-08-25 08:01:44 +00:00

Closed #24 能力对比报告雷达图和排名调研 2026-08-25 07:58:34 +00:00

Closed #23 质量监控仪表盘历史趋势调研 2026-08-25 07:49:43 +00:00

Closed #20 上线验收报告 go/no-go 结论调研 2026-08-25 06:23:31 +00:00

Closed #19 扩展 llm_score 支持多维度评分 2026-08-25 06:19:34 +00:00

Closed #18 功能完整性评估方案调研 2026-08-25 06:12:07 +00:00

Closed #17 平台能力与需求差距分析 2026-08-25 05:54:47 +00:00

Closed #15 定义报告消费者与决策场景 2026-08-25 03:16:44 +00:00

Closed #14 定义评估维度清单 2026-08-25 02:53:51 +00:00

Closed #16 当前平台能力盘点 2026-08-24 17:51:16 +00:00

Closed #11 release: v1.1.1 收尾发布 2026-08-14 06:40:14 +00:00

Closed #10 refactor(intelligent-eval): 边界收尾 + ADR(S5, S6, S7) 2026-08-13 08:28:04 +00:00

Closed #4 test(intelligent-eval): cron_pool 边界(auto-scale 振荡 + stuck 临界) 2026-08-13 08:28:03 +00:00

Closed #8 refactor(intelligent-eval): 决策/队列逻辑与 DB 解耦(S3) 2026-08-13 08:28:03 +00:00

Closed #9 refactor(intelligent-eval): Router 逻辑下沉(S2) 2026-08-13 08:28:03 +00:00

Closed #7 refactor(intelligent-eval): 收敛时段/欠账/严重度领域知识(S1, S4) 2026-08-13 08:28:03 +00:00

Closed #5 test(intelligent-eval): openclaw_client 单元 + webhook 语义 2026-08-13 08:28:03 +00:00

Closed #6 test(intelligent-eval): 前端 CronPoolMonitor + router 契约 2026-08-13 08:28:03 +00:00

Closed #3 test(intelligent-eval): worker 任务竞争与故障链路 e2e 2026-08-13 08:28:02 +00:00

Closed #2 Refactor: Deepen Campaign Intelligence, Read Model, and Runtime 2026-08-11 08:44:52 +00:00

Closed #1 Refactor: Deepen evaluation architecture modules 2026-08-11 08:44:51 +00:00

1 Issue created by 1 user

Opened #13 Wayfinder: AgentEvalTool 价值评估与决策 2026-08-24 17:46:48 +00:00