Milestones
List view
Improve the evals/ harness and how skill quality is measured: ground-truth generation, per-runtime measurement, review-quality scoring, model benchmarking, triggering-eval coverage, and F1/recall tracking behind the repo's effectiveness claims. Anchor doc: evals/EVALUATION_IMPROVEMENT_PLAN.md
No due date•1/1 issues closedNew wa-review skill variants/companions. Issues: #106, #89
No due date•5/5 issues closedCross-platform install parity and devops-agent packaging. Issues: #102, #53
No due date•4/4 issues closedMachine-readable wa-review output + CI gate + drift guard. Issues: #90, #118 (PR #119)
No due date•8/9 issues closedFix crawler content drops and normalize lens references; unblocks new lenses. Issues: #80 (blocker), #99, #75, #76
No due date•4/6 issues closed