auditlisted
Install: claude install-skill SONGYEONGSIN/vibe-flow
# /audit — AHE harness 자기 진화 루프
`rules/harness-evolution.md`의 evaluate→analyze→improve 루프를 1 호출로 실행한다. 모델은 고정하고 harness만 증거 기반으로 진화시킨다. **증거 없는 수정 금지** — 모든 finding은 4 필드를 채우고, 그 효과는 ledger가 다음 라운���에 반증한다.
> **도메인 경계**: `/audit` = harness 자기 진화(7-component: prompts/descriptions/impl/hooks/skills/agents/memory). `retro` = 프로젝트 회고. `telemetry` = 사용량 관찰(이 스킬의 evaluate 데이터 소스). `/security-audit` = 공격 벡터. 중복 호출 금지.
---
## Phase 0. 라운드 라벨 + 직전 finding 반증 (decision-observability)
```bash
# F-R10 (audit R17): 라운드 개시 전 main 건강도 확인. R17 은 main 이 10일째 RED 인 상태로
# 개시됐고, RED 는 감사 트레이스가 아니라 우발적 조회로 발견됐다. failure 가 있으면
# 라운드를 진행하기 전에 복구를 선행한다 — red 위에서 수집한 trace 는 오염된다
# (��제로 두 스모크의 양성 대조군이 repo 상태를 상속해 검출력을 잃었다, F-R04).
gh run list --branch main --limit 2 --json name,conclusion,headSha
LEDGER_SH="core/skills/audit/scripts/ledger.sh" # (.claude/ 런타임은 .claude/skills/audit/scripts/ledger.sh)
# fix 가 머지된 finding 은 mark-fixed 로 open→fixed 전이 (PR 머지 시점)
# reconcile 워크리스트 = status=fixed 이고 actual_delta 미기록인 것:
bash "$LEDGER_SH" pending-verify
```
**먼저** `pending-verify` 목록(직전 라운드 fix 머지됐으나 미검증)을 측정한다. 각 finding의 `predicted_delta`가 실제로 움직였는지 telemetry/점수로 확인 → `ledger.sh resolve <id> "<actual>" verified|refuted`. 움직이지 않았으면 `refuted`(오진 또는 무효 fix → 메타-학습). 이 단계가 AHE의 "decision observability" — 예측이 자동 반증된다. (`open`은 아직 미해결 finding, `pending-verify`는 해결됐으나 미검증 finding.)
라운드 라벨은 직전 라운드의 다음 글자(R1=A … R7=G → 다음 H).
## Phase 1. evaluate — trace 수집 (병렬)
pass/fail이 아닌 **trace**를 모은다. 병렬로:
- `