oracle-bumplisted
Install: claude install-skill Huanyu-Hibiki/Huanyu-Skills
# /oracle-bump — Rubric / Bucket 升级(按轨道)
两种模式:
| 模式 | 触发 | 做什么 | 验证强度 |
|---|---|---|---|
| **完整 rubric bump** | `--propose "<新公式>"` | 改公式/维度/权重 | 5 步 + 跨模型审核(强制) |
| **bucket-only 重校** | `--bucket-only` | 只重新派生 bucket 边界 | 数据自动派生,无审核 |
完整 bump 严格遵守 [bump-validation-protocol.md](../../shared-references/bump-validation-protocol.md)。**按轨道独立**:一次操作只 bump 一个轨道。
## Overview
```
入口:/oracle-bump
↓
[Phase A0: 模式分流]
├─ --bucket-only → [Phase B: 轻量重校]
└─ --propose → [Phase 0~8: 完整 bump]
```
## Constants
- **READINESS_HEURISTIC** — 默认:该轨校准池 ≥5 样本 + ≥1 个跨样本观察有 ≥3 样本支持;Claude 可基于强信号(≥3x 偏差反例 / 单点极强模因)提前,可因证据弱推迟。**提议必标注 default-aligned / judgment-driven**
- **THRESHOLD = 0.8** — 排序一致性阈值(4/5)。**写死**,统计刚性
- **CROSS_MODEL_AUDIT = true** — 跨模型独立审核默认开
- **REQUIRE_CONFIRM = true** — 落地前用户明确 "yes, bump"
## 完整 rubric bump 流程
### Phase 0: 前置门槛检查(按轨道)
| 检查 | 失败处理 |
|---|---|
| `in_progress_session == null` | 拒绝:"有 in-progress 预测未完成,先走完或清掉" |
| `--track <id>` 指定(必填) | 漏了 → 询问"升级哪轨?"(列出 content-plan 轨道) |
| 该轨校准池 ≥5(默认)+ 上次 bump 后 ≥1 新样本 | 硬约束:无新样本拒绝;样本少软约束:显式标注后仍走全流程 |
| **诊断前置**:「本公式能否解决 retro 暴露的偏差?」 | 答案 no 或混合且核心偏差在 no 侧(如平台分发问题 rubric 修不了)→ **在 Phase 0 直接拒绝进 Phase 1**,省掉后面工作量 |
诊断证据先跑收敛工具(确定性重算,不靠记忆):`python tools/score-curve.py <项目根> --track <id> --json` → 该轨偏差方向序列(连续高估/低估?)+ 平均绝对偏差 + bucket 命中率。「retro 暴露的偏差」以此数据交叉核对 state 的 consecutive_directional_errors——**公式修不了方向性系统偏差以外的命中问题**(bucket 命中低但方向随机 → 该跑 --bucket-only 而不是 rubric bump)。
校准池 = `state.calibration_samples_by_track