xb-datalisted
Install: claude install-skill dennydkt/xbskill
# xb-data:数据工作
调用前先读 `../xbskill/references/interaction-settings.md`,按用户已选调用强度和保存提示执行;明确指定其他技能或拒绝 XB 时退出。未初始化时只允许配置与说明,禁止代选或先执行后确认。
直调时先读取 `../xbskill/references/contracts.md` 与 `../xbskill/references/resolution-standard.md`;任何文件缺失时报告精确路径并停止,不得凭记忆补造。用户承担数据分析、数据工程、数据治理或数据产品责任,且岗位/生命周期/阶段会改变动作时,再读取 `../xbskill/references/role-context-model.md` 与 `../xbskill/references/data-work-specialties.md`;一次性低风险取数不加载全图谱。口径或方法结论依赖外部规范、论文或文档时,再读取 `../xbskill/references/knowledge-source-protocol.md`。
任务跨自动化、报告、演示或审查,或出现多来源冲突、批量改动、敏感数据和重复返工时,读取 `../xbskill/references/task-domain-patterns.md`;单表低风险整理不加载。
## 任务定义
报表、排名或数字结论进入个人评价与责任争议时,读取 `../xbskill/references/data-conclusion-review.md`,交付能复现的原值/新值/差额与仍成立结论。涉及绩效权重与评价规则时再读取 `../xbskill/references/career-evidence-review.md` 的绩效部分;主观评价与可复算项分开。文件缺失时报出路径并停止相应复核,保留当前唯一专科。
数据工作的产物要让有权者基于可追溯证据作出更好的决定;单个数字或图表只是其中的证据载体。先区分:
- **取数 Question**:在已确认口径与数据版本下生成可核对结果;
- **解释 Problem**:区分真实变化、口径变化、数据质量和随机波动;
- **决策 Problem**:说明结论怎样改变动作、资源或风险;
- **治理 Problem**:让重复口径、血缘、权限和版本冲突变得可控制。
- **数据产品 Problem**:把用户决定、数据契约、服务质量、采用反馈与版本/退役连成闭环。
不知道业务问题时可以做数据体检,但只能称“数据质量审计”,不能自动上升为业务洞察。
## 核心判断模型:结论可信度取决于最弱环
```text
业务问题 → 决策用途 → 指标定义 → 数据生成 → 抽取与关联
→ 清洗/计算 → 比较基线 → 不确定性 → 结论范围 → 现实验证
```
用七个门审查结论:
| 门 | 必答问题 | 失败后的含义 |
|---|---|---|
| 定义 | 指标对象、粒度、时间窗、单位、去重和边界是什么? | 数字不可比较 |
| 生成 | 字段怎样在业务流程中产生? | 字段名不能代表业务含义 |
| 完整 | 缺失、迟到、重复、删改和覆盖有多少? | 总量可能失真 |
| 关联 | 键是否唯一,连接是否膨胀或漏配? | 分组和归因不可靠 |
| 计算 | 公式、过滤、版本和中间结果能否复现? | 结论不能复核 |
| 比较 | 基线、对照、季节性、样本和可比范围合理吗? | 变化无法解释 |
|