forge-healthlisted
Install: claude install-skill Xinyang-Li666/SciCrucible
# /forge-health — 知识库健康检查
> **SciCrucible 根目录**: `D:\科研\SciCrucible\` —— 所有 wiki/、raw/、scripts/ 路径以此为基准。
运行 forge-health.sh 脚本,并由 LLM 解读和修复发现的问题。
## 流程
1. **运行脚本**:执行 `bash D:\科研\SciCrucible\scripts\forge-health.sh`
2. **分析结果**:
- 断链 → 判断是页面缺失(需创建)还是链接笔误(需修正)
- 孤立页面 → 判断是概念确实独立,还是缺少入链(需在相关页面添加链接)
3. **逐项修复**:每发现一个问题,询问用户后再修复
## 脚本检查之外的 LLM 专项检查
脚本运行后,LLM 还应检查脚本无法检测的问题:
### 1. 结构完整性
- **概念页覆盖**:index.md 核心概念区的 5 个专题组下的所有页面是否都存在
- **index.md 时效性**:是否存在 `[待建立]` 标记?所有 [[双链]] 目标页面是否都存在?
- **项目页框架**:项目综述是否包含完整的 8 章结构?缺失章节需补建
### 2. 内容质量
- **过期内容**:扫描 wiki/ 中所有标记了 `[待更新]` 或超过 6 个月未编辑的页面
- **提纲化检测**:页面是否只有标题和列表,缺乏实质性叙述(< 3 句连续文字说明)?
- **孤立概念**:concepts/ 中的页面是否至少被 index.md 和 1 个其他页面引用?
### 3. 知识缺口
- **literature/ 中提到但 concepts/ 中未覆盖的概念**:扫描文献页面中的关键术语,检查是否有对应概念页
- **跨领域关联缺失**:UHTC 和正极相关的页面是否缺少跨领域类比链接?
### 4. 一致性
- **矛盾检测**:不同页面中对同一概念/数据的描述是否存在矛盾
- **冗余检测**:内容高度重复的页面(如两个概念页大量讨论同一机制)
### 5. 文献质量
- **分区标注**:literature/ 中的文献页面是否标注了期刊评级?
- **脉络引用**:项目页文献脉络中引用的文献是否均为高评级期刊(评级1-2),排除低评级期刊?
### 6. DOI 字段一致性
- **DOI 覆盖率**:递归扫描 `wiki/**/literature/*.md`,检查每页是否存在 `**DOI:**` 字段
- **缺失率统计**:(缺失 DOI 的文献数 / 总文献数)
- 缺失率 > 10% → 报告「⚠️ 文献 DOI 覆盖率不足,可能导致去重漏网」
- **列出所有缺失 DOI 的文献**,供用户手动补充
- DOI 格式校验:检测异常格式(如 URL 而非裸 DOI、包含中文字符等)
### 7. 文献索引缓存一致性
- **对比 `wiki/literature_index.json` 与实际 `wiki/**/literature/*.md`**(递归覆盖各课题):
- 文件存在但索引缺失 → 报告「索引缺失条目: N」,建议补录
- 索引指向已删除文件 → 报告「索引悬空条目: N」,建议清理
- 索引 `count` 与实际文件数不一致 → 报告差异
- **索引不存在** → 提示用户运行 `/forge-ingest` 任意一篇文献触发自动重建
- 索引 JSON 格式校验:是