knowledge-wikilisted
Install: claude install-skill mooncirclez/presales-workbench
# 知识编译 · Compounding Wiki
参考 Karpathy 的 LLM Wiki 模式:**知识编译一次、长期复用**,而不是每次提问都重新翻原文。
## 何时使用
- 用户说"编译知识库""建知识 wiki""把资料整理成知识页""提炼 XX 主题的知识"
- 写方案/投标时需要引用规范条款、最佳实践,但原文散落在几十份 PDF 里
## 三层结构(勿打乱)
| 层 | 位置 | 说明 |
|---|---|---|
| 原文 | `knowledge/my local knowledge/` | 用户放的 PDF/PPTX/DOCX,**只读,永不修改** |
| 提取文本 | `knowledge/.extracted/**.md` | 由 `python3 bin/extract.py` 生成的可检索镜像,**不要手工编辑** |
| 知识页 | `knowledge/wiki/` | 你产出的成果:概念页 + `index.md` |
## 编译流程
### 第 1 步:确认提取物是最新的
```bash
python3 bin/extract.py # 增量提取(新增/改动的文档)
python3 bin/extract.py --status # 查看统计与失败项
```
提取失败标注 `empty(需 OCR)` 的多为图片型 PDF/扫描件——**不要凭标题猜测其内容**,在知识页里注明"原文为图片版,内容【待补充】"。
### 第 2 步:确定编译范围
一次只编译一个主题域(如"ITIL/ITSM""SRE/稳定性""信创与云合规""竞品分析"),范围过大会产出泛泛而谈的页面。
用 grep 在 `knowledge/.extracted/` 里定位相关文件:
```bash
grep -rl "关键词" "knowledge/.extracted" | head -20
```
### 第 3 步:写知识页
每个**概念**一页(不是每个文件一页!),放在 `knowledge/wiki/<主题域>/<概念>.md`:
```markdown
---
title: 概念名
domain: ITIL
sources:
- .extracted/<你的目录>/<资料文件>.md
updated: YYYY-MM-DD
---
# 概念名
**一句话定义**(能直接抄进方案的那种)
## 要点
- 核心要素、流程、角色(带 [[相关概念]] 链接)
## 售前用法
- 客户问什么时候用得上;可直接引用的规范表述
- 我方产品/方案如何对应(仅当资料中确有依据)
## 出处
- `<提取文件路径>`(原文:`my local knowledge/<对应原文>`)
```
### 第 4 步:织链接与索引
- 概念之间用 `[[双向链接]]`(如 `[[事件管理]]`、`[[服务级别管理]]`),被链接页不存在时**顺手创建占位页**并在其中注明【待补充】
- 更新 `knowledge/wiki/index.md`:按主题域分组列出全部页面,一��一个带一句话摘要
## 铁律
- **只写资料里有的**。事实、数字、条款必须能追到 `sources` 里的具体文件;推断与建议放在"售前用法"并标注"(推断)"。
- **不复述整篇原文**,提炼成可用的知识,一页控制在 150 行内。
- 原文与 `.extracted/` 只读,产出只写 `knowledg