← ClaudeAtlas

tashanzhishilisted

Use when 用户给出 YouTube/B站/播客链接,或一段视频文字稿、字幕、他人文章,要整理并剪藏成 20-knowledge/他山之石 下的「他人观点」笔记。触发词:用他山之石、剪藏到他山之石、整理成他山之石文档、把这个视频/链接存档、归档他人观点。
anneheartrecord/charles-skill · ★ 3 · AI & Automation · score 74
Install: claude install-skill anneheartrecord/charles-skill
# 剪藏他人观点到「他山之石」(tashanzhishi) ## Overview 把一个视频、播客或文章的内容,整理成一篇**可以直接阅读的文章**,存进 `20-knowledge/他山之石/`。 核心原则:产出的是给读者看的**文章**,不是观点汇总,也不是逐条「作者认为……」的清单。忠实于来源、把事实和推测分清、标注作者立场,但用流畅的文章呈现。这不是写用户自己署名的内容,所以**不套用户文风、也不跑 de-ai-flavor**。输出永远中文。 ## 何时用 / 不用 用:用户给链接或粘贴文字稿,说要「剪藏到他山之石」「整理成他山之石文档」「归档这个观点」。 不用:用户要写自己署名的推文/文章(那是写作任务,走文风流程)。 ## 输入两种来源 1. **链接**(YouTube/B站/播客等)→ 用 yt-dlp 抓元数据 + 字幕。 2. **粘贴的文字/字幕/文章** → 直接用,跳过抓取。 ## 流程 ### 1. 拿到原文 链接来源,运行本目录的脚本: ```bash bash ~/.claude/skills/tashanzhishi/fetch-transcript.sh "<链接>" # 默认读 Chrome 登录态 bash ~/.claude/skills/tashanzhishi/fetch-transcript.sh "<链接>" safari # 换浏览器:safari/brave/edge/firefox ``` 它会打印一个临时目录路径,里面有 `meta.txt`(标题 ||| 作者 ||| 上传日期 ||| 链接 ||| 时长)和一个 `.vtt` 字幕文件。YouTube 现在要求登录态才能下字幕,脚本默认读 Chrome 的 cookies,所以需要在 Chrome 里登录过 YouTube。 把字幕清洗成纯文本再读: ```bash python3 ~/.claude/skills/tashanzhishi/vtt2text.py "<那个目录>"/sub.*.vtt > /tmp/transcript.txt ``` `vtt2text.py` 会去掉时间轴、内联标签、HTML 实体,并合并自动字幕的滚动重复。然后用 Read 读 `meta.txt` 和 `/tmp/transcript.txt`。注意:视频结尾常有重复的「精彩片段」集锦,蒸馏时忽略那段。 ### 2. 写成一篇可读文章 - 清洗自动字幕的识别错误、逐字空格、错的专有名词(公司名、人名、术语、英文缩写),但不改作者语气和立场。 - 用流畅的中文写成一篇文章,**把读者当杂志读者**:正常标点(用冒号、写完整句子),不要「短语。完整句。」这种断裂节奏,也不要「1. 作者认为 X」的清单堆叠。 - 按内容自然分几个 `##` 小标题导航;attribution 自然融进句子(他算了笔账、她的观察是、他给了个尺子)。 - 事实与推测分清:可核实的当事实写,推测和判断点明是作者观点。结尾用一段「可信与存疑」的编辑提醒收尾。 - 可以摘 1 到 5 句原话金句融进正文,但别让全文变成摘抄。 ### 3. 写文件 写到 `20-knowledge/他山之石/<简洁中文标题>.md`,文件名不含斜杠。`captured` 用 `date +%F` 的当天日期。结构见下。 ## 文档结构(可读文章,不是观点汇总) ```markdown --- tags: [他山之石, <领域标签