browser-harvest
Featured从需要登录的浏览器后台批量抓表格数据——SEO 面板、分析后台、广告平台、任何没有 API 或 API 要加钱的 SaaS 报表。解决四个必踩的坑:虚拟滚动表格没有 <table> 标签、数据出不了页面沙箱、执行通道超时、后台标签不渲染。用户提到 抓后台数据、导出报表、这个面板能不能自动化、批量查词、扒竞品数据、没有 API、导出要花钱/扣点数、爬虫抓不到表格、表格是 div 不是 table、把这个流程自动化 时使用本 skill。也在任何"要在登录态网页里重复取数"的任务中主动使用——第一次跑通就该固化成脚本,不要下次重新摸索 DOM。
Install
Quality Score: 88/100
Skill Content
Details
- Author
- yan-labs
- Repository
- yan-labs/yan-skills
- Created
- 2 months ago
- Last Updated
- today
- Language
- JavaScript
- License
- MIT
Similar Skills
Semantically similar based on skill content — not just same category
opencli
用 OpenCLI 驱动用户本机那个真实的、已登录的 Chrome,或调用它的 160+ 站点 adapter。任何需要登录态的页面操作都从这里开始——读登录后的后台、抓没有 API 的表格、填表提交、跑一个站点命令、把页面数据取回来。也覆盖会话命名与租约纪律("我的标签页被别人抢了")、批量取数与落盘、adapter 的编写与自修复、opencli doctor 排障。用户提到 opencli、浏览器自动化、用我的浏览器、驱动 Chrome、登录态、抓后台数据、抓表格、导出报表、填表、自动点击、截图、adapter、doctor 报错、session 撞名、标签页被抢、tab 泄漏,或说"打开这个页面看看""帮我登录后台查一下""这个站没有 API"时,务必使用本 Skill。也在需要判断"这件事该不该开浏览器"时使用——本 Skill 第零节就是那张判断表(要不要登录态、有没有现成脚本或 adapter、配额站能不能动手、什么时候该转给 agent-reach 或业务 Skill)。只要动作会落在浏览器上,先读这里再动手。
single-file-dashboard
把表格数据做成"一个 HTML 文件就是全部"的可传播看板——双击即开、离线可用、密码访问、数据加密、单元格就地可改、图表用原生 SVG 手绘。当交付物需要靠邮件/U盘/共享文件夹在同事之间传、且对方电脑上不能装任何东西时使用。也用于需要把经营数据锁在本地不外发的场景。
web-table-pay
把一个网址上的数据整理成一张能直接用的 Excel——一次付费 7 天不限次,期内重复使用不再计费。凡遇到"这个页面的数据要导成表""榜单/列表/报表只能一条条复制""网页上的数字要拿去做统计""数据在页面上但导不出来""这份名单每天都要重新取一遍"时主动使用。**本 Skill 依赖在线授权服务**:执行提取前会先取一份授权凭证(未付费会返回 402 账单),拿到授权后在**你本机**完成取数与成表,授权本身**离线可校验**;诊断(probe)**免费**——先看清楚数据在哪、能不能取,再决定要不要提取。能力:页面自带表格的直接读;数据由脚本渲染的页面 → 先定位它真正读取的数据地址再取;只有重复区块的页面 → 按块成表。产出规范 xlsx + 一份带前后对比计数的**提取报告**(适合直接转发)。上游声明总数与实收不一致时**拒绝写出**(不交半份数据)。只读公开可读页面:不带登录凭据、不做身份伪装,站点拒绝或要求验证码即停止并说明。