datalisted
Install: claude install-skill jmech-pepa/pepa-claude-toolkit
# Data — analýza tabulkových dat přes DuckDB v1.0
## Kdy použít
- Ad-hoc analýza datového souboru: agregace, přehledy po období/kategorii, top-N, anomálie, srovnání.
- Opakované spuštění dříve uložené analýzy nad novým exportem stejné struktury.
- Kdy NEpoužít:
- Tvorba/editace sešitu jako výstupního dokumentu (formátování, vzorce, grafy) → skill na Excel/xlsx.
- Data v datovém skladu (BigQuery apod.) → dotazuj přímo tam, DuckDB je na lokální soubory.
- Nesourodé finanční modely (merged cells, hlavičky uprostřed listu) → openpyxl/Read, DuckDB čeká tabulku.
## Vstup
- Cesta k souboru + co chceš zjistit. Bez souboru: `Glob` na *.csv/*.xlsx/*.json v CWD a zeptej se, který.
## Workflow
1. **Hledej uložený dotaz.** `Glob` na `analyzy/*.sql` vedle datového souboru. Pokud existuje dotaz odpovídající zadání, spusť ho (`duckdb -c ".read <file>.sql"`) a nepiš nový. Změnu chtěného výstupu řeš úpravou uloženého souboru, ne novým od nuly.
2. **Inspekce před dotazem.** Nikdy nehádej názvy ani typy sloupců:
```bash
duckdb -c "SUMMARIZE FROM '<soubor>'" # schéma + statistiky
duckdb -c "FROM '<soubor>' LIMIT 5" # ukázka dat
```
3. **Sémantika sloupců.** Když z názvů a ukázky není jednoznačné, co sloupec znamená (např. „Částka" — cena za kus, nebo součet řádku?), zeptej se přes `AskUserQuestion`. Nehádej — špatná domněnka = správně spočítaný nesmysl.
4. **Dotaz piš do souboru, ne inline.** Založ `analyzy/<slug>.sql` vedle dat (hlavička: účel, zdrojový soubor, datum,