Przejdź do treści

Genealogia danych · 5 faz pipeline'u

Każda liczba ma ścieżkę.

Liczby na dashboardzie i w paperze nie pojawiają się znikąd. Powstają w pięcioetapowym pipelinie, w którym każdy etap jest reprodukowalny z opublikowanego CSV plus 1958 surowych plików wyjściowych modeli. Klik na każdy kafel — odpowiedni widok ze wszystkimi rzędami / runami.

01

RAW

5444

plików

Pierwotne wyjścia modeli zapisywane podczas każdego runu — JSON parsed-score, system prompt, user prompt, raw text response. Wszystko zmirorowane do public/magisterka/raw/.

in

docs/paper/magisterka/synthetic/out/

out

public/magisterka/raw/{persona}-{model}-{ts}-{raw,system,user}.txt + .json

→ Eksploruj 30 person × 7 modeli × 2 przebiegi

02

PARSED

1202

record-batterii

Build pipe ekstraktuje per-item odpowiedzi: 598 runów TCTM-22 (payload.tctm.answers[].chosenMascType) + 604 runów self-report (ecrR/ments/kpp/tipiPl).

in

payload.{tctm,ecrR,ments,kpp,tipiPl}.answers w out/*.json

out

DashboardData.{tctmAnswers,selfReportAnswers}

→ Otwórz data.json (1.95 MB)

03

SCORED

1156

rzędów CSV

Per-run scoring przez analyze_and_prepare.py: score_dbzr, score_ments, score_kpp, score_tipi (wszystkie z polskimi normami i reverse-coding maps). Każdy rząd CSV = jedna run × jedna persona × jeden warunek.

in

parsed answers + reverse-coding maps + polish norms

out

all_data.csv (369 rzędów × 53 kolumny)

→ Dashboard §1 — TCTM-22 distribution

04

AGGREGATED

57+

agregatów

Per-condition × per-model statystyki opisowe (M, SD, range, kappa, ICC). Każdy agregat ma listę CSV rzędów które go wyprodukowały, plus paths do raw output JSONów dla drill-down.

in

CSV rows filtered by condition × model × run

out

DashboardAggregates.{tctm, attachment, framing, baselines, variance, retest, ...}

→ Dashboard — wszystkie 35+ wykresów

05

DERIVED

387/387

paper claims PASS

Cross-vendor i porównawcze statystyki — ICC(2,1), Fleiss κ, Cochran Q + Bonferroni/BH, pairwise Cohen d / Hedges g, Spearman ρ, ANOVA, Cronbach α, power analysis. Plus verifier który blokuje deploy jeśli numerka się nie zgadza.

in

Aggregated stats + raw rows for cross-vendor recompute

out

aggregates.{icc, cochran, fleiss5, fleiss4, cohenDPairwise, cronbach, anova, ...} + VerifyReport

→ Pełna praca magisterska

Verify gate

387/387 liczbowych twierdzeń paperu reprodukuje się z surowego CSV przy pnpm magisterka:build. Build jest gated — jeden FAIL i deploy nie przejdzie. Lista checków obejmuje sample sizes, TCTM-22 dystrybucję, profile błędów MASC, klasyfikację stylu, ICC, Fleiss κ, Cochran Q (z Bonferroni i BH), test-retest, baseline profile, variance ratios, framing shifts, oraz trafności per-item.

eks

Używamy plików cookie do analizy ruchu (Google Analytics 4, PostHog) i wykrywania błędów (Sentry). Zbieramy dane o urządzeniu, przeglądarce i odwiedzanych podstronach. Treści twoich rozmów zostają na urządzeniu. Polityka prywatności