Struktúra- és adatminőség-vizsgálat összefoglalója: rekord- és változószám, súlyozás módja, a tartalmi kérdésblokkok bontása, valamint az azonosított adatminőségi kockázatok.
suly · nem×kor, kor×végzettség, telep.-régió szerintKattints egy sorra a témakörhöz tartozó változók listájának megnyitásához, majd egy változóra az alapstatisztikák megjelenítéséhez.
| Témakör | Lefedett terület | Kérdések | Relatív méret | |
|---|---|---|---|---|
| A „kérdés” önálló kérdésblokkot jelöl — egy többválasztós (multi-select) kérdés minden alopciója egy kérdésnek számít. A legördülő változólista ennek megfelelően oszlop-szinten (finomabb bontásban) sorolja fel a tételeket. A táblázat nem tartalmazza a ~200, felirat nélküli, azonosítatlan oszlopot (l. lentebb az adatminőségi problémák között). | ||||
A második vizsgálati kör Python-számításokkal validált eredményei. Kattints egy sorra a részletekért.
78 tartalmi (de felirat nélküli) oszlopnál — a BNK1, MOB2, TELKO_1, BANK_1 és NETBANK blokkokban — a válaszok 95–99,9%-a egyetlen (0,0) kategóriába esik. Ezeknek önmagukban nincs elemzési hasznuk, és mivel nincs SPSS-felirat, nem dönthető el, hogy ez valódi ritkaság vagy hibás kódolás.
5 db OLDL-oszlop (OLDL71, 75, 77, 79, 84) 100%-ban hiányzik, miközben a blokk többi 92 oszlopánál az átlagos hiányzás csak 8,77% — ez technikai hibára utal. Ezzel szemben a szűrt kérdéseknél (pl. TURIZM6_7, DOHANY2_7) a magas hiányzás indokolt.
A kódból pontosan számolt eredmény szerint ahol mindkét változatban (eredeti és „_uj”) van érvényes érték, ott 100%-ban egyezik az adat. Az „_uj” mező nem eltérő újrakódolás, hanem az eredeti szigorú részhalmaza — több rekordnál egyszerűen hiányzik.
A suly terjedelme 0,395–2,497 (átlag=1,000). A felső 1%-ba eső rekordok súlya kiugróan magas, és aránytalanul nagy hatással vannak egy egyszerű (súlyozott) átlagszámítás eredményére.
A DLS21–DLS27 (7 tétel) mindegyike azonos irányítottságú 4-fokú skála, fordított kódolású tétel nincs közöttük. A DLS28 (11 kategóriás gyakorisági skála) és DLS29 (3 kategóriás skála) viszont teljesen más struktúrájú — index- vagy összegképzésnél külön kezelendők.