1/24
Flashcards gebaseerd op de hoorcolleges en cursustekst van 'Statistiek van de sociale wetenschappen' door Prof. dr. Cecil Meeusen (2025-2026).
Name | Mastery | Learn | Test | Matching | Spaced | Call with Kai | Chat |
|---|
No analytics yet
Send a link to your students to track their progress
Wat is dataficatie volgens hoofdstuk 1?
De trend waarbij dagdagelijkse acties en interacties worden omgezet in data die kunnen worden opgevolgd, geanalyseerd en geoptimaliseerd.
Hoe wordt Social Data Science gedefinieerd in de tekst?
De combinatie tussen domeinspecifieke kennis van sociale wetenschappen, computerwetenschappen en datawetenschappen.
Welke drie V’s kenmerken Big Data?
Volume, Veranderlijkheid en Verscheidenheid.
Wat is het verschil tussen een populatie en een steekproef?
Een populatie is de verzameling van alle onderzoekseenheden met een afbakening in tijd en ruimte, terwijl een steekproef een deelverzameling van onderzoekseenheden uit die populatie is.
Wat zijn de vier meetniveaus in de hiërarchie van laag naar hoog?
Nominaal, Ordinaal, Interval en Ratio.
Wanneer spreekt men van een dichotome meetschaal?
Wanneer de nominale meetschaal slechts twee waarden kan aannemen (bijvoorbeeld wel of geen Instagram account).
Wat is een quasi-kwantitatieve variabele?
Een schaal die intrinsiek ordinaal is (geen meeteenheid), maar door de omvang van de uitkomstenverzameling (zoals een 11-punt schaal) toch als kwantitatief wordt behandeld.
Wat is de definitie van de modus?
De waargenomen waarde die het meest voorkomt in de steekproef en dus de hoogste frequentie vertoont.
Hoe wordt de mediaan berekend als de steekproefomvang n even is?
Als het gemiddelde van de waarden van de twee middelste observaties: 2x2n+x2n+1
Wat is de formule voor het berekenen van het bereik (R)?
R=xmax−xmin
Hoe wordt de interkwartielafstand (IQR) gedefinieerd?
De lengte van het gebied rond de mediaan dat de middelste helft (50%) van de observaties omvat: IQR=Q^(0.75)−Q^(0.25)=Q3−Q1
Welke eigenschap geldt voor ongeveer 95% van de gegevens bij een normale verdeling?
Dat zij binnen een afstand van ongeveer twee (1.96) standaarddeviaties (σ) aan weerszijden van het populatiegemiddelde (μ) liggen.
Wat is de formule voor een Z-score?
zi=sxxi−xˉ
Wat is het verschil tussen een linksscheve en een rechtsscheve verdeling?
Bij een rechtsscheve verdeling zwakt de rechterstaart trager af; bij een linksscheve verdeling zwakt de linkerstaart trager af.
Wat stelt de Wet van de Grote Aantallen?
Hoe groter het aantal experimenten of de steekproefomvang n, hoe dichter de empirische relatieve frequenties bij de theoretische kansen of populatiewaarden zullen liggen.
Wanneer benadert een binomiaalverdeling (B(n,p)) een normaalverdeling?
Wanneer zowel p×n≥10 als (1−p)×n≥10.
Wat is een steekproeferror (e)?
De benaderingsfout die ontstaat doordat een steekproef slechts een schatting geeft van de populatieparameter: xˉ=μ+e.
Wat is de definitie van de standaard error (standaardfout)?
De standaarddeviatie van een steekproevenverdeling: σXˉ=nσ
Wanneer is een schatter zuiver (onvertekend)?
Wanneer de verwachte waarde van de steekproevenverdeling gelijk is aan de populatieparameter.
Wat is een Type 1-fout bij hypothesetesten?
De situatie waarin de nulhypothese (H0) ten onrechte wordt verworpen terwijl deze in werkelijkheid waar is.
Wat wordt bedoeld met de 'power' van een test?
De kans (1−β) dat een statistische test een nulhypothese verwerpt die daadwerkelijk verworpen dient te worden.
Wanneer gebruikt men de Student t-verdeling in plaats van de normaalverdeling?
Wanneer de populatievariantie (σ2) onbekend is en geschat moet worden op basis van de steekproefgegevens.
Tussen welke waarden ligt een correlatiecoëfficiënt altijd?
In het interval [−1,1].
Wat is de Simpson’s Paradox?
Een fenomeen waarbij een trend die aanwezig is in subgroepen verdwijnt of omkeert wanneer de groepen worden samengenomen.
Wat is het doel van gestandaardiseerde residuelen in een kruistabel?
Het detecteren van lokale afhankelijkheid tussen specifieke celwaarden door te kijken hoe de waargenomen frequentie afwijkt van de verwachte frequentie.