Written Assignment 3

Lämna in ditt svar via Canvas.

I den här uppgiften ska ni arbeta med enkätdata från SOM-institutet vid Göteborgs universitet. Använd Stata-kommandona och instruktionerna i dokumentet som delades ut inför den första Stata-workshopen, tillgängligt via Canvas (Stata_Workshop1.pdf).

Datasetet ni ska använda finns på Canvas, och är samma dataset som vi använde under Stata-workshopen. Ladda ner Stata-datafilen “WA3_SOMdata.dta” och spara den i din arbetsmapp. Det är bra att skapa en do-fil för dina kommandon, men du ska inte bifoga do-filen med dina inlämnade svar på Canvas.

När datan är importerad, behåll följande variabler: year, trust_polit, like_party, female, yearofbirth, rural, edu3. Behåll dessutom endast enkäter från 2010 och framåt.

1. I den här frågan ska ni använda Stata för att beräkna viss beskrivande statistik (se Stata_Workshop1.pdf, sida 3). Fundera på vilka mått på centralitet och spridningsmått som är rimliga att beräkna för respektive variabel, givet deras mätskala. Beräkna ett mått på centralitet och, om möjligt, ett spridningsmått för var och en av följande sex variabler: trust_polit, female, rural, edu3, yearofbirth, like_party.1 Vad säger dessa mått om variablerna?

2. Skapa följande variabler med hjälp av de befintliga variablerna i datasetet: A) ett mått på respondenternas ålder vid tidpunkten för deras deltagande i enkäten (enkätåret minus deras födelseår); B) en indikator för högre utbildning (eftergymnasial); samt två variabler som anger respondenternas partisympatier, en för Sverigedemokraterna och en för Miljöpartiet. Indikatorvariablerna ska anta värdena 0 eller 1.

3. I de följande två frågorna ska ni beräkna villkorade medelvärden.

a) Beräkna andelen partisympatisörer för Sverigedemokraterna respektive Miljöpartiet, bland dem som besvarade enkäten 2018. Skiljer sig dessa jämfört med partiernas officiella röstandel på nationell nivå i riksdagsvalet 2018? Om ja, varför tror du att det är så? Diskutera kortfattat.

b) Beräkna genomsnittliga andelar sympatisörer för Sverigedemokraterna och Miljöpartiet, den här gången med alla enkätår (2010–2018), men separat för manliga och kvinnliga respondenter. Upprepa därefter samma procedur för respondenter i stad kontra på landsbygd. Skiljer sig dessa genomsnitt åt? Diskutera kortfattat era resultat.

4. I den här frågan ska ni dra ett slumpmässigt urval av er data. Behåll först endast observationer från 2018. Spara därefter denna delmängd av datan som en separat Stata-datafil.

Föreställ er att hela populationen av väljare finns med i datasetet. Av någon anledning har vi dock inte tillgång till fullständig data om alla väljare. Istället har vi en enkät med bara 10 % av väljarna. Dra ett slumpmässigt urval på 10 % av din data med kommandot sample 10 och beräkna den genomsnittliga andelen sympatisörer för Sverigedemokraterna respektive Miljöpartiet. Konstruera sedan 95-procentiga konfidensintervall för att testa om dessa skattningar är statistiskt signifikant skilda från den genomsnittliga andelen sympatisörer ni beräknade i fråga 3 a).

5. Anta att vi kunde få tag i ett större urval på 50 % av respondenterna. Läs in datasetet med 2018 års respondenter igen, men den här gången, dra slumpmässigt 50 % av urvalet och beräkna det genomsnittliga stödet för Sverigedemokraterna respektive Miljöpartiet. Ligger skattningarna med 50 % av urvalet närmare de genomsnittliga röstandelarna i fråga 3a?

Footnotes

  1. Under menyerna Statistics > Summaries, tables and tests > Summary and descriptive statistics > Summary statistics och Statistics > Summaries, tables and tests > Frequency tables > One-way table hittar ni användbara kommandon (och det hjälper er mycket om ni går på workshopen!). För er med svensk version av Stata är det Statistik > Summeringar, tabeller och tester > Sammanfattande och beskrivande statistik > Sammanfattande statistik och Statistik > Summeringar, tabeller och tester > Sammanfattande och beskrivande statistik > Frekvenstabeller > Envägstabell.↩︎