Missing data och imputation eller Får man hitta på data? Lars Lindhagen, UCR
|
|
- Mona Julia Jonasson
- för 8 år sedan
- Visningar:
Transkript
1 Missing data och imputation eller Får man hitta på data? Lars Lindhagen, UCR
2 Inledning Saknat data finns alltid, åtminstone i stora registerstudier. Ett problem som måste hanteras på något sätt. Om man gör tokigt, kan två saker hända: Bias (gentemot ett tänkt, fullständigt dataset). Fel precision (för hög eller för låg).
3 Lär känna ditt data Börja med att försöka förstå varför data saknas! Vilka variabler brukar saknas samtidigt? Jämför individer med och utan missing m.a.p. t.ex. utfall. Tabeller eller logistisk regression med missing som utfall. Ha inte för bråttom!
4 Rubins terminologi Vad för sorts mekanism har gett upphov till missing? Exempelstudie: Är lågt blodtryck (BP) en riskfaktor för äldre? BP inte alltid uppmätt.
5 Rubin: MCAR, MAR Missing completely at random (MCAR): Att ett värde saknas beror på något helt externt. Ex: BP mättes inte för att apparaten var trasig. Missing at random (MAR): MCAR inom strata av observerat data. Ex: BP mättes mer sällan på gamla. Men bland dessa mättes det lika ofta på dem med lågt som med högt BP. MAR MCAR!
6 Rubin: MNAR Missing not at random (MNAR, informativ missing): Sannolikhet för missing beror på själva värdet. Ex: BP mättes mindre ofta på patienter med lågt BP, även bland de gamla. Svårt att hantera. Kräver externa antaganden eller sensitivitetsanalys. Kan inte skilja MAR från MNAR genom att titta på data. Kräver sakkunskap/antaganden.
7 MAR MCAR Vad göra? 1. Försök hitta igen det saknade datat. 2. Stryk variabler med mycket missing från analysen. 3. Complete case-analys (CCA): Kasta bort individer med missing. 4. Enkel imputation: Gissa ett värde. 5. Multipel imputation (MI): Gissa flera värden.
8 En simulering Låtsas studera effekt av hjärtsvikt på mortalitet med rökning som confounder: Rökning Hjärtsvikt OR 5 Död Prob Rökning saknas = 40% om hjärtsvikt och död 5% annars Simulera 5000 patienter. 516 saknar information om rökning (10.3%).
9 Hjärtsvikt Död Rökning Complete case-analys Stryk alla individer med någon missing. Fördelar: Enkelt att göra och förstå. Ingen bias om MCAR. Nackdelar: Bias om inte MCAR. Dålig precision om mycket data slängs. Kastar bort
10 Simulering: CCA Stryk de 516 patienterna utan data på rökning. Rökare Hjärtsvikt Död. Nej Nej Nej Ja Nej Nej Ja Ja. Nej Ja Resultat av logistisk regression: Variabel OR 95% CI Hjärtsvikt Rökning Kraftig bias för hjärtsvikt.
11 Hjärtsvikt Död Rökning Enkel imputation Gissa ett värde för saknat data. T.ex. Median/typvärde. Via prediktionsmodell. Last observation carried forward. Använder Använder! Fördelar: Ganska enkelt. Nackdelar: Hittar på data! Kan bli för smala (eller breda!) konfidensintervall. Kan ge bias om man gör det för enkelt.
12 Simulering: Enkel imputation Fyll i typvärde ( Nej) på rökning. Rökare Hjärtsvikt Död Nej Nej Nej Nej Ja Nej Nej Ja Ja Nej Nej Ja Resultat av logistisk regression: Variabel OR 95% CI Hjärtsvikt Rökning Mycket bättre. Viss bias för rökning.
13 Multipel imputation Gissa flera värden för saknat data. Skapa flera alternativa dataset utan missing. Oftast: Slumpa från prediktionsmodell. Hittar inte på data, utan bara fördelningar för saknat data (modellering). Variationen mellan dataseten speglar okunskapen om det sanna värdet.
14 Hjärtsvikt Död Rökning Multipel imputation Använder Skattar OR Saknat data något som skattas, inte något som ligger till grund för en skattning.
15 Multipel imputation Fördelar: Tar bort bias om MAR och korrekt imputationsmodell. Ger lagom precision (använder bara det data man faktiskt har). Nackdelar: Komplicerat, tar tid (programmering och CPU).
16 MI: Analys och poolning De imputerade dataseten analyseras var för sig. Det finns alltså aldrig ett poolat dataset. Sen poolar man resultaten. Hänsyn tas då till: Standardfel för varje imputation. Variation mellan imputationer. Hittar inte på data!
17 Sim: MI 1. Imputera Rökare Hjärtsvikt Död 2. Analysera Ursprungligt dataset Ja Nej Nej Nej Ja Nej Nej Ja Ja Nej Nej Ja Variabel OR 95% CI Hjärtsvikt Rökning Rökare Hjärtsvikt Död. Nej Nej Nej Ja Nej Nej Ja Ja. Nej Ja Rökare Hjärtsvikt Död Nej Nej Nej Nej Ja Nej Nej Ja Ja Nej Nej Ja Variabel OR 95% CI Hjärtsvikt Rökning Poola Variabel OR 95% CI Hjärtsvikt Rökning Biasen borta CI lite bredare Rökare Hjärtsvikt Död Nej Nej Nej Nej Ja Nej Nej Ja Ja Variabel OR 95% CI Hjärtsvikt Rökning
18 MI: Val av prediktorer Vilka variabler ska man stoppa in i prediktionsmodellen? Åtminstone alla variabler som ska vara med i den kommande analysen, inklusive y. Gärna ytterligare variabler med prediktivt värde.
19 MI: Hur många imputationer? 5 imputationer duger nog gott i många sammanhang. Vissa experter: Lika många imputationer som man har procent individer med någon missing. Kanske lite konservativt?
20 När behöver man imputera? Harrells tumregler, baserat på andel individer med missing: 5%: Spelar inte så stor roll hur man gör. Duger nog med CCA eller enkel imputation. 5 15%: Enkel imputation nog OK, men multipel är bättre. 15%: Använd multipel imputation.
21 Vad kan man imputera? Tre sorters variabler: z: Confounder x: Huvudexponering y: Utfall z x y Alla dessa går att imputera. Man avstår dock ofta från att imputera y.
22 Vågar jag imputera? Kan kännas läskigt: Har vi verkligen MAR? Kan vi specificera en korrekt imputationsmodell? Men alternativet att kasta bort individer bygger på ännu starkare antaganden (MCAR).
23 Missing-kategori Alternativ idé: Inför en särskild kategori för saknat data. Ex: Rökning Nej, Ja, Okänt. Rekommenderas inte! Om rökning saknas för att patienten är död, så får Rökning = Okänt en stor prediktiv kraft, på bekostnad av andra variabler.
24 Missing-kategori Rökare Hjärtsvikt Död Okänt Nej Nej Nej Ja Nej Nej Ja Ja Okänt Nej Ja Variabel OR 95% CI Hjärtsvikt Rökning Ja Rökning Okänt Viss bias för hjärtsvikt. Rökning Okänt ser farligt ut...
25 Sammanfattning Saknat data finns nästan alltid. Måste hanteras på något sätt. Multipel imputation är nog bäst. Tänkbara förenklingar (approximationer): Variabler med missing inte så viktiga: Enkel imputation. Inte så mycket missing: Complete case. Får man hitta på data? Nej, men man får imputera.
MULTIPEL IMPUTATION. Ett sätt att fylla i hålen i ditt datamaterial?
MULTIPEL IMPUTATION Ett sätt att fylla i hålen i ditt datamaterial? Pär Ola Bendahl IKVL, Avdelningen för Onkologi Lunds Universitet Par Ola.Bendahl@med.lu.se Översikt 1. Introduktion till problemet 2.
Läs merMULTIPEL IMPUTATION - Ett sätt att hantera problemet med missing data
MULTIPEL IMPUTATION - Ett sätt att hantera problemet med missing data Pär-Ola Bendahl IKVL, Avdelningen för Onkologi Lunds Universitet Par-Ola.Bendahl@med.lu.se Översikt Introduktion till problemet Enkla
Läs merPropensity Scores. Bodil Svennblad UCR 16 september 2014
Propensity Scores Bodil Svennblad UCR 16 september 2014 Jämföra två behandlingar Randomiserad studie A B Inte alltid etiskt försvarbart Dyrt Restriktioner på studiepopulationen (generaliserbart?) Real
Läs merKvantitativa metoder och datainsamling
Kvantitativa metoder och datainsamling Kurs i forskningsmetodik med fokus på patientsäkerhet 2015-09-23, Peter Garvin FoU-enheten för närsjukvården Kvantitativ och kvalitativ metodik Diskborsten, enkronan
Läs merUpprepade mätningar och tidsberoende analyser. Stefan Franzén Statistiker Registercentrum Västra Götaland
Upprepade mätningar och tidsberoende analyser Stefan Franzén Statistiker Registercentrum Västra Götaland Innehåll Stort område Simpsons paradox En mätning per individ Flera mätningar per individ Flera
Läs merEkonomisk statistik 2 Economic statistics 2. Imputering
Ekonomisk statistik 2 Economic statistics 2 Imputering Masterkurs Daniel Thorburn Höstterminen 2008 Stockholms Universitet Ekonomisk statistik Höstterminen 2008 Stockholms Universitet Saknade värden Totalt
Läs merSF1905 Sannolikhetsteori och statistik: Lab 2 ht 2011
Avd. Matematisk statistik Tobias Rydén 2011-09-30 SF1905 Sannolikhetsteori och statistik: Lab 2 ht 2011 Förberedelser. Innan du går till laborationen, läs igenom den här handledningen. Repetera också i
Läs merST-fredag i Biostatistik & Epidemiologi När ska jag använda vilket test?
ST-fredag i Biostatistik & Epidemiologi När ska jag använda vilket test? Mikael Eriksson Specialistläkare CIVA Karolinska Universitetssjukhuset, Solna Grund för hypotestestning 1. Definiera noll- och alternativhypotes,
Läs merBortfallsproblematik ur ett metodperspektiv
Bortfallsproblematik ur ett metodperspektiv Daniel Thorburn Surveyföreningen 2011-05-27 Olika metodaspekter Bortfall versus andra fel Psykologi varför svarar man? (inte?) Åtgärder vid insamling (förebygg!)
Läs merF19, (Multipel linjär regression forts) och F20, Chi-två test.
Partiella t-test F19, (Multipel linjär regression forts) och F20, Chi-två test. Christian Tallberg Statistiska institutionen Stockholms universitet Då man testar om en enskild variabel X i skall vara med
Läs merFöreläsning 11: Mer om jämförelser och inferens
Föreläsning 11: Mer om jämförelser och inferens Matematisk statistik David Bolin Chalmers University of Technology Maj 12, 2014 Oberoende stickprov Vi antar att vi har två oberoende stickprov n 1 observationer
Läs merMultivariabel statistik
Multivariabel statistik beware of the wolf Johan Lindbäck Uppsala Clinical Research Center Kvalitetsregisterforskningskonferens Arlanda 26 maj 2015 J Lindbäck (UCR) Multivariabla modeller 26/5 2015 2/36
Läs merEPIDEMIOLOGI. Läran om sjukdomsförekomst i en befolkning (Ahlbom, Norell)
EPIDEMIOLOGI Läran om sjukdomsförekomst i en befolkning (Ahlbom, Norell) Läran om utbredningen av och orsakerna till hälsorelaterade tillstånd eller förhållanden i specifika populationer och tillämpningen
Läs merFöreläsning 9. NDAB02 Statistik; teori och tillämpning i biologi
Föreläsning 9 Statistik; teori och tillämpning i biologi 1 (kap. 20) Introduktion I föregående föreläsning diskuterades enkel linjär regression, där en oberoende variabel X förklarar variationen hos en
Läs merFÖRELÄSNINGSMATERIAL. diff SE. SE x x. Grundläggande statistik 2: KORRELATION OCH HYPOTESTESTNING. Påbyggnadskurs T1. Odontologisk profylaktik
Grundläggande statistik Påbyggnadskurs T1 Odontologisk profylaktik FÖRELÄSNINGSMATERIAL : KORRELATION OCH HYPOTESTESTNING t diff SE x 1 diff SE x x 1 x. Analytisk statistik Regression & Korrelation Oberoende
Läs merFöreläsning G60 Statistiska metoder
Föreläsning 9 Statistiska metoder 1 Dagens föreläsning o Regression Regressionsmodell Signifikant lutning? Prognoser Konfidensintervall Prediktionsintervall Tolka Minitab-utskrifter o Sammanfattning Exempel
Läs merFöreläsning 9. NDAB01 Statistik; teori och tillämpning i biologi
Föreläsning 9 Statistik; teori och tillämpning i biologi 1 (kap. 20) Introduktion I föregående föreläsning diskuterades enkel linjär regression, där en oberoende variabel X förklarar variationen hos en
Läs merMedicinsk statistik II
Medicinsk statistik II Läkarprogrammet termin 5 VT 2013 Susanna Lövdahl, Msc, doktorand Klinisk koagulationsforskning, Lunds universitet E-post: susanna.lovdahl@med.lu.se Dagens föreläsning Fördjupning
Läs merDatakvalitet. Hva duger data til? Jonas Ranstam jonas.ranstam@med.lu.se
Hva duger data til? Jonas Ranstam jonas.ranstam@med.lu.se Registercentrum Syd, Skånes Universitetssjukhus och Inst. f. kliniska vetenskaper, Lunds Universitet, Klinikgatan 22, 22185 Lund, Sverige 15 Jan
Läs merKandidatuppsats. Nr 2014:1. Prediktorer i imputeringsmodellen. Statistiska institutionen. Anna-Karin Oscarsson och Anni Jonsson Juho
Kandidatuppsats Statistiska institutionen Bachelor thesis, Department of Statistics Nr 2014:1 Prediktorer i imputeringsmodellen Predictors in the imputation model Anna-Karin Oscarsson och Anni Jonsson
Läs merInstruktioner till Inlämningsuppgiften i Statistik Kursen Statistik och Metod Psykologprogrammet (T8), Karolinska Institutet
1 Instruktioner till Inlämningsuppgiften i Statistik Kursen Statistik och Metod Psykologprogrammet (T8), Karolinska Institutet För att bli godkänd på inlämningsuppgiften krävs att man utför uppgiften om
Läs merHur skriver man statistikavsnittet i en ansökan?
Hur skriver man statistikavsnittet i en ansökan? Val av metod och stickprovsdimensionering Registercentrum Norr http://www.registercentrumnorr.vll.se/ statistik.rcnorr@vll.se 11 Oktober, 2018 1 / 52 Det
Läs merSTATISTISK POWER OCH STICKPROVSDIMENSIONERING
STATISTISK POWER OCH STICKPROVSDIMENSIONERING Teori UPPLÄGG Gemensam diskussion Individuella frågor Efter detta pass hoppas jag att: ni ska veta vad man ska tänka på vilka verktyg som finns vilket stöd
Läs merIntroduktion till kausala effekter
Introduktion till kausala effekter Ronnie Pingel Institutionen f or folkh also- och v ardvetenskap och Statistiska institutionen 2016-09-03 Utgångspunkten Introduktion Vanligt mål i empirisk forskning
Läs merEn rät linje ett enkelt samband. En rät linje + slumpbrus. Observationspar (X i,y i ) MSG Staffan Nilsson, Chalmers 1.
En rät linje ett enkelt samband Y β 1 Lutning (slope) β 0 Skärning (intercept) 1 Y= β 0 + β 1 X X En rät linje + slumpbrus Y Y= β 0 + β 1 X + brus brus ~ N(0,σ) X Observationspar (X i,y i ) Y Ökar/minskar
Läs merFÅ FRAM INDATA. När inga data finns!? Beslutsfattarens dilemma är att det är svårt att spå! Särskilt om framtiden!
FÅ FRAM INDATA När inga data finns!? Beslutsfattarens dilemma är att det är svårt att spå! Särskilt om framtiden! (Falstaff Fakir) Svårigheter att få fram bra information - en liten konversation Ge mig
Läs merKorrelation kausalitet. ˆ Y =bx +a KAPITEL 6: LINEAR REGRESSION: PREDICTION
KAPITEL 6: LINEAR REGRESSION: PREDICTION Prediktion att estimera "poäng" på en variabel (Y), kriteriet, på basis av kunskap om "poäng" på en annan variabel (X), prediktorn. Prediktion heter med ett annat
Läs merF18 MULTIPEL LINJÄR REGRESSION, FORTS. (NCT
Stat. teori gk, ht 006, JW F18 MULTIPEL LINJÄR REGRESSION, FORTS. (NCT 1.1, 13.1-13.6, 13.8-13.9) Modell för multipel linjär regression Modellantaganden: 1) x-värdena är fixa. ) Varje y i (i = 1,, n) är
Läs merKapitel 12: TEST GÄLLANDE EN GRUPP KOEFFICIENTER - ANOVA
Kapitel 12: TEST GÄLLANDE EN GRUPP KOEFFICIENTER - ANOVA 12.1 ANOVA I EN MULTIPEL REGRESSION Exempel: Tjänar man mer som egenföretagare? Nedan visas ett utdrag ur ett dataset som innehåller information
Läs merInStat Exempel 4 Korrelation och Regression
InStat Exempel 4 Korrelation och Regression Vi ska analysera ett datamaterial som innehåller information om kön, längd och vikt för 2000 personer. Materialet är jämnt fördelat mellan könen (1000 män och
Läs merAtt välja statistisk metod
Att välja statistisk metod en översikt anpassad till kursen: Statistik och kvantitativa undersökningar 15 HP Vårterminen 2018 Lars Bohlin Innehåll Val av statistisk metod.... 2 1. Undersökning av en variabel...
Läs merInstuderingsfrågor till avsnittet om statistik, kursen Statistik och Metod, Psykologprogrammet på KI, T8
1 Instuderingsfrågor till avsnittet om statistik, kursen Statistik och Metod, Psykologprogrammet på KI, T8 Dessa instuderingsfrågor är främst tänkta att stämma överens med innehållet i föreläsningarna,
Läs merTentamen för kursen. Linjära statistiska modeller. 22 augusti
STOCKHOLMS UNIVERSITET MATEMATISK STATISTIK Tentamen för kursen Linjära statistiska modeller 22 augusti 2008 9 14 Examinator: Anders Björkström, tel. 16 45 54, bjorks@math.su.se Återlämning: Rum 312, hus
Läs merStatistisk försöksplanering
Statistisk försöksplanering Provmoment: Ladokkod: Tentamen ges för: TentamensKod: Skriftlig tentamen 3 hp 51SF01 Textilingenjörsutbildningen Tentamensdatum: 25 Oktober 2017 Tid: 09:00-13 Hjälpmedel: Miniräknare
Läs merSF1900 Sannolikhetsteori och statistik, HT 2017 Laboration 1 för CINEK2
Matematisk Statistik SF1900 Sannolikhetsteori och statistik, HT 2017 Laboration 1 för CINEK2 1 Introduktion Denna laboration är inte poänggivande utan är till för den som vill bekanta sig med MATLAB. Fokusera
Läs merFöreläsning 12: Regression
Föreläsning 12: Regression Matematisk statistik David Bolin Chalmers University of Technology Maj 15, 2014 Binomialfördelningen Låt X Bin(n, p). Vi observerar x och vill ha information om p. p = x/n är
Läs merResidualanalys. Finansiell statistik, vt-05. Normalfördelade? Normalfördelade? För modellen
Residualanalys För modellen Johan Koskinen, Statistiska institutionen, Stockholms universitet Finansiell statistik, vt-5 F7 regressionsanalys antog vi att ε, ε,..., ε är oberoende likafördelade N(,σ Då
Läs merMVE051/MSG Föreläsning 14
MVE051/MSG810 2016 Föreläsning 14 Petter Mostad Chalmers December 14, 2016 Beroende och oberoende variabler Hittills i kursen har vi tittat på modeller där alla observationer representeras av stokastiska
Läs merTill ampad statistik (A5) Förläsning 13: Logistisk regression
Till ampad statistik (A5) Förläsning 13: Logistisk regression Ronnie Pingel Statistiska institutionen Senast uppdaterad: 2016-03-08 Exempel 1: NTU2015 Exempel 2: En jobbannons Exempel 3 1 1 Klofstad, C.
Läs merHur hanterar man avvikande patienter? Estimander och analysmetoder i kliniska prövningar
Hur hanterar man avvikande patienter? Estimander och analysmetoder i kliniska prövningar Alexandra Jauhiainen Early Clinical Biometrics AstraZeneca R&D Mölndal, Sverige Statistikerträffen 2015 En klinisk
Läs merIntroduktion till statistik för statsvetare
och enkäter "Det finns inget så praktiskt som en bra teori" September 2011 och enkäter Inledning Inledning Om vi vill mäta en egenskap hos en population individer (individer kan vara personer, företag
Läs merAgenda. Statistik Termin 11, Läkarprogrammet, VT14. Forskningsprocessen. Agenda (forts.) Data - skalnivåer. Den heliga treenigheten
Agenda Statistik Termin 11, Läkarprogrammet, VT14 I: Grundläggande begrepp och beskrivande statistik II: Exempel på typisk forskning III. Frågestund Martin Cernvall martin.cernvall@pubcare.uu.se Grundläggande
Läs merStatistik och epidemiologi T5
Statistik och epidemiologi T5 Anna Axmon Biostatistiker Yrkes- och miljömedicin Dagens föreläsning Fördjupning av hypotesprövning Repetition av p-värde och konfidensintervall Tester för ytterligare situationer
Läs merHSB BRF HAMNEN, ÅSIKTEN ETAPP TVÅ
1 0 01 4 rok 116,0 5 220 5 600 000 1 1 02 4 rok 113,0 5 175 5 475 000 1 1 03 4 rok 116,0 5 220 5 710 000 1 2 04 4 rok 113,0 5 175 5 760 000 1 2 05 4 rok 116,0 5 220 5 900 000 1 3 06 4 rok 113,0 5 175 5
Läs merST-fredag epidemiologi och biostatistik 2017
ST-fredag epidemiologi och biostatistik 2017 Emma Larsson. ST-läkare, PhD. PMI, KS Solna Gabriella Jäderling. Överläkare, PhD. PMI KS Solna Mikael Eriksson. Specialistläkare, doktorand. PMI KS Solna. Max
Läs merHI1024 Programmering, grundkurs TEN
HI1024 Programmering, grundkurs TEN2 2016-12-22 KTH STH Flemingsberg 8.15-13.00 Tillåtna hjälpmedel: Kursboken C PROGRAMMING A Modern Approach K. N. King helt utan anteckningar Alternativt C från början
Läs merInstruktioner till Inlämningsuppgiften i Statistik Kursen Statistik och Metod Psykologprogrammet (T8), Karolinska Institutet
1 Instruktioner till Inlämningsuppgiften i Statistik Kursen Statistik och Metod Psykologprogrammet (T8), Karolinska Institutet Uppdaterad: 130114 För att bli godkänd på inlämningsuppgiften krävs att man
Läs merParade och oparade test
Parade och oparade test Andrew Hooker Division of Pharmacokinetics and Drug Therapy Department of Pharmaceutical Biosciences Uppsala University Hypotesprövning: möjliga jämförelser Jämförelser mot ett
Läs merBinomialfördelning, två stickprov
Diskreta data Binomialfördelning, två stickprov Hypotesprövning måste inte grunda sig på normalfördelning 1948 visste man inte om streptomycin var effektivt mot tuberkulos, men man misstänkte det. För
Läs merStudietyper, inferens och konfidensintervall
Studietyper, inferens och konfidensintervall Andrew Hooker Division of Pharmacokinetics and Drug Therapy Department of Pharmaceutical Biosciences Uppsala University Studietyper Experimentella studier Innebär
Läs merStatistik och epidemiologi T5
Statistik och epidemiologi T5 Anna Axmon Biostatistiker Yrkes- och miljömedicin Biostatistik kursmål Dra slutsatser utifrån basala statistiska begrepp och analyser och själva kunna använda sådana metoder.
Läs merEpidemiologi T5. Kursmål epidemiologi. Kursmål epidemiologi. Kunna förklara och använda grundläggande epidemiologiska begrepp
Epidemiologi T5 Kursmål epidemiologi Kunna förklara och använda grundläggande epidemiologiska begrepp Prevalens Incidens Riskanalys Kursmål epidemiologi Kunna beräkna en diagnostisk metods informationsvärde
Läs merVANLIGA TERMER OCH BEGREPP INOM MEDICINSK VETENSKAP OCH STATISTIK
VANLIGA TERMER OCH BEGREPP INOM MEDICINSK VETENSKAP OCH STATISTIK TERM Analytisk statistik Bias Confounder (förväxlingsfaktor)) Deskriptiv statistik Epidemiologi Fall-kontrollstudie (case-control study)
Läs merStandardfel (Standard error, SE) SD eller SE. Intervallskattning MSG Staffan Nilsson, Chalmers 1
Standardfel (Standard error, SE) Anta vi har ett stickprov X 1,,X n där varje X i has medel = µ och std.dev = σ. Då är Det sista kalls standardfel (eng:standard error of mean (SEM) eller (SE) och skattas
Läs merTentamen i matematisk statistik (92MA31, STN2) kl 08 12
LINKÖPINGS UNIVERSITET MAI Johan Thim Tentamen i matematisk statistik (92MA1, STN2) 21-1-16 kl 8 12 Hjälpmedel är: miniräknare med tömda minnen och formelbladet bifogat. Varje uppgift är värd 6 poäng.
Läs merPoolade data över tiden och över tvärsnittet. Oberoende poolade tvärsnittsdatamängder från olika tidpunkter.
PANELDATA Poolade data över tiden och över tvärsnittet Alternativ 1: Oberoende poolade tvärsnittsdatamängder från olika tidpunkter. Oberoende stickprov dragna från stora populationer vid olika tidpunkter.
Läs merResultatet läggs in i ladok senast 13 juni 2014.
Matematisk statistik Tentamen: 214 6 2 kl 14 19 FMS 35 Matematisk statistik AK för M, 7.5 hp Till Del A skall endast svar lämnas. Samtliga svar skall skrivas på ett och samma papper. Övriga uppgifter fordrar
Läs merDemonstration av laboration 2, SF1901
KTH 29 November 2017 Laboration 2 Målet med dagens föreläsning är att repetera några viktiga begrepp från kursen och illustrera dem med hjälp av MATLAB. Laboration 2 har följande delar Fördelningsfunktion
Läs merF23 forts Logistisk regression + Envägs-ANOVA
F23 forts Logistisk regression + Envägs-ANOVA Repetition Detta går inteattbeskriva på någotrimligtsättmed en linjär funktion PY Xx) β 0 +β x Den skattade linjen går utanför intervallet0, ): Y ärenbinärvariabel0-,dikotom)manvillmodellera,
Läs merUppgift 1. f(x) = 2x om 0 x 1
Avd. Matematisk statistik TENTAMEN I Matematisk statistik SF1907, SF1908 OCH SF1913 TORSDAGEN DEN 30 MAJ 2013 KL 14.00 19.00. Examinator: Gunnar Englund, 073 321 3745 Tillåtna hjälpmedel: Formel- och tabellsamling
Läs merLaboration 3: Urval och skattningar
S0004M Statistik 1 Undersökningsmetodik. Laboration 3: Urval och skattningar Denna laboration handlar om slumpmässiga urval. Dessa urval ska användas för att uppskatta egenskaper hos en population. Statistiska
Läs merInnehåll: 3.4 Parametriskt eller ej 3.5 Life Table 3.6 Kaplan Meier 4. Cox Regression 4.1 Hazard Function 4.2 Estimering (PL)
Innehåll: 1. Risk & Odds 1.1 Risk Ratio 1.2 Odds Ratio 2. Logistisk Regression 2.1 Ln Odds 2.2 SPSS Output 2.3 Estimering (ML) 2.4 Multipel 3. Survival Analys 3.1 vs. Logistisk 3.2 Censurerade data 3.3
Läs merStatistiska metoder för säkerhetsanalys
F10: Intensiteter och Poissonmodeller Frågeställningar Konstant V.v.=Var Cyklister Poissonmodeller för frekvensdata Vi gör oberoende observationer av de (absoluta) frekvenserna n 1, n 2,..., n k från den
Läs merHypotesprövning. Andrew Hooker. Division of Pharmacokinetics and Drug Therapy Department of Pharmaceutical Biosciences Uppsala University
Hypotesprövning Andrew Hooker Division of Pharmacokinetics and Drug Therapy Department of Pharmaceutical Biosciences Uppsala University Hypotesprövning Liksom konfidensintervall ett hjälpmedel för att
Läs merStatistiska Institutionen Gebrenegus Ghilagaber (docent)
Statistiska Institutionen Gebrenegus Ghilagaber (docent) Lösningsförslag till skriftlig tentamen i FINANSIELL STATISTIK, grundnivå, 7,5 hp, VT09. Onsdagen 3 juni 2009-1 Sannolkhetslära Mobiltelefoner tillverkas
Läs merFöreläsning 8, Matematisk statistik 7.5 hp för E Punktskattningar
Föreläsning 8, Matematisk statistik 7.5 hp för E Punktskattningar Stas Volkov Stanislav Volkov s.volkov@maths.lth.se FMSF20 F8: Statistikteori 1/20 Översikt Exempel Repetition Exempel Matematisk statistik
Läs merSambandsmått. Centralmått. Det mest frekventa värdet. Det mittersta värdet i en rangordnad fördelning. Aritmetiska medelvärdet.
PM315 HT016 Emma äck Formelsamling Centralmått Typvärde T Median Md ritmetiska medelvärdet Det mest frekventa värdet Det mittersta värdet i en rangordnad fördelning = n Spridningsmått Variationsvidd (Range)
Läs merBootstrapping i fall-/kontrollstudier av genetiska markörer
Bootstrapping i fall-/kontrollstudier av genetiska markörer Håkan Lövkvist RSKC 2011-03-09 Vad är bootstrapping? Bootstrap = stövelstropp Annan översättning: Ta sig i kragen, vara självbärande Litterär
Läs merHYPOTESPRÖVNING sysselsättning
0 självmord 20 40 60 HYPOTESPRÖVNING 4. Se spridningsdiagrammen nedan (A, B och C). Alla tre samband har samma korrelation och samma regressionslinje (r = 0,10, b = 0,15). Vi vill testa om sambandet mellan
Läs merFinansiell statistik
Finansiell statistik Föreläsning 5 Tidsserier 4 maj 2011 14:26 Vad är tidsserier? En tidsserie är en mängd av observationer y t, där var och en har registrerats vid en specifik tidpunkt t. Vanligen görs
Läs merVad beror skillnaden på? Systematiska och slumpmässiga fel
Vad beror skillnaden på? Systematiska och slumpmässiga fel Typer av fel och rätt Verklig skillnad Stort slumpfel! En studie genomförs Vi observerar en skillnad! Vi observerar ingen skillnad Slumpfel Systematiska
Läs merAutokorrelation och Durbin-Watson testet. Patrik Zetterberg. 17 december 2012
Föreläsning 6 Autokorrelation och Durbin-Watson testet Patrik Zetterberg 17 december 2012 1 / 14 Korrelation och autokorrelation På tidigare föreläsningar har vi analyserat korrelationer för stickprov
Läs merLaboration 2. i 5B1512, Grundkurs i matematisk statistik för ekonomer
Laboration 2 i 5B52, Grundkurs i matematisk statistik för ekonomer Namn: Elevnummer: Laborationen syftar till ett ge information och träning i Excels rutiner för statistisk slutledning, konfidensintervall,
Läs mer7,5 högskolepoäng. Statistisk försöksplanering och kvalitetsstyrning. TentamensKod: Tentamensdatum: 30 oktober 2015 Tid: 9-13:00
Statistisk försöksplanering och kvalitetsstyrning Provmoment: Ladokkod: Tentamen ges för: TentamensKod: Tentamen 5Hp 41I12B KINAF13, KINAR13, KINLO13,KMASK13 7,5 högskolepoäng Tentamensdatum: 30 oktober
Läs merAnalys av medelvärden. Jenny Selander , plan 3, Norrbacka, ingång via den Samhällsmedicinska kliniken
Analys av medelvärden Jenny Selander jenny.selander@ki.se 524 800 29, plan 3, Norrbacka, ingång via den Samhällsmedicinska kliniken Jenny Selander, Kvant. metoder, FHV T1 december 20111 Innehåll Normalfördelningen
Läs merFöreläsning 8, Matematisk statistik 7.5 hp för E, HT-15 Punktskattningar
Föreläsning 8, Matematisk statistik 7.5 hp för E, HT-15 Punktskattningar Anna Lindgren 25 november 2015 Anna Lindgren anna@maths.lth.se FMSF20 F8: Statistikteori 1/17 Matematisk statistik slumpens matematik
Läs merDATORÖVNING 2: STATISTISK INFERENS.
DATORÖVNING 2: STATISTISK INFERENS. START Logga in och starta Minitab. Se till att du kan skriva Minitab-kommandon direkt i Session-fönstret (se föregående datorövning). CENTRALA GRÄNSVÄRDESSATSEN Enligt
Läs merTENTAMEN I MATEMATISK STATISTIK Statistik för lärare 7,5 hp
UMEÅ UNIVERSITET Tentamen 2016-08-24 Sid 1 TENTAMEN I MATEMATISK STATISTIK Statistik för lärare 7,5 hp Skrivtid: 16-22 Tillåtna hjälpmedel: Miniräknare. Formelblad och tabeller bifogas till tentamen. Studenterna
Läs merFel och fel. slumpmässiga och systema4ska fel i epidemiologiska studier Katja Fall Vetenskapligt förhållningssä>
Fel och fel slumpmässiga och systema4ska fel i epidemiologiska studier Katja Fall Vetenskapligt förhållningssä> Varför? En hjälp då man kri4skt granskar studier - andras. och egna! A> ta fram e> es4mat
Läs merMatematisk statistik för B, K, N, BME och Kemister
Matematisk statistik för B, K, N, BME och Kemister Föreläsning 11 & 12 Johan Lindström 5 & 14 oktober 2015 Johan Lindström - johanl@maths.lth.se FMS086/MASB02 F11 1/27 Johan Lindström - johanl@maths.lth.se
Läs merTentamen för kursen. Linjära statistiska modeller. 16 augusti 2007 9 14
STOCKHOLMS UNIVERSITET MATEMATISK STATISTIK Tentamen för kursen Linjära statistiska modeller 16 augusti 2007 9 14 Examinator: Anders Björkström, tel. 16 45 54, bjorks@math.su.se Återlämning: Rum 312, hus
Läs merFöreläsning 2 (kap 3): Diskreta stokastiska variabler
Föreläsning 2 (kap 3): Diskreta stokastiska variabler Marina Axelson-Fisk 20 april, 2016 Idag: Diskreta stokastiska (random) variabler Frekvensfunktion och fördelningsfunktion Väntevärde Varians Några
Läs merGrupp/Center-statistik. Terminologi/ordlista...2 Urval...3 Analystyper...4
Terminologi/ordlista...2...3 Analystyper...4 1 Terminologi/ordlista Gruppering Patientinformationsvariabel Besöksvariabel Patientstatus En/flervalsvariabel Numerisk variabel Fritextvariabel Standardbesök
Läs merSF1901: SANNOLIKHETSTEORI OCH STATISTIKTEORI KONSTEN ATT DRA INTERVALLSKATTNING. STATISTIK SLUTSATSER. Tatjana Pavlenko.
SF1901: SANNOLIKHETSTEORI OCH STATISTIK FÖRELÄSNING 10 STATISTIKTEORI KONSTEN ATT DRA SLUTSATSER. INTERVALLSKATTNING. Tatjana Pavlenko 25 april 2017 PLAN FÖR DAGENS FÖRELÄSNING Statistisk inferens oversikt
Läs merFöreläsning 8. NDAB02 Statistik; teori och tillämpning i biologi
Föreläsning 8 Statistik; teori och tillämpning i biologi 1 Dagens föreläsning o Enkel linjär regression (kap 17.1 17.5) o Skatta regressionslinje (kap 17.2) o Signifikant lutning? (kap 17.3, 17.5a) o Förklaringsgrad
Läs merFör logitmodellen ges G (=F) av den logistiska funktionen: (= exp(z)/(1+ exp(z))
Logitmodellen För logitmodellen ges G (=F) av den logistiska funktionen: F(z) = e z /(1 + e z ) (= exp(z)/(1+ exp(z)) Funktionen motsvarar den kumulativa fördelningsfunktionen för en standardiserad logistiskt
Läs merTENTAMEN I REGRESSIONSANALYS OCH TIDSSERIEANALYS
STOCKHOLMS UNIVERSITET Statistiska institutionen Marcus Berg VT2014 TENTAMEN I REGRESSIONSANALYS OCH TIDSSERIEANALYS Fredag 23 maj 2014 kl. 12-17 Skrivtid: 5 timmar Godkända hjälpmedel: Kalkylator utan
Läs merTentamen i Tillämpad statistisk analys, GN, 7.5 hp. 23 maj 2013 kl. 9 14
STOCKHOLMS UNIVERSITET MT4003 MATEMATISKA INSTITUTIONEN LÖSNINGAR Avd. Matematisk statistik 3 maj 013 Lösningar Tentamen i Tillämpad statistisk analys, GN, 7.5 hp 3 maj 013 kl. 9 14 Uppgift 1 a Eftersom
Läs merData på individ/hushålls/företags/organisationsnivå. Idag större datamänger än tidigare
MIKROEKONOMETRI Data på individ/hushålls/företags/organisationsnivå Tvärsnittsdata och/eller longitudinella data o paneldata Idag större datamänger än tidigare Tekniska framsteg erbjuder möjligheter till
Läs merDATORÖVNING 6: CENTRALA GRÄNSVÄRDES-
DATORÖVNING 6: CENTRALA GRÄNSVÄRDES- SATSEN OCH FELMARGINALER I denna datorövning ska du använda Minitab för att empiriskt studera hur den centrala gränsvärdessatsen fungerar, samt empiriskt utvärdera
Läs merBild 1. Bild 2 Sammanfattning Statistik I. Bild 3 Hypotesprövning. Medicinsk statistik II
Bild 1 Medicinsk statistik II Läkarprogrammet T5 HT 2014 Anna Jöud Arbets- och miljömedicin, Lunds universitet ERC Syd, Skånes Universitetssjukhus anna.joud@med.lu.se Bild 2 Sammanfattning Statistik I
Läs merSvensk Dialysdatabas. Blodtryck och blodtrycksbehandling PD. Klinikdata hösten 2005 Översikt åren 2002 2005
Svensk Dialysdatabas Blodtryck och blodtrycksbehandling PD Klinikdata hösten 5 Översikt åren 2 5 Innehållsförteckning Läsanvisningar och kommentarer...3 Figur 1. Systoliskt BT 5...4 Figur 2. Andel med
Läs merPatrik Pavlov & Nils-Henrik Jansson
Kandidatuppsats i Statistik Cryptosporidiumutbrottet i Östersunds kommun 2010 Påverkan på kommunens barn Linköpings universitet, VT 2013 Statistik och dataanalysprogrammet Patrik Pavlov & Nils-Henrik Jansson
Läs merInstruktioner till Examinationen Kursen Introduktion till Multivariat Dataanalys Karolinska Institutet
1 Instruktioner till Examinationen Kursen Introduktion till Multivariat Dataanalys Karolinska Institutet Uppdaterad: 120412 För att bli godkänd skall man utföra alla sex uppgifter som beskrivs nedan. OBS:
Läs merObligatorisk uppgift, del 1
Obligatorisk uppgift, del 1 Uppgiften består av tre sannolikhetsproblem, som skall lösas med hjälp av miniräknare och tabellsamling. 1. Vid tillverkning av en produkt är felfrekvensen 0,02, dvs sannolikheten
Läs mer10.1 Enkel linjär regression
Exempel: Hur mycket dragkraft behövs för att en halvledare skall lossna från sin sockel vid olika längder på halvledarens ben. De halvledare vi betraktar är av samma storlek (bortsett benlängden). 70 Scatterplot
Läs merStatistik 1 för biologer, logopeder och psykologer
Innehåll 1 Analys av korstabeller 2 Innehåll 1 Analys av korstabeller 2 Korstabeller Vi har tidigare under kursen redan bekantat oss med korstabeller. I en korstabell redovisar man fördelningen på två
Läs mer2. Lära sig beskriva en variabel numeriskt med "proc univariate" 4. Lära sig rita diagram med avseende på en annan variabel
Datorövning 1 Statistikens Grunder 2 Syfte 1. Lära sig göra betingade frekvenstabeller 2. Lära sig beskriva en variabel numeriskt med "proc univariate" 3. Lära sig rita histogram 4. Lära sig rita diagram
Läs merBestäm med hjälp av en lämplig och välmotiverad approximation P (X > 50). (10 p)
Avd. Matematisk statistik TENTAMEN I SF1901, SF1905, SANNOLIKHETSTEORI OCH STATISTIK, MÅNDAGEN DEN 17:E AUGUSTI 2015 KL 8.00 13.00. Kursledare: Tatjana Pavlenko, 08-790 84 66 Tillåtna hjälpmedel: Formel-
Läs merKausalitet 2012-03-26. Kausalitet. Vad är kausal inferens? Seminariets agenda. P(Y a=1 =1) P(Y a=0 =1) Kausal effekt för en individ i:
Seminariets agenda Vad är kausal inferens? nna Ekman rbets- och miljömedicin Kausalitet Statistiska samband kontra kausalitet Konfounding DG ett grafiskt stöd Inverse propability weights Kausalitet ounterfactual
Läs mer