Ik heb een gigantische dataset van 334 modelruns en 51 members en 59 verwachtingstijden. Dit levert een kleine miljoen waarden op. Ik pak voor elk member, verwachtingstijd en modelrun de verwachting, daar zoek ik de waarneming bij (de waarnemingstijd is modelrun + verwachtings) en vervolgens doe ik afwijking = verwachting - waarneming. Dit levert dus een hele lange rij afwijkingen op. Ik groepeer vervolgens per verwachtingstijd en bereken de gemiddelde afwijking.
Dit levert de rode lijn in onderstaande grafiek op. Je ziet duidelijk haaientanden, wat mij nogal verbaasd. Ik kan niet goed verklaren waardoor dat komt. Als je een soort gewogen gemiddelde neemt middels (0.5*x-1+x+0.5*x+1)/2, de blauwe lijn, krijg je wel een duidelijk beeld. Heb jij enig idee, Alwin, of iemand anders? Ik zet hieronder ook even de eerste 15 records neer waarmee ik ben gaan rekenen, ter illustratie. Alle tijden zijn UTC.
Modelrun Tau Member Fct Obs Bias
2009-10-01 00:00:00 108 32 14.300 12.4 1.900
2009-10-01 00:00:00 108 33 15.500 12.4 3.100
2009-10-01 00:00:00 108 34 17.300 12.4 4.900
2009-10-01 00:00:00 108 35 14.200 12.4 1.800
2009-10-01 00:00:00 108 36 15.200 12.4 2.800
2009-10-01 00:00:00 108 37 14.300 12.4 1.900
2009-10-01 00:00:00 108 38 16.600 12.4 4.200
2009-10-01 00:00:00 108 39 15.900 12.4 3.500
2009-10-01 00:00:00 108 40 13.600 12.4 1.200
2009-10-01 00:00:00 108 41 13.500 12.4 1.100
2009-10-01 00:00:00 108 42 13.900 12.4 1.500
2009-10-01 00:00:00 108 43 10.400 12.4 -2.000
2009-10-01 00:00:00 108 44 13.900 12.4 1.500
2009-10-01 00:00:00 108 45 12.500 12.4 0.100
2009-10-01 00:00:00 108 46 17.100 12.4 4.700
Gr. Ben
Quote selectie