Ten eerste is de voorspellingswaarde van het witte lijntje (gemiddelde) vele malen groter dan het gemiddelde van één individueel lid. Dit heeft ermee te maken dat de fouten in de individuele verwachtingen elkaar opheffen (en extremen ook weggefilterd worden, waardoor de grootschalige trend in de anomalieverdeling beter gepakt wordt en dat is meestal wat goed scoort) en dat het gemiddelde representatief is voor de onzekerheid zowel in de initiële condities als het model zelf. Het middelen doet afbraak aan detail van de verwachting, maar zorgt er wel voor dat de grootschaligere anomaliepatronen beter benaderd worden. Je ziet dat de score voor bijv. de anomalie in de 500 hPa-hoogte altijd beter is van het ensemblegemiddelde dan van een willekeurig individueel lid, terwijl voor een frequentieverdeling van neerslagmaxima over een verwachtingsperiode enkele van de individuele leden (veel) beter zullen scoren dan het gemiddelde.
Het ensemblegemiddelde is ook niet minderwaardig ten aanzien van de andere leden in termen van absolute (grid)equivalentie. Als je tien ruimtelijke velden middelt, dan komt daar gewoon een gemiddeld ruimtelijk veld uit met eenzelfde resolutie. Zoals reeds gezegd verdwijnen er wel details maar de grootschalige ligging van troggen e.d. zit er natuurlijk wel degelijk in. Aangezien de individuele leden altijd de extreme kant op gang (zo zijn ze ontworpen, om een ,,richting'' op te gaan die het snelst en meest afwijkt), wordt met het middelen de realiteit van het grote patroon vaak beter benaderd. Het ensemblegemiddelde is een potentieel juiste verwachting, maar wel ééntje met een hoger potentieel dan de anderen als je kijkt naar parameters die het grootschalige bovenluchtpatroon beschrijven (bijv. anomalie van de 500 hPa hoogte, zie mijn grafiek). Voor dingen die een veel fijnere resolutie vereisen en een grote ruimtelijke variatie hebben, zoals neerslagmaxima, zullen individuele leden betere scores halen (maar dan wordt ook geverifieerd mbv. frequenties en niet met afwijkingen).
Ik ben op mijn werk al een half jaar bezig met mij te verdiepen in de theorie achter ensembles en heb al eens een verificatiesuite opgezet voor zowel operationele modellen als ensembles voor interne verificatie. De resultaten zijn vergelijkbaar met wat o.a. ECMWF en NCEP zelf berekenen. In het geval van de ensembles blijkt: het gemiddelde scoort vele malen beter dan elk individueel lid. Hieronder de anomalie correlatie-coefficiënt van de ECMWF maandverwachting die ik heb opgeduikeld uit een publicatie.
Gr. Ben
Quote selectie