Je kan niet één Oper als 'de waarheid' nemen en die dan vergelijken met de daadwerkelijke Tx.
Stel dat je Oper GFS0612 als de waarheid neemt voor 13-04.
Dan heb je een Oper te pakken die compleet afwijkt van het ensemble (zie onderstaand ensemble).
Daarnaast kan je nooit DMO nemen als 'de waarheid'.
Heb even snel gekeken naar de afgelopen maand en wat alle GFS00z en 12z Opers voor die dag berekende, daarop mijn correctie op de DMO van de Tx toegepast en dat vergeleken met de daadwerkelijke opgetreden Tx (dit alles voor De Bilt).
Vervolgens heb ik alles rood laten maken waarbij de daadwerkelijke Tx één graad of meer boven of onder de meest waarschijnlijke Tx zat.
Van de 32 dagen was dat op 17 dagen het geval, met de grootste afwijking (3,6) op 31-3.
Op veel van de andere dagen bedroeg de afwijking slechts een paar tienden (zie volledig overzicht hier onder) en dat is prima.
Uiteraard beslaat deze periode 'slechst' één maand, terwijl mijn dataset loopt vanaf december 2017.
Ja, er zijn dagen dat GFS er flink naast zit, maar over het algemeen presteren de gezamenlijke Opers van de GFS00z en 12z runs (gemeten vanaf het moment dat een dag op +7 dagen in de verwachtingen komt) heel erg goed.
