Naar deze grafiek kijkende, zou je kunnen stellen dat die hele verbetering zo ongeveer tussen 1995 en 2010 tot stand is gekomen. Zou je dan kunnen stellen dat destijds pure computing power en een nog niet geoptimaliseerd rekenmodel de limiterende factoren waren en nu meer de resolutie van meetdata die als input dienen? Oftewel, nog meer rekenkracht en modeloptimalisatie leidt niet meer tot betere resultaten als er niet meer inputdata voorhanden is?
Dat denk ik inderdaad wel, want een van de grootste problemen is de initialisatie van de modellen. Maar daarbij gaat het niet alleen om de hoeveelheid waarnemingen, maar ook over hoe je die lokale waarnemingen omzet in regionaal te gebruiken waardes. Niet alle waarnemingen zijn even representatief voor hun omgeving. Het is dan de vraag hoe je daarvoor moet corrigeren, en dat dan in verschillende omstandigheden. Dat is niet eenvoudig.