Een model draagt nu drie alledaagse diensten

Google DeepMind introduceerde WeatherNext 3 op 3 september 2026 en bouwde het rechtstreeks in Google Zoeken, de Gemini-app, Google Maps, de Maps Platform Weather API, Earth Engine en BigQuery. Het model genereert elk uur een nieuwe wereldwijde voorspelling in plaats van elke zes uur, en verwerkt live satellietdata zodra die binnenkomt in plaats van te wachten op de volgende geplande run. Oppervlaktetemperatuur en vocht worden herleid tot een raster van 5 kilometer, andere oppervlaktevariabelen tot 10 kilometer, en atmosferische variabelen zoals windsnelheid tot 25 kilometer, een sprong die Google omschrijft als ongeveer vijf keer scherper dan zijn voorganger, WeatherNext 2.

Google stelt zelf dat het model tot 50 procent nauwkeurigere neerslagvoorspellingen levert voor planning een dag of langer vooruit, met de grootste vooruitgang in regio's waar voorspellen historisch het zwakst was. Het bericht noemt ook twee concrete industriële toepassingen: het inschatten van turbineopbrengst op basis van windsnelheidsvoorspellingen op 100 meter hoogte voor exploitanten van duurzame energie, en het voorspellen van bewolking en zonnestraling voor zonneparken.

Een cijfer is onafhankelijk gecontroleerd, en het is niet het cijfer uit de pitch

WeatherNext 3 wordt niet uitsluitend door zichzelf beoordeeld. Brightband, een onafhankelijk weersvoorspellingsbedrijf, beheert Operational WeatherBench, een live klassement dat operationele AI- en op fysica gebaseerde weermodellen doorlopend tegen elkaar afzet onder reële omstandigheden. Volgens Brightbands eigen metingen behaalde WeatherNext 3 op 26 van de laatste 30 dagen van augustus 2026 de laagste foutmarge op de temperatuur op 2 meter hoogte, voor zowel het IFS van ECMWF als het GFS van NOAA, de twee referentiemodellen op basis van fysica waarop meteorologen al decennia vertrouwen. Dat is een echt resultaat van een derde partij, behaald door een partij zonder belang bij het succes van Google, en het verdient het om als reëel bewijs te worden behandeld in plaats van samen met de rest te worden weggewuifd.

Het verschil zit een laag dieper. Het klassement van Brightband meet temperatuurnauwkeurigheid. De cijfers waarmee Google zijn eigen aankondiging daadwerkelijk opent, en die een exploitant van duurzame energie of landbouw nodig zou hebben voordat hij het model voor een echte beslissing vertrouwt, zijn vergelijkingen van neerslagnauwkeurigheid: tot 60 procent beter dan IMERG-satellietdata, 30 procent beter dan MRMS-radardata, en 10 procent beter dan regenmeters op de grond. Die drie cijfers komen niet van Brightband. Ze komen van Google DeepMind, dat zijn eigen model afzet tegen datasets die het zelf heeft gekozen.

Geverifieerde temperatuurnauwkeurigheid, zelfgerapporteerde neerslagnauwkeurigheid

ClaimWie heeft het gemeten
Laagste foutmarge op temperatuur op 2 meter, 26 van de laatste 30 dagen (augustus 2026)Brightband, onafhankelijke derde partij
Tot 60 procent beter dan IMERG op neerslagGoogle DeepMind, zelfgerapporteerd
Tot 30 procent beter dan MRMS op neerslagGoogle DeepMind, zelfgerapporteerd

Dat onderscheid telt vooral voor de twee industriële toepassingen die Google in zijn eigen bericht noemt: het inschatten van turbineopbrengst op basis van windsnelheidsvoorspellingen op 100 meter hoogte, en het voorspellen van bewolking en zonnestraling voor zonneparken. Windproductie noch zonnestraling is temperatuur. De metriek die een exploitant daadwerkelijk onafhankelijk gecontroleerd zou willen zien, neerslag- en bewolkingsnauwkeurigheid, staat aan de zelfgerapporteerde kant van de tabel, terwijl de metriek die toevallig onafhankelijk geverifieerd is, temperatuur, niet degene is waarvan die twee toepassingen afhangen.

Niets hiervan betekent dat de neerslagcijfers fout zijn. DeepMind heeft een sterke staat van dienst op het gebied van weer, en het eigen klassement van Brightband is bewijs dat het onderliggende model werkelijk capabel is. Het betekent dat een exploitant van een windpark of zonnepark die de productie op basis van deze data aanstuurt, vertrouwt op een mix van een gecontroleerde score en een door de leverancier gerapporteerde score, gepresenteerd in dezelfde aankondiging zonder aan te geven welke welke is.