Verslaat context het gemiddelde?
De testperiode april–juni 2026 is niet gebruikt om het model te passen. Hier staat de technische toets, de foutmaat en de volgende bewijsgrens—zonder de productpresentatie op Home te onderbreken.
Wat dit aantoont
De volledige modelketen kan context, capaciteit en uitzonderingen verwerken en levert op deze reproduceerbare simulatie een duidelijk lagere fout dan dezelfde weekdag in de vier voorgaande weken.
Wat een pilot nog moet aantonen
Dezelfde winst moet opnieuw zichtbaar worden op echte, ongeziene restaurantdagen. Daarom blijven forecastvintages, bronkwaliteit, ondernemerscorrecties en realisatie afzonderlijk bewaard.
Niet alleen gemiddeld goed
MISE splitst dezelfde testset uit naar dagsoort en weerregime. Zo blijft zichtbaar waar de fout, richting en 80%-band betrouwbaar zijn — en waar nog te weinig bewijs bestaat.
Dagsoort
Weerregime
Zeven aparte vintages, één eerlijke bronstatus
T−1 gebruikt de bestaande modelvintage. T−2 tot en met T−7 zijn afzonderlijk uitgegeven, reproduceerbare showcase-reconstructies zonder de latere realisatie als invoer. Ze bewijzen de horizonwerking van het product, niet de commerciële nauwkeurigheid van een productiepilot.
Chronologisch kalibreren, daarna pas toetsen
De eerste 32 dagen bepalen uitsluitend de foutmarge. De latere 33 dagen blijven onaangeraakt voor de beoordeling. Zo wordt de te smalle band hersteld zonder op die validatiedagen te passen.
- Kalibratie
- — vroegste testdagen
- Validatie
- — latere, onaangeraakte dagen
- Foutmarge
- — 80%-conformalscore
- Dekking
- — schaduwtest wordt berekend