- Bij grote aantallen is niet snelheid het probleem maar wat er gebeurt bij een fout
- Ontwerp op herhaalpogingen, meldingen en handmatige beoordeling
- Stilletjes stoppen is de duurste faalwijze die er is
Systemen die tienduizend berichten per dag verwerken, gaan zelden stuk op de tienduizend berichten. Ze gaan stuk op de drie berichten die niet aan de verwachting voldoen, en op de vraag wat er dan moet gebeuren.
De duurste fout
De duurste faalwijze is een koppeling die stilletjes stopt. Er komt geen melding, er wordt niets verwerkt, en niemand merkt het tot een opdrachtgever belt dat hij al twee dagen geen statusupdate heeft gehad. De schade zit dan net zo goed in de relatie als in de operatie.
Waarop u ontwerpt
- Herhaalpogingen bij tijdelijke storingen, met oplopende wachttijd zodat u de tegenpartij niet overbelast.
- Een duidelijke grens tussen tijdelijk falen en definitief falen, want die vragen om verschillende afhandeling.
- Een wachtrij voor berichten die handmatige beoordeling nodig hebben, met de reden erbij.
- Actieve bewaking die meldt bij uitblijven van verkeer, niet alleen bij fouten.
Dat laatste is het belangrijkst
Bewaking op fouten vangt een systeem dat verkeerde dingen doet. Bewaking op uitblijven van verkeer vangt een systeem dat niets doet, en dat is de situatie die het langst onopgemerkt blijft. Een simpele controle die meldt dat er sinds twee uur niets is binnengekomen, voorkomt de meeste ellende.
Doorstroom boven snelheid
Bij hoge volumes is het zelden nodig dat een enkel bericht in milliseconden wordt verwerkt. Wel is het nodig dat de stroom niet stokt als er een piek is of als de tegenpartij traag reageert. Dat is een andere ontwerpvraag, en die stellen wij aan het begin in plaats van na de eerste storing.


