Hvad er high availability?
High availability (HA, høj tilgængelighed) er princippet om at designe systemer, der tåler fejl uden at gå ned. Hardware fejler, disks dør, strøm forsvinder, og opdateringer kræver genstart. Det er ikke undtagelser, men driftsvilkår. Et højtilgængeligt system er bygget, så ingen af de hændelser rammer brugerne: driften fortsætter på den redundante komponent, mens den fejlede repareres.
Grundopskriften har to ingredienser: redundans, altså at alt kritisk findes i mindst to eksemplarer (servere, netværk, strøm, internetforbindelser), og automatisk failover, der opdager fejlen og flytter trafikken uden at vente på et menneske.
Nierne: hvad koster oppetid?
Tilgængelighed måles som oppetid i procent ("nierne"):
- 99 % ≈ 3,7 døgns nedetid om året
- 99,9 % ("tre niere") ≈ 8,8 timer om året
- 99,99 % ≈ 53 minutter om året
- 99,999 % ("fem niere") ≈ 5 minutter om året
Hvert ekstra ni-tal kræver mere redundans, mere automatik og flere tests, og prisen stiger derefter. Derfor er det rigtige spørgsmål ikke "hvor mange niere kan vi få?", men "hvad koster en times nedetid os pr. system?". Webshoppen og økonomisystemet har sjældent samme svar. Kravet fastlægges pr. system og skrives ind i jeres SLA, så leverancen kan måles.
High availability vs. disaster recovery
De to forveksles ofte, men løser forskellige problemer:
- High availability beskytter mod komponentfejl i hverdagen: en død server, en netværksfejl, en genstart. Reaktionen er automatisk og måles i sekunder.
- Disaster recovery håndterer katastrofen: ransomware, brand, tab af et helt datacenter. Reaktionen følger en plan og måles i timer.
Pointen: HA erstatter hverken backup eller DR. Et fuldt redundant system replikerer også ransomware-krypterede data i realtid: perfekt tilgængeligt og perfekt ødelagt. I skal bruge begge dele, dimensioneret efter systemernes kritikalitet.
Sådan opnås high availability i praksis
I moderne drift ligger værktøjerne klar: serverklynger og virtualisering med automatisk failover, load balancere foran webapplikationer, redundante internetforbindelser og strømforsyninger, og i cloud-platforme som Azure indbyggede tilgængelighedszoner, hvor arbejdsbelastninger spredes over fysisk adskilte datacentre. Mindst lige så vigtigt er overvågning: fejl på den redundante komponent skal opdages med det samme, ellers kører I uden sikkerhedsnet uden at vide det.
Sådan hjælper MI Support IT
Vi designer og drifter højtilgængelige miljøer for danske SMV'er: redundant IT-hosting og cloud-løsninger, overvågning døgnet rundt og klare SLA'er, kombineret med den backup og beredskabsplan, der griber jer, når katastrofen alligevel indtræffer. Kontakt os, hvis nedetid er begyndt at koste rigtige penge.