Peter Dümig: „Je nach Dauer und betroffener Branche reichen die Auswirkungen eines Ausfalls von lästig bis katastrophal.“
ITD: Herr Dümig, ein betriebssicheres Rechenzentrum (RZ) ist für Unternehmen von existenzieller Bedeutung. Was sind die häufigsten Ursachen von Ausfällen oder Unterbrechungen?
Peter Dümig: Nach meiner Erfahrung sind menschliches Versagen oder Fehler im Design die häufigsten Ursachen für Ausfälle. Sogar in multinationalen Großkonzernen kommt es zu solchen Bedienfehlern, die teilweise globale Infrastrukturen lahmlegen. Fehler in der Soft- oder Hardware, die Ausfälle oder Unterbrechungen verursachen, sind eher selten.
ITD: Welche Auswirkungen kann ein kompletter Ausfall für die betroffenen Nutzer haben?
Dümig: Je nach Dauer und betroffener Branche reichen die Auswirkungen eines Ausfalls von lästig bis katastrophal. In manchen Fällen kann der Betrieb auch einfach an dem Punkt wieder einsetzen, an dem es zum Ausfall kam. Dann kostet ein solcher Vorfall möglicherweise nur Produktivität und Nerven. Meistens kommt es aber zu Umsatzeinbußen oder Reputationsverlust – im schlimmsten Fall in einem Ausmaß, der das ganze Unternehmen gefährden kann. Besonders dort, wo keine Recovery-Pläne oder Fail-over-Systeme vorhanden sind, wird ein kompletter Ausfall schnell zum Worst-Case-Szenario.
ITD: Welche Aspekte sind für die physikalische Sicherheit und Hochverfügbarkeit eines RZ entscheidend?
Dümig: Wichtig sind zunächst Redundanzen, etwa in der Stromversorgung, der Kühlung, dem Netzwerk, aber auch redundante Rechenzentren als Ganzes. Diese greifen in allen Fällen, in denen ein Ausfall nicht vollständig ausgeschlossen werden kann. Zudem wird der Faktor Lokation immer wichtiger. Von Bedrohungen wie Unwettern oder Hochwasser sind auch deutsche Rechenzentren vermehrt betroffen. Zudem muss die Zugangssicherheit gewährleistet sein, also der Schutz vor unbefugtem Zutritt. Genauso sollten sie gegen Feuer und Staub abgesichert werden.
ITD: Wie wird die Betriebssicherheit in modernen Rechenzentren sichergestellt?
Dümig: Die Grundsätze der Betriebssicherheit gelten unverändert auch für Rechenzentren, aber moderne RZ-Architekturen sind hier oft im Vorteil, weil sie by design resilienter gestaltet sind. So können etwa Software-defined-Infrastrukturen und Virtualisierung helfen, Ausfälle abzufedern. Genauso profitieren moderne Rechenzentren von Colocation-Szenarien und der Cloud als Fail-over-Lösung.
Dies ist ein Artikel aus unserer Print-Ausgabe 6/2022. Bestellen Sie ein kostenfreies Probe-Abo.
ITD: Inwiefern lässt sich überprüfen, wie robust ein Rechenzentrum tatsächlich ist?
Dümig: Als Betreiber eines Rechenzentrums kann man viele Szenarien theoretisch durchspielen, aber wie robust die eigene Infrastruktur wirklich ist, lässt sich nur auf einem Weg herausfinden – man probiert es aus. Solche Tests sind aufwendig und natürlich immer mit Risiken verbunden, daher werden sie meist gescheut. Trotzdem ist es ratsam, Ausfallszenarien nicht auszuschließen, zu testen und sich darauf entsprechend vorzubereiten. Gute Planung ist im Ernstfall Gold wert.
Bildquelle: Dell Technologies