Zum Inhalt springen
Proaktive Sicherheitsupdates

Monitoring & Notfall

Ein Ausfall wird teuer, wenn er erst durch einen Kundenanruf auffällt. Diese Kategorie behandelt Überwachung und Reaktion: Verfügbarkeitsprüfungen aus mehreren Netzen, Kontrolle kritischer Abläufe wie Warenkorb und Bestellabschluss, Zertifikats- und Domainfristen, Fehlerraten und Antwortzeiten, Speicherplatz und Warteschlangen. Wir zeigen, wie Schwellenwerte gesetzt werden, damit Meldungen ernst genommen werden statt im Rauschen unterzugehen, und wie ein Bereitschaftsablauf mit klaren Zuständigkeiten aussieht. Dazu kommen Wiederanlaufpläne: Welche Sicherungen existieren, wie lange dauert eine Wiederherstellung tatsächlich, wer informiert Kundschaft und Dienstleister? Auch Nachbereitung und Ursachenanalyse nach einer Störung gehören dazu. Ergänzend geht es um Kommunikation: welche Informationen Kundschaft und Dienstleister im Störungsfall brauchen und wer sie freigibt.

DNS-Störung .de am 5. Mai 2026: Shop lief, Kunden sahen SERVFAILServer, Shopsystem, Zertifikat: einwandfreiAuflösung der Domain: SERVFAILSignaturkette der .de-ZoneWas verschiedene Resolver daraus machenRoot-Zone: DS-Record für .de.de-Zone: DNSKEY veröffentlichtRRSIG mit Key-Tag 33834 - nicht validierbarshop.de: A-Record unverändert korrektAuch unsignierte .de-Domains betroffen (NSEC3-Beweis)Validierender Resolver (DNSSEC-Prüfung aktiv)Signatur prüfenErgebnis: BogusSERVFAIL an den KundenKunde hinter öffentlichem oder Unternehmens-Resolver: Shop existiert nichtNicht validierender Resolver (Prüfung inaktiv)Keine PrüfungAntwort akzeptiertShop erreichbar - HTTP 200Uptime-Check von diesem Standort: grün - der Ausfall bleibt unsichtbarVerlauf der Störung - 5./6. Mai 2026 (DENIC eG, heise online)21:43 Uhrerste fehlerhafte RRSIG21:50 UhrMonitoring schlägt an00:08 Uhrkorrigierte Zone verteilt01:15 UhrBetrieb wiederhergestellt3 Std.Störungsdauer der .de-Zone(DENIC eG)33 %validierbare .de-Signaturen(DENIC eG)18 Mio.registrierte .de-Domains(DENIC eG, Juni 2026)DNS-Wartung: Signaturkette, Registry-Lock und resolver-differenziertes Monitoring als eigene Ebene
Monitoring & Notfall 20. Juli 2026

DNS-Wartung für Shops: DNSSEC, Locks und Monitoring

Der DENIC-Ausfall vom 5. Mai 2026 zeigte: Ein Shop kann unerreichbar sein, obwohl alles läuft. DNSSEC-Kette, Domain-Locks und Resolver-Monitoring warten.

13 Min. Lesezeit
Reaktionszeit-SLA: Severity, MTTR und EskalationSeverity-Stufen — Reaktion und Lösung (MTTR)StufeReaktionLösung (MTTR)BetriebP1 kritisch15 Min4 Std24/7P2 hoch1 Std8 Std24/7P3 mittel4 Gesch.-Std24 Std8x5Eskalationskette (P1)1Alarm ausgelöstMonitoring erkennt Ausfall · 0 Sek2L1 Bereitschaftreagiert und bestätigt · Ziel 15 Min3L2 TechnikerAuto-Übergabe nach 15 Min ohne Antwort4L3 Team-Leadfalls nach 30 Min noch ungelöstIncident-Verlauf (heute)02:14Alarm: Checkout nicht erreichbarals P1 eingestuft02:16L1 Bereitschaft bestätigtReaktion (MTTA) 2 Min02:41Ursache isoliert, Fix aufgespieltim Staging geprüft02:56Behoben: Checkout wieder onlineLösung (MTTR) 42 Min · SLA erfüllt
Monitoring & Notfall 3. Juli 2026

Reaktionszeit-SLA: Was guter Notfall-Support kann

Reaktionszeit-SLA für Online-Shops: Severity-Stufen P1 bis P4, realistische MTTR-Werte und woran Sie verlässlichen Notfall-Support erkennen.

13 Min. Lesezeit
Was ein Shop-Ausfall pro Minute kostetDirekter Umsatzverlust2.000 EUR+pro Minute (KMU-Shop, Stoßzeit)Indirekte Folgekosten5- bis 10-fachReputation, Abwanderung, CLV-VerlustKostenkurve während des Ausfalls0-2 Min5 Min10 Min20 Min30 Min45 Min60 MinErkennung < 2 Min15.000 $Spitzenwert pro Minutebranchenweiter Durchschnittgroßer Organisationen 2026600 Mrd. $jährliche AusfallkostenGlobal-2000-Unternehmen,plus 50 Prozent in zwei Jahren3,4 %Aktienkurs-Rücksetzerim Schnitt nach einemeinzelnen Ausfallvorfall24/7-Monitoring meldet den Ausfall, bevor der erste Kunde ihn bemerkt
Monitoring & Notfall 1. Juli 2026

Ausfallkosten 2026: Was ein Shop-Ausfall pro Minute kostet

Was ein Shop-Ausfall 2026 pro Minute kostet: direkte und indirekte Kosten, warum Erkennung in unter 2 Minuten zählt und wie 24/7-Monitoring schützt.

12 Min. Lesezeit
Performance-Monitoring im WartungsvertragLive-Dashboard: Uptime + Antwortzeit + Core Web Vitals + SLA-ReportingUptime (30 Tage)99,96%Ziel-SLA 99,9%Antwortzeit p75248msBudget 400msLCP p751,9sSchwelle 2,5sAntwortzeit-Verlauf gegen SLA-ZielwertSLAAlert: Antwortzeit-Regression erkanntAuslöser: p75 248ms überschreitet Budget kurzUrsache: neues Plugin nach Update (Regression-Watch)Eskalation: E-Mail sofort, dann SMS nach 5 MinStatus: bestätigt, Rollback im WartungsfensterMonatsreportSLA erfülltVerfügbarkeit99,96%Ø Antwortzeit212msCWV-Status3/3 gutIncidents10,1s schnellere Ladezeit = +8,4% Conversions im Handel (Google/Deloitte, Milliseconds Make Millions)
Monitoring & Notfall 19. Juni 2026

Performance-Monitoring im Wartungsvertrag verankern

Performance-Monitoring als fester SLA-Bestandteil: Performance-Budgets, Alerts, Monatsreports und Regression-Watch für dauerhaft schnelle Online-Shops.

13 Min. Lesezeit
Log-Monitoring und Alerting für Online-Shops1. Log-QuellenWebserver (nginx/Apache)Shopware PHP-FPMMySQL Slow-Query-LogPayment-/API-GatewayCronjobs und Worker2. Aggregation und ParsingZentrale Log-Pipeline (JSON)level=ERROR trace_id=a91f order_id=10493level=WARN status=502 route=/checkoutlevel=INFO event=payment.ok 245msIndex + Volltextsuche + RetentionLogs - Metriken - Traces korreliert über trace_id3. Alert-RegelnFehlerrate 5xx > 2%über 5 Min - kritischp95-Latenz > 2sCheckout - WarnungAnomalie: 0 Bestellungenin 15 Min - kritisch4. Eskalation und On-CallStufe 1Chat + Push sofortStufe 2SMS nach 5 MinStufe 3Anruf On-Call nach 15 MinStufe 4Leitung nach 30 MinAlarm-Müdigkeit vermeidenSymptom-basiert, dedupliziert, mit SeverityNur handlungsrelevante Alerts erreichen On-CallIncident-ReaktionRunbook - Diagnose über trace_id - PostmortemMTTR senken statt nur MTBF zählenErgebnis: Probleme im Shop frühzeitig sichtbar - präzise Alerts - schnelle DiagnoseStrukturiertes Logging | Log-Level | Aggregation | Schwellenwerte | Anomalien | On-Call | Postmortem
Monitoring & Notfall 3. Juni 2026

Log-Monitoring und Alerting für Online-Shops einrichten

Strukturiertes Logging, zentrale Log-Aggregation, sinnvolle Alerts und Eskalation: So erkennen Sie Probleme im Online-Shop, bevor Ihre Kunden sie melden.

13 Min. Lesezeit
Checkout-Monitoring: stiller Ausfall der BestellstreckeUptime-Signal: HTTP 200 OKUmsatz: 0 BestellungenSynthetischer Transaktions-Check - Kauf-Funnel im Minutentakt aus 3 Regionen1. ProduktseitePreis 49,90 €Bestand: verfügbarOK 210 ms2. WarenkorbArtikel im CartGutschein -10%OK 340 ms3. CheckoutAdresse geprüftVersand berechnetOK 520 ms4. ZahlungGateway-TimeoutOTP-Schritt verlorenFEHLER 4/4!Transaktions-Check fehlgeschlagenSchritt 4/4 - Zahlung: Gateway-Timeout3 von 3 Regionen bestätigen den FehlerSchwelle: 2 Fehlläufe / 2 Regionen erreichtDrei Ebenen - eine SichtUptime: erreichbar? (grün, aber blind)Log: Backend-Fehler? (kein Eintrag)Transaktion: Kauf möglich? (Fehler)70%durchschnittlicher Kaufabbruch(Baymard Institute)15%Abbruch durch Shop-Fehler(Baymard Institute)+8,4%Conversion je 0,1 s schneller(Deloitte)Synthetisches Transaktions-Monitoring erkennt den stillen Ausfall, bevor der Umsatz einbricht
Monitoring & Notfall 18. Mai 2026

Checkout-Monitoring: defekte Bestellstrecke erkennen

Synthetisches Transaktions-Monitoring erkennt stille Checkout-Ausfälle: Warenkorb, Gutschein und Zahlung im Minutentakt prüfen, bevor der Umsatz einbricht.

12 Min. Lesezeit