Burchard Monitoring

Burchard Monitoring

Leitstand
Aktueller Zustand aller überwachten Umgebungen — auf zwei getrennten Ebenen: Statuswort und App-Score (0–100) bewerten nur die Plattform selbst (Verfügbarkeit, Health, Datenbank, offene Fehlergruppen, Hintergrund-Jobs; ein Ausfall setzt den Score immer auf 0). Probleme einzelner Mandanten (fehlende Webhooks, Warteschlangen-Fehler, kaputte Kunden-Domain) stufen die App nicht herab — sie erscheinen im Mandanten-Chip mit eigenem Zustand und Score und alarmieren als „Mandant gestört". Der Mandanten-Score ist gestaffelt: Basis 100, kleine begründete Abzüge (ein hängender Warteschlangen-Eintrag −5, Schutzschalter −20, Shop getrennt −50, toter Daten-Zufluss = 0); jeder Abzug steht im Tooltip der Zeile. „Auffällig" heißt also nur: da ist etwas anzusehen — nicht: der Mandant ist halb krank. „Betrieb" zeigt die Verarbeitung aller Mandanten zusammen, ebenfalls ohne die App zu bewerten.

Offene Vorfälle — bitte ansehen

ZeitStatusVorfallApp / MandantAktion
Vorfälle
Ein Vorfall entsteht automatisch, wenn eine Regel anschlägt: Ziel ausgefallen, Hintergrund-Job überfällig, neue Fehlerart aufgetreten oder Fehler-Anstieg. Bestätigen = „ich kümmere mich" (stoppt die Eskalations-Erinnerung) · Beheben = erledigt. Ausfälle und wieder aktive Jobs schließen sich selbst.
Fehlergruppen
Gleiche Fehlerart = eine Gruppe (Auftragsnummern, IDs usw. werden dafür neutralisiert): 50 gleiche Importfehler erscheinen als eine Zeile mit Zähler. Beheben nach Ursachen-Fix — tritt der Fehler erneut auf, öffnet sich die Gruppe automatisch wieder („N× wieder"). Stumm = bekannt, bewusst ignorieren.
StatusFehlerApp / MandantAnzahlZuerstZuletztVersionAktion
Hintergrund-Jobs
Jeder wiederkehrende Job der Apps meldet ein Lebenszeichen (Heartbeat). Bleibt es länger als das 3-fache des erwarteten Intervalls aus, gilt der Job als überfällig → Vorfall + Alarm. Meldet er sich wieder, schließt sich der Vorfall von selbst.
AppMandantJobLetztes LebenszeichenErwartet alleStatusDauerMenge
Controlling
Nutzungszahlen der letzten 14 Tage je App, Mandant und Ereignis-Typ — z. B. wie viele Bestellungen importiert oder Angebote angenommen wurden. Grundlage für Auswertungen und später für die Abrechnung.
AppMandantEreignis14 Tage24 h
Ziele
Die überwachten Umgebungen. „Nur Ping" prüft Erreichbarkeit + Version; die Tiefen-Checks „woo-admin" (WooCommerce-App) und „portal-admin" (Angebotsportal) lesen zusätzlich interne Kennzahlen und die Mandanten-Sicht (brauchen den Admin-Zugang der App). Leeres Passwort beim Speichern = gespeichertes behalten. Änderungen wirken sofort.
Name*AnzeigeBasis-URL*Tiefen-CheckAdmin-UserAdmin-Passwort
Einstellungen
Alles wird hier im Dashboard verwaltet und sofort wirksam — kein Neustart, kein Serverzugriff nötig. Passwörter und Tokens verlassen den Server nie wieder, nachdem sie gespeichert sind.

E-Mail-Alarme (SMTP)

Host
Port
TLS (465)
aktiv = SMTPS/465, sonst STARTTLS/587
Benutzer
Passwort
Absender
Empfänger

Alarm-Kanäle & Regeln

Teams-Webhook-URL
Eskalation nach
Min. unbestätigt → Erinnerung (0 = aus)
Surge-Schwelle
Fehler je Gruppe in 15 Min → Alarm

Push-Benachrichtigungen (dieses Gerät)

Alarme (Ausfall, Wieder-OK, neue Fehlerarten, überfällige Jobs) zusätzlich als Push auf dieses Gerät — auch bei geschlossener App.
iPhone/iPad: zuerst in Safari über Teilen → „Zum Home-Bildschirm" installieren und die App von dort öffnen — erst dann erlaubt Apple Push (ab iOS 16.4).
Status
–
Geräte-Abos
–
Anmeldungen
–

Telemetrie (Ingest-Tokens je App)

AppToken
Die App sendet Events per POST /api/v1/events mit Authorization: Bearer <Token>. Der volle Token ist nur direkt nach dem Erzeugen sichtbar.