Zum Hauptinhalt springen
Betrieb und Monitoring

Ein Dashboard, das immer grün ist, wird nicht gelesen

Dashboards beantworten Fragen, die in dem Moment niemand gestellt hat, in dem niemand hinsieht. Sie zeigen den aktuellen Zustand fortlaufend und ändern ihn still, sodass der Übergang (das, was tatsächlich zählt) unbemerkt bleibt, außer jemand hat gerade dieses Panel offen.

Eine Zusammenfassung arbeitet andersherum. Sie kommt an, sie wird einmal gelesen, und sie sagt, was sich gegenüber der letzten unterscheidet. Ein sechs Monate gesunder Service braucht eine Zeile. Der, der über Nacht Fehler zurückzugeben begonnen hat, braucht den Anfang.

Der zweite Fehlermodus ist Abdeckung. Jedes Team hat einen Service, den niemand überwacht, weil er während einer Migration eingerichtet wurde, und eine Zusammenfassung aus einer ausdrücklich genannten Liste macht seine Abwesenheit sichtbar.

Prüfen ist günstig. Etwas zu erzeugen, das ein Mensch in 30 Sekunden lesen und dem vertrauen kann, ist der Teil, der sich zu bauen lohnt.

So läuft der ActionFlow auf der Canvas

Ein Start Scheduled-Knoten führt die Prüfung in Ihrem Intervall aus, und ein Loop-Knoten geht die Serviceliste durch, die Sie erklären, nicht das, was zufällig registriert ist.

Ein HTTP Request-Knoten ruft jeden Health-Endpoint in der Schleife auf, und ein Validate-Knoten prüft die Antwort gegen das, was gesund für diesen Service bedeutet (ein Statusfeld, eine Version, eine Abhängigkeitsliste), statt einen 200 als Antwort zu akzeptieren.

Ein Math-Knoten berechnet die Antwortzeit relativ zur eigenen Baseline des Service, weil ein Service, der sonst in 40 Millisekunden antwortet und jetzt 400 braucht, beeinträchtigt ist, während er noch oben ist.

Ein PostgreSQL-Knoten hält den vorherigen Lauf, und ein Merge-Knoten verbindet ihn, sodass die Zusammenfassung Übergänge berichtet, nicht Zustände.

Ein Filter-Knoten teilt die Ergebnisse in geändert, fehlschlagend und stabil, und ein Sort-Knoten setzt die Änderungen zuerst.

Ein Generate Text-Knoten schreibt die Zusammenfassung in klarer Sprache, nennt was sich geändert hat und reduziert die stabilen Services auf eine Zahl.

Ein Slack-Knoten postet sie, und ein If-Knoten leitet alles Fehlschlagende auf Ihren Alerting-Pfad, statt es in einer Zusammenfassung zu lassen, die eine Stunde lang niemand lesen mag.

Knoten, die dieser ActionFlow verwendet

  • Start Scheduled (Start): das Prüfintervall, das Sie wählen.
  • Loop (Control): geht eine erklärte Serviceliste durch, sodass Lücken in der Abdeckung sichtbar sind.
  • HTTP Request (Util): ruft jeden Health-Endpoint auf.
  • Validate (Data): prüft den Response-Body, nicht nur den Statuscode.
  • Math (Util): Antwortzeit gegen die eigene Baseline dieses Service.
  • PostgreSQL (Data) with Merge (Control): der vorherige Lauf, damit Übergänge berichtet werden können.
  • Generate Text (AI Core): die Zusammenfassung, stabile Services auf eine Zahl reduziert.
  • Slack (Communication) with If (Control): postet die Zusammenfassung. Fehlschläge nehmen den Alerting-Pfad.

Häufige Fragen

KI-Workflows bauen

Legen Sie ein kostenloses Konto an, öffnen Sie eine Vorlage oder eine leere Fläche und führen Sie Ihren ersten ActionFlow aus.

Newsletter

Produktupdates erhalten

Neue Nodes, Agents und Produktnotizen. Wir senden E-Mails nur, wenn sich das Öffnen lohnt.

Sie können das Abonnement jederzeit beenden.