Zum Hauptinhalt springen
Version: 3.1
Betrieb & Sicherheit

Prometheus

Sammelt und speichert Metriken der Plattform.

Prometheus ist ein Open-Source-System zur Erfassung, Speicherung und Auswertung numerischer Zeitreihen. Es ruft Metrikendpunkte in regelmäßigen Abständen ab, versieht Messwerte mit Labels und speichert sie lokal. Mit PromQL lassen sich Zeitreihen auswählen, miteinander verrechnen und zu technischen Zustandsaussagen verdichten.

Die wichtigsten Konzepte sind:

  • Targets und Scraping bestimmen, welche Metrikendpunkte regelmäßig abgefragt werden.
  • Labels beschreiben eine Zeitreihe beispielsweise durch Dienst, Namespace, Pod oder Statuscode.
  • ServiceMonitor und PodMonitor machen Kubernetes-Workloads über den Prometheus Operator auffindbar.
  • Recording Rules berechnen wiederverwendbare Zeitreihen aus häufig benötigten Abfragen.
  • Alerting Rules erzeugen einen Alarmzustand, wenn ein PromQL-Ausdruck die definierte Bedingung erfüllt.

Prometheus in der UDSP

Prometheus bildet die Metrikbasis des zentralen Observability-Stacks. Der Rollout verwendet den kube-prometheus-stack und erfasst dadurch den Zustand des Kubernetes-Clusters, seiner Knoten und Workloads sowie zusätzliche ServiceMonitor-Ziele. PostgreSQL- und Patroni-Exporter ergänzen die Plattformmetriken um Datenbankzustände; weitere Komponenten wie APISIX, Loki oder Velero können eigene Metriken bereitstellen.

Prometheus wertet außerdem die mitgelieferten Betriebsregeln aus. Ein ausgelöster Alarm wird an Alertmanager übergeben. Für Dashboards und technische Analysen fragt Grafana Monitoring die gespeicherten Zeitreihen über PromQL ab. Prometheus selbst speichert keine fachlichen Sensor-, Kontext- oder Nutzdaten.

Die lokale Speicherung ist durch storage_size und retention_days begrenzt. Wird Thanos aktiviert, kann ein zusätzlicher langfristiger Metrikpfad über externen S3-Speicher aufgebaut werden; dieser ersetzt nicht die lokale Betriebsfähigkeit von Prometheus.

Technische Abhängigkeiten

Prometheus nutzt die im Observability-Stack bereitgestellten Alarm- und Exportpfade. Die überwachten Anwendungen bleiben selbstständig und sind keine Startvoraussetzung.

Alertmanager
Alarmzustellung · 0.28.1

Alertmanager

Übernimmt ausgelöste Alarme aus Prometheus, gruppiert sie und leitet sie an konfigurierte Empfänger weiter.

Komponente öffnen
Optionale zusätzliche Messziele

Metrik-Exporter

Stellen technische Zustände von Nodes, PostgreSQL und Patroni als Prometheus-Metriken bereit.

Komponente öffnen

Konfiguration und Deployment

inv_ml.enable aktiviert den gemeinsamen Observability-Stack. Unter inv_ml.prometheus werden Instanzzahl, PVC-Größe und Aufbewahrungsdauer festgelegt. Die Exporter besitzen eigene Schalter unter inv_ml.exporters; Thanos wird unabhängig davon im gleichnamigen Block konfiguriert.

Alle Felder sind unter Plattformbasis konfigurieren: Observability und Backup beschrieben. Das Monitoringkonzept und der Signalweg zu Grafana und Alertmanager werden unter Observability und Monitoring eingeordnet.

Rollen und Rechte

Die UDSP legt für Prometheus keine Keycloak-Client-Rollen an und veröffentlicht die Prometheus-Oberfläche im Standard nicht als regulären Nutzerzugang. Berechtigungen entstehen auf der technischen Ebene:

Erfassung

Prometheus ServiceAccount

Entdeckt freigegebene Kubernetes-Ziele und liest deren technische Metrikendpunkte.

Auswertung

Grafana-Datenquelle

Fragt PromQL über den internen Dienst ab und visualisiert die freigegebenen Betriebsmetriken.

Administration

Plattformbetrieb

Verwaltet ServiceMonitor-, Regel- und Aufbewahrungskonfigurationen über den Deployment-Prozess.

Metrikendpunkte dürfen keine Secrets oder personenbezogenen Nutzdaten als Labels enthalten. Änderungen an Scrape-Zielen und Regeln können Reichweite, Kosten und Alarmverhalten der gesamten Plattform beeinflussen und gehören deshalb in einen nachvollziehbaren technischen Freigabeprozess.

Referenzen