Technik zur Nachverfolgung und Korrelation von Anfragen über mehrere Dienste, um Performance-Probleme und Fehlerursachen in verteilten Systemen sichtbar zu machen.
Distributed Tracing ist eine Technik zur Erfassung und Korrelation von Anfragen über mehrere Dienste hinweg, um Leistung zu analysieren und Fehler in verteilten Systemen zu diagnostizieren. Es protokolliert Spans und Trace-Kontext über Prozess- und Netzwerkgrenzen, ermöglicht Ursachenermittlung, Latenzaufteilung und Abhängigkeitsanalyse für bessere Observability.
Mittlere Dauer einer verteilten Anfrage gemessen über Traces.
Prozentsatz der Traces, die Fehler oder Ausnahmen enthalten.
Durchschnittliche Anzahl von Spans in einem Trace als Granularitätsindikator.
Einsatz von Jaeger zur Sammlung, Visualisierung und Analyse von Traces in einer Microservice-Umgebung.
Bibliotheken nutzen, um automatisch HTTP-Requests zu instrumentieren und Trace-Kontext weiterzureichen.
Komplette Request-Traces speichern, um einen Fehlerpfad über mehrere Dienste nachzuvollziehen.
Anwendungsbibliotheken mit OpenTelemetry instrumentieren und Trace-Kontext propagieren.
OpenTelemetry Collector einrichten und Exporter konfigurieren.
Trace-Sampling, Retention und Speicherschicht an SLA und Kosten anpassen.