Definition
Die Gesamtzeit vom Absenden einer Anfrage an ein System bis zur Fertigstellung und Rückgabe des Ergebnisses für diese spezifische Anfrage oder Transaktion.
Prinzip
Prinzip
Antwortzeit besteht aus Warteschlangen/Wartezeit, Verarbeitungs-/Servicezeit und Kommunikationslatenz; sie kann pro Anfrage gemessen, gemittelt oder als Perzentile der Schwanzverteilung analysiert werden — die Wahl der Messung beeinflusst die Interpretation für Nutzererlebnis und SLA‑Einhaltung.
Demonstration
Demonstration
Eine HTTP‑API, die ein POST empfängt, die Aufgabe 5 ms in die Warteschlange stellt, sie in 50 ms verarbeitet und mit 20 ms Netzwerkrundlaufzeit antwortet, hat eine beobachtete Antwortzeit von ~75 ms; die Messung des 99. Perzentils über Anfragen zeigt, ob seltene langsame Anfragen das Nutzererlebnis beeinträchtigen.
Fehlanwendung
Fehlanwendung
Nur die durchschnittliche Antwortzeit zur Beurteilung der Leistung zu verwenden und dabei Tail‑Latenzen zu ignorieren oder Antwortzeit mit Durchsatz zu verwechseln; z. B. kann ein System mit niedriger mittlerer Latenz, aber sehr hohem 99,9‑Perzentil zu schlechtem Verhalten unter Last führen.
Konsequenz
Konsequenz
Kontrolle der Antwortzeit verbessert die wahrgenommene Performance, erfüllt SLAs und kann Abbrüche reduzieren; Optimierungen erfordern oft Reduktion von Warteschlangen, Parallelisierung oder Priorisierung kritischer Anfragen.
Umkehrung
Umkehrung
Wird stattdessen nur auf Durchsatz fokussiert, kann das System maximale Anfragen/s erreichen auf Kosten hoher Antwortzeiten und schlechter Interaktivität; andererseits kann die Minimierung der Antwortzeit für alle Anfragen zu unverhältnismäßigen Kosten führen.
Abgrenzung
Abgrenzung
Antwortzeit gilt für eine einzelne Anfrage oder Transaktion und schließt Hintergrund‑asynchrone eventual‑consistency‑Operationen aus, sofern sie die beobachtbare Fertigstellung nicht beeinflussen; die Messung muss Stichprobenmethode, Zeitursprung (Client vs Server) und Umfang angeben.
Semantische Spannung
Semantische Spannung
Oft synonym mit Latenz verwendet, obwohl Latenz auch eine Einwegnetzwerkverzögerung bedeuten kann, während Antwortzeit die Serververarbeitung einschließt; Spannungen bestehen auch zum Durchsatz (Anfragen/s), da Trade‑offs zwischen niedriger Latenz und hohem Durchsatz bestehen.
Synthese
Synthese
Antwortzeit ist die End‑to‑End‑Dauer, die für eine Anfrage erlebt wird, zusammengesetzt aus Wartezeit, Verarbeitung und Kommunikationsverzögerungen; aussagekräftige Bewertung erfordert Perzentilanalyse und eindeutige Messdefinitionen im Kontext von Nutzerwirkung oder SLA‑Zielen.