Definition
Der Prozess, Rechenaufgaben, Verbindungen oder Anfragen auf mehrere Server oder Ressourcen zu verteilen, um Durchsatz zu erhöhen, Antwortzeiten zu verkürzen und Verfügbarkeit sowie Ressourcenauslastung zu verbessern.

Prinzip

Prinzip
Arbeitslasten werden Ressourcen zugewiesen anhand von Richtlinien (Round-Robin, Least-Connections, Weighted, Consistent Hashing, metrikgesteuert), die Kapazität, Zustand und Zielsetzungen (Latenz, Fairness, Affinität) berücksichtigen.

Demonstration

Demonstration
Ein Load-Balancer verteilt eingehende HTTP-Anfragen auf einen Pool von Webservern mit Least-Connections, während Gesundheitsprüfungen nicht reagierende Server entfernen; konsistentes Hashing weist Cache-Schlüssel Backend-Knoten zu und minimiert Remapping bei Knotenwechseln.

Fehlanwendung

Fehlanwendung
Einfaches Round-Robin ohne Berücksichtigung heterogener Server oder Sticky Sessions zu verwenden, die viele Anfragen an einen Server zwingen und Hotspots verursachen; das Ignorieren von Health-Checks führt zu Routing zu ausgefallenen Knoten.

Konsequenz

Konsequenz
Richtige Lastverteilung erhöht Durchsatz, senkt Tail-Latenzen und verbessert Fehlertoleranz; sie ermöglicht elastisches Skalieren und Wartung ohne Dienstunterbrechung, wenn Health- und Kapazitätsdaten berücksichtigt werden.

Umkehrung

Umkehrung
Alle Anfragen auf einem einzelnen Server zu konzentrieren oder gleichmäßig zu verteilen ohne Kapazitätsbeachtung kann Flaschenhälse und Single Points of Failure schaffen und den Gesamtdurchsatz sowie die Resilienz verringern.

Abgrenzung

Abgrenzung
Gilt für die Verteilung von Anfragen und Aufgaben über mehrere Rechen- oder Netzwerkressourcen; umfasst nicht automatisch Autoscaling, Planen lang laufender Batch-Jobs oder Anwendungsebene-Konsistenzmanagement.

Semantische Spannung

Semantische Spannung
Überlappt mit Scheduling und Autoscaling: Scheduler optimieren Zuweisungen über Zeit, Autoscaling verändert Kapazität; Load-Balancing fokussiert das Laufzeit-Routing und die Verteilung auf vorhandene Ressourcen.

Synthese

Synthese
Lastverteilung ist der Laufzeitentscheidungsprozess, der eingehende Arbeit auf verfügbare Ressourcen abbildet und dabei Routing-Policies sowie Health-/Metriken-Feedback nutzt, um Auslastung, Latenz und Verfügbarkeit zu optimieren.