 ##  [Lastverteilung](/de/node/58809) 

 Definition

Der Prozess, Rechenaufgaben, Verbindungen oder Anfragen auf mehrere Server oder Ressourcen zu verteilen, um Durchsatz zu erhöhen, Antwortzeiten zu verkürzen und Verfügbarkeit sowie Ressourcenauslastung zu verbessern.

 

 

 

 

 

 





## Prinzip

Prinzip

Arbeitslasten werden Ressourcen zugewiesen anhand von Richtlinien (Round-Robin, Least-Connections, Weighted, Consistent Hashing, metrikgesteuert), die Kapazität, Zustand und Zielsetzungen (Latenz, Fairness, Affinität) berücksichtigen.

 

 

 

 

 





## Demonstration

Demonstration

Ein Load-Balancer verteilt eingehende HTTP-Anfragen auf einen Pool von Webservern mit Least-Connections, während Gesundheitsprüfungen nicht reagierende Server entfernen; konsistentes Hashing weist Cache-Schlüssel Backend-Knoten zu und minimiert Remapping bei Knotenwechseln.

 

 

 

 

## Fehlanwendung

Fehlanwendung

Einfaches Round-Robin ohne Berücksichtigung heterogener Server oder Sticky Sessions zu verwenden, die viele Anfragen an einen Server zwingen und Hotspots verursachen; das Ignorieren von Health-Checks führt zu Routing zu ausgefallenen Knoten.

 

 

 

 

 





## Konsequenz

Konsequenz

Richtige Lastverteilung erhöht Durchsatz, senkt Tail-Latenzen und verbessert Fehlertoleranz; sie ermöglicht elastisches Skalieren und Wartung ohne Dienstunterbrechung, wenn Health- und Kapazitätsdaten berücksichtigt werden.

 

 

 

 

## Umkehrung

Umkehrung

Alle Anfragen auf einem einzelnen Server zu konzentrieren oder gleichmäßig zu verteilen ohne Kapazitätsbeachtung kann Flaschenhälse und Single Points of Failure schaffen und den Gesamtdurchsatz sowie die Resilienz verringern.

 

 

 

 

 





## Abgrenzung

Abgrenzung

Gilt für die Verteilung von Anfragen und Aufgaben über mehrere Rechen- oder Netzwerkressourcen; umfasst nicht automatisch Autoscaling, Planen lang laufender Batch-Jobs oder Anwendungsebene-Konsistenzmanagement.

 

 

 

 

 





## Semantische Spannung

Semantische Spannung

Überlappt mit Scheduling und Autoscaling: Scheduler optimieren Zuweisungen über Zeit, Autoscaling verändert Kapazität; Load-Balancing fokussiert das Laufzeit-Routing und die Verteilung auf vorhandene Ressourcen.

 

 

 

 

 





## Synthese

Synthese

Lastverteilung ist der Laufzeitentscheidungsprozess, der eingehende Arbeit auf verfügbare Ressourcen abbildet und dabei Routing-Policies sowie Health-/Metriken-Feedback nutzt, um Auslastung, Latenz und Verfügbarkeit zu optimieren.