Définition
Le processus de répartition des tâches informatiques, connexions ou requêtes entre plusieurs serveurs ou ressources afin d'améliorer le débit, réduire le temps de réponse et augmenter la disponibilité et l'utilisation des ressources.

Principe

Principe
Attribuer le travail aux ressources selon des politiques (round-robin, moins-de-connexions, pondéré, hashing cohérent, piloté par métriques) qui tiennent compte de la capacité, de l'état et des objectifs (latence, équité, affinité).

Démonstration

Démonstration
Un répartiteur (load balancer) oriente les requêtes HTTP entrantes vers un pool de serveurs web en utilisant la stratégie 'least-connections' tandis que des contrôles de santé excluent les serveurs non réactifs ; le hashing cohérent assigne des clés de cache aux nœuds backend en minimisant les remappages lors d'ajouts/retraits de nœuds.

Mauvaise application

Mauvaise application
Utiliser un simple round-robin sans tenir compte de l'hétérogénéité des serveurs ou des sessions collantes qui concentrent les requêtes sur un serveur, provoquant des points chauds et une dégradation des performances ; ignorer la santé conduit à router vers des nœuds défaillants.

Conséquence

Conséquence
Une bonne répartition de charge augmente le débit, réduit la latence de queue et améliore la tolérance aux pannes ; elle permet une montée en charge élastique et des opérations de maintenance sans interruption lorsqu'elle repose sur la connaissance de la santé et de la capacité.

Inversion

Inversion
Concentrer toutes les requêtes sur un seul serveur ou distribuer uniformément sans tenir compte de la capacité peut créer des goulots d'étranglement et des points uniques de défaillance, réduisant le débit et la résilience du système.

Limite

Limite
S'applique à la distribution de requêtes et de tâches entre plusieurs ressources informatiques ou réseau ; n'englobe pas automatiquement l'autoscaling, la planification de travaux batch longue durée, ni la gestion de cohérence au niveau applicatif.

Tension sémantique

Tension sémantique
Se recoupe avec l'ordonnancement et l'autoscaling : les ordonnanceurs optimisent l'affectation dans le temps et l'autoscaling modifie la capacité ; la répartition de charge se concentre sur l'acheminement d'exécution vers des ressources existantes.

Synthèse

Synthèse
La répartition de charge est le processus décisionnel d'exécution qui mappe le travail entrant sur les ressources disponibles en utilisant des politiques d'acheminement et des retours de métriques/santé pour optimiser utilisation, latence et disponibilité.