Dynamische, automatische Anpassung von Instanzen und Ressourcen an Lasten zur Verbesserung von Verfügbarkeit und Kosten.
Autoscaling passt die Ressourcen- und Instanzanzahl einer Anwendung automatisch an reale Lastbedingungen an. Es optimiert Verfügbarkeit und Kosten, indem Kapazität dynamisch skaliert wird — in der Cloud, auf Container-Orchestratoren oder in hybriden Umgebungen. Entscheidungskriterien und Metriken steuern Regeln und Grenzwerte.
Anzahl laufender Instanzen oder Pods zur Kapazitätsmessung.
Prozentuale Ressourcenausschöpfung zur Auslösung von Skalierungsaktionen.
Durchsatz und Reaktionszeit als Indikatoren für notwendige Skalierung.
Weit verbreitete Implementierung von Pod-basiertem Autoscaling anhand von CPU- und benutzerdefinierten Metriken.
Cloud‑Anbieter‑Mechanismus für automatische Skalierung von EC2-Instanzen nach Policies und Zielmetriken.
Beispiele aus Functions-as-a-Service (z. B. Provisioned Concurrency) zur Steuerung von Startzeit und Durchsatz.
Metriken und Observability einrichten; relevante Metriken validieren.
Skalierungsregeln mit Min/Max- und Cooldown-Parametern definieren.
Automatisches Scaling in Stufen testen (Staging → Canary → Prod) und überwachen.