Skalierung

Skaliere deinen Web Service auf lowcloud Platform. Autoscaling (HPA), feste Replicas und das Scaling-Log.

Zuletzt aktualisiert: 8. Juni 2026

Skalierung

Jeder Web Service hat einen eigenen Scaling-Tab. Er steuert, wie viele Instanzen laufen und wie sie auf Last reagieren. Die Live-Replica-Anzahl (ready / desired) siehst du auf der Deployment-Card im General-Tab des Services.

Autoscaling (HPA)

Stateless Services skalieren automatisch anhand der CPU-Auslastung (Ziel: 80 %).

  • Autoscaling an: lege die minimale und maximale Anzahl an Instanzen fest. lowcloud fügt Instanzen hinzu, wenn die CPU steigt, und entfernt sie, wenn sie fällt.
  • Autoscaling aus: der Service läuft mit einer festen Anzahl Replicas, die du manuell setzt.

Web Services skalieren auf bis zu 10 Instanzen.

Persistente Volumes

Ein Service mit einem persistenten Volume ist auf eine einzelne Replica festgelegt und kann nicht autoskalieren. Das Volume ist read-write-once, daher kann es nur eine Instanz mounten. Um horizontal zu skalieren, lagere State in eine Database oder Object Storage aus.

Scaling-Log

Der Scaling-Tab führt ein Log der letzten Scaling-Events. Jeder Eintrag zeigt die Replica-Änderung (z. B. 1 → 2), ob sie Autoscaled oder Manual war, und wann sie passiert ist.