Skalowanie poziome a pionowe
Zrozumieją Państwo dwa podstawowe sposoby zwiększania pojemności API — skalowanie w górę i skalowanie wszerz — oraz dowiedzą się, jak wybierać między nimi na podstawie kosztów, limitów i architektury.
Skalowanie poziome a pionowe to bezpłatna lekcja API Rate Limiting & Scalability Patterns na CoddyKit. To lekcja 4 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej API Rate Limiting & Scalability Patterns, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs API Rate Limiting & Scalability Patterns zawiera 4 lekcji w sumie.
Części tej lekcji nie zostały jeszcze przetłumaczone i są wyświetlane po angielsku.
Two Ways to Grow
When an API runs out of capacity you have two levers:
- Vertical scaling (scale up) — make the machine bigger
- Horizontal scaling (scale out) — add more machines
Each has very different cost and reliability profiles.
Vertical Scaling Explained
Vertical scaling means upgrading a single server: more CPU cores, more RAM, faster disks.
It is simple — no code changes — but you eventually hit the largest instance available, and that one box is a single point of failure.
Horizontal Scaling Explained
Horizontal scaling adds more identical servers behind a load balancer. Traffic spreads across the fleet.
- No hard ceiling — add nodes as needed
- One node failing does not take down the service
The Cost Curve
Vertical scaling cost rises steeply — top-tier hardware carries a premium. Horizontal scaling uses many commodity nodes, which is usually cheaper per unit of capacity at large scale.
Statelessness Enables Scale-Out
To scale out, any node must handle any request. That requires stateless services — no session data stored on the instance.
Push session and state to a shared store (Redis, a database) so nodes stay interchangeable.
// session in a shared store, not local memory
await redis.set('session:' + id, data, 'EX', 3600)Auto-Scaling Groups
Cloud platforms add or remove nodes automatically based on metrics like CPU or request rate.
You define a min, max, and a target metric; the platform keeps the fleet sized to load.
min_instances: 2
max_instances: 20
target_cpu_percent: 60When Vertical Still Wins
Scaling up is the right call when:
- The workload is hard to distribute (a single large in-memory dataset)
- You need a quick fix before re-architecting
- Licensing is per-node and a bigger box is cheaper
Diminishing Returns
Adding nodes is not free scaling — shared resources (a single database, a lock) become the new bottleneck. This is why scaling the data tier often matters more than the app tier.
Combining Both
Real systems mix strategies: right-size each node (a bit of vertical) then run many of them (horizontal). The goal is the best cost per request at your reliability target.
Measuring Before Scaling
Never scale blindly. Profile first to find the real constraint — CPU, memory, I/O, or a downstream dependency. Scaling the wrong dimension wastes money and hides the true bottleneck.
Scaling and Cost Awareness
Capacity is not free. A fleet sized for peak sits idle at night, burning money. Combine auto-scaling with right-sizing and consider spot or reserved capacity to match spend to real demand.
Quick Check
Check your understanding of scaling directions.
Recap
You compared scaling strategies:
- Vertical — bigger box, simple, but capped and a single point of failure
- Horizontal — more boxes, resilient, needs statelessness
- Auto-scaling sizes the fleet to load
- Always measure the real bottleneck first
Ucz się API Rate Limiting & Scalability Patterns dzięki korepetycjom AI — za darmo
Pisz i uruchamiaj kod w przeglądarce, otrzymuj natychmiastową pomoc od korepetytora AI dostępnego 24/7 i kontynuuj naukę w sieci lub w aplikacji.
- Kursy
- 12
- Lekcje
- 48
Często zadawane pytania
Czy lekcja „Skalowanie poziome a pionowe” jest bezpłatna?
Tak — pełny tekst „Skalowanie poziome a pionowe” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu API Rate Limiting & Scalability Patterns, przejdź na CoddyKit PRO. Kurs API Rate Limiting & Scalability Patterns zawiera 4 lekcji w sumie.
Co nauczysz się w „Skalowanie poziome a pionowe”?
Zrozumieją Państwo dwa podstawowe sposoby zwiększania pojemności API — skalowanie w górę i skalowanie wszerz — oraz dowiedzą się, jak wybierać między nimi na podstawie kosztów, limitów i architektury. Ćwiczysz API Rate Limiting & Scalability Patterns z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.
Czy potrzebuję doświadczenia, aby zacząć API Rate Limiting & Scalability Patterns?
Nie wymagamy żadnego doświadczenia. API Rate Limiting & Scalability Patterns w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 4 z 4.
Ile czasu zajmuje lekcja „Skalowanie poziome a pionowe”?
Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.
Czy mogę pisać i uruchamiać kod w tej lekcji API Rate Limiting & Scalability Patterns?
Tak. Każda lekcja API Rate Limiting & Scalability Patterns zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.
Wszystkie lekcje w tym kursie
- Zrozumienie skalowalności API
- Najważniejsze wskaźniki skalowalności
- Projektowanie bezstanowych i stanowych API
- Skalowanie poziome a pionowe