Instanties en replica's passend dimensioneren
Stem hardware af op werkelijke belastingprofielen.
Instanties en replica's passend dimensioneren is een gratis MLOps Academy-les op CoddyKit. Dit is les 1 van 4. Je kunt de volledige les hieronder gratis lezen en daarna in de browser praktisch oefenen met een ingebouwde code-editor en een AI-begeleider die 24/7 beschikbaar is. Deze les maakt deel uit van het leertraject MLOps Academy. Je voortgang wordt gesynchroniseerd op het web en in de CoddyKit-app. De cursus MLOps Academy bevat in totaal 4 lessen.
Betalen voor wat je gebruikt
De meeste kosten voor ML-diensten ontstaan door instanties die grotendeels niets doen. Juiste dimensionering betekent dat je hardware en het aantal replica's afstemt op je werkelijke belasting, niet op je ergste vrees.
Meten voordat je bespaart
Je kunt iets niet juist dimensioneren als je het niet hebt gemeten. Begin met het bekijken van het werkelijke CPU- en geheugengebruik op een normale verkeersdag.
De valkuil van overprovisioning
Een enorme instantie kiezen voor het geval dat veilig voelt, maar kost elk uur geld. Chronisch laag gebruik is het duidelijkste teken van overprovisioning.
Je gebruik aflezen
Als het gemiddelde CPU-gebruik rond 15 procent ligt, is je instantie veel te groot. Streef naar een gezonde doelwaarde voor het gebruik met ruimte voor korte pieken.
kubectl top pods -n servingVerticaal versus horizontaal
Verticaal schalen geeft één replica een grotere machine. Horizontaal schalen voegt in plaats daarvan meer kleine replica's toe, wat meestal beter werkt bij wisselende verkeerspieken.
Verzoeken en limieten instellen
Op Kubernetes vertelt je resourceverzoek de scheduler hoeveel elke replica echt nodig heeft. Stel dit in op basis van gemeten gebruik, niet op een ruwe schatting.
resources:
requests:
cpu: "500m"
memory: "1Gi"Het juiste aantal replica's kiezen
Te weinig replica's betekent wachtrijen en trage antwoorden. Te veel betekent inactieve pods waarvoor je nog steeds betaalt. Stem het aantal replica's af op je maximale gelijktijdige belasting.
Autoscaling de vraag laten volgen
Een Horizontal Pod Autoscaler voegt replica's toe wanneer de belasting stijgt en verwijdert ze wanneer die daalt, zodat je niet betaalt voor capaciteit buiten de piekuren.
kubectl autoscale deploy model --min 2 --max 10 --cpu-percent 60Een veiligheidsminimum aanhouden
Een minimumaantal replica's houdt enkele pods actief, zodat verkeer nooit bij een koude, lege service terechtkomt. Dit is de afweging tussen kosten en beschikbaarheid.
GPU-machines zijn duur
GPU-instanties kosten vele malen meer dan CPU-instanties. Vraag alleen een GPU aan wanneer je model die echt nodig heeft en benut deze intensief, zodat hij nooit ongebruikt blijft.
Juiste dimensionering blijft nodig
Verkeerspatronen veranderen in de loop van weken en maanden. Bekijk het instantietype en het aantal replica's regelmatig opnieuw, zodat je vloot goed blijft aansluiten.
Korte controle
Laten we bekijken wat laag gebruik je vertelt.
Samenvatting
Je hebt het gebruik gemeten, gekozen tussen verticaal en horizontaal schalen, verzoeken ingesteld en autoscaling toegevoegd. Je vloot sluit nu aan op de werkelijke vraag. 💸
Leer Python met een AI-tutor — gratis
Schrijf echte code en voer die uit in je browser, krijg direct hulp van een AI-tutor die 24/7 beschikbaar is en ga verder waar je gebleven bent op het web of in de app.
- Cursussen
- 30
- Lessen
- 120
Veelgestelde vragen
Is de les “Instanties en replica's passend dimensioneren” gratis?
Ja — de volledige tekst van “Instanties en replica's passend dimensioneren” kun je hier gratis op het web lezen. Als je interactief wilt oefenen met een ingebouwde code-editor en een AI-begeleider die 24/7 beschikbaar is, en de rest van de cursus MLOps Academy wilt ontgrendelen, kun je upgraden naar CoddyKit PRO. De cursus MLOps Academy bevat in totaal 4 lessen.
Wat leer ik in “Instanties en replica's passend dimensioneren”?
Stem hardware af op werkelijke belastingprofielen. Je oefent met MLOps Academy door code rechtstreeks in de browser uit te voeren. Een AI-begeleider die 24/7 beschikbaar is beantwoordt je vragen terwijl je de les doorwerkt.
Heb ik ervaring nodig om met MLOps Academy te beginnen?
Ervaring vooraf is niet nodig. MLOps Academy op CoddyKit is opgebouwd voor beginners tot gevorderden, zodat je hier of bij het begin kunt starten en in je eigen tempo kunt leren. Dit is les 1 van 4.
Hoe lang duurt de les “Instanties en replica's passend dimensioneren”?
De meeste lessen van CoddyKit duren ongeveer 5–10 minuten. Elke les is kort en interactief, zodat je gestaag vooruitgaat en op het web en in de app precies verdergaat waar je was gebleven.
Kan ik code schrijven en uitvoeren in deze les over MLOps Academy?
Ja. Elke les over MLOps Academy bevat een ingebouwde code-editor, zodat je rechtstreeks in je browser echte code kunt schrijven en uitvoeren en direct feedback van AI krijgt — lokale installatie is niet nodig.
Alle lessen in deze cursus
- Instanties en replica's passend dimensioneren
- Kwantificeren en distilleren voor goedkopere inferentie
- Spot Instances gebruiken voor training
- Kosten per voorspelling bijhouden