Carregue o modelo uma única vez na inicialização
Utilize eventos de ciclo de vida para que o carregamento aconteça apenas uma vez.
Carregue o modelo uma única vez na inicialização é uma aula grátis de MLOps Academy no CoddyKit. Esta é a aula 3 de 4. Você pode ler a aula completa abaixo gratuitamente — depois pratica ao vivo no navegador com um editor de código integrado e um tutor de IA 24/7. Faz parte do caminho de aprendizado de MLOps Academy, e seu progresso é sincronizado entre a web e o app CoddyKit. O curso de MLOps Academy inclui 4 aulas no total.
A armadilha do endpoint lento
Se chamar joblib.load dentro de /predict, o modelo será recarregado em cada pedido. Isso é lento e desperdiça recursos com modelos grandes. 🐢
Carregue-o apenas uma vez
A solução é carregar o model uma única vez quando o serviço iniciar, mantê-lo na memória e reutilizá-lo em todas as previsões.
O mecanismo lifespan
O FastAPI fornece uma função lifespan para executar a configuração antes de atender pedidos e a limpeza depois. É o local adequado para carregar o modelo.
Escreva um gestor de contexto assíncrono
Aplique o decorador asynccontextmanager a uma função assíncrona. O código antes de yield é executado no arranque; o código depois é executado no encerramento.
from contextlib import asynccontextmanagerGuarde o modelo no estado
Carregue o modelo no arranque e guarde-o em app.state, um local partilhado que todos os gestores de pedidos podem consultar mais tarde.
@asynccontextmanager
async def lifespan(app):
app.state.model = joblib.load("model.joblib")
yieldLigue-o à aplicação
Passe a sua função lifespan ao criar a aplicação. Agora o FastAPI executará o seu código de carregamento uma vez, quando o servidor arrancar.
app = FastAPI(lifespan=lifespan)Leia-o na rota
Dentro de /predict, obtenha o modelo já carregado a partir de app.state. Sem leitura do disco: apenas uma pesquisa rápida na memória.
@app.post("/predict")
def predict(req: Request):
model = req.app.state.modelFaça a limpeza no encerramento
Tudo o que estiver depois de yield será executado quando a aplicação parar, sendo perfeito para fechar ficheiros ou libertar a memória da GPU ocupada pelo modelo.
yield
app.state.model = NonePrimeiro pedido mais rápido
Como o carregamento terminou no arranque, até o primeiro utilizador recebe uma resposta rápida, sem a penalização de um carregamento a frio. ⚡
Controle o número de trabalhadores
Cada worker do uvicorn é um processo independente com a sua própria cópia do modelo. Mais trabalhadores significam mais memória, por isso dimensione-os cuidadosamente.
Por que é importante
Carregar uma vez é uma otimização essencial para servir modelos: reduz a latência, diminui as operações de entrada e saída do disco e mantém a utilização da memória previsível sob tráfego real. 📈
Verificação rápida
Quer que o seu modelo seja carregado exatamente uma vez quando o serviço arrancar. Onde deve fazê-lo?
Recapitulação
Moveu o carregamento para um mecanismo lifespan, guardou o modelo em app.state e leu-o a cada pedido. Um carregamento, respostas rápidas e encerramento limpo. 🙌
Perguntas Frequentes
A aula “Carregue o modelo uma única vez na inicialização” é grátis?
Sim — o texto completo de “Carregue o modelo uma única vez na inicialização” é grátis para ler aqui na web. Para praticá-la interativamente (um editor de código integrado e um tutor de IA 24/7) e desbloquear o restante do curso de MLOps Academy, atualize para CoddyKit PRO. O curso de MLOps Academy inclui 4 aulas no total.
O que vou aprender em “Carregue o modelo uma única vez na inicialização”?
Utilize eventos de ciclo de vida para que o carregamento aconteça apenas uma vez. Você pratica MLOps Academy com código prático que executa diretamente no navegador, e um tutor de IA 24/7 responde suas dúvidas enquanto trabalha na aula.
Preciso ter experiência prévia para começar MLOps Academy?
Nenhuma experiência prévia é necessária. MLOps Academy no CoddyKit é estruturado para alunos iniciantes até avançados, então você pode começar aqui ou desde o início e aprender no seu ritmo. Esta é a aula 3 de 4.
Quanto tempo leva a aula “Carregue o modelo uma única vez na inicialização”?
A maioria das aulas CoddyKit leva cerca de 5–10 minutos. Cada uma é compacta e interativa, então você faz progresso constante e retoma exatamente de onde parou entre web e app.
Posso escrever e executar código nesta aula de MLOps Academy?
Sim. Cada aula de MLOps Academy inclui um editor de código integrado, então você escreve e executa código real direto no navegador e recebe feedback de IA instantaneamente — nenhuma configuração local necessária.
Todas as aulas deste curso
- Seu primeiro endpoint /predict
- Valide requisições com Pydantic
- Carregue o modelo uma única vez na inicialização
- Adicione uma verificação de prontidão /health