Validar um endpoint local de inferência sem conectá-lo automaticamente à produção.
- Confirme GPU, driver e runtime.
- Copie
.env.examplepara.env. - Selecione um modelo permitido para o hardware.
- Revise
docker compose config. - Inicie somente o serviço
vllm. - Valide
/health,/v1/modelse uma inferência curta. - Registre versões e resultados.
- Ative monitoramento opcional.
- Execute benchmarks sintéticos sem dados reais.
- Desligue o laboratório quando terminar.
cp .env.example .env
docker compose config
docker compose up -d vllm
docker compose logs -f vllm
curl -fsS http://localhost:8000/health[ ] modelo e revisão
[ ] licença conferida
[ ] GPU e driver
[ ] imagem/engine e versão
[ ] quantização
[ ] contexto e concorrência
[ ] dataset sintético
[ ] saída bruta preservada
[ ] resultado e limitações documentados