Maestro Embeddings

Painel de prontidão do serviço

Estado do serviço
Modelo —
Em memória (RAM) …
Em cache (disco) …
Pronto para /embed …
Baixando… —
Pré-carregar modelo

Dispara o download + carregamento na RAM sem esperar uma chamada /embed. Requer o X-Service-Key configurado em MAESTRO_SERVICE_KEY.

Ambiente Hugging Face
HF Home —
Cache do Hub —
Token de API …
Pasta de cache existe …

Runtime
Python —
Plataforma —
PyTorch —
CUDA —
Logs (tempo real)

Últimas linhas do processo em memória. Útil para diagnosticar falhas de download/carga do modelo.

Carregando logs...

Atualiza automaticamente a cada 3 s enquanto o modelo não está em memória.