davidcastagnetoa/skills

torchserve

Servidor de modelos PyTorch para inferencia de modelos de verificación de identidad con batching y versionado

First seen Mar 3, 2026

Installation

$ npx skills add davidcastagnetoa/skills --skill torchserve

Also in this package

Other skills from davidcastagnetoa/skills · top by installs.

npx skills add davidcastagnetoa/skills

Browse all from davidcastagnetoa/skills

More details

Agent compatibility

Declared targets from SKILL.md / docs. Unmarked agents are not listed — the skill may still install via the CLI.

Claude Code Not declared
Cursor Not declared
Codex Not declared
GitHub Copilot Not declared
Windsurf Not declared
Gemini CLI Not declared
Cline Not declared
OpenCode Not declared

Repository health

Stars 1
Default branch main
Open issues 0
Status Active

Package contents

Files included with this skill beyond the listing page.

  • skill md SKILL.md 3,135 B
  • docs SUMMARY.md 128 B

History

  1. First seen on skills.sh
  2. First recorded snapshot · 10 installs

SKILL.md

torchserve

Configura y despliega TorchServe como servidor de modelos PyTorch para servir los modelos de liveness detection (MiniFASNet), face recognition (ArcFace) y anti-spoofing del pipeline KYC. Proporciona batching dinámico, versionado de modelos y métricas de rendimiento integradas para monitoreo en producción.

When to use

Usa esta skill cuando necesites desplegar o configurar el servidor de inferencia PyTorch dentro del modelserveragent. Aplica cuando se requiera servir modelos ML del pipeline de verificación facial con soporte para batching, múltiples versiones simultáneas y endpoints de métricas.

Instructions

  1. Instalar TorchServe y sus dependencias:

``bash pip install torchserve torch-model-archiver torch-workflow-archiver ``

  1. Empaquetar cada modelo como un MAR (Model Archive) usando torch-model-archiver:

``bash torch-model-archiver --model-name arcface \ --version 1.0 \ --model-file models/arcface.py \ --serialized-file weights/arcfacer100.pth \ --handler handlers/facerecognitionhandler.py \ --export-path modelstore/ ``

  1. Configurar el archivo config.properties con batching dinámico, número de workers y puertos:

``properties inferenceaddress=http://0.0.0.0:8080 managementaddress=http://0.0.0.0:8081 metricsaddress=http://0.0.0.0:8082 jobqueuesize=100 batchsize=8 maxbatchdelay=200 defaultworkersper_model=2 ``

  1. Crear handlers personalizados para cada tipo de modelo (liveness, face_match, anti-spoofing) que implementen initialize(), preprocess(), inference() y postprocess().
  1. Iniciar TorchServe con el model store y la configuración:

``bash torchserve --start --model-store model_store/ \ --ts-config config.properties \ --models arcface=arcface.mar liveness=minifasnet.mar ``

  1. Registrar nuevas versiones de modelos en caliente mediante la Management API:

``bash curl -X POST "http://localhost:8081/models?url=arcfacev2.mar&modelname=arcface&initial_workers=2" ``

  1. Configurar métricas de Prometheus para monitorear latencia de inferencia, throughput y errores por modelo:

``properties metricsmode=prometheus metricsformat=prometheus ``

  1. Implementar health checks en el endpoint /ping y validar que todos los modelos estén cargados antes de aceptar tráfico de verificación.

Notes

  • El batching dinámico es crítico para optimizar el throughput cuando múltiples verificaciones KYC llegan simultáneamente; ajustar batchsize y maxbatch_delay según la carga esperada.
  • Cada modelo debe tener su propio handler para manejar correctamente el preprocesamiento específico (normalización facial, resize de documentos, etc.).
  • Monitorear el uso de memoria GPU constantemente ya que cargar múltiples modelos (ArcFace + MiniFASNet + anti-spoofing) puede exceder la VRAM disponible.