Modal: Plataforma Serverless GPU para IA/ML
Despliega y sirve modelos de IA/ML en la nube con GPUs bajo demanda (H100, A100, L40S) usando la plataforma serverless Modal. Permite crear endpoints web, pipelines batch, trabajos programados y sandboxes para ejecución de código sin gestionar infraestructura.
Incluida en el Pase · para Modal, Python, FastAPI
// qué_hace
Integra la plataforma Modal para desplegar funciones Python serverless con GPUs on-demand, sirviendo modelos de IA, procesando datos en paralelo y programando pipelines en la nube.
// cómo_lo_hace
Usa el SDK de Modal para decorar funciones Python con recursos cloud (GPU, CPU, memoria, volúmenes, secretos) y desplegarlas como endpoints web, trabajos batch o tareas programadas con autoscaling automático.
// ejemplo_de_uso
Úsala cuando necesitas ejecutar modelos de IA pesados sin pagar por servidores dedicados 24/7. Ej.: lanzar un endpoint de inferencia con GPU A100 que sólo consume créditos mientras recibe peticiones reales.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…