← Volver al catálogo
IA, ingeniería y MLOpsSistemaAvanzadoEn el pase

Modal: Plataforma Serverless GPU para IA/ML

Despliega y sirve modelos de IA/ML en la nube con GPUs bajo demanda (H100, A100, L40S) usando la plataforma serverless Modal. Permite crear endpoints web, pipelines batch, trabajos programados y sandboxes para ejecución de código sin gestionar infraestructura.

Comprobando acceso…

Incluida en el Pase · para Modal, Python, FastAPI

// resultado_de_ejemplo
Abrir en una pestaña nueva ↗

// qué_hace

Integra la plataforma Modal para desplegar funciones Python serverless con GPUs on-demand, sirviendo modelos de IA, procesando datos en paralelo y programando pipelines en la nube.

// cómo_lo_hace

Usa el SDK de Modal para decorar funciones Python con recursos cloud (GPU, CPU, memoria, volúmenes, secretos) y desplegarlas como endpoints web, trabajos batch o tareas programadas con autoscaling automático.

// ejemplo_de_uso

Úsala cuando necesitas ejecutar modelos de IA pesados sin pagar por servidores dedicados 24/7. Ej.: lanzar un endpoint de inferencia con GPU A100 que sólo consume créditos mientras recibe peticiones reales.

// plataformas

ModalPythonFastAPIvLLMPyTorchHugging Face Transformers
Categoría
IA, ingeniería y MLOps
Tipo
Sistema
Nivel
Avanzado
Licencia
MIT
Seguridad
seguro · riesgo bajo
Versión
1.0.0

// opiniones_de_la_comunidad

Opiniones

Cargando opiniones…