← Volver al catálogo
IA, ingeniería y MLOpsAnálisisIntermedioGratis

Estimador de memoria para modelos Hugging Face

Herramienta CLI que calcula la memoria VRAM/RAM necesaria para ejecutar modelos de Hugging Face (Safetensors o GGUF) sin necesidad de descargarlos. Incluye estimación opcional de caché KV para LLMs y VLMs.

Descargar SKILL.md

Descarga abierta · sin registro · para CLI, Linux, macOS

// resultado_de_ejemplo
Abrir en una pestaña nueva ↗

// qué_hace

Estima la memoria GPU/RAM necesaria para cargar e inferir con cualquier modelo del Hub de Hugging Face.

// cómo_lo_hace

Usa peticiones HTTP Range para leer solo los metadatos del modelo (sin descargar pesos) y calcula el uso de memoria para pesos y caché KV.

// ejemplo_de_uso

Úsala antes de alquilar una GPU para saber exactamente cuánta VRAM necesitarás. Ej.: estimas la memoria de LLaMA-3 70B en float16 para decidir si cabe en una A100 de 80 GB o necesitas dos.

// plataformas

CLILinuxmacOSWindows
Categoría
IA, ingeniería y MLOps
Tipo
Análisis
Nivel
Intermedio
Licencia
Apache-2.0
Seguridad
seguro · riesgo bajo
Versión
1.0.0

// opiniones_de_la_comunidad

Opiniones

Cargando opiniones…

// pase_cultiva_ia

Llévate todo el arsenal con el Pase

Todas las skills, prompts y automatizaciones del catálogo en un único archivo, listas para usar: un pago, acceso de por vida y las novedades que añadamos. Sin suscripción.

Pago único · IVA incluido · pago seguro con Stripe.

Acceso inmediato · si no es lo que esperabas, te devolvemos los 10 €.