Optimizador de Costes LLM
Skill experta para reducir el gasto en APIs de modelos de lenguaje entre un 40-80% sin degradar la calidad, mediante routing de modelos, prompt caching, compresion y observabilidad de costes. Imprescindible al disenar o auditar cualquier feature de IA.
Incluida en el Pase · para Claude, OpenAI, Google Gemini
// qué_hace
Audita, optimiza y disenha arquitecturas de coste para sistemas que usan APIs de LLM, identificando donde se desperdicia dinero y aplicando tecnicas probadas de ahorro.
// cómo_lo_hace
Opera en tres modos (auditoria, optimizacion, diseno nuevo) con tablas de routing por complejidad, estrategias de caching semantico, control de tokens de salida y flags proactivos sobre patrones de sobrecoste.
// ejemplo_de_uso
Perfecta para cuando la factura mensual de OpenAI o Anthropic sube sin control y no sabes dónde se escapa el dinero. Ej.: auditar un sistema de atención al cliente y descubrir que el 60% del gasto es en prompts idénticos que se pueden cachear.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…