Fine-Tuning de LLMs con Datasets de Kaggle
Pipeline completo para descargar datasets de Kaggle, preprocesarlos en formato de chat y ajustar LLMs con PEFT/LoRA de manera eficiente en memoria. Ideal para construir chatbots de atención al cliente o asistentes de IA especializados en un dominio concreto.
Incluida en el Pase · para Python, HuggingFace, Kaggle
// qué_hace
Proporciona un workflow end-to-end para descargar datasets de Kaggle, convertirlos al formato de chat de HuggingFace y entrenar LLMs con adaptadores LoRA en 4 bits.
// cómo_lo_hace
Combina la CLI de Kaggle para descarga de datos, scripts Python de preprocesamiento a JSONL, y el trainer SFTTrainer de TRL con configuracion PEFT/LoRA y cuantizacion BitsAndBytes.
// ejemplo_de_uso
Para equipos que quieren adaptar un LLM público a su dominio específico sin datos propios suficientes. Ej.: un equipo legal descarga un dataset jurídico de Kaggle, lo convierte a formato chat y entrena un modelo Llama en 4 bits sobre una GPU de 24 GB.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…