🎵
Cultiva Sonora
Pipeline de descarga · yt-dlp
Archivo Digital Automatizado
Pipeline completo para descarga, conversión y organización de catálogo musical con yt-dlp + ffmpeg + Whisper.
yt-dlp 2024.11 ffmpeg 7.0 Python 3.12 Whisper v3
45
Tracks en catálogo
4
Artistas
12.4 GB
Archivo FLAC
1000+
Plataformas soportadas
Flujo del Pipeline
🔗
Fuente
Canal YouTube
@CultivaSonora/videos + playlist list=PLcultiva2024
⬇️
Descarga
yt-dlp
Mejor calidad de audio, archive tracking, rate-limit
🔄
Conversión
ffmpeg
FLAC lossless + MP3 320kbps + normalización
📝
Subtítulos
SRT / Whisper
Subtítulos automáticos ES + transcripción Whisper
📁
Organización
Archivo
Por artista, año y formato. Sin duplicados.
Comandos por Caso de Uso
Archivo FLAC — Canal completo
FLAC
# Descargar todo el canal como FLAC lossless
# organizado por artista (uploader)
yt-dlp -x \
  --audio-format flac \
  --embed-metadata \
  --embed-thumbnail \
  --download-archive archivo-maestro.txt \
  --rate-limit 8M \
  --sleep-interval 3 \
  -o "archivo-maestro/%(uploader)s/%(upload_date>%Y)s - %(title)s.%(ext)s" \
  "https://youtube.com/@CultivaSonora/videos"
Distribución MP3 320kbps
MP3
# Playlist completa como MP3 numerados
# para distribución interna
yt-dlp -x \
  --audio-format mp3 \
  --audio-quality 0 \
  --embed-thumbnail \
  --embed-metadata \
  --download-archive dist-mp3.txt \
  -o "distribucion/mp3/%(playlist_index)03d - %(title)s.%(ext)s" \
  "https://youtube.com/playlist?list=PLcultiva2024ABCDEF"
Subtítulos ES — Sin redescargar video
SRT
# Solo subtítulos, sin bajar el video
yt-dlp \
  --skip-download \
  --write-sub \
  --write-auto-sub \
  --sub-lang es \
  --convert-subs srt \
  -o "subtitulos/es/%(title)s" \
  "https://youtube.com/@CultivaSonora/videos"

# Listar idiomas disponibles antes:
yt-dlp --list-subs "URL_VIDEO"
Pipeline Whisper — Transcripción
WAV
# Descargar entrevista como WAV para Whisper
yt-dlp -x \
  --audio-format wav \
  -o "temp/%(title)s.%(ext)s" \
  "URL_ENTREVISTA"

# Transcribir con Whisper v3
whisper "temp/entrevista.wav" \
  --model large-v3 \
  --language es \
  --output_format srt,txt \
  --output_dir transcripciones/
🎤
Catálogo Cultiva Sonora
Artista Tracks Formato Estado
Neurona Verde 18 FLAC + MP3 Descargado
Pulso Lateral 12 FLAC + MP3 Descargado
Deriva Sonora 9 MP3 En proceso
Entorno 440 6 MP3 En cola
~/cultiva-sonora/
📁 archivo-maestro/
📁 Neurona Verde/
│ │ 🎵 2024 - Bosque Eléctrico.flac48 MB
│ │ 🎵 2024 - Latido Verde.flac52 MB
│ │ 🎵 2023 - Raíz Digital.flac39 MB
📁 Pulso Lateral/
🎵 2024 - Frecuencia 7.flac61 MB
📁 distribucion/
📁 mp3/
🎶 001 - Bosque Eléctrico.mp311 MB
🎶 002 - Latido Verde.mp312 MB
📁 subtitulos/
📁 es/
📄 Bosque Eléctrico.es.srt
📁 transcripciones/
📝 entrevista-neurona.txt
📄 entrevista-neurona.srt
📋 archivo-maestro.txt(45 IDs)
Configuración Global (~/.config/yt-dlp/config)
⚙️
~/.config/yt-dlp/config
Activo
# Formato por defecto: mejor video hasta 1080p, MP4
-f bestvideo[height<=1080][ext=mp4]+bestaudio[ext=m4a]/best[height<=1080]

# Plantilla de salida organizada por uploader
-o %(uploader)s/%(title)s.%(ext)s

# Metadatos y thumbnail embebidos siempre
--embed-metadata
--embed-thumbnail

# Evitar re-descargas (archivo global)
--download-archive ~/.local/share/yt-dlp/archive.txt

# Rate limiting para no ser bloqueado
--rate-limit 10M
--sleep-interval 3

# Subtítulos automáticos en español
--write-auto-sub
--sub-lang es
--convert-subs srt
Integraciones del Pipeline
🎛️
yt-dlp + ffmpeg
Merge de streams de vídeo/audio y conversión entre formatos sin pérdida de calidad.
yt-dlp -x --audio-format flac "URL"
🧠
yt-dlp + Whisper
Descarga como WAV y transcripción automática con OpenAI Whisper v3 en español.
whisper audio.wav --model large-v3 --language es
📦
Batch + Archive
Descarga masiva desde lista de URLs con tracking de duplicados y reintentos automáticos.
yt-dlp -a urls.txt --download-archive done.txt