Editar video con IA

Corta-silencios

El script que detecta los silencios con ffmpeg, transcribe con Whisper con tiempos por palabra, cruza las dos cosas para no cortar nunca a mitad de una palabra, y devuelve el video limpio más la lista de cortes.

Para qué sirve

Una grabación de 10 minutos tiene 3 de silencios, dudas y arranques. Cortarlos a mano es una hora. El script lo hace en el tiempo que tarda en transcribir, y no se come sílabas porque sabe dónde termina cada palabra.

Cómo funciona

  1. ffmpeg marca cada tramo por debajo de un umbral de volumen (por defecto -35 dB) que dure más de 0,35 segundos.
  2. whisper transcribe con el inicio y el fin de cada palabra.
  3. Se cruzan: un silencio se corta solo si cae completo entre el fin de una palabra y el inicio de la siguiente. Si un tramo «silencioso» tiene una palabra adentro (un «eh» bajito), no se corta.
  4. Se deja un margen de 0,12 segundos a cada lado para que no suene apretado.
  5. Los cortes se aplican en seco, sin fundidos.

Uso

python corta-silencios.py entrada.mp4 --salida limpia.mp4 --umbral -35 --minimo 0.35 --margen 0.12

Deja también limpia.cortes.json con cada corte (inicio, fin, la última palabra antes y la primera después) para revisar en un minuto.

Los parámetros que cambian el resultado

ParámetroSúbelo si…Bájalo si…
Umbral (dB)Hay ruido de fondo y no detecta silenciosCorta respiraciones que quieres dejar
Mínimo (s)Corta pausas expresivasQuedan huecos largos
Margen (s)Suena atropelladoQuedan colas de aire

Las trampas ya pagadas

Qué NO resuelve

No elige entre tomas repetidas (si dijiste la frase tres veces, deja las tres). Para eso está «Corte por guion».

Siguiente paso

«Kit de edición» junta este script con el spec de edición para que el montaje salga con tu estética.

Si quieres aplicarlo con ayuda

Estos recursos son para dueños de negocio, marcas personales, y para quien quiere vender IA o escalar su agencia. Si quieres que lo veamos para tu caso, escríbeme y te digo por dónde partir.

Escribirle a Ignacio por WhatsApp