#125 · Herramienta de audio en el navegador

Etiquetador de segmentos de voz

Divide un audio hablado en tramos probables de voz usando un umbral de energía y silencios mínimos. Después puedes asignar etiquetas a cada segmento y exportar las marcas.

Audio hablado

Segmentación local por energía
Ningún archivo de audio seleccionado
Elige un archivo de audio para comenzar.
El audio se procesa localmente en tu navegador y no se sube a ningún servidor.
Publicidad

Cómo usar Etiquetador de segmentos de voz

  1. Carga un audio hablado.
  2. Configura el umbral, el silencio mínimo y la duración mínima.
  3. Pulsa “Detectar segmentos”.
  4. Edita las etiquetas de cada tramo en la lista de resultados.
  5. Descarga el CSV de marcas si necesitas reutilizar las etiquetas.

Qué hace esta herramienta de audio

El etiquetador crea una segmentación básica basada en energía. No realiza reconocimiento de voz ni identificación automática de hablantes; su objetivo es preparar intervalos temporales que puedas nombrar manualmente.

Se calcula RMS por ventanas, se agrupan ventanas activas separadas por silencios cortos y se descartan segmentos demasiado breves. Las etiquetas se guardan con inicio y fin.

La detección por energía no distingue voz de música u otros sonidos fuertes. Para diarización real de hablantes se necesitaría un modelo especializado que no está incluido.

Formatos compatibles y límites

Funciona con audio decodificable por Web Audio. El CSV de etiquetas se genera localmente.

PódcastAdecuado para separar bloques de conversación y pausas.
EntrevistasÚtil para crear marcas antes de etiquetar manualmente.
Música con vozPuede detectar música como actividad sonora.
Ruido constantePuede requerir un umbral superior.

Ejemplo y consejos prácticos

Ejemplo práctico

En una entrevista de 3 minutos, el detector encuentra 14 tramos activos. Puedes renombrarlos como “Presentador”, “Invitado” o “Pregunta 1” y exportar inicio y fin en CSV.

Consejos

  • Ajusta el umbral para que el ruido de fondo no se considere voz.
  • Usa silencios mínimos más largos para unir frases cercanas.
  • Revisa y corrige las etiquetas antes de utilizarlas como capítulos o anotaciones.

Preguntas frecuentes

¿Cómo dividir una grabación de voz en segmentos por silencios?

Configura un umbral de voz y un silencio mínimo. La herramienta agrupa la actividad sonora y crea un segmento nuevo cuando la pausa supera ese límite.

¿Cómo etiquetar partes de una entrevista con marcas de tiempo?

Después de detectar los segmentos, edita el nombre de cada fila y exporta el CSV para conservar etiqueta, tiempo inicial y tiempo final.

¿Este etiquetador reconoce automáticamente quién está hablando?

No. Detecta actividad sonora probable, pero la identificación de hablantes requiere diarización con modelos especializados.

¿Qué silencio mínimo usar para separar frases en un pódcast?

Entre 300 y 700 ms suele ser un rango útil como punto de partida, aunque depende del ritmo de habla y de cuánto quieras agrupar las frases.

¿Por qué la música aparece como un segmento de voz?

El algoritmo se basa en energía y no clasifica el contenido. Música, golpes o ruido intenso también pueden superar el umbral y considerarse actividad.

Herramientas de audio relacionadas

Salida de segmentación

DetecciónRMS por ventanas de 20 ms.
AgrupaciónUne actividad separada por silencios cortos.
EtiquetasEditables manualmente en el navegador.
ExportaciónCSV con etiqueta, inicio y fin.

Explora más herramientas de audio

Categorías de Callaudio
Edición y recorte de audio

Corta, divide, une, aplica fundidos, invierte y organiza audio.

Ver todo
Conversión y exportación de audio

Convierte y exporta formatos habituales compatibles con el navegador.

Ver todo
Volumen y sonoridad

Ajusta la ganancia, normaliza niveles y analiza la sonoridad.

Ver todo
Velocidad, tono y temporización

Modifica la reproducción, el tono, el tempo, los retardos y la temporización.

Ver todo
Grabación y voz

Graba, prueba, supervisa y prepara audio de voz.

Ver todo
Pódcast y voz hablada

Prepara audio hablado, segmentos de pódcast y transcripciones.

Ver todo
Práctica musical y tono

Practica con tonos, tempo, afinación y ayudas rítmicas.

Ver todo
Análisis de audio y metadatos

Analiza la forma de onda, la frecuencia, la duración, los picos y las etiquetas.

Ver todo