Revisión editorial

Comprender y medir tu frecuencia vocal en Hz

Qué mide la frecuencia fundamental, cómo un detector convierte un sonido en número, qué dicen realmente las normas publicadas y cómo obtener una medición comparable.

Por Equipo editorial de BasaltonePolítica editorial

Un número en hercios es lo más concreto que puedes saber de tu voz. También es lo más fácil de malinterpretar. Esta guía explica qué es ese número, cómo lo produce un detector, qué dicen realmente los datos de población y cómo obtener dos mediciones honestamente comparables.

Qué mide un hercio

Un hercio equivale a un ciclo por segundo. Durante un sonido sonoro, tus pliegues vocales se abren y se cierran siguiendo un patrón repetitivo. El ritmo de esa repetición es la frecuencia fundamental, que se escribe F0. A 120 Hz los pliegues completan 120 ciclos de apertura y cierre cada segundo.

El tono es la percepción asociada a F0, y ambos están relacionados sin ser idénticos. El volumen, el timbre, la audición de quien escucha e incluso la frase que rodea al sonido desplazan un poco el tono percibido. F0 es lo que mide una máquina. El tono es lo que oye una persona.

Cómo un detector convierte un sonido en número

Un detector no mide toda tu voz de una vez. Toma un fragmento breve de audio, evalúa cuán periódico es y estima el ritmo de repetición. En Basaltone ese fragmento es de 2048 muestras, unos 43 milisegundos en un micrófono habitual de 48 kHz, y el análisis se ejecuta 30 veces por segundo.

Dos cosas importan más que el algoritmo.

La primera es el rechazo. No todos los fragmentos merecen un número. Basaltone puntúa la periodicidad de cada uno y descarta lo que baja de 0,75 en esa escala, que es a lo que se parecen los ataques aireados, las consonantes y el ruido de la sala. También elimina todo lo que queda fuera de 60 a 500 Hz, y trata un salto mayor de 5 semitonos como sospechoso hasta que varias lecturas consecutivas coinciden, porque un salto aislado del orden de la octava casi siempre es un error de detección y no un movimiento vocal real.

La segunda es el suavizado. Una lectura cruda fotograma a fotograma tiembla mucho más que tu voz. Las lecturas aceptadas pasan por un filtro de mediana corto y después por un suavizado exponencial que trabaja en semitonos y no en hercios, porque pasos iguales en semitonos suenan iguales al oído y los pasos iguales en hercios no.

Una decisión va deliberadamente en contra del uso habitual del audio: Basaltone pide al navegador que desactive la cancelación de eco, la reducción de ruido y el control automático de ganancia. Esos procesos mejoran las llamadas remodelando la señal, que es justo lo que una medición no debe hacer.

Qué dicen realmente las cifras publicadas

Aquí es donde fallan casi todas las páginas: citan un rango sin fuente y lo presentan como un estándar que hay que alcanzar.

El mayor estudio poblacional reciente sobre el tema, de Berg y sus colegas en el Journal of Voice, midió a 2472 adultos de 40 a 79 años en Alemania. A nivel conversacional encontró una F0 media de unos 112 Hz en hombres y unos 169 Hz en mujeres.

El resultado interesante no son las medias. Es que la media femenina se sitúa varios semitonos por debajo de los valores que recogen los manuales más antiguos. Las normas poblacionales cambian con la década, el país, el método de grabación y la tarea que se pidió a quien habla.

Trata los rangos publicados como una descripción de grupos, no como un objetivo personal. Una voz que queda fuera no tiene ningún problema, y una voz que queda dentro no es «correcta». Tu primera medición es una referencia mucho más útil que cualquier media poblacional, porque es el único número con el que tus mediciones posteriores pueden compararse legítimamente.

Obtener una medición comparable

Una lectura aislada dice muy poco. Dos lecturas comparables dicen mucho. Casi todo el trabajo consiste en mantener constante todo salvo tu voz.

Mantén constantePor qué importa
La frase que leesPalabras distintas llevan entonación y tono medio distintos
La distancia al micrófonoEl nivel cambia qué fotogramas suaves superan el umbral de ruido
La salaEl ruido de fondo sube el umbral y elimina tus fotogramas más suaves
El momento del díaLas voces suelen situarse más abajo poco después de despertar
El nivel de esfuerzoHablar más alto sube la F0 mucho antes de que se perciba fuerte

Dos hábitos importan más que cualquier equipo.

Habla el tiempo suficiente. Basaltone solo cuenta una sesión para tu progresión a partir de 60 segundos, porque las muestras más cortas quedan dominadas por la frase que dijiste por casualidad.

Compara medianas, no extremos. La nota más grave que puedes producir un instante no es tu tono de habla, y no es estable de un día a otro. Basaltone informa del grave y el agudo de una sesión como los percentiles 10 y 90 de tus lecturas en vez del mínimo y el máximo crudos, para que un solo fotograma con crujido no defina tu rango.

Qué cuenta como un cambio real

Los hercios no son perceptivamente regulares. Los mismos 5 Hz no valen lo mismo en la parte alta y en la baja de una voz, y por eso la aplicación razona internamente en semitonos y divide tu recorrido en escalones de 0,75 semitonos.

Punto de partidaUn escalón de 0,75 semitonos
100 Hzunos 4,4 Hz
120 Hzunos 5,3 Hz
165 Hzunos 7,3 Hz
200 Hzunos 8,9 Hz

Lee la tabla en los dos sentidos. Una diferencia de 6 Hz a 165 Hz es menor de lo que parece. La misma diferencia a 100 Hz supera un escalón entero. También significa que dos o tres hercios de diferencia entre dos sesiones no son información, son dispersión de la medida.

Como las sesiones aisladas se dispersan, Basaltone nunca te hace progresar con un solo resultado. Toma la mediana de tus últimas cinco sesiones válidas y se mueve como mucho un escalón por sesión, en cualquier dirección. Duración y progreso del entrenamiento vocal explica cómo leer esa curva a lo largo de las semanas.

El límite de un solo número

F0 es una dimensión de la voz, y no aquella a la que más responden quienes escuchan. No mide la resonancia, ni los formantes, ni el peso vocal, ni la articulación, ni el ritmo y los patrones de entonación de tu habla. Dos personas con hercios casi idénticos pueden sonar muy distintas, que es el tema de tono, timbre, resonancia y formantes.

Tampoco determina una identidad, un estado de salud ni cómo te percibirá una persona concreta. Un detector de tono es una cinta métrica, no un veredicto. Si un número te empuja a forzar la voz hacia abajo, ha dejado de ser útil: consulta fatiga, tensión y seguridad vocal para las señales que importan más que cualquier medición, y el entrenamiento para una voz más grave para el lugar que ocupa una medición en la práctica real.

La prueba pública de Basaltone analiza el audio localmente en tu navegador y no guarda ninguna grabación.

Medir mi voz de referencia

Fuentes

Seguir leyendo

Registro para la beta cerrada

Ayúdanos a construir Basaltone

Cuéntanos qué quieres lograr con tu voz. Revisamos cada solicitud e invitamos por correo a las personas seleccionadas.