¿Por qué mi voz suena distinta en una grabación?
La respuesta corta
Porque al hablar oyes tu voz por dos caminos: por el aire, como todos, y por las vibraciones que viajan por los huesos del cráneo hasta el oído interno. La grabación solo capta la parte que va por el aire, que es la voz que oyen los demás; le falta el refuerzo de los huesos en las frecuencias medias y bajas.
Dos caminos hasta tu oído
Cuando hablas, las cuerdas vocales no solo mueven el aire que sale por la boca. También hacen vibrar la garganta, la mandíbula y los huesos del cráneo, y esas vibraciones llegan directo al oído interno. Así que tu voz te llega por dos vías a la vez: la conducción aérea, que entra por la oreja como cualquier otro sonido, y la conducción ósea, que viaja por dentro de la cabeza.[4]
Los demás solo reciben la primera. Un micrófono, también. Por eso la grabación suena “rara”: es tu voz sin la parte que solo tú escuchas.[2]
Tu voz te llega por el aire (flecha de afuera) y por los huesos del cráneo (flecha de adentro). A los demás, y al micrófono, solo les llega la de afuera.
Qué le falta a la grabación
No es un detalle. El físico Georg von Békésy midió en 1949 cuánto perdía la gente del volumen de su propia voz al bloquear la parte aérea con tubos rellenos de algodón en los oídos: unos 6 decibeles, lo que indica que las dos vías tienen una fuerza parecida.[1]
Pero no pesan igual en todas las frecuencias. En 2010, un grupo de la Universidad Tecnológica Chalmers y la Universidad de Linköping, en Suecia, midió la voz de 20 personas mientras pronunciaban diez fonemas, con y sin unas orejeras grandes que bloqueaban el aire. La conducción ósea dominaba entre 1000 y 2000 hercios en la mayoría de los fonemas, y en las vocales como la “i” y la “e” desde unos 700 hercios.[1]
Otro experimento lo midió al revés: le pidió a la gente que arreglara su grabación hasta que sonara como se oye a sí misma. En la Universidad Stanford y la Universidad Nacional de Seúl, 21 personas —8 músicos aficionados y 13 estudiantes de canto lírico— grabaron su voz y la pasaron por un ecualizador de ocho bandas. Casi todos subieron las mismas frecuencias: la franja de 300 a 1200 hercios, la de los medios y graves de la voz hablada.[2] A esa grabación le faltaba “cuerpo”, y eso es lo que aportan los huesos.
| Oyente | Por el aire | Por los huesos |
|---|---|---|
| Tú, al hablar | Sí | Sí |
| Otra persona | Sí | No |
| Un micrófono | Sí | No |
| Tú, con los oídos tapados | Atenuado | Sí, reforzado en graves |
Fuente: Reinfeldt et al. 2010; Won, Berger y Slaney 2014.
Cómo lo sabemos
El problema de fondo es que no se puede poner un micrófono en el oído interno de una persona que habla. Por eso los experimentos separan las dos vías de a una. Von Békésy bloqueó el aire con tubos rellenos de algodón que no tapaban del todo el conducto, para no alterar la parte ósea, y comparó cuánto bajaba el volumen.[1]
Reinfeldt y sus colegas lo hicieron con más precisión. Diseñaron una orejera grande que atenuaba el sonido del aire en al menos 20 decibeles sin sellar el conducto, porque sellarlo refuerza artificialmente los graves de la vía ósea (el “efecto de oclusión”, el de hablar con los oídos tapados). Con un micrófono dentro del conducto auditivo midieron la presión del sonido con la orejera puesta, que es casi toda ósea, y con el oído abierto, y además midieron los umbrales de audición de cada persona por aire y por hueso para convertir esas presiones en lo que realmente se oye.[1] El método del ecualizador de Stanford no mide el sonido sino la percepción, y por eso complementa al primero: los dos coinciden en que la vía ósea refuerza las frecuencias medias.
Lo que se suele decir mal
“La grabación te hace sonar más agudo” es una simplificación. La vía ósea no suma graves profundos: refuerza sobre todo la franja media de la voz, entre unos cientos y 2000 hercios según el sonido.[1][2] Lo que se nota al escuchar la grabación es la falta de ese “cuerpo”, y el resultado se percibe como una voz más fina.
Y el disgusto no es solo acústico. En un estudio con 80 personas, cuando evaluaban grabaciones sin saber que entre ellas estaba la propia, calificaban su voz como más atractiva de lo que la calificaban los demás.[3] El rechazo aparece cuando sabemos que somos nosotros y la voz no coincide con la que llevamos toda la vida oyendo.
Otras preguntas
¿Cuál es mi voz de verdad?
Para los demás, la de la grabación (si el micrófono y el parlante son buenos). La que oyes al hablar existe solo para ti, porque suma la parte que llega por los huesos de tu cabeza.
¿Por qué me tapo los oídos y me oigo más fuerte?
Al taparte los oídos atenúas lo que llega por el aire, pero el sonido que viaja por los huesos queda encerrado en el conducto auditivo y se refuerza en las frecuencias bajas. Es el mismo efecto que molesta a muchos usuarios de audífonos.
¿A todos les pasa?
Sí: el doble camino es anatomía, no sensibilidad. Lo que cambia de una persona a otra es cuánto les molesta, y en un estudio, quienes no sabían que estaban oyendo su propia grabación la calificaron mejor que los demás.
Fuentes
- Reinfeldt S, Östli P, Håkansson B, Stenfelt S. Hearing one's own voice during phoneme vocalization — Transmission by air and bone conduction . Journal of the Acoustical Society of America, 128(2): 751-762 (2010). primaria 20 personas, 10 fonemas: la conducción ósea domina la propia voz entre 1 y 2 kHz en la mayoría de los fonemas. Resume también el experimento de von Békésy (1949): la parte aérea y la ósea tienen una magnitud parecida.
- Won SY, Berger J, Slaney M. Simulation of One's Own Voice in a Two-parameter Model . Proceedings of the 13th International Conference on Music Perception and Cognition (ICMPC) (2014). primaria 21 cantantes ajustaron un ecualizador hasta que su grabación sonara como se oían: reforzaron sobre todo la banda de 300 a 1200 Hz.
- Hughes SM, Harrison MA. I like my voice better: self-enhancement bias in perceptions of voice attractiveness . Perception, 42(9): 941-949 (2013). primaria 80 personas calificaron grabaciones sin saber que estaba la propia: puntuaron su voz como más atractiva que como la puntuaron los demás. Leído el resumen.
- Hengen J, Hammarström IL, Stenfelt S. Perception of One's Own Voice After Hearing-Aid Fitting for Naive Hearing-Aid Users and Hearing-Aid Refitting for Experienced Hearing-Aid Users . Trends in Hearing, 24 (2020). La propia voz es una combinación de vibraciones por el aire y por las estructuras de la garganta y la cabeza; el rechazo a la propia voz es una queja común de quienes usan audífonos.
Publicado el 27 de septiembre de 2026. Revisado contra las fuentes el . ¿Ves un error? Avísanos.
Para seguir mirando
¿Cuál es la velocidad del sonido?
En el aire a 20 °C, el sonido viaja a unos 343 metros por segundo (1235 km/h), y a 0 °C baja a 331 m/s porque depende de la temperatura. En el agua de mar va a unos 1500 m/s, más de cuatro veces más rápido.
¿Por qué vemos el rayo antes de oír el trueno?
Porque la luz viaja a 300.000 km por segundo y el sonido a unos 340 metros por segundo, casi 900.000 veces más lento. El destello llega en millonésimas de segundo; el trueno tarda unos 3 segundos por cada kilómetro de distancia.
¿Es verdad que los humanos tenemos solo cinco sentidos?
Más de cinco: la lista de vista, oído, olfato, gusto y tacto es de Aristóteles, de hace más de 2.300 años. La neurociencia suma al menos el equilibrio y la propiocepción, y los especialistas discuten si el total es seis, siete, ocho o más según el criterio.
¿A cuántos kilómetros está el horizonte?
Para una persona de pie a la orilla del mar, con los ojos a 1,7 m de altura, el horizonte está a unos 4,7 km en línea recta, y a unos 5 km si se cuenta la curvatura normal de la luz en el aire. La distancia crece con la raíz cuadrada de la altura: a 100 m ya son unos 36 a 39 km.
¿Cómo avanza un cohete en el vacío?
Un cohete no necesita aire: expulsa gases hacia atrás a varios kilómetros por segundo y, por la tercera ley de Newton, los gases lo empujan hacia adelante. En el vacío rinde incluso más: el motor RS-25 de la NASA da unos 2279 kN de empuje en vacío contra 1859 kN al nivel del mar.
¿Por qué cambia el sonido de la sirena al pasar?
Por el efecto Doppler: mientras la ambulancia se acerca, cada onda de sonido sale un poco más cerca de ti que la anterior, las ondas llegan más juntas y el tono sube; al alejarse, llegan más separadas y baja. A 100 km/h, el salto entre ambos tonos es de casi 3 semitonos.






