Lector de texto en voz alta con 10 acentos del español
Gratis, sin cuenta. Elige la región y escucha.
36 voces de 36 personas distintas, de España y de América, cada una con su acento medido. Te llevas un MP3 sin marca de agua. Y 64 idiomas más se leen con una voz nativa.

- 36
- voces en español
- 10
- regiones, cada voz medida
- 64
- idiomas con voz nativa
- gratis
- siempre, sin cuenta
Diez regiones, no «español de España» y «español latino»
Casi todas las herramientas te dan dos opciones: España o «latino». Aquí hay diez, y no las hemos inventado nosotros: son las diez etiquetas que las propias personas eligieron al grabar en Common Voice. Una voz de Buenos Aires no suena como una de Bogotá, y una de Canarias no suena como una de Madrid.
- 10 regiones
- 36 voces
- Common Voice, CC0 1.0
Asturias, Castilla y León, Cantabria, País Vasco, Navarra, Aragón, La Rioja
España, norte
La zona donde nació el castellano y donde la zeta suena más nítida.
- el autobús
- autobús
- el coche
- coche
- la piscina
- piscina
- el teléfono móvil
- móvil
- la patata
- patata
- tú
- tú
- «caza» y «casa»
- distintas
4 voces de España, norte
- Nekanemujer, distingue casa y caza
- Covadongamujer, distingue casa y caza
- Íñigohombre, distingue casa y caza
- Gorkahombre, distingue casa y caza
Todas leyeron frases en español estándar. Lo que oyes es el estándar con la pronunciación de cada región, no jerga ni habla de barrio. Las palabras que pegas se leen tal como las escribes. Las diez regiones, una por una.
¿Esta voz dice «caza» o dice «casa»?
Nueve de cada diez hispanohablantes sesean: pronuncian la zeta igual que la ese. Una máquina que clona voces oye mucho español de un lado y otro, y a veces se le escapa: le pone la zeta de Madrid a una voz de Lima, o se la quita a una de Valladolid. Por eso medimos cada voz antes de ponerla en la lista.
- 8
- distinguen
- 26
- sesean
- 2
- sin concluir
Cada voz lee dos frases: una llena de zetas y ces («cazar, cocer, Zaragoza»), otra con las mismas vocales pero solo con eses. Un análisis acústico mide cuánta energía aguda tiene cada frase: la ese es un ruido agudo y fuerte, la zeta castellana es débil. Si la frase con zetas suena mucho menos aguda, la voz distingue; si suenan igual, sesea. La voz que contradice a la región que su dueño declaró no entra en el selector.
La medición, voz por voz36 voces de 36 personas distintas
La línea de onda junto a cada nombre está medida en el archivo que puedes escuchar; no es un dibujo. La cifra en hercios es el tono medio de ese mismo archivo. 18 mujeres y 18 hombres. Pulsa «Usar» para llevar una voz al lector de arriba.
- 18 mujeres, 18 hombres
- 91 a 260 Hz
- CC0 1.0
- Nekane
España, norte · mujer · 214 Hz
Zeta y ese: distingue
- Covadonga
España, norte · mujer · 208 Hz
Zeta y ese: distingue
- Íñigo
España, norte · hombre · 162 Hz
Zeta y ese: distingue
- Gorka
España, norte · hombre · 137 Hz
Zeta y ese: distingue
- Genoveva
España, centro · mujer · 176 Hz
Zeta y ese: sin concluir
- Braulio
España, centro · hombre · 141 Hz
Zeta y ese: distingue
- Rocío
España, sur · mujer · 221 Hz
Zeta y ese: sesea
- Macarena
España, sur · mujer · 202 Hz
Zeta y ese: distingue
- Cristóbal
España, sur · hombre · 123 Hz
Zeta y ese: distingue
- Curro
España, sur · hombre · 119 Hz
Zeta y ese: distingue
- Naira
Canarias · mujer · 227 Hz
Zeta y ese: sesea
- Idaira
Canarias · mujer · 172 Hz
Zeta y ese: sin concluir
- Ayoze
Canarias · hombre · 134 Hz
Zeta y ese: sesea
- Yeray
Canarias · hombre · 121 Hz
Zeta y ese: sesea
- Xóchitlelegida
México · mujer · 218 Hz
Zeta y ese: sesea
- Cuauhtémoc
México · hombre · 160 Hz
Zeta y ese: sesea
- Tonatiuh
México · hombre · 135 Hz
Zeta y ese: sesea
- Dayana
Caribe · mujer · 188 Hz
Zeta y ese: sesea
- Yaritza
Caribe · mujer · 174 Hz
Zeta y ese: sesea
- Yoel
Caribe · hombre · 156 Hz
Zeta y ese: sesea
- Yesenia
Centroamérica · mujer · 218 Hz
Zeta y ese: sesea
- Ixchel
Centroamérica · mujer · 200 Hz
Zeta y ese: sesea
- Nahúm
Centroamérica · hombre · 136 Hz
Zeta y ese: sesea
- Balam
Centroamérica · hombre · 113 Hz
Zeta y ese: sesea
- Killa
Andes y Pacífico · mujer · 245 Hz
Zeta y ese: sesea
- Illari
Andes y Pacífico · mujer · 167 Hz
Zeta y ese: sesea
- Amaru
Andes y Pacífico · hombre · 139 Hz
Zeta y ese: sesea
- Inti
Andes y Pacífico · hombre · 135 Hz
Zeta y ese: sesea
- Agustina
Río de la Plata · mujer · 226 Hz
Zeta y ese: sesea
- Milagros
Río de la Plata · mujer · 199 Hz
Zeta y ese: sesea
- Facundo
Río de la Plata · hombre · 121 Hz
Zeta y ese: sesea
- Nahuel
Río de la Plata · hombre · 91 Hz
Zeta y ese: sesea
- Millaray
Chile · mujer · 260 Hz
Zeta y ese: sesea
- Rayen
Chile · mujer · 222 Hz
Zeta y ese: sesea
- Lautaro
Chile · hombre · 135 Hz
Zeta y ese: sesea
- Vicente
Chile · hombre · 123 Hz
Zeta y ese: sesea
Fuente: Common Voice 17 de Mozilla, bajo CC0 1.0. Las personas grabaron en casa con el micrófono que tenían; de cada una se eligió la grabación más limpia, se descartó todo lo que quedaba por debajo de un umbral medido de ruido, y un reconocedor de voz comprobó que la voz construida lee bien. Sobre el proyecto explica cómo se hizo la selección.
Con ocho segundos de grabación, la voz puede ser la tuya
Ninguna otra página gratuita en español lo ofrece.
Grabaciones de hasta 2 MB y como máximo 5 voces al día por dirección IP. Tu voz recibe un código aleatorio que solo se guarda en este navegador: Cedilla no tiene una lista común de voces, ninguna página muestra el código y no hay ningún camino por el que tu voz pueda hacerse pública. La otra cara de la moneda: si borras los datos del navegador o cambias de equipo, la voz se pierde.
- 1
El cuadro para subir la grabación está justo debajo del selector de voz, arriba. Sube un fragmento de 3 a 8 segundos: una sola persona, hablando claro, sin música de fondo.
- 2
La máquina aprende la voz en unos diez segundos. Después queda en tu lista y ya está seleccionada.
- 3
Úsala como cualquier otra, también en otros idiomas. Las palabras se leen bien, pero el acento de tu grabación se sigue oyendo.
- 4
Pulsa «Borrar» cuando quieras. La voz desaparece de este equipo y el servidor recibe la orden de olvidar la grabación.
Cuatro pasos, menos de un minuto
- 1
Pega el texto
Escribe o pega tu texto en el cuadro de arriba. Hasta 500 palabras de una vez, tantas veces como quieras.
- 2
Elige región y voz
Puedes escucharlas todas antes. Cada voz es una persona distinta, no una variante de la misma máquina.
- 3
Escucha
Un texto de 500 palabras tarda unos 17 segundos. Mientras tanto la página muestra los segundos que van pasando.
- 4
Descarga el MP3
Sin marca de agua. Para estudiar, para un vídeo, para el trabajo, para lo que necesites.
64 idiomas más, leídos por alguien que los habla desde la cuna
Cada uno de estos 64 idiomas tiene una voz construida a partir de la grabación de una persona que lo habla de nacimiento, y un reconocedor de voz la comprobó antes de ponerla aquí. Inglés, portugués, catalán, gallego, francés e italiano están entre ellos. Un idioma sin voz nativa no tiene botón de escucha. La frase bajo cada nombre viene de la Declaración Universal de los Derechos Humanos.
- 64 con hablantes nativos
- 646 códigos de idioma en total
Al lado de las otras páginas gratuitas
Los datos están tomados de las propias páginas de cada servicio el 6 de septiembre de 2026.
| Característica | Cedilla | TTSReader | Speechify | SpeechGen |
|---|---|---|---|---|
| Voces en español | 36 personas distintas | las del navegador o del sistema | no lo indica | «207», de varias máquinas |
| Regiones | 10, elegidas por cada hablante | España y «latino» | España, México, Argentina y «latino» | por país, sin número de personas |
| Acento comprobado | sí: medición de zeta y ese en cada voz | no | no | no |
| Origen de las voces | Common Voice, CC0 1.0 | no lo indica | no lo indica | no lo indica |
| Gratis de una vez | 500 palabras (unos 3 000 caracteres) | sin límite claro, voces del sistema | con cuenta, plan de pago para voces mejores | 1 000 caracteres sin registro |
| Tu propia voz | sí, gratis | no | de pago | de pago |
| Cuenta necesaria | no | no | sí | no |
| Licencia de las voces | CC0 1.0, sin condiciones | no lo indica | no lo indica | no lo indica |
Preguntas que nos hacen
¿Es gratis de verdad?
Sí. Sin cuenta, sin periodo de prueba y sin tarjeta. Puedes leer 500 palabras de una vez (3800 caracteres), 60 veces al día desde la misma dirección IP, con 5 segundos entre una lectura y la siguiente. Los límites existen porque una sola tarjeta gráfica genera el audio para todo el mundo, no porque después llegue una factura.
¿Tiene voces latinas o solo de España?
Las dos cosas, y bastante más fino que eso. Hay 10 regiones: cuatro de España (norte, centro, sur y Canarias) y seis de América (México, Caribe, Centroamérica, Andes y Pacífico, Río de la Plata y Chile). Cada persona eligió su región al grabar; nosotros no adivinamos nada a partir del sonido.
¿Qué es el seseo y por qué lo medís?
Sesear es pronunciar la zeta y la ce igual que la ese: «caza» suena como «casa». Así habla toda Hispanoamérica, Canarias y buena parte de Andalucía; el resto de España distingue los dos sonidos. Lo medimos porque una voz clonada puede cambiar de bando sin querer, y una voz «de México» con zeta madrileña es una voz que miente. La medición está en la ficha de cada voz.
¿De dónde salen las voces?
De Common Voice, el corpus abierto de Mozilla. Personas voluntarias leen frases y declaran ellas mismas su región y su género. Todo el material está bajo CC0 1.0: no hay que pedir permiso ni citar a nadie. De cada persona tomamos la grabación más limpia, y un reconocedor de voz comprobó que la voz construida lee bien.
¿Cuántas voces hay y cómo se reparten?
36 voces en español: 18 de mujeres y 18 de hombres, en 10 regiones. Cada voz es una persona; no hay dos ajustes de la misma. Además, 64 idiomas más tienen una voz de alguien que los habla desde la cuna, y en total la página puede leer 646 códigos de idioma.
¿Puedo usar el audio en YouTube o en un trabajo comercial?
Sí. El MP3 no lleva marca de agua y las voces están bajo CC0 1.0, lo más cerca de «sin condiciones» que puede estar una licencia. No tienes que citar a Cedilla ni a la fuente. La responsabilidad sobre lo que haces leer es tuya.
¿Guardan mi texto?
No. El texto se lee y se olvida. El archivo de audio se queda hasta un día en el servidor para que puedas volver a descargarlo, y después se borra solo. No hay ninguna cuenta a la que asociarlo.
¿Lee bien los números y las abreviaturas?
Casi siempre, pero es el punto más frágil de cualquier lector. Un año («1998») o una cantidad con decimales pueden salir raros, y «Sr.», «pág.» o «EE. UU.» a veces se leen letra a letra. Si un número tiene que salir perfecto, escríbelo con letras. La página te avisa cuando el idioma elegido no ha sido comprobado con cifras.
¿Puedo crear mi propia voz?
Sí, con una grabación de 3 a 8 segundos. El cuadro está bajo el selector de voz, arriba. La voz recibe un código aleatorio que solo se guarda en tu navegador: no hay lista común y ninguna página muestra el código. Sube solo tu propia voz o una para la que tengas permiso.
¿Tenéis la voz de Loquendo?
No. Loquendo es una voz de máquina de los años 2000 que se busca sobre todo para hacer memes, y aquí no hay ninguna voz de máquina: todas están construidas a partir de la grabación de una persona real. Si lo que quieres es ese sonido robótico, esta no es tu página, y preferimos decirlo antes de que pruebes.
¿Por qué no suenan como en un estudio?
Porque no lo son. Las personas de Common Voice grabaron en casa, con el micrófono que tenían. De cada una tomamos el fragmento más limpio y descartamos todo lo que estaba por debajo de un umbral de ruido, pero un estudio es otra cosa. A cambio, son personas reales de diez regiones, y eso es exactamente lo que ninguna voz de estudio te puede dar.
Actualizado el 2026-09-06