Ir al lector

Lector de texto en voz alta con 10 acentos del español

Gratis, sin cuenta. Elige la región y escucha.

36 voces de 36 personas distintas, de España y de América, cada una con su acento medido. Te llevas un MP3 sin marca de agua. Y 64 idiomas más se leen con una voz nativa.

Dial de un transistor de los años sesenta con una aguja azul sobre una escala de marcas
26 / 500 palabras
36
voces en español
10
regiones, cada voz medida
64
idiomas con voz nativa
gratis
siempre, sin cuenta

Diez regiones, no «español de España» y «español latino»

Casi todas las herramientas te dan dos opciones: España o «latino». Aquí hay diez, y no las hemos inventado nosotros: son las diez etiquetas que las propias personas eligieron al grabar en Common Voice. Una voz de Buenos Aires no suena como una de Bogotá, y una de Canarias no suena como una de Madrid.

  • 10 regiones
  • 36 voces
  • Common Voice, CC0 1.0

Asturias, Castilla y León, Cantabria, País Vasco, Navarra, Aragón, La Rioja

España, norte

La zona donde nació el castellano y donde la zeta suena más nítida.

el autobús
autobús
el coche
coche
la piscina
piscina
el teléfono móvil
móvil
la patata
patata
«caza» y «casa»
distintas
Todas las voces de España, norte

4 voces de España, norte

  • Nekanemujer, distingue casa y caza
  • Covadongamujer, distingue casa y caza
  • Íñigohombre, distingue casa y caza
  • Gorkahombre, distingue casa y caza

Todas leyeron frases en español estándar. Lo que oyes es el estándar con la pronunciación de cada región, no jerga ni habla de barrio. Las palabras que pegas se leen tal como las escribes. Las diez regiones, una por una.

¿Esta voz dice «caza» o dice «casa»?

Nueve de cada diez hispanohablantes sesean: pronuncian la zeta igual que la ese. Una máquina que clona voces oye mucho español de un lado y otro, y a veces se le escapa: le pone la zeta de Madrid a una voz de Lima, o se la quita a una de Valladolid. Por eso medimos cada voz antes de ponerla en la lista.

8
distinguen
26
sesean
2
sin concluir

Cada voz lee dos frases: una llena de zetas y ces («cazar, cocer, Zaragoza»), otra con las mismas vocales pero solo con eses. Un análisis acústico mide cuánta energía aguda tiene cada frase: la ese es un ruido agudo y fuerte, la zeta castellana es débil. Si la frase con zetas suena mucho menos aguda, la voz distingue; si suenan igual, sesea. La voz que contradice a la región que su dueño declaró no entra en el selector.

La medición, voz por voz

36 voces de 36 personas distintas

La línea de onda junto a cada nombre está medida en el archivo que puedes escuchar; no es un dibujo. La cifra en hercios es el tono medio de ese mismo archivo. 18 mujeres y 18 hombres. Pulsa «Usar» para llevar una voz al lector de arriba.

  • 18 mujeres, 18 hombres
  • 91 a 260 Hz
  • CC0 1.0
  • Nekane

    España, norte · mujer · 214 Hz

    Zeta y ese: distingue

  • Covadonga

    España, norte · mujer · 208 Hz

    Zeta y ese: distingue

  • Íñigo

    España, norte · hombre · 162 Hz

    Zeta y ese: distingue

  • Gorka

    España, norte · hombre · 137 Hz

    Zeta y ese: distingue

  • Genoveva

    España, centro · mujer · 176 Hz

    Zeta y ese: sin concluir

  • Braulio

    España, centro · hombre · 141 Hz

    Zeta y ese: distingue

  • Rocío

    España, sur · mujer · 221 Hz

    Zeta y ese: sesea

  • Macarena

    España, sur · mujer · 202 Hz

    Zeta y ese: distingue

  • Cristóbal

    España, sur · hombre · 123 Hz

    Zeta y ese: distingue

  • Curro

    España, sur · hombre · 119 Hz

    Zeta y ese: distingue

  • Naira

    Canarias · mujer · 227 Hz

    Zeta y ese: sesea

  • Idaira

    Canarias · mujer · 172 Hz

    Zeta y ese: sin concluir

  • Ayoze

    Canarias · hombre · 134 Hz

    Zeta y ese: sesea

  • Yeray

    Canarias · hombre · 121 Hz

    Zeta y ese: sesea

  • Xóchitlelegida

    México · mujer · 218 Hz

    Zeta y ese: sesea

  • Cuauhtémoc

    México · hombre · 160 Hz

    Zeta y ese: sesea

  • Tonatiuh

    México · hombre · 135 Hz

    Zeta y ese: sesea

  • Dayana

    Caribe · mujer · 188 Hz

    Zeta y ese: sesea

  • Yaritza

    Caribe · mujer · 174 Hz

    Zeta y ese: sesea

  • Yoel

    Caribe · hombre · 156 Hz

    Zeta y ese: sesea

  • Yesenia

    Centroamérica · mujer · 218 Hz

    Zeta y ese: sesea

  • Ixchel

    Centroamérica · mujer · 200 Hz

    Zeta y ese: sesea

  • Nahúm

    Centroamérica · hombre · 136 Hz

    Zeta y ese: sesea

  • Balam

    Centroamérica · hombre · 113 Hz

    Zeta y ese: sesea

  • Killa

    Andes y Pacífico · mujer · 245 Hz

    Zeta y ese: sesea

  • Illari

    Andes y Pacífico · mujer · 167 Hz

    Zeta y ese: sesea

  • Amaru

    Andes y Pacífico · hombre · 139 Hz

    Zeta y ese: sesea

  • Inti

    Andes y Pacífico · hombre · 135 Hz

    Zeta y ese: sesea

  • Agustina

    Río de la Plata · mujer · 226 Hz

    Zeta y ese: sesea

  • Milagros

    Río de la Plata · mujer · 199 Hz

    Zeta y ese: sesea

  • Facundo

    Río de la Plata · hombre · 121 Hz

    Zeta y ese: sesea

  • Nahuel

    Río de la Plata · hombre · 91 Hz

    Zeta y ese: sesea

  • Millaray

    Chile · mujer · 260 Hz

    Zeta y ese: sesea

  • Rayen

    Chile · mujer · 222 Hz

    Zeta y ese: sesea

  • Lautaro

    Chile · hombre · 135 Hz

    Zeta y ese: sesea

  • Vicente

    Chile · hombre · 123 Hz

    Zeta y ese: sesea

Fuente: Common Voice 17 de Mozilla, bajo CC0 1.0. Las personas grabaron en casa con el micrófono que tenían; de cada una se eligió la grabación más limpia, se descartó todo lo que quedaba por debajo de un umbral medido de ruido, y un reconocedor de voz comprobó que la voz construida lee bien. Sobre el proyecto explica cómo se hizo la selección.

Con ocho segundos de grabación, la voz puede ser la tuya

Ninguna otra página gratuita en español lo ofrece.

Grabaciones de hasta 2 MB y como máximo 5 voces al día por dirección IP. Tu voz recibe un código aleatorio que solo se guarda en este navegador: Cedilla no tiene una lista común de voces, ninguna página muestra el código y no hay ningún camino por el que tu voz pueda hacerse pública. La otra cara de la moneda: si borras los datos del navegador o cambias de equipo, la voz se pierde.

  1. 1

    El cuadro para subir la grabación está justo debajo del selector de voz, arriba. Sube un fragmento de 3 a 8 segundos: una sola persona, hablando claro, sin música de fondo.

  2. 2

    La máquina aprende la voz en unos diez segundos. Después queda en tu lista y ya está seleccionada.

  3. 3

    Úsala como cualquier otra, también en otros idiomas. Las palabras se leen bien, pero el acento de tu grabación se sigue oyendo.

  4. 4

    Pulsa «Borrar» cuando quieras. La voz desaparece de este equipo y el servidor recibe la orden de olvidar la grabación.

Cuatro pasos, menos de un minuto

  1. 1

    Pega el texto

    Escribe o pega tu texto en el cuadro de arriba. Hasta 500 palabras de una vez, tantas veces como quieras.

  2. 2

    Elige región y voz

    Puedes escucharlas todas antes. Cada voz es una persona distinta, no una variante de la misma máquina.

  3. 3

    Escucha

    Un texto de 500 palabras tarda unos 17 segundos. Mientras tanto la página muestra los segundos que van pasando.

  4. 4

    Descarga el MP3

    Sin marca de agua. Para estudiar, para un vídeo, para el trabajo, para lo que necesites.

64 idiomas más, leídos por alguien que los habla desde la cuna

Cada uno de estos 64 idiomas tiene una voz construida a partir de la grabación de una persona que lo habla de nacimiento, y un reconocedor de voz la comprobó antes de ponerla aquí. Inglés, portugués, catalán, gallego, francés e italiano están entre ellos. Un idioma sin voz nativa no tiene botón de escucha. La frase bajo cada nombre viene de la Declaración Universal de los Derechos Humanos.

  • 64 con hablantes nativos
  • 646 códigos de idioma en total
Ver la lista completa con el resultado de cada idioma

Al lado de las otras páginas gratuitas

Los datos están tomados de las propias páginas de cada servicio el 6 de septiembre de 2026.

CaracterísticaCedillaTTSReaderSpeechifySpeechGen
Voces en español36 personas distintaslas del navegador o del sistemano lo indica«207», de varias máquinas
Regiones10, elegidas por cada hablanteEspaña y «latino»España, México, Argentina y «latino»por país, sin número de personas
Acento comprobadosí: medición de zeta y ese en cada voznonono
Origen de las vocesCommon Voice, CC0 1.0no lo indicano lo indicano lo indica
Gratis de una vez500 palabras (unos 3 000 caracteres)sin límite claro, voces del sistemacon cuenta, plan de pago para voces mejores1 000 caracteres sin registro
Tu propia vozsí, gratisnode pagode pago
Cuenta necesarianonono
Licencia de las vocesCC0 1.0, sin condicionesno lo indicano lo indicano lo indica

Preguntas que nos hacen

¿Es gratis de verdad?

Sí. Sin cuenta, sin periodo de prueba y sin tarjeta. Puedes leer 500 palabras de una vez (3800 caracteres), 60 veces al día desde la misma dirección IP, con 5 segundos entre una lectura y la siguiente. Los límites existen porque una sola tarjeta gráfica genera el audio para todo el mundo, no porque después llegue una factura.

¿Tiene voces latinas o solo de España?

Las dos cosas, y bastante más fino que eso. Hay 10 regiones: cuatro de España (norte, centro, sur y Canarias) y seis de América (México, Caribe, Centroamérica, Andes y Pacífico, Río de la Plata y Chile). Cada persona eligió su región al grabar; nosotros no adivinamos nada a partir del sonido.

¿Qué es el seseo y por qué lo medís?

Sesear es pronunciar la zeta y la ce igual que la ese: «caza» suena como «casa». Así habla toda Hispanoamérica, Canarias y buena parte de Andalucía; el resto de España distingue los dos sonidos. Lo medimos porque una voz clonada puede cambiar de bando sin querer, y una voz «de México» con zeta madrileña es una voz que miente. La medición está en la ficha de cada voz.

¿De dónde salen las voces?

De Common Voice, el corpus abierto de Mozilla. Personas voluntarias leen frases y declaran ellas mismas su región y su género. Todo el material está bajo CC0 1.0: no hay que pedir permiso ni citar a nadie. De cada persona tomamos la grabación más limpia, y un reconocedor de voz comprobó que la voz construida lee bien.

¿Cuántas voces hay y cómo se reparten?

36 voces en español: 18 de mujeres y 18 de hombres, en 10 regiones. Cada voz es una persona; no hay dos ajustes de la misma. Además, 64 idiomas más tienen una voz de alguien que los habla desde la cuna, y en total la página puede leer 646 códigos de idioma.

¿Puedo usar el audio en YouTube o en un trabajo comercial?

Sí. El MP3 no lleva marca de agua y las voces están bajo CC0 1.0, lo más cerca de «sin condiciones» que puede estar una licencia. No tienes que citar a Cedilla ni a la fuente. La responsabilidad sobre lo que haces leer es tuya.

¿Guardan mi texto?

No. El texto se lee y se olvida. El archivo de audio se queda hasta un día en el servidor para que puedas volver a descargarlo, y después se borra solo. No hay ninguna cuenta a la que asociarlo.

¿Lee bien los números y las abreviaturas?

Casi siempre, pero es el punto más frágil de cualquier lector. Un año («1998») o una cantidad con decimales pueden salir raros, y «Sr.», «pág.» o «EE. UU.» a veces se leen letra a letra. Si un número tiene que salir perfecto, escríbelo con letras. La página te avisa cuando el idioma elegido no ha sido comprobado con cifras.

¿Puedo crear mi propia voz?

Sí, con una grabación de 3 a 8 segundos. El cuadro está bajo el selector de voz, arriba. La voz recibe un código aleatorio que solo se guarda en tu navegador: no hay lista común y ninguna página muestra el código. Sube solo tu propia voz o una para la que tengas permiso.

¿Tenéis la voz de Loquendo?

No. Loquendo es una voz de máquina de los años 2000 que se busca sobre todo para hacer memes, y aquí no hay ninguna voz de máquina: todas están construidas a partir de la grabación de una persona real. Si lo que quieres es ese sonido robótico, esta no es tu página, y preferimos decirlo antes de que pruebes.

¿Por qué no suenan como en un estudio?

Porque no lo son. Las personas de Common Voice grabaron en casa, con el micrófono que tenían. De cada una tomamos el fragmento más limpio y descartamos todo lo que estaba por debajo de un umbral de ruido, pero un estudio es otra cosa. A cambio, son personas reales de diez regiones, y eso es exactamente lo que ninguna voz de estudio te puede dar.

Actualizado el 2026-09-06