Toolso.AI
Toolso.AI
HerramientasCategoríasTendenciasNovedadesPreciosBlog
Toolso.AI
Toolso.AI

💌Suscríbete a AI Tools Weekly

Selección semanal curada de las últimas y más populares herramientas de IA y tendencias, entregadas en tu bandeja de entrada Suscribirse

Toolso.AI
Toolso.AI

Descubre las mejores herramientas de IA para aumentar tu productividad

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Categorías populares

  • Escritura con IA
  • Imágenes con IA
  • Video con IA
  • Programación con IA
  • Más categorías

Explorar

  • Herramientas más recientes
  • Herramientas populares
  • Más herramientas
  • Enviar herramienta
  • Precios

Acerca de

  • Acerca de nosotros
  • Contacto
  • Blog
  • Registro de cambios

Legal

  • Política de cookies
  • Política de privacidad
  • Términos de servicio
  • Política de reembolso
© 2026 Toolso.AI Todos los derechos reservados
Oferta limitadaOferta por tiempo limitadoListado destacadoRevisión en 24 h · Sin backlink · 30 días destacado$29.90luego $59.90Sube a $59.90 después del 31 octTermina en--:--:--Enviar ahora
  1. Inicio
  2. Todas las herramientas
  3. Tecnología de voz
  4. TTSMaker
Vista previa de la interfaz de TTSMaker
Logotipo de TTSMaker

TTSMaker

TTSMaker convierte texto pegado en MP3 o WAV desde el navegador, con más de 600 voces de IA en más de 100 idiomas, cuota gratuita semanal y derechos comerciales sin atribución.

Tecnología de vozGeneración de VozGeneración de Audio#Texto a voz#Multilingüe#Subtítulos
Probar gratis
Guardados
Visitas
Vistas
Precio
Freemium
Publicado
18 sept 2026
Dominio
ttsmaker.com

Información del producto TTSMaker

Probar gratis
Información de la herramienta
Guardados
Visitas
Vistas
Precio
Freemium
Publicado
18 sept 2026
Dominio
ttsmaker.com

Herramientas destacadas

Herramientas relacionadas

Probar gratis

¿Qué es TTSMaker?

TTSMaker es un servicio gratuito de texto a voz que funciona en el navegador: pegas un texto y obtienes un archivo de audio para escuchar o descargar. Hay dos accesos: el conversor abierto de ttsmaker.com, que no pide cuenta, y TTSMaker Pro en pro.ttsmaker.com, con cuotas de caracteres de pago, editor de diálogos con varias voces y API.

Es un conversor, no un estudio. Entra texto y sale un MP3 o un WAV; en las páginas revisadas para esta ficha no aparece línea de tiempo de edición ni punto de entrada para clonación de voz. El resumen del proveedor lo presenta como una herramienta gratuita de texto a voz que ofrece servicios de síntesis de voz y admite varios idiomas, y la sección de preguntas del sitio describe lo mismo como un generador de voz con IA.

Dos cosas lo separan de los planes gratuitos vecinos. El plan gratuito no es una prueba: el proveedor anuncia una versión gratuita permanente para los usuarios y se reserva el derecho de ajustar las políticas correspondientes en el futuro. Y los derechos comerciales llegan con la salida gratuita, no con una mejora de plan — la licencia publicada concede un derecho de uso no exclusivo, irrevocable, mundial y perpetuo sobre los archivos de audio generados.

El coste está en el otro lado: los archivos se borran en minutos y el nivel gratuito trae captchas y publicidad.

Funciones principales

Biblioteca de voces y tope por voz

El catálogo se anuncia con más de 600 voces de IA en más de 100 idiomas. El detalle que la mayoría de las fichas omite: el tope de una conversión se fija por voz y no por cuenta. En la lista conviven entradas marcadas como Limit Per Conversion: 20000 characters junto a otras marcadas como Limit Per Conversion: 300 characters, así que elegir voz es elegir cuánto texto cabe en una pasada.

Dentro de la biblioteca hay un segundo nivel: las voces señaladas como unlimited. Todos los planes, incluido el gratuito, indican más de 20, y su salida no consume la cuota semanal de caracteres. Eso sí, es una política y no una garantía: el proveedor se reserva el derecho de ajustar el número de voces, su disponibilidad (añadir o retirar voces) y la velocidad de síntesis.

Controles de voz

  • Ajustes de emoción, solo en parte del catálogo. Las voces con etiqueta Emotion ofrecen estilos como locución de noticias, tono alegre, enfado o susurro. El proveedor cifra en unas 20 las voces compatibles; las cuentas gratuitas ven un aviso de mejora de plan en lugar del control.
  • Velocidad, volumen, tono. Velocidad de 0.5x a 2.0x, volumen de 10% a 200%, tono de -50% a +100%; los valores personalizados libres quedan para las cuentas de pago.
  • Pausas. Una marca de pausa se coloca en cualquier punto del texto, hasta diez segundos cada una, pero el número de inserciones depende del plan: hasta 50 en la versión gratuita y hasta 300 en la Pro.

Formatos de salida, subtítulos y música de fondo

El audio se exporta en MP3, OGG, AAC, OPUS o WAV, y el MP3 tiene ajuste estándar y de alta calidad; en alta calidad el tamaño del archivo convertido suele duplicarse. Dos extras son poco habituales a este precio: el conversor genera un archivo de subtítulos con marcas de tiempo para el audio recién producido, y se puede poner música de fondo bajo la locución, con hasta 3 archivos BGM en la versión gratuita que caducan a las 6 horas, frente a 20 subidas en los planes de pago. Un modo de solo escucha previsualiza una voz convirtiendo únicamente los primeros 50 caracteres.

Generación de diálogos con varias voces

Un editor de diálogos aparte construye conversaciones a partir de bloques, cada uno con su idioma y su voz, convierte el texto de cada bloque en voz y fusiona todos los bloques en un único archivo. El tope gratuito es estrecho: hasta 5 bloques, 200 caracteres por bloque y un máximo de 5 diálogos generados por semana. Las cuentas de pago lo amplían a 300 proyectos con hasta 100 bloques cada uno, y la versión gratuita no incluye función de guardado para ellos.

Guía

Hacer la primera conversión

  1. Pega el texto en el cuadro del conversor. El tutorial publicado fija la referencia: el límite gratuito es de 20000 caracteres por semana y algunas voces admiten uso ilimitado.
  2. Elige el grupo de idiomas y luego la voz, comparando su tope por conversión con la longitud del guion.
  3. Abre More Settings para velocidad, volumen, tono o pausas entre párrafos.
  4. Convierte, descarga de inmediato y exporta los subtítulos en la misma sesión: el enlace caduca junto con el audio.

Las marcas de pausa en el texto son más fiables que añadir silencio en el montaje; se expresan en milisegundos y la API ofrece el mismo mecanismo como parámetro en el rango 0-10000 ms, con 0 por defecto.

Llamar a la API

La API v2 tiene dos llamadas principales: una devuelve la lista de voces con sus identificadores y topes de caracteres, y la otra crea un pedido de conversión y devuelve, en lugar del audio, una URL a un archivo temporal que se elimina a las 2 horas. Integra por eso la descarga en el mismo trabajo que crea el pedido.

Casos de uso y ejemplos de flujo de trabajo

La lista de escenarios del proveedor se concentra en tres tareas, y cada una topa con una restricción del producto:

  • Locución de vídeos cortos. El caso estrella, donde lo relevante en lo comercial es la regla de atribución: el audio puede usarse en plataformas como YouTube, TikTok o pódcasts, y citar la fuente no es obligatorio, no estás obligado a atribuir la fuente.
  • Audiolibros y textos largos. Solo viable con una voz de texto largo; una voz limitada a 300 caracteres partiría un capítulo en decenas de conversiones.
  • Material para aprender idiomas. Aquí encaja el editor de diálogos: cada bloque cambia de idioma y de voz, suficiente para montar un ejercicio de comprensión oral a dos voces en un archivo.

Los desarrolladores añaden un cuarto patrón: envoltorios de Python de terceros en una plataforma pública de alojamiento de código, uno de los cuales se describe como una biblioteca de Python para interactuar con la API de TTSMaker y convertir texto en voz.

Para quién es

Buena opción si eres:

  • Un creador que quiere derechos comerciales limpios sin pagar. La licencia permite a los usuarios usar, modificar, reproducir, distribuir y mostrar libremente el contenido de audio con fines tanto personales como comerciales, sin pagar tarifas adicionales ni obtener permisos extra.
  • Un usuario ocasional cuyo volumen cabe en 20,000 caracteres por semana o que se limita a las voces marcadas como unlimited.
  • Un docente o estudiante que prepara material de escucha en varios idiomas, o un desarrollador que busca una API de texto a voz barata para lotes poco frecuentes.

Mala opción si eres:

  • Alguien que produce audio donde el realismo de la voz es el producto. La reseña independiente que aun así lo recomienda describe una salida que a veces puede sonar algo artificial sin dejar de ser clara e inteligible.
  • Dependiente de activos almacenados, o alguien que ejecuta automatización de alto volumen sobre las voces premium, ya que el grupo unlimited queda excluido del tráfico de la API.
  • Alguien sujeto a normas de compra que exigen política de privacidad vigente y SLA de soporte: ninguna de las dos está firmemente establecida en las páginas publicadas.

Plataformas

  • Solo web, con dos accesos. Todo funciona en el navegador; en las páginas revisadas no apareció cliente de escritorio, aplicación móvil ni extensión, de modo que cada conversión necesita conexión.
  • Idiomas de interfaz. El conversor ofrece accesos localizados en rutas propias para decenas de idiomas, algo distinto de los idiomas que cubren las voces.
  • API REST, solo en planes de pago. El acceso depende del plan: hace falta suscripción de nivel PRO o Studio, ya que el nivel Lite no admite esta función.
  • Una clave, una petición por segundo. Cada cuenta solo puede crear una clave de API, eliminable y recreable si hace falta, y el límite QPS por clave es de 1 petición por segundo.
  • Tope por petición. Una sola llamada acepta texto con una longitud máxima de 20,000 caracteres.

Hay una incoherencia que importa si desarrollas sobre ella: la misma página de documentación dice que la URL temporal vale 24 horas y, más abajo, que el archivo se elimina a las dos horas. Planifica con la cifra más corta.

Precios

La facturación cuenta caracteres y no minutos, porque la duración del audio depende del idioma, la voz y los ajustes de velocidad. El margen que decide qué plan necesitas: 300,000 caracteres producen alrededor de 6.9 horas de audio en inglés, 4.3 horas en español y más de 14 horas en chino por las diferencias entre idiomas. La tabla se capturó en su estado de facturación anual; la pestaña mensual no llegó a mostrarse en esa pasada, así que abajo solo están confirmadas las cifras anuales.

PlanFacturación anualCuota de caracteresMáximo por conversión
FreeGratis20,000 por semana500
Lite$119.88 al año, $36 de ahorro300,000 al mes10,000
Pro Mini$227.88 al año, $60 de ahorro600,000 al mes20,000
Pro Max$299.88 al año, $96 de ahorro1,200,000 al mes20,000
Studio$1296 al año, $384 de ahorro6,000,000 al mes30,000

Los niveles también se diferencian en publicidad y captchas, inserciones de pausa, plazas de alojamiento y de música de fondo, facturación y objetivos de respuesta por correo que se estrechan de 72h en Lite a 24h en Studio. La API empieza en Pro Mini y los paquetes adicionales de caracteres se venden aparte a los suscriptores.

  • Nada se acumula. La cuota de caracteres de los usuarios no puede acumularse, y la cuota mensual se reinicia al comienzo de cada ciclo de facturación.
  • Cancelar mantiene el acceso hasta fin de periodo. Tras la cancelación sigues teniendo acceso a todas las funciones premium hasta que termine tu ciclo de facturación actual.
  • Los reembolsos son estrechos y de una sola vez. Una suscripción sin usar se reembolsa dentro de los 30 días posteriores al cobro; pasados 500 caracteres consumidos la ventana se cierra, no hay reembolsos parciales y TTSMaker permite un solo reembolso por cuenta antes de restringir las compras.
  • Los pagos pasan por un intermediario comercial. La información de la tarjeta de crédito nunca la almacena TTSMaker Pro, los precios se muestran en dólares estadounidenses y las empresas de la UE deben introducir el VAT-ID durante el pago, porque después ya no puede aplicarse.

Alternativas a TTSMaker: cuándo mirar hacia otro lado

La comparación más útil llega de fuera. Un repaso editorial independiente de generadores de voz con IA eligió TTSMaker como su opción gratuita, alegando que el uso comercial está permitido incluso en las voces gratuitas y que hay más de 600 voces en 100 idiomas, de las cuales 20 se pueden usar gratis sin límite, y en la misma entrada juzgó que la interfaz resulta básica frente a ElevenLabs o Speechify. Gana en derechos y precio, pierde en acabado.

Tres situaciones aconsejan otra herramienta: cuando la voz es el entregable y se juzgará como interpretación; cuando hace falta clonación de voz, que ninguna página revisada aquí ofrece; y cuando un flujo de trabajo necesita activos alojados duraderos y no un enlace que caduca.

Un aviso mientras comparas: los directorios de herramientas de IA de terceros arrastran cifras desfasadas, y uno sigue mostrando más de 200 voces de IA, en contradicción con la tabla oficial de planes vigente.

Limitaciones

Topes del nivel gratuito y de las cuotas

  • La cuota semanal y el tope por conversión son dos límites distintos, y la tabla fija los del nivel gratuito en 20,000 caracteres por semana y un máximo de 500 por conversión. Las dos páginas oficiales no coinciden, y esta revisión no determina cuál se aplica.
  • Las sesiones gratuitas incluyen captcha y publicidad, con soporte por correo de baja prioridad.
  • Superar una cuota de pago ralentiza el trabajo en lugar de detenerlo: el usuario pasa automáticamente a síntesis lenta y cola hasta el inicio del siguiente ciclo. Incluso la mayor cuota de alta velocidad tiene tope, un máximo de 10 millones de caracteres por ciclo.
  • La automatización queda fuera del grupo unlimited: las voces unlimited no están disponibles para las llamadas de la API, y el uso de la API se descuenta de la cuota de caracteres de los pedidos de síntesis normales.

Cuánto tiempo se conservan los archivos y el texto

Es la restricción operativa clave, y tres páginas oficiales dan tres cifras distintas:

  • Las condiciones de licencia comercial dicen que el servicio almacena temporalmente los archivos de audio y sus enlaces de descarga durante un máximo de 30 minutos y que no conserva ni el texto introducido ni el contenido generado más allá de esa ventana.
  • Las condiciones del servicio dicen que los registros de entrada y el audio de salida convertido se almacenan no más de 24 horas, únicamente para facilitar las descargas de los usuarios.
  • La política de privacidad de Pro describe el texto aportado como borrado automáticamente a los 60 minutos según los ajustes del usuario.

Las filas de la tabla encajan con una diferencia por plan — 30 minutos de historial en el gratuito, 24h en los de pago — pero los textos de licencia y privacidad no acotan así el alcance, y la discrepancia sigue sin resolverse. En cualquier caso: descarga el audio y el archivo de subtítulos en cuanto termine la conversión.

Qué recogen las políticas y qué no dicen

  • La recogida automática es amplia: direcciones IP, datos de geolocalización, identificadores únicos de dispositivo e historial de navegación y de búsqueda. El intercambio con proveedores de servicios tiene un límite explícito — no vendemos tu información — y los usuarios pueden solicitar acceso, revisión, actualización, rectificación o supresión de esos datos.
  • Si el texto enviado sirve para entrenar modelos de voz no se aborda en ninguna página revisada aquí, y las condiciones arrastran una tensión que conviene notar: un párrafo afirma que bajo ninguna circunstancia se difundirán a terceros las entradas de los usuarios ni el audio de salida, mientras otro concede el derecho a poner la información y el contenido de los usuarios a disposición de proveedores externos.
  • Las reglas de edad también difieren: las condiciones fijan la edad mínima en 16 años, elevada allí donde la ley local exige una edad mayor, mientras que la política de privacidad de Pro indica que los servicios no se dirigen a menores de 13 años y que los usuarios menores de 16 necesitan consentimiento parental.
  • La política de privacidad del sitio gratuito lleva fecha de entrada en vigor del 15 de agosto de 2022, declara basarse en una plantilla comercial y todavía contiene un marcador de posición sin rellenar donde debería ir un enlace.

Cláusulas legales que conviene leer antes de contratar

  • La propiedad está dividida: TTSMaker no reclama la propiedad del audio generado por los usuarios, pero conserva todos los derechos sobre su tecnología subyacente, sus modelos de voz y sus sistemas, de modo que los usuarios obtienen derechos de uso y no la titularidad del derecho de autor. Lo que introduces sigue siendo tuyo, porque el contenido y la información que envías a TTSMaker siguen siendo de tu propiedad.
  • El servicio se presta sin garantía, tal cual y según disponibilidad, y remite las disputas a arbitraje bajo la ley del estado de Wyoming, con renuncia a las acciones colectivas.
  • Las reglas de las plataformas de distribución quedan fuera de la responsabilidad del proveedor. La cláusula de responsabilidad trata las políticas de plataformas de terceros como un riesgo que asume el usuario, y el ejemplo que el propio proveedor da de ese riesgo es que YouTube se niegue a permitir la monetización de vídeos con voz sintética: se trata de la formulación del proveedor y no de una regla de plataforma verificada, ya que la política vigente de esa plataforma no se ha comprobado aquí. En cualquier caso, los derechos comerciales concedidos aquí no prevalecen sobre la política de voz sintética de una plataforma de distribución.
  • Las expectativas de soporte difieren entre páginas: una da al soporte gratuito un tiempo medio de respuesta de 7 días laborables, y otra dice que los suscriptores reciben atención prioritaria en 24–72 horas, mientras que el resto puede esperar entre 7 y 15 días hábiles.

Preguntas frecuentes

Q1. ¿Cuánto tiempo tengo para descargar mi audio?

Minutos, no días. Las cifras publicadas no concuerdan — 30 minutos en la licencia, 60 minutos en la política de privacidad de Pro, 24 horas en las condiciones — y todas son lo bastante cortas como para que descargar de inmediato sea el único hábito seguro. Una reseña independiente advierte lo mismo: TTSMaker solo guarda tus archivos 30 minutos antes de borrarlos.

Q2. ¿Puedo conseguir una clave de API en el plan gratuito o Lite?

No. El acceso a la API exige una suscripción Pro o Studio, una clave por cuenta y una petición por segundo. Las cuentas Free y Lite no tienen ningún soporte de API.

Q3. ¿Puedo cancelar y recuperar mi dinero?

Cancelar es posible en cualquier momento, con acceso hasta el final del ciclo de facturación. Los reembolsos son más estrechos: dentro de los 30 días si no se ha consumido ningún carácter, dentro de los 7 días posteriores al cobro si se han consumido menos de 500, sin reembolsos parciales y con un solo reembolso por cuenta antes de que se bloqueen las compras.

¿Conoces una herramienta similar?
Si conoces otras grandes herramientas de IA, no dudes en enviárnoslas