TTSMaker es un servicio gratuito de texto a voz que funciona en el navegador: pegas un texto y obtienes un archivo de audio para escuchar o descargar. Hay dos accesos: el conversor abierto de ttsmaker.com, que no pide cuenta, y TTSMaker Pro en pro.ttsmaker.com, con cuotas de caracteres de pago, editor de diálogos con varias voces y API.
Es un conversor, no un estudio. Entra texto y sale un MP3 o un WAV; en las páginas revisadas para esta ficha no aparece línea de tiempo de edición ni punto de entrada para clonación de voz. El resumen del proveedor lo presenta como una herramienta gratuita de texto a voz que ofrece servicios de síntesis de voz y admite varios idiomas, y la sección de preguntas del sitio describe lo mismo como un generador de voz con IA.
Dos cosas lo separan de los planes gratuitos vecinos. El plan gratuito no es una prueba: el proveedor anuncia una versión gratuita permanente para los usuarios y se reserva el derecho de ajustar las políticas correspondientes en el futuro. Y los derechos comerciales llegan con la salida gratuita, no con una mejora de plan — la licencia publicada concede un derecho de uso no exclusivo, irrevocable, mundial y perpetuo sobre los archivos de audio generados.
El coste está en el otro lado: los archivos se borran en minutos y el nivel gratuito trae captchas y publicidad.
El catálogo se anuncia con más de 600 voces de IA en más de 100 idiomas. El detalle que la mayoría de las fichas omite: el tope de una conversión se fija por voz y no por cuenta. En la lista conviven entradas marcadas como Limit Per Conversion: 20000 characters junto a otras marcadas como Limit Per Conversion: 300 characters, así que elegir voz es elegir cuánto texto cabe en una pasada.
Dentro de la biblioteca hay un segundo nivel: las voces señaladas como unlimited. Todos los planes, incluido el gratuito, indican más de 20, y su salida no consume la cuota semanal de caracteres. Eso sí, es una política y no una garantía: el proveedor se reserva el derecho de ajustar el número de voces, su disponibilidad (añadir o retirar voces) y la velocidad de síntesis.
El audio se exporta en MP3, OGG, AAC, OPUS o WAV, y el MP3 tiene ajuste estándar y de alta calidad; en alta calidad el tamaño del archivo convertido suele duplicarse. Dos extras son poco habituales a este precio: el conversor genera un archivo de subtítulos con marcas de tiempo para el audio recién producido, y se puede poner música de fondo bajo la locución, con hasta 3 archivos BGM en la versión gratuita que caducan a las 6 horas, frente a 20 subidas en los planes de pago. Un modo de solo escucha previsualiza una voz convirtiendo únicamente los primeros 50 caracteres.
Un editor de diálogos aparte construye conversaciones a partir de bloques, cada uno con su idioma y su voz, convierte el texto de cada bloque en voz y fusiona todos los bloques en un único archivo. El tope gratuito es estrecho: hasta 5 bloques, 200 caracteres por bloque y un máximo de 5 diálogos generados por semana. Las cuentas de pago lo amplían a 300 proyectos con hasta 100 bloques cada uno, y la versión gratuita no incluye función de guardado para ellos.
Las marcas de pausa en el texto son más fiables que añadir silencio en el montaje; se expresan en milisegundos y la API ofrece el mismo mecanismo como parámetro en el rango 0-10000 ms, con 0 por defecto.
La API v2 tiene dos llamadas principales: una devuelve la lista de voces con sus identificadores y topes de caracteres, y la otra crea un pedido de conversión y devuelve, en lugar del audio, una URL a un archivo temporal que se elimina a las 2 horas. Integra por eso la descarga en el mismo trabajo que crea el pedido.
La lista de escenarios del proveedor se concentra en tres tareas, y cada una topa con una restricción del producto:
Los desarrolladores añaden un cuarto patrón: envoltorios de Python de terceros en una plataforma pública de alojamiento de código, uno de los cuales se describe como una biblioteca de Python para interactuar con la API de TTSMaker y convertir texto en voz.
Buena opción si eres:
Mala opción si eres:
Hay una incoherencia que importa si desarrollas sobre ella: la misma página de documentación dice que la URL temporal vale 24 horas y, más abajo, que el archivo se elimina a las dos horas. Planifica con la cifra más corta.
La facturación cuenta caracteres y no minutos, porque la duración del audio depende del idioma, la voz y los ajustes de velocidad. El margen que decide qué plan necesitas: 300,000 caracteres producen alrededor de 6.9 horas de audio en inglés, 4.3 horas en español y más de 14 horas en chino por las diferencias entre idiomas. La tabla se capturó en su estado de facturación anual; la pestaña mensual no llegó a mostrarse en esa pasada, así que abajo solo están confirmadas las cifras anuales.
| Plan | Facturación anual | Cuota de caracteres | Máximo por conversión |
|---|---|---|---|
| Free | Gratis | 20,000 por semana | 500 |
| Lite | $119.88 al año, $36 de ahorro | 300,000 al mes | 10,000 |
| Pro Mini | $227.88 al año, $60 de ahorro | 600,000 al mes | 20,000 |
| Pro Max | $299.88 al año, $96 de ahorro | 1,200,000 al mes | 20,000 |
| Studio | $1296 al año, $384 de ahorro | 6,000,000 al mes | 30,000 |
Los niveles también se diferencian en publicidad y captchas, inserciones de pausa, plazas de alojamiento y de música de fondo, facturación y objetivos de respuesta por correo que se estrechan de 72h en Lite a 24h en Studio. La API empieza en Pro Mini y los paquetes adicionales de caracteres se venden aparte a los suscriptores.
La comparación más útil llega de fuera. Un repaso editorial independiente de generadores de voz con IA eligió TTSMaker como su opción gratuita, alegando que el uso comercial está permitido incluso en las voces gratuitas y que hay más de 600 voces en 100 idiomas, de las cuales 20 se pueden usar gratis sin límite, y en la misma entrada juzgó que la interfaz resulta básica frente a ElevenLabs o Speechify. Gana en derechos y precio, pierde en acabado.
Tres situaciones aconsejan otra herramienta: cuando la voz es el entregable y se juzgará como interpretación; cuando hace falta clonación de voz, que ninguna página revisada aquí ofrece; y cuando un flujo de trabajo necesita activos alojados duraderos y no un enlace que caduca.
Un aviso mientras comparas: los directorios de herramientas de IA de terceros arrastran cifras desfasadas, y uno sigue mostrando más de 200 voces de IA, en contradicción con la tabla oficial de planes vigente.
Es la restricción operativa clave, y tres páginas oficiales dan tres cifras distintas:
Las filas de la tabla encajan con una diferencia por plan — 30 minutos de historial en el gratuito, 24h en los de pago — pero los textos de licencia y privacidad no acotan así el alcance, y la discrepancia sigue sin resolverse. En cualquier caso: descarga el audio y el archivo de subtítulos en cuanto termine la conversión.
Minutos, no días. Las cifras publicadas no concuerdan — 30 minutos en la licencia, 60 minutos en la política de privacidad de Pro, 24 horas en las condiciones — y todas son lo bastante cortas como para que descargar de inmediato sea el único hábito seguro. Una reseña independiente advierte lo mismo: TTSMaker solo guarda tus archivos 30 minutos antes de borrarlos.
No. El acceso a la API exige una suscripción Pro o Studio, una clave por cuenta y una petición por segundo. Las cuentas Free y Lite no tienen ningún soporte de API.
Cancelar es posible en cualquier momento, con acceso hasta el final del ciclo de facturación. Los reembolsos son más estrechos: dentro de los 30 días si no se ha consumido ningún carácter, dentro de los 7 días posteriores al cobro si se han consumido menos de 500, sin reembolsos parciales y con un solo reembolso por cuenta antes de que se bloqueen las compras.