Toolso.AI
Toolso.AI
HerramientasCategoríasTendenciasNovedadesPreciosBlog
Toolso.AI
Toolso.AI

💌Suscríbete a AI Tools Weekly

Selección semanal curada de las últimas y más populares herramientas de IA y tendencias, entregadas en tu bandeja de entrada Suscribirse

Toolso.AI
Toolso.AI

Descubre las mejores herramientas de IA para aumentar tu productividad

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Categorías populares

  • Escritura con IA
  • Imágenes con IA
  • Video con IA
  • Programación con IA
  • Más categorías

Explorar

  • Herramientas más recientes
  • Herramientas populares
  • Más herramientas
  • Enviar herramienta
  • Precios

Acerca de

  • Acerca de nosotros
  • Contacto
  • Blog
  • Registro de cambios

Legal

  • Política de cookies
  • Política de privacidad
  • Términos de servicio
  • Política de reembolso
© 2026 Toolso.AI Todos los derechos reservados
Oferta limitadaOferta por tiempo limitadoListado destacadoRevisión en 24 h · Sin backlink · 30 días destacado$29.90luego $59.90Sube a $59.90 después del 31 octTermina en--:--:--Enviar ahora
  1. Inicio
  2. Todas las herramientas
  3. Tecnología de voz
  4. Speechgen.io
Vista previa de la interfaz de Speechgen.io
Logotipo de Speechgen.io

Speechgen.io

Texto a voz en el navegador con más de 5.000 voces, diálogos de varios locutores, audio sincronizado con subtítulos, clonación de voz y API, pagado con paquetes de créditos válidos un año en lugar de una suscripción mensual.

Tecnología de vozGeneración de VozGeneración de Audio#Texto a voz#Clonación de voz#Transcripción
Ver precios
Guardados
Visitas
Vistas
Precio
De pago
Publicado
5 oct 2026
Dominio
speechgen.io
Valoración de usuarios

¿Has usado esta herramienta? Valórala

Valorar esta herramienta

Información del producto Speechgen.io

Ver precios
Información de la herramienta
Guardados
Visitas
Vistas
Precio
De pago
Publicado
5 oct 2026
Dominio
speechgen.io
Valoración de usuarios

¿Has usado esta herramienta? Valórala

Valorar esta herramienta

Herramientas destacadas

Herramientas relacionadas

Ver precios

¿Qué es Speechgen.io?

Speechgen.io (escrito SpeechGen.io y SpeechGen en sus propias páginas) se describe como un generador de voz con IA en línea con más de 5.000 voces realistas. El texto escrito en el editor web, o tomado de un documento o de un archivo de subtítulos, vuelve convertido en audio descargable.

El sitio afirma que cubre 150 idiomas y exporta en MP3, WAV y FLAC. Los paquetes de créditos se pagan una sola vez, sin suscripción ni renovación automática, que es su principal contraste con los planes mensuales de texto a voz.

La página de soporte nombra a Bueno Limited, con una dirección de beneficiario en North Point, Hong Kong. La política de privacidad, en cambio, llama al responsable del tratamiento «the Operator» (el Operador) y no nombra ninguna empresa en su texto.

Las asignaciones gratuitas, las reglas de reembolso y la longitud máxima del texto difieren de una página a otra; esas diferencias se tratan en Precios y Limitaciones.

Funciones principales

Speechgen.io reúne los controles de narración, diálogo, tiempos y música en un solo editor de navegador.

Voces y niveles de calidad

  • Tres niveles: las voces se pueden filtrar por género, acento y nivel de calidad Standard, HD o PRO, y cada nivel consume créditos a un ritmo distinto.
  • Escucha gratuita: las combinaciones de voz, velocidad y tono se pueden previsualizar con tu propio texto, y el sitio afirma que las muestras no descuentan caracteres.
  • Gráficos de entonación: más de la mitad de la biblioteca, entre voces normales y PRO, ofrece un gráfico cuyos puntos se arrastran para subir o bajar el tono en palabras concretas.
  • Voces de personajes con nombre: las páginas por género cubren estilos de miedo, infantiles y de dibujos animados, y el sitio dice que su voz Brian es «el equivalente moderno con IA» de la voz británica Brian creada por IVONA y adquirida después por Amazon Polly.

En las páginas revisadas aquí, Speechgen.io no nombra los motores de voz que hay detrás de sus niveles.

Controles del editor

  • Velocidad y tono: la velocidad va de x0,1 a x2,2, y el tono de -20 a +20 en pasos de 2.
  • Pausas: los silencios predeterminados entre frases y entre párrafos se pueden ajustar por separado de 150 ms a 30 segundos.
  • Varios locutores: se pueden asignar voces distintas a párrafos distintos con etiquetas de nombre, de modo que una entrevista o un reparto de personajes se exporta como un único archivo.
  • Música de fondo: una pista de la biblioteca de música con IA integrada, o un archivo propio, se puede mezclar bajo la voz sin salir del editor.

Herramientas para textos largos y subtítulos

  • Archivos por capítulo: escribir una etiqueta de corte en su propia línea exporta cada segmento como un archivo de audio independiente.
  • Límite de segmentos: una generación admite hasta 1.000 segmentos cortos o 500 largos, así que los libros más grandes deben dividirse en varias tandas.
  • Audio sincronizado con subtítulos: un archivo SRT o VTT subido se locuta línea por línea en cada código de tiempo exacto, con lo que el audio llega al editor de vídeo ya sincronizado.

Caché inteligente

Cada frase generada permanece en caché durante 7 días, y una nueva generación solo cobra las frases nuevas o editadas. Corregir una palabra en un guion largo cuesta, por tanto, esa frase y no el texto completo.

Clonación de voz

Un modelo de voz personal se crea a partir de 10 a 60 segundos de habla clara y funciona en 15 idiomas: nueve marcados como estables y seis como experimentales.

Transcripción

La página de inicio describe la transcripción de audio en 140 idiomas con etiquetas de hablante y marcas de tiempo. La página de precios indica para la misma función subidas de hasta 1 GB o 3 horas, «150+» idiomas y exportación de subtítulos SRT o VTT, así que las dos páginas no coinciden en el número de idiomas.

Guía

Pasar texto a voz online en Speechgen.io sigue un orden fijo, porque algunos cambios vuelven a consumir caracteres.

  1. Elige primero el idioma. La guía oficial indica seleccionar el idioma del texto antes que nada; solo entonces se abre la lista de voces de ese idioma.
  2. Elige una voz. Para trabajos multilingües, las voces con códigos como Ava_US y Ava_ES mantienen una misma voz reconocible entre idiomas, lo que ayuda en proyectos de diálogo.
  3. Pega o sube el texto. Se aceptan como entrada texto plano y archivos DOCX, PDF y SRT.
  4. Fija velocidad y tono antes de la primera generación. Ajustar la velocidad o el tono provoca una regeneración completa y vuelve a consumir los límites de caracteres. Las pausas entre frases y párrafos, en cambio, se pueden modificar sin consumir límites.
  5. Elige el formato de salida antes de generar. MP3 es la descarga predeterminada; para WAV, OPUS u otra frecuencia de muestreo hay que seleccionarlo y regenerar la voz antes de poder descargar ese archivo.

Casos de uso y ejemplos

La página de inicio ilustra su mercado con ejemplos de clientes. Son casos descritos por el proveedor, no pruebas independientes.

  • Menús telefónicos e IVR: un ejemplo es un menú telefónico bilingüe en inglés y español para una red veterinaria de cinco clínicas en Atlanta, entregado como MP3 a 64 kbps y actualizado en unos 30 segundos.
  • Tasa de bits según el canal: la guía de calidad del sitio asocia 8–64 kbps con teléfono, IVR y señalización, 64–128 kbps con YouTube, pódcasts y e-learning, y 192–320 kbps con trabajos de radiodifusión.
  • Ejercicios de e-learning: un ejercicio bilingüe de español mezcla inglés y español en una misma grabación y se divide por lección en 50 archivos MP3 a partir de un solo guion.
  • Alertas de seguridad laboral: otro caso usa la API para lanzar avisos de seguridad por megafonía en seis idiomas en un almacén de 15.000 m².
  • Audioguías localizadas: una audioguía de exposición se localiza a cinco idiomas a partir de una sola subida de SRT, con una voz distinta elegida para cada idioma.

Para quién es

Speechgen.io encaja con compradores cuyas necesidades de audio llegan a rachas. La página de precios pregunta «¿Por qué pagar cada mes si no lo usas cada mes?» y afirma que sus paquetes siguen activos hasta un año.

Encaja probablemente

  • Creadores de vídeo: según el sitio, los archivos de locución con IA pueden ir a proyectos de YouTube, TikTok o Reels mediante editores como Premiere Pro, DaVinci Resolve y CapCut.
  • Proyectos multilingües con poco presupuesto: las voces Standard se describen como el nivel más económico y el que cubre la gama de idiomas más amplia.

Menos adecuado

  • Menores que quieren clonar una voz: la clonación de voz exige que los usuarios tengan al menos 18 años, independientemente del consentimiento de los padres.
  • Proyectos basados en imitar a figuras públicas reales: las normas de contenido descritas en Limitaciones restringen las voces de políticos y figuras públicas.
  • Compradores que necesitan una red de seguridad amplia para reembolsos: las condiciones de reembolso son estrechas, y las páginas oficiales no coinciden sobre ellas.

Plataformas

  • Editor web: Speechgen.io funciona en el navegador, sin software que instalar.
  • Navegadores móviles: las herramientas de clonación de voz funcionan en el navegador en ordenador, tableta y móvil. En las páginas revisadas aquí no se ofrece ninguna aplicación nativa de escritorio ni móvil.
  • API REST: el acceso a la API requiere una cuenta de pago. El método /text devuelve el audio al instante para un máximo de 2.000 caracteres, mientras que /longtext procesa hasta 1.000.000 de caracteres mediante un identificador de tarea que se consulta periódicamente.
  • Marcas de tiempo: el método /subs funciona como /longtext, pero además devuelve marcas de tiempo de subtítulos para alinear el audio con vídeo o diapositivas.
  • Automatización sin código: la API REST devuelve una URL de audio con una sola llamada HTTP y, según el sitio, funciona con n8n, Make y Zapier.
  • WordPress: un plugin gratuito pone voz a los artículos de sitios WordPress, pero solo se instala desde un archivo comprimido, no está en el repositorio de WordPress y necesita tokens de Speechgen para funcionar.

Precios

Speechgen.io vende seis paquetes de créditos de pago único, desde 25.000 créditos por $4.99 hasta 10.000.000 de créditos por $599.99.

PaquetePrecioEtiqueta mostrada en la páginaVoz con IA estimada
25.000 créditos$4.99ninguna~60 min
65.000 créditos$9.99$13 tachado, 23 % de descuento~155 min
200.000 créditos$24.99$40 tachado, 38 % de descuento~476 min
500.000 créditos$49.99$100 tachado, 50 % de descuento~1.190 min
2.000.000 créditos$149.99$400 tachado, 63 % de descuento~4.762 min
10.000.000 créditos$599.99$2000 tachado, 70 % de descuento~23.810 min

La página no explica qué representan los precios de referencia tachados. Las estimaciones en minutos suponen un texto medio en inglés a unas 140 palabras por minuto.

  • Tasas de conversión: un crédito equivale a 2 caracteres de voz Standard, 1 carácter de Pro o 0,5 caracteres de HD.
  • Unidad de facturación: se factura por carácter, incluidos espacios y signos de puntuación.
  • Validez: los créditos son válidos durante un año desde la compra; una nueva compra suma el saldo restante y reinicia el plazo de un año.
  • Incluido en cada paquete: cada paquete trae licencia comercial, acceso a la API, todas las voces, caché inteligente e historial de 30 días.
  • Un solo saldo: los mismos créditos sirven para texto a voz, transcripción o ambas cosas.
  • Pago y facturas: se aceptan Stripe y PayPal, y las facturas permiten indicar un nombre de empresa, una dirección y un número de IVA personalizados.

Asignación gratuita

La página de inicio describe una escalera gratuita de tres pasos: 1.000 caracteres sin cuenta, 2.000 más al registrarse gratis y luego 3.000 caracteres al día durante 7 días. La política de privacidad describe en cambio una tarifa de prueba de 5 Limits y 1.000 Limits gratuitos tras registrarse con una dirección de gmail.com, yahoo.com o hotmail.com. Las páginas no concilian las dos versiones.

Costes de la clonación de voz

Crear un clon cuesta 2.000 créditos, almacenarlo 250 créditos al día, y la síntesis se cobra a la tarifa HD. La clonación de voz no tiene nivel gratuito; eliminar un clon detiene sus cargos de almacenamiento.

Alternativas a Speechgen.io

Speechgen.io contrapone sus paquetes a planes mensuales que, según dice, cuestan entre $22 y $99 al mes se usen o no. Dos productos de suscripción que aparecen a su lado en una plataforma de descubrimiento de productos muestran el otro lado de esa disyuntiva.

  • ElevenLabs: ElevenLabs vende planes con facturación mensual o anual e incluye un plan Free a $0 al mes. Su plan Starter figura como todo lo de Free más una licencia comercial y clonación de voz instantánea, mientras que Speechgen.io vincula su licencia comercial también al uso gratuito.
  • Wondercraft: Wondercraft ofrece un generador de pódcasts con IA que planifica, graba y edita automáticamente episodios con música y capítulos. Factura mensual o anualmente y tiene un plan Free a $0 al mes con 150 créditos.

Speechgen.io encaja con tandas irregulares que necesitan créditos duraderos; los productos de suscripción encajan con una producción mensual constante o con una edición al estilo pódcast.

Limitaciones

Varios límites clave son contradicciones entre las propias páginas de Speechgen.io.

Cifras contradictorias

  • Longitud máxima del texto: la página de inicio dice que se pueden pegar hasta 1.000.000 de caracteres, además de subir archivos DOCX, PDF o SRT.
  • Un límite más alto en otro lugar: la guía paso a paso establece un máximo de 2.000.000 de caracteres por generación.
  • Número de voces: un texto de la página de inicio todavía habla de varias decenas de voces e idiomas disponibles, frente a la cifra de 5.000+ que se usa en otras partes.

Restricciones de entrada y salida

  • Símbolos: la guía advierte que los emojis y los emoticonos pueden alterar la generación de audio.
  • Cobertura de SSML: voces distintas admiten conjuntos distintos de etiquetas SSML.

Reembolsos, cuentas y fiabilidad

  • Página de reembolsos: la página de la política de reembolso dice que no hay reembolso por los tokens no gastados.
  • Excepción en la política de privacidad: la política, sin embargo, permite solicitar una devolución dentro de las 24 horas siguientes a la compra si el uso no supera los 3.000 caracteres.
  • Una sola cuenta: está prohibido crear varias cuentas.
  • Interrupción del servicio: en respuestas publicadas en una plataforma de reseñas de terceros, la empresa dijo que una caída en septiembre de 2025 dejó su sitio web inaccesible, y más tarde que una versión mínima funcionaba en 3 días y la funcionalidad completa en 5 días.
  • Valoraciones de usuarios: según una captura del 5 de octubre de 2026, una plataforma de reseñas de terceros mostraba una media de 3,0 sobre 21 reseñas a nivel de empresa, con un 53 % de cinco estrellas y un 14 % de una estrella; una muestra tan pequeña solo da una orientación.

Lagunas en los textos legales

  • Términos principales no encontrados: los términos de clonación de voz remiten la ley aplicable a «los Términos de Servicio principales de SpeechGen». En las páginas revisadas aquí, incluido el mapa del sitio, no se encontró ninguna página de términos generales independiente, y el propio enlace de los términos de clonación apunta de nuevo a los términos de clonación.
  • Se nombra otro dominio: la página DMCA se refiere a material publicado en naturalvoice.io en lugar de speechgen.io.
  • Verificación: los términos de clonación dicen que el servicio no verifica previamente el audio subido, la identidad del usuario ni el consentimiento declarado. La página de clonación de voz incluye a los usuarios menores de 18 años, con la indicación «se requiere verificación de edad», entre sus elementos prohibidos.

Privacidad y derechos

  • Uso comercial: Speechgen.io afirma que todos los planes gratuitos y de pago incluyen una licencia comercial y que los usuarios son dueños de los archivos de audio que crean.
  • Derechos de autor del texto: la política de privacidad no impone restricciones al uso del archivo locutado, incluido el uso comercial, pero hay que seguir respetando los derechos de autor del texto de origen.
  • Voces políticas: el servicio no debe usarse para simular la voz o la imagen de políticos o funcionarios públicos, ni siquiera con su consentimiento.
  • Otros usos prohibidos: las normas prohíben suplantar a cualquier persona sin permiso explícito y el uso en aplicaciones sexualmente explícitas.
  • Datos recopilados: la política de privacidad incluye la dirección de correo electrónico como dato personal y dice que se recogen datos anonimizados de visitantes mediante servicios de estadísticas como Google Analytics. En las páginas revisadas aquí, no indica si el texto enviado se usa para entrenar modelos.
  • Conservación de archivos: los archivos de usuarios registrados se guardan 30 días y los de usuarios no registrados 24 horas, tras lo cual el historial se elimina de forma irrecuperable.
  • Favoritos: la guía menciona una caché de frases de 7 días, un historial de proyectos de 30 días y almacenamiento permanente de los archivos favoritos, algo que la regla de borrado a 30 días de la política de privacidad no menciona.

Normas de la clonación de voz

  • Consentimiento: clonar a otra persona requiere un consentimiento escrito explícito, informado y documentado, que debe conservarse durante toda la vida del clon y al menos dos años después de su eliminación.
  • Prueba a petición: Speechgen.io puede pedir una prueba del consentimiento y elimina el clon si no se presenta documentación válida en un plazo de 7 días.
  • Voces restringidas: no pueden clonarse jefes de Estado en ejercicio, altos cargos, jueces, candidatos electorales, personas fallecidas sin autorización de su sucesión ni figuras públicas cuyo clon pudiera interpretarse como aval, suplantación o difamación.
  • Propiedad: los usuarios conservan la propiedad de las muestras que suben y del audio sintetizado con su modelo de voz.
  • Alcance de la licencia: los usuarios conceden a Speechgen.io una licencia sobre muestras y modelos únicamente para operar el servicio para ellos, incluida la mejora de su propio modelo de voz.
  • Prohibición de entrenamiento: los términos de clonación prohíben usar el audio generado para entrenar o mejorar modelos de voz de terceros o productos competidores.
  • Lugar de tratamiento: las muestras y modelos de voz pueden tratarse en servidores de cualquier jurisdicción que elija Speechgen.io.
  • Plazo de eliminación: según los términos de clonación, un modelo eliminado se retira de los sistemas activos en un plazo de 30 días, y las copias de seguridad se purgan con una rotación estándar. La página de clonación de voz dice en cambio que la eliminación es instantánea y borra el modelo de forma permanente.

Preguntas frecuentes

Q1. ¿Puedo usar el audio de Speechgen.io con fines comerciales?

Sí, según el sitio: el uso gratuito y el de pago incluyen una licencia comercial, y la política de privacidad añade que hay que seguir respetando los derechos de autor del texto de origen.

Q2. ¿Caducan los créditos de Speechgen.io?

Sí. Los créditos duran un año desde la compra, y comprar otro paquete traslada el saldo restante y reinicia el plazo.

Q3. ¿Puedo clonar la voz de otra persona?

Solo con su consentimiento escrito documentado, y no en el caso de grupos restringidos como jefes de Estado en ejercicio, jueces o candidatos electorales. Los usuarios deben tener al menos 18 años.

¿Conoces una herramienta similar?
Si conoces otras grandes herramientas de IA, no dudes en enviárnoslas