Toolso.AI
Toolso.AI
OutilsCatégoriesTendancesNouveautésTarifsBlog
Toolso.AI
Toolso.AI

💌Abonnez-vous à AI Tools Weekly

Sélection hebdomadaire des derniers et meilleurs outils IA et tendances, livrés dans votre boîte mail S'abonner

Toolso.AI
Toolso.AI

Découvrez les meilleurs outils IA pour booster votre productivité

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Catégories populaires

  • Écriture IA
  • Image IA
  • Vidéo IA
  • Codage IA
  • Plus de catégories

Explorer

  • Derniers outils
  • Outils populaires
  • Plus d'outils
  • Soumettre un outil
  • Tarifs

À propos

  • À propos de nous
  • Contact
  • Blog
  • Journal des modifications

Légal

  • Politique des cookies
  • Politique de confidentialité
  • Conditions d'utilisation
  • Politique de remboursement
© 2026 Toolso.AI Tous droits réservés
Offre limitéeOffre limitéeMise en avantExamen sous 24 h · Sans backlink · 30 jours en vedette$29.90puis $59.90Passe à $59.90 après le 31 oct.Fin dans--:--:--Soumettre
  1. Accueil
  2. Tous les outils
  3. Technologie vocale
  4. Speechgen.io
Aperçu de l’interface de Speechgen.io
Logo de Speechgen.io

Speechgen.io

Synthèse vocale dans le navigateur avec plus de 5 000 voix, dialogues à plusieurs voix, audio calé sur les sous-titres, clonage vocal et API, payée par packs de crédits valables un an plutôt que par abonnement mensuel.

Technologie vocaleGénération de VoixGénération Audio#Synthèse vocale#Clonage vocal#Transcription
Voir les tarifs
Favoris
Visites
Vues
Tarif
Payant
Publié le
5 oct. 2026
Domaine
speechgen.io
Note des utilisateurs

Vous avez utilisé cet outil ? Notez-le

Noter cet outil

Informations produit Speechgen.io

Voir les tarifs
Informations sur l'outil
Favoris
Visites
Vues
Tarif
Payant
Publié le
5 oct. 2026
Domaine
speechgen.io
Note des utilisateurs

Vous avez utilisé cet outil ? Notez-le

Noter cet outil

Outils en vedette

Outils associés

Voir les tarifs

Speechgen.io, qu’est-ce que c’est ?

Speechgen.io (écrit SpeechGen.io et SpeechGen sur ses propres pages) se présente comme un générateur de voix IA en ligne doté de plus de 5 000 voix réalistes. Le texte saisi dans l’éditeur web, ou repris d’un document ou d’un fichier de sous-titres, est renvoyé sous forme d’audio téléchargeable.

Le site indique couvrir 150 langues et exporter en MP3, WAV et FLAC. Les packs de crédits se paient une seule fois, sans abonnement ni renouvellement automatique : c’est sa principale différence avec les offres mensuelles de synthèse vocale.

La page d’assistance nomme Bueno Limited, avec une adresse de bénéficiaire à North Point, Hong Kong. La politique de confidentialité, en revanche, désigne le responsable du traitement comme « the Operator » (l’opérateur) et ne nomme aucune société dans son texte.

Les quotas gratuits, les règles de remboursement et la longueur maximale du texte varient d’une page à l’autre ; ces écarts sont traités sous Tarification et Limitations.

Fonctionnalités principales

Speechgen.io réunit narration, dialogue, minutage et réglages musicaux dans un seul éditeur de navigateur.

Voix et niveaux de qualité

  • Trois niveaux : les voix se filtrent par genre, par accent et par niveau de qualité Standard, HD ou PRO, et chaque niveau consomme les crédits à un rythme différent.
  • Écoute gratuite : les combinaisons de voix, de vitesse et de hauteur peuvent être préécoutées avec votre propre texte, et le site affirme que les échantillons ne déduisent aucun caractère.
  • Graphiques d’intonation : plus de la moitié de la bibliothèque, voix ordinaires et PRO confondues, propose un graphique dont on fait glisser les points pour monter ou baisser la hauteur sur des mots choisis.
  • Voix de personnages nommées : des pages par genre couvrent les styles effrayant, enfant et dessin animé, et le site présente sa voix Brian comme « l’équivalent IA moderne » de la voix britannique Brian créée par IVONA, puis rachetée par Amazon Polly.

Dans les pages vérifiées ici, Speechgen.io ne nomme pas les moteurs vocaux qui se cachent derrière ses niveaux.

Réglages de l’éditeur

  • Vitesse et hauteur : la vitesse va de x0,1 à x2,2, et la hauteur de -20 à +20 par pas de 2.
  • Pauses : les silences par défaut entre les phrases et entre les paragraphes se règlent chacun de 150 ms à 30 secondes.
  • Plusieurs locuteurs : des voix différentes peuvent être attribuées à différents paragraphes grâce à des balises de nom, si bien qu’une interview ou une distribution de personnages s’exporte en un seul fichier.
  • Musique de fond : un morceau de la bibliothèque musicale IA intégrée, ou votre propre fichier, peut être mixé sous la voix sans quitter l’éditeur.

Outils pour textes longs et sous-titres

  • Fichiers par chapitre : une balise de découpe saisie seule sur une ligne exporte chaque segment dans un fichier audio distinct.
  • Plafond de segments : une génération autorise jusqu’à 1 000 segments courts ou 500 segments longs ; les livres plus volumineux doivent donc être répartis sur plusieurs passes.
  • Audio calé sur les sous-titres : un fichier SRT ou VTT importé est vocalisé ligne par ligne à chaque timecode exact, ce qui donne un audio déjà synchronisé dans le logiciel de montage vidéo.

Cache intelligent

Chaque phrase générée reste en cache pendant 7 jours, et une nouvelle génération ne facture que les phrases nouvelles ou modifiées. Corriger un mot dans un long script coûte donc cette phrase, et non le texte entier.

Clonage vocal

Un modèle vocal personnel se construit à partir de 10 à 60 secondes de parole claire et fonctionne dans 15 langues : neuf indiquées comme stables et six expérimentales.

Transcription

La page d’accueil décrit une transcription audio en 140 langues avec identification des locuteurs et horodatage. La page des tarifs indique pour la même fonction des imports jusqu’à 1 Go ou 3 heures, « 150+ » langues et un export de sous-titres SRT ou VTT : les deux pages divergent donc sur le nombre de langues.

Guide

La synthèse vocale en ligne avec Speechgen.io suit un ordre précis, car certaines modifications consomment à nouveau des caractères.

  1. Choisir d’abord la langue. Le guide officiel demande de sélectionner la langue du texte avant toute chose ; ensuite seulement s’ouvre la liste des voix de cette langue.
  2. Choisir une voix. Pour un travail multilingue, les voix codées comme Ava_US et Ava_ES conservent une même voix reconnaissable d’une langue à l’autre, ce qui aide pour les projets de dialogue.
  3. Coller ou importer le texte. Texte brut, fichiers DOCX, PDF et SRT sont acceptés en entrée.
  4. Fixer vitesse et hauteur avant la première génération. Modifier la vitesse ou la hauteur déclenche une régénération complète et consomme de nouveau les limites de caractères. Les pauses entre phrases et entre paragraphes, à l’inverse, se modifient sans consommer de limites.
  5. Choisir le format de sortie avant de générer. Le MP3 est le téléchargement par défaut ; pour du WAV, de l’OPUS ou une autre fréquence d’échantillonnage, il faut le sélectionner et régénérer la voix avant de pouvoir télécharger ce fichier.

Cas d’usage et exemples

La page d’accueil illustre son marché par des exemples de clients. Ce sont des cas décrits par l’éditeur, non des tests indépendants.

  • Menus téléphoniques et SVI : un exemple est un menu téléphonique bilingue anglais-espagnol pour un réseau vétérinaire de cinq cliniques à Atlanta, livré en MP3 à 64 kbps et mis à jour en 30 secondes environ.
  • Débit selon le canal : le guide qualité du site associe 8–64 kbps au téléphone, au SVI et à l’affichage, 64–128 kbps à YouTube, aux podcasts et à l’e-learning, et 192–320 kbps à la diffusion.
  • Exercices d’e-learning : un exercice bilingue d’espagnol mélange l’anglais et l’espagnol dans un même enregistrement et est découpé par leçon en 50 fichiers MP3 à partir d’un seul script.
  • Alertes de sécurité au travail : un autre cas utilise l’API pour déclencher, par sonorisation, des alertes de sécurité en six langues dans un entrepôt de 15 000 m².
  • Audioguides localisés : un audioguide d’exposition est localisé en cinq langues à partir d’un seul import SRT, avec une voix différente choisie pour chaque langue.

Pour qui

Speechgen.io convient aux acheteurs dont les besoins audio arrivent par à-coups. La page des tarifs demande « Pourquoi payer chaque mois si vous ne l’utilisez pas chaque mois ? » et indique que ses packs restent actifs jusqu’à un an.

Profils probables

  • Créateurs vidéo : selon le site, les fichiers de voix off IA peuvent rejoindre des projets YouTube, TikTok ou Reels via des logiciels de montage comme Premiere Pro, DaVinci Resolve et CapCut.
  • Projets multilingues à petit budget : les voix Standard sont décrites comme le niveau le plus économique et celui qui couvre l’éventail de langues le plus large.

Profils moins adaptés

  • Mineurs souhaitant cloner une voix : le clonage vocal exige que les utilisateurs aient au moins 18 ans, même avec le consentement parental.
  • Projets fondés sur l’imitation de personnalités publiques réelles : les règles de contenu décrites dans Limitations restreignent les voix de responsables politiques et de personnalités publiques.
  • Acheteurs ayant besoin d’un large filet de sécurité pour les remboursements : les conditions de remboursement sont étroites, et les pages officielles se contredisent à leur sujet.

Plateformes

  • Éditeur web : Speechgen.io fonctionne dans le navigateur, sans logiciel à installer.
  • Navigateurs mobiles : les outils de clonage vocal fonctionnent dans le navigateur sur ordinateur, tablette et mobile. Dans les pages vérifiées ici, aucune application native pour ordinateur ou mobile n’est proposée.
  • API REST : l’accès à l’API nécessite un compte payant. La méthode /text renvoie l’audio immédiatement jusqu’à 2 000 caractères, tandis que /longtext traite jusqu’à 1 000 000 de caractères via un identifiant de tâche interrogé périodiquement.
  • Horodatage : la méthode /subs fonctionne comme /longtext, mais renvoie aussi des horodatages de sous-titres pour caler l’audio sur une vidéo ou des diapositives.
  • Automatisation sans code : l’API REST renvoie une URL audio à partir d’un seul appel HTTP et, selon le site, fonctionne avec n8n, Make et Zapier.
  • WordPress : un plugin gratuit vocalise les articles des sites WordPress, mais il ne s’installe qu’à partir d’une archive, ne figure pas dans le répertoire WordPress et nécessite des jetons Speechgen pour fonctionner.

Tarification

Speechgen.io vend six packs de crédits ponctuels, de 25 000 crédits pour $4.99 à 10 000 000 de crédits pour $599.99.

PackPrixMention affichée sur la pageDurée de voix IA estimée
25 000 crédits$4.99aucune~60 min
65 000 crédits$9.99$13 barré, 23 % de réduction~155 min
200 000 crédits$24.99$40 barré, 38 % de réduction~476 min
500 000 crédits$49.99$100 barré, 50 % de réduction~1 190 min
2 000 000 crédits$149.99$400 barré, 63 % de réduction~4 762 min
10 000 000 crédits$599.99$2000 barré, 70 % de réduction~23 810 min

La page n’explique pas ce que représentent les prix de référence barrés. Les estimations en minutes supposent un texte anglais moyen lu à environ 140 mots par minute.

  • Taux de conversion : un crédit correspond à 2 caractères de voix Standard, 1 caractère de Pro ou 0,5 caractère de HD.
  • Unité de facturation : la facturation se fait au caractère, espaces et ponctuation compris.
  • Validité : les crédits sont valables un an à compter de l’achat ; un nouvel achat ajoute le solde restant et relance le compteur d’un an.
  • Inclus dans chaque pack : chaque pack comprend une licence commerciale, l’accès à l’API, toutes les voix, la mise en cache intelligente et un historique de 30 jours.
  • Un seul solde : les mêmes crédits servent à la synthèse vocale, à la transcription ou aux deux.
  • Paiement et factures : Stripe et PayPal sont acceptés, et les factures permettent d’indiquer un nom de société, une adresse et un numéro de TVA personnalisés.

Quota gratuit

La page d’accueil décrit une échelle gratuite en trois paliers : 1 000 caractères sans compte, 2 000 de plus à l’inscription gratuite, puis 3 000 caractères par jour pendant 7 jours. La politique de confidentialité décrit plutôt un tarif d’essai de 5 Limits et 1 000 Limits gratuits après inscription avec une adresse gmail.com, yahoo.com ou hotmail.com. Les pages ne concilient pas les deux versions.

Coût du clonage vocal

Créer un clone coûte 2 000 crédits, le stocker 250 crédits par jour, et la synthèse est facturée au tarif HD. Le clonage vocal n’a pas d’offre gratuite ; supprimer un clone met fin à ses frais de stockage.

Alternatives à Speechgen.io

Speechgen.io oppose ses packs aux forfaits mensuels qui, selon lui, coûtent de $22 à $99 par mois, qu’on les utilise ou non. Deux produits par abonnement présentés à ses côtés sur une plateforme de découverte de produits montrent l’autre versant de ce compromis.

  • ElevenLabs : ElevenLabs vend des forfaits à facturation mensuelle ou annuelle et propose une offre Free à $0 par mois. Son offre Starter est présentée comme tout le contenu de Free plus une licence commerciale et le clonage vocal instantané, alors que Speechgen.io associe sa licence commerciale à l’usage gratuit aussi.
  • Wondercraft : Wondercraft propose un générateur de podcasts IA qui planifie, enregistre et monte automatiquement des épisodes avec musique et chapitres. Il facture au mois ou à l’année et propose une offre Free à $0 par mois avec 150 crédits.

Speechgen.io convient aux lots irréguliers qui demandent des crédits durables ; les produits par abonnement conviennent à une production mensuelle régulière ou à un montage de type podcast.

Limitations

Plusieurs limites clés sont des contradictions entre les propres pages de Speechgen.io.

Chiffres contradictoires

  • Longueur maximale du texte : la page d’accueil indique qu’on peut coller jusqu’à 1 000 000 de caractères, en plus des imports DOCX, PDF ou SRT.
  • Un plafond plus élevé ailleurs : le guide pas à pas indique un maximum de 2 000 000 de caractères par génération.
  • Nombre de voix : un encart de la page d’accueil parle encore de plusieurs dizaines de voix et de langues disponibles, contre le chiffre de 5 000+ utilisé ailleurs.

Contraintes d’entrée et de sortie

  • Symboles : le guide avertit que les emojis et les émoticônes peuvent perturber la génération audio.
  • Prise en charge du SSML : les voix ne prennent pas toutes en charge les mêmes jeux de balises SSML.

Remboursements, comptes et fiabilité

  • Page de remboursement : la page de politique de remboursement indique qu’aucun remboursement n’est accordé pour les jetons non utilisés.
  • Exception de la politique de confidentialité : la politique de confidentialité autorise toutefois une demande de retour dans les 24 heures suivant l’achat si l’utilisation reste inférieure ou égale à 3 000 caractères.
  • Un seul compte : la création de plusieurs comptes est interdite.
  • Interruption de service : dans des réponses publiées sur une plateforme d’avis tierce, l’entreprise a indiqué qu’une panne en septembre 2025 avait rendu son site inaccessible, puis qu’une version minimale fonctionnait sous 3 jours et l’ensemble des fonctions sous 5 jours.
  • Notes des utilisateurs : d’après une capture du 5 octobre 2026, une plateforme d’avis tierce affichait une moyenne de 3,0 sur 21 avis au niveau de l’entreprise, dont 53 % de cinq étoiles et 14 % d’une étoile ; un échantillon aussi réduit ne donne qu’une tendance.

Lacunes des textes juridiques

  • Conditions principales introuvables : les conditions de clonage vocal renvoient le droit applicable aux « conditions d’utilisation principales de SpeechGen ». Dans les pages vérifiées ici, plan du site compris, aucune page de conditions générales distincte n’a été trouvée, et le lien des conditions de clonage renvoie vers ces mêmes conditions de clonage.
  • Un autre domaine cité : la page DMCA mentionne des contenus publiés sur naturalvoice.io plutôt que sur speechgen.io.
  • Vérification : les conditions de clonage indiquent que le service ne vérifie pas au préalable l’audio importé, l’identité de l’utilisateur ni le consentement revendiqué. La page de clonage vocal range les utilisateurs de moins de 18 ans, avec la mention « vérification de l’âge requise », parmi ses éléments interdits.

Confidentialité et droits

  • Usage commercial : Speechgen.io affirme qu’une licence commerciale accompagne chaque offre gratuite et payante et que les utilisateurs possèdent les fichiers audio qu’ils créent.
  • Droits d’auteur du texte : la politique de confidentialité n’impose aucune restriction à l’utilisation du fichier vocalisé, usage commercial compris, mais le droit d’auteur du texte source doit toujours être respecté.
  • Voix politiques : le service ne doit pas servir à simuler la voix ou l’image de responsables politiques ou de représentants de l’État, même avec leur consentement.
  • Autres usages interdits : les règles interdisent d’usurper l’identité de quiconque sans autorisation explicite ainsi que l’utilisation dans des applications sexuellement explicites.
  • Données collectées : la politique de confidentialité cite l’adresse e-mail comme donnée personnelle et indique que des données de visite anonymisées sont recueillies via des services de statistiques comme Google Analytics. Dans les pages vérifiées ici, elle ne précise pas si le texte soumis sert à entraîner des modèles.
  • Conservation des fichiers : les fichiers des utilisateurs inscrits sont conservés 30 jours et ceux des utilisateurs non inscrits 24 heures, après quoi l’historique est supprimé de façon irrécupérable.
  • Favoris : le guide mentionne un cache de phrases de 7 jours, un historique de projets de 30 jours et un stockage permanent des fichiers favoris, ce que la règle de suppression à 30 jours de la politique de confidentialité ne mentionne pas.

Règles du clonage vocal

  • Consentement : cloner une autre personne exige un consentement écrit explicite, éclairé et documenté, conservé pendant toute la durée de vie du clone et au moins deux ans après sa suppression.
  • Preuve sur demande : Speechgen.io peut demander une preuve du consentement et supprime le clone si aucun justificatif valable n’est fourni sous 7 jours.
  • Voix interdites : les chefs d’État en exercice, les hauts fonctionnaires, les juges, les candidats à une élection, les personnes décédées sans autorisation de leur succession, et les personnalités publiques dont le clonage pourrait passer pour une caution, une usurpation d’identité ou une diffamation ne peuvent pas être clonés.
  • Propriété : les utilisateurs restent propriétaires des échantillons qu’ils importent et de l’audio synthétisé avec leur modèle vocal.
  • Portée de la licence : les utilisateurs accordent à Speechgen.io une licence sur les échantillons et les modèles uniquement pour faire fonctionner le service à leur intention, y compris pour améliorer leur propre modèle vocal.
  • Interdiction d’entraînement : les conditions de clonage interdisent d’utiliser l’audio généré pour entraîner ou améliorer des modèles vocaux tiers ou des produits concurrents.
  • Lieu de traitement : les échantillons et modèles vocaux peuvent être traités sur des serveurs situés dans toute juridiction choisie par Speechgen.io.
  • Délai de suppression : selon les conditions de clonage, un modèle supprimé est retiré des systèmes actifs sous 30 jours, les sauvegardes étant purgées selon une rotation standard. La page de clonage vocal affirme au contraire que la suppression est instantanée et retire définitivement le modèle.

FAQ

Q1. Puis-je utiliser l’audio de Speechgen.io à des fins commerciales ?

Oui, selon le site : une licence commerciale est incluse dans l’usage gratuit comme payant, et la politique de confidentialité ajoute que le droit d’auteur du texte source doit toujours être respecté.

Q2. Les crédits Speechgen.io expirent-ils ?

Oui. Les crédits durent un an à compter de l’achat, et l’achat d’un autre pack reporte le solde restant et relance le compteur.

Q3. Puis-je cloner la voix de quelqu’un d’autre ?

Uniquement avec son consentement écrit documenté, et pas pour les groupes restreints comme les chefs d’État en exercice, les juges ou les candidats à une élection. Les utilisateurs doivent avoir au moins 18 ans.

Connaissez-vous un outil similaire ?
Si vous connaissez d'autres excellents outils IA, n'hésitez pas à nous les soumettre