Toolso.AI
Toolso.AI
Alle ToolsKategorienIm TrendNeueste ToolsPreiseBlog
Toolso.AI
Toolso.AI

💌Abonnieren Sie AI Tools Weekly

Wöchentlich kuratierte Auswahl der neuesten und angesagtesten KI-Tools und Trends, direkt in Ihrem Posteingang Abonnieren

Toolso.AI
Toolso.AI

Entdecken Sie die besten KI-Tools, um Ihre Produktivität zu steigern

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Beliebte Kategorien

  • KI-Schreiben
  • KI-Bild
  • KI-Video
  • KI-Programmierung
  • Weitere Kategorien

Entdecken

  • Neueste Tools
  • Beliebte Tools
  • Mehr Tools
  • Tool einreichen
  • Preise

Über

  • Über uns
  • Kontakt
  • Blog
  • Änderungsprotokoll

Rechtliches

  • Cookie-Richtlinie
  • Datenschutzrichtlinie
  • Nutzungsbedingungen
  • Rückerstattungsrichtlinie
© 2026 Toolso.AI Alle Rechte vorbehalten
BefristetZeitlich begrenztHervorgehobener EintragPrüfung in 24 Std. · Kein Backlink · 30 Tage hervorgehoben$29.90danach $59.90Nach dem 31. Okt. steigt der Preis auf $59.90Endet in--:--:--Jetzt einreichen
  1. Startseite
  2. Alle Tools
  3. Sprachtechnologie
  4. Speechgen.io
Oberflächenvorschau von Speechgen.io
Logo von Speechgen.io

Speechgen.io

Browserbasiertes Text-to-Speech mit über 5.000 Stimmen, Dialogen mit mehreren Sprechern, untertitelsynchronem Audio, Stimmklonen und API, bezahlt über ein Jahr gültige Credit-Pakete statt eines Monatsabos.

SprachtechnologieSprachgenerierungAudio-Generierung#Text-zu-Sprache#Stimmklonen#Transkription
Preise ansehen
Gespeichert
Besuche
Aufrufe
Preis
Kostenpflichtig
Veröffentlicht
5. Okt. 2026
Domain
speechgen.io
Nutzerbewertung

Hast du dieses Tool genutzt? Bewerte es

Dieses Tool bewerten

Speechgen.io Produktinformationen

Preise ansehen
Tool-Informationen
Gespeichert
Besuche
Aufrufe
Preis
Kostenpflichtig
Veröffentlicht
5. Okt. 2026
Domain
speechgen.io
Nutzerbewertung

Hast du dieses Tool genutzt? Bewerte es

Dieses Tool bewerten

Empfohlene Tools

Verwandte Tools

Preise ansehen

Was ist Speechgen.io?

Speechgen.io (auf den eigenen Seiten auch SpeechGen.io und SpeechGen geschrieben) beschreibt sich als Online-KI-Stimmengenerator mit mehr als 5.000 realistischen Stimmen. Text, der im Web-Editor eingetippt oder aus einem Dokument oder einer Untertiteldatei übernommen wird, kommt als herunterladbares Audio zurück.

Laut Website deckt der Dienst 150 Sprachen ab und exportiert MP3, WAV und FLAC. Credit-Pakete werden einmalig bezahlt, ohne Abo und ohne automatische Verlängerung – der Hauptunterschied zu monatlichen Text-to-Speech-Tarifen.

Die Support-Seite nennt Bueno Limited mit einer Empfängeradresse in North Point, Hongkong. Die Datenschutzerklärung bezeichnet den Verantwortlichen dagegen als „the Operator“ (den Betreiber) und nennt im Text kein Unternehmen.

Kostenlose Kontingente, Erstattungsregeln und maximale Textlänge unterscheiden sich von Seite zu Seite; diese Abweichungen behandeln Preise und Einschränkungen.

Kernfunktionen

Speechgen.io bündelt die Steuerung von Erzählstimme, Dialog, Timing und Musik in einem einzigen Browser-Editor.

Stimmen und Qualitätsstufen

  • Drei Stufen: Stimmen lassen sich nach Geschlecht, Akzent und den Qualitätsstufen Standard, HD oder PRO filtern, und jede Stufe verbraucht Credits unterschiedlich schnell.
  • Kostenloses Probehören: Kombinationen aus Stimme, Tempo und Tonhöhe lassen sich mit eigenem Text anhören, und laut Website werden für Hörproben keine Zeichen abgezogen.
  • Intonationsgrafiken: Mehr als die Hälfte der Bibliothek, normale und PRO-Stimmen zusammen, bietet eine Grafik, deren Punkte man zieht, um die Tonhöhe auf ausgewählten Wörtern zu heben oder zu senken.
  • Benannte Figurenstimmen: Genre-Seiten decken gruselige, kindliche und Cartoon-Stile ab, und laut Website ist die hauseigene Stimme Brian „das moderne KI-Pendant“ zur britischen Brian-Stimme, die IVONA geschaffen hat und die später von Amazon Polly übernommen wurde.

In den hier geprüften Seiten nennt Speechgen.io die Sprach-Engines hinter seinen Stufen nicht.

Editor-Steuerung

  • Tempo und Tonhöhe: Das Tempo reicht von x0,1 bis x2,2, die Tonhöhe von -20 bis +20 in Zweierschritten.
  • Pausen: Die Standardpausen zwischen Sätzen und zwischen Absätzen lassen sich jeweils von 150 ms bis 30 Sekunden einstellen.
  • Mehrere Sprecher: Über Namens-Tags lassen sich verschiedenen Absätzen verschiedene Stimmen zuweisen, sodass ein Interview oder ein Figurenensemble als einzige Datei exportiert wird.
  • Hintergrundmusik: Ein Titel aus der integrierten KI-Musikbibliothek oder ein eigener Upload lässt sich unter die Stimme mischen, ohne den Editor zu verlassen.

Werkzeuge für lange Texte und Untertitel

  • Kapiteldateien: Ein Trenn-Tag in einer eigenen Zeile exportiert jeden Abschnitt als separate Audiodatei.
  • Segmentobergrenze: Eine Generierung erlaubt bis zu 1.000 kurze oder 500 lange Segmente, größere Bücher müssen daher auf mehrere Durchläufe verteilt werden.
  • Untertitelgetaktetes Audio: Eine hochgeladene SRT- oder VTT-Datei wird Zeile für Zeile exakt zum jeweiligen Timecode vertont, sodass das Audio im Videoschnittprogramm bereits synchron liegt.

Intelligenter Cache

Jeder generierte Satz bleibt 7 Tage im Cache, und bei einer Neugenerierung werden nur neue oder bearbeitete Sätze berechnet. Wer in einem langen Skript ein Wort korrigiert, zahlt also nur für diesen Satz statt für den ganzen Text.

Stimmklonen

Ein persönliches Stimmmodell entsteht aus 10 bis 60 Sekunden klarer Sprache und funktioniert in 15 Sprachen: neun als stabil und sechs als experimentell gekennzeichnet.

Transkription

Die Startseite beschreibt Audio-Transkription in 140 Sprachen mit Sprecherkennzeichnung und Zeitstempeln. Die Preisseite nennt für dieselbe Funktion Uploads bis 1 GB oder 3 Stunden, „150+“ Sprachen und SRT- oder VTT-Untertitelexport – die beiden Seiten widersprechen sich also bei der Zahl der Sprachen.

Anleitung

Wer mit Speechgen.io online Text in Sprache umwandeln will, hält sich an eine feste Reihenfolge, denn manche Änderungen kosten erneut Zeichen.

  1. Zuerst die Sprache wählen. Laut offizieller Anleitung wird vor allem anderen die Textsprache ausgewählt; erst dann öffnet sich die Stimmenliste für diese Sprache.
  2. Eine Stimme wählen. Für mehrsprachige Arbeit halten Stimmen mit Codes wie Ava_US und Ava_ES eine wiedererkennbare Stimme über Sprachen hinweg, was bei Dialogprojekten hilft.
  3. Text einfügen oder hochladen. Als Eingabe werden reiner Text sowie DOCX-, PDF- und SRT-Dateien akzeptiert.
  4. Tempo und Tonhöhe vor dem ersten Durchlauf festlegen. Eine Änderung von Tempo oder Tonhöhe löst eine vollständige Neugenerierung aus und verbraucht erneut Zeichenlimits. Pausen zwischen Sätzen und Absätzen lassen sich dagegen ändern, ohne Limits zu verbrauchen.
  5. Das Ausgabeformat vor der Generierung wählen. Standard-Download ist MP3; WAV, OPUS oder eine andere Abtastrate muss ausgewählt und die Sprache neu generiert werden, bevor sich diese Datei herunterladen lässt.

Anwendungsfälle und Beispiele

Die Startseite veranschaulicht ihren Markt mit Kundenbeispielen. Es sind vom Anbieter beschriebene Fälle, keine unabhängigen Tests.

  • Telefonmenüs und IVR: Ein Beispiel ist ein zweisprachiges Telefonmenü auf Englisch und Spanisch für ein Tierarztnetz mit fünf Kliniken in Atlanta, geliefert als MP3 mit 64 kbps und in etwa 30 Sekunden aktualisiert.
  • Bitrate nach Kanal: Der Qualitätsleitfaden der Website ordnet 8–64 kbps Telefon, IVR und Beschilderung zu, 64–128 kbps YouTube, Podcasts und E-Learning und 192–320 kbps Rundfunkarbeit.
  • E-Learning-Übungen: Eine zweisprachige Spanischübung mischt Englisch und Spanisch in einer Aufnahme und wird aus einem einzigen Skript lektionsweise in 50 MP3-Dateien aufgeteilt.
  • Sicherheitsdurchsagen am Arbeitsplatz: Ein weiterer Fall nutzt die API, um in einem 15.000 m² großen Lager Sicherheitsdurchsagen über die Lautsprecheranlage in sechs Sprachen auszulösen.
  • Lokalisierte Audioguides: Ein Ausstellungs-Audioguide wird aus einem einzigen SRT-Upload in fünf Sprachen lokalisiert, mit einer anderen Stimme für jede Sprache.

Für wen ist es

Speechgen.io passt zu Käufern, deren Audiobedarf schubweise anfällt. Die Preisseite fragt „Warum monatlich zahlen, wenn Sie es nicht monatlich nutzen?“ und gibt an, dass die Pakete bis zu einem Jahr aktiv bleiben.

Passt wahrscheinlich

  • Videoersteller: Laut Website lassen sich Dateien mit KI-Vertonung über Schnittprogramme wie Premiere Pro, DaVinci Resolve und CapCut in YouTube-, TikTok- oder Reels-Projekte einbinden.
  • Mehrsprachige Projekte mit kleinem Budget: Standard-Stimmen werden als günstigste Stufe beschrieben, die zugleich das breiteste Sprachspektrum abdeckt.

Weniger geeignet

  • Minderjährige, die eine Stimme klonen wollen: Stimmklonen setzt ein Mindestalter von 18 Jahren voraus, unabhängig von einer Zustimmung der Eltern.
  • Projekte auf Basis der Nachahmung realer Personen des öffentlichen Lebens: Die unter Einschränkungen beschriebenen Inhaltsregeln beschränken Stimmen von Politikern und Personen des öffentlichen Lebens.
  • Käufer, die ein breites Sicherheitsnetz bei Erstattungen brauchen: Die Erstattungsbedingungen sind eng, und die offiziellen Seiten widersprechen sich dabei.

Plattformen

  • Web-Editor: Speechgen.io läuft im Browser, ohne dass Software installiert werden muss.
  • Mobile Browser: Die Werkzeuge zum Stimmklonen laufen im Browser auf Desktop, Tablet und Smartphone. In den hier geprüften Seiten wird keine native Desktop- oder Mobil-App angeboten.
  • REST-API: Für den API-Zugang ist ein kostenpflichtiges Konto nötig. Die Methode /text liefert Audio für bis zu 2.000 Zeichen sofort, während /longtext bis zu 1.000.000 Zeichen über eine abgefragte Task-ID verarbeitet.
  • Zeitstempel: Die Methode /subs arbeitet wie /longtext, liefert aber zusätzlich Untertitel-Zeitstempel, um Audio an Video oder Folien auszurichten.
  • No-Code-Automatisierung: Die REST-API gibt über einen einzigen HTTP-Aufruf eine Audio-URL zurück und funktioniert laut Website mit n8n, Make und Zapier.
  • WordPress: Ein kostenloses Plugin vertont Artikel auf WordPress-Websites, lässt sich aber nur aus einem Archiv installieren, steht nicht im WordPress-Verzeichnis und benötigt zum Betrieb Speechgen-Tokens.

Preise

Speechgen.io verkauft sechs einmalige Credit-Pakete, von 25.000 Credits für $4.99 bis 10.000.000 Credits für $599.99.

PaketPreisAuf der Seite angezeigtes LabelGeschätzte KI-Sprache
25.000 Credits$4.99keines~60 Min.
65.000 Credits$9.99durchgestrichen $13, 23 % Rabatt~155 Min.
200.000 Credits$24.99durchgestrichen $40, 38 % Rabatt~476 Min.
500.000 Credits$49.99durchgestrichen $100, 50 % Rabatt~1.190 Min.
2.000.000 Credits$149.99durchgestrichen $400, 63 % Rabatt~4.762 Min.
10.000.000 Credits$599.99durchgestrichen $2000, 70 % Rabatt~23.810 Min.

Die Seite erklärt nicht, wofür die durchgestrichenen Referenzpreise stehen. Die Minutenschätzungen gehen von durchschnittlichem englischem Text mit etwa 140 Wörtern pro Minute aus.

  • Umrechnung: Ein Credit entspricht 2 Zeichen Standard-Sprache, 1 Zeichen Pro oder 0,5 Zeichen HD.
  • Abrechnungseinheit: Abgerechnet wird pro Zeichen, einschließlich Leerzeichen und Satzzeichen.
  • Gültigkeit: Credits gelten ein Jahr ab Kauf; ein neuer Kauf addiert das Restguthaben und startet die Jahresfrist neu.
  • In jedem Paket enthalten: Jedes Paket umfasst eine kommerzielle Lizenz, API-Zugang, alle Stimmen, intelligentes Caching und einen 30-Tage-Verlauf.
  • Ein Guthaben: Dieselben Credits können für Text-to-Speech, Transkription oder beides verwendet werden.
  • Zahlung und Rechnungen: Stripe und PayPal werden akzeptiert, und Rechnungen erlauben einen eigenen Firmennamen, eine Adresse und eine USt-IdNr.

Kostenloses Kontingent

Die Startseite beschreibt eine dreistufige Gratisleiter: 1.000 Zeichen ohne Konto, 2.000 weitere bei kostenloser Registrierung, danach 3.000 Zeichen pro Tag für 7 Tage. Die Datenschutzerklärung beschreibt stattdessen einen Testtarif mit 5 Limits und 1.000 kostenlose Limits nach Registrierung mit einer Adresse von gmail.com, yahoo.com oder hotmail.com. Die Seiten bringen die beiden Versionen nicht in Einklang.

Kosten für Stimmklone

Das Erstellen eines Klons kostet 2.000 Credits, das Speichern 250 Credits pro Tag, und die Synthese wird zum HD-Satz berechnet. Für Stimmklonen gibt es keine Gratisstufe; das Löschen eines Klons beendet seine Speichergebühren.

Alternativen zu Speechgen.io

Speechgen.io stellt seine Pakete Monatstarifen gegenüber, die nach eigener Aussage $22–$99 pro Monat kosten, ob genutzt oder nicht. Zwei Abo-Produkte, die auf einer Plattform zur Produktentdeckung neben ihm gelistet sind, zeigen die andere Seite dieses Zielkonflikts.

  • ElevenLabs: ElevenLabs verkauft Tarife mit monatlicher oder jährlicher Abrechnung und bietet einen Free-Tarif für $0 pro Monat. Sein Starter-Tarif wird als alles aus Free plus kommerzielle Lizenz und sofortiges Stimmklonen gelistet, während Speechgen.io seine kommerzielle Lizenz auch an die kostenlose Nutzung knüpft.
  • Wondercraft: Wondercraft bietet einen KI-Podcast-Generator, der Episoden mit Musik und Kapiteln plant, aufnimmt und automatisch schneidet. Abgerechnet wird monatlich oder jährlich, und es gibt einen Free-Tarif für $0 pro Monat mit 150 Credits.

Speechgen.io eignet sich für unregelmäßige Stapel, bei denen Credits lange reichen müssen; die Abo-Produkte eignen sich für gleichmäßige monatliche Produktion oder Schnitt im Podcast-Stil.

Einschränkungen

Mehrere zentrale Einschränkungen sind Widersprüche zwischen Speechgen.ios eigenen Seiten.

Widersprüchliche Angaben

  • Maximale Textlänge: Die Startseite gibt an, dass sich bis zu 1.000.000 Zeichen einfügen lassen, neben Uploads als DOCX, PDF oder SRT.
  • Eine höhere Grenze an anderer Stelle: Die Schritt-für-Schritt-Anleitung nennt maximal 2.000.000 Zeichen pro Generierung.
  • Anzahl der Stimmen: Ein Textblock auf der Startseite spricht noch von mehreren Dutzend verfügbaren Stimmen und Sprachen, entgegen der anderswo genannten Zahl von 5.000+.

Einschränkungen bei Ein- und Ausgabe

  • Symbole: Die Anleitung warnt, dass Emojis und Emoticons die Audiogenerierung stören können.
  • SSML-Unterstützung: Verschiedene Stimmen unterstützen unterschiedliche Sätze von SSML-Tags.

Erstattungen, Konten und Zuverlässigkeit

  • Erstattungsseite: Laut Seite zur Erstattungsrichtlinie gibt es für nicht verbrauchte Tokens keine Erstattung.
  • Ausnahme in der Datenschutzerklärung: Die Datenschutzerklärung erlaubt jedoch einen Rückgabeantrag innerhalb von 24 Stunden nach dem Kauf, wenn die Nutzung höchstens 3.000 Zeichen beträgt.
  • Ein Konto: Das Anlegen mehrerer Konten ist verboten.
  • Dienstausfall: In Antworten auf einer Bewertungsplattform eines Drittanbieters erklärte das Unternehmen, ein Ausfall im September 2025 habe die Website unerreichbar gemacht, und später, dass innerhalb von 3 Tagen eine Minimalversion lief und innerhalb von 5 Tagen der volle Funktionsumfang.
  • Nutzerbewertungen: Laut Erfassung vom 5. Oktober 2026 zeigte eine Bewertungsplattform eines Drittanbieters einen Durchschnitt von 3,0 aus 21 Bewertungen auf Unternehmensebene, davon 53 % mit fünf Sternen und 14 % mit einem Stern; eine so kleine Stichprobe gibt nur eine Richtung vor.

Lücken in den Rechtstexten

  • Hauptbedingungen nicht gefunden: Die Bedingungen zum Stimmklonen verweisen beim anwendbaren Recht auf „die Hauptnutzungsbedingungen von SpeechGen“. In den hier geprüften Seiten, einschließlich der Sitemap der Website, wurde keine separate Seite mit allgemeinen Bedingungen gefunden, und der Link in den Klonbedingungen führt zurück zu den Klonbedingungen selbst.
  • Eine andere Domain genannt: Die DMCA-Seite bezieht sich auf Material, das auf naturalvoice.io veröffentlicht wurde, nicht auf speechgen.io.
  • Überprüfung: Die Klonbedingungen besagen, dass der Dienst hochgeladenes Audio, die Identität der Nutzer und behauptete Einwilligungen nicht vorab prüft. Die Seite zum Stimmklonen führt Nutzer unter 18 Jahren mit dem Vermerk „Altersverifizierung erforderlich“ unter ihren verbotenen Punkten.

Datenschutz und Rechte

  • Kommerzielle Nutzung: Speechgen.io gibt an, dass zu jedem kostenlosen und kostenpflichtigen Tarif eine kommerzielle Lizenz gehört und dass Nutzer die von ihnen erstellten Audiodateien besitzen.
  • Urheberrecht am Text: Die Datenschutzerklärung schränkt die Nutzung der vertonten Datei nicht ein, auch nicht die kommerzielle, doch das Urheberrecht am Ausgangstext muss weiterhin beachtet werden.
  • Politische Stimmen: Der Dienst darf nicht genutzt werden, um Stimme oder Bild von Politikern oder Regierungsbeamten zu simulieren, selbst mit deren Einwilligung.
  • Weitere verbotene Nutzungen: Die Regeln untersagen, sich ohne ausdrückliche Erlaubnis als eine andere Person auszugeben, sowie die Nutzung in sexuell expliziten Anwendungen.
  • Erhobene Daten: Die Datenschutzerklärung nennt die E-Mail-Adresse als personenbezogenes Datum und gibt an, dass anonymisierte Besucherdaten über Statistikdienste wie Google Analytics erhoben werden. In den hier geprüften Seiten sagt sie nicht, ob eingereichter Text zum Training von Modellen verwendet wird.
  • Aufbewahrung von Dateien: Dateien registrierter Nutzer werden 30 Tage, Dateien nicht registrierter Nutzer 24 Stunden aufbewahrt, danach wird der Verlauf unwiederbringlich gelöscht.
  • Favoriten: Die Anleitung nennt einen 7-tägigen Satz-Cache, einen 30-tägigen Projektverlauf und dauerhafte Speicherung von Favoritendateien, was die 30-Tage-Löschregel der Datenschutzerklärung nicht erwähnt.

Regeln zum Stimmklonen

  • Einwilligung: Das Klonen einer anderen Person erfordert eine ausdrückliche, informierte, dokumentierte schriftliche Einwilligung, die während der gesamten Lebensdauer des Klons und mindestens zwei Jahre nach dessen Löschung aufzubewahren ist.
  • Nachweis auf Anfrage: Speechgen.io kann einen Nachweis der Einwilligung verlangen und löscht den Klon, wenn nicht innerhalb von 7 Tagen gültige Unterlagen vorgelegt werden.
  • Gesperrte Stimmen: Amtierende Staatsoberhäupter, hochrangige Amtsträger, Richter, Wahlkandidaten, Verstorbene ohne Genehmigung des Nachlasses sowie Personen des öffentlichen Lebens, bei denen ein Klon als Billigung, Identitätsanmaßung oder Verleumdung verstanden werden könnte, dürfen nicht geklont werden.
  • Eigentum: Nutzer bleiben Eigentümer ihrer hochgeladenen Proben und des mit ihrem Stimmmodell synthetisierten Audios.
  • Lizenzumfang: Nutzer räumen Speechgen.io eine Lizenz an Proben und Modellen ausschließlich dafür ein, den Dienst für sie zu betreiben, einschließlich der Verbesserung ihres eigenen Stimmmodells.
  • Trainingsverbot: Die Klonbedingungen verbieten, generiertes Audio zum Training oder zur Verbesserung von Stimmmodellen Dritter oder von Konkurrenzprodukten zu verwenden.
  • Verarbeitungsort: Stimmproben und -modelle können auf Servern in jeder von Speechgen.io gewählten Rechtsordnung verarbeitet werden.
  • Zeitpunkt der Löschung: Nach den Klonbedingungen wird ein gelöschtes Modell innerhalb von 30 Tagen aus den aktiven Systemen entfernt, Backups werden im Standardturnus bereinigt. Die Seite zum Stimmklonen sagt dagegen, die Löschung erfolge sofort und entferne das Modell dauerhaft.

FAQ

Q1. Darf ich Audio von Speechgen.io kommerziell nutzen?

Ja, laut Website: Eine kommerzielle Lizenz ist bei kostenloser und kostenpflichtiger Nutzung enthalten, und die Datenschutzerklärung ergänzt, dass das Urheberrecht am Ausgangstext weiterhin zu beachten ist.

Q2. Verfallen Credits bei Speechgen.io?

Ja. Credits gelten ein Jahr ab Kauf, und der Kauf eines weiteren Pakets überträgt das Restguthaben und startet die Frist neu.

Q3. Darf ich die Stimme einer anderen Person klonen?

Nur mit deren dokumentierter schriftlicher Einwilligung und nicht für gesperrte Gruppen wie amtierende Staatsoberhäupter, Richter oder Wahlkandidaten. Nutzer müssen mindestens 18 Jahre alt sein.

Kennen Sie ein ähnliches Tool?
Wenn Sie andere großartige KI-Tools kennen, können Sie sie uns gerne einreichen