Hast du dieses Tool genutzt? Bewerte es
Hast du dieses Tool genutzt? Bewerte es
Luvvoice ist ein Online-Dienst für Sprachsynthese, der geschriebenen Text in herunterladbares Audio verwandelt. Die eigene Beschreibung ist geradeheraus: ein kostenloses Online-Werkzeug für Text-zu-Sprache (TTS), das deinen Text in natürlich klingende Sprache verwandelt — du fügst Text ein oder tippst ihn, wählst eine Stimme und lädst die entstandene MP3 herunter oder hörst sie direkt im Browser. Das auf der Seite herausgestellte Argument ist die Größe: über 200 Stimmen in mehr als 70 Sprachen.
Das Produkt läuft auf luvvoice.com und wird von Soundsynth Tech LLC betrieben — eine Tatsache, die in keinem Marketingtext auftaucht. Sie erscheint in der Freistellungsklausel der Nutzungsbedingungen und wird durch den App-Store-Eintrag unabhängig bestätigt, der Soundsynth Tech LLC als Anbieter nennt. Dass zwei unabhängige Quellen beim Betreiber übereinstimmen, ist bei einem Produkt dieser Größe bemerkenswert, denn viele kleine TTS-Seiten legen überhaupt keine Firmenidentität offen.
Der Seitentitel lautet „Kostenloser Text-zu-Sprache-Konverter Online, Keine Wortgrenze". Dieser Satz ist der Hauptköder des Produkts, und er hält dem Abgleich mit der eigenen Dokumentation der Seite nicht stand.
Jede Stufe hat eine harte Zeichenobergrenze. Die Preisseite gibt für den Gratistarif 10.000 Zeichen pro Monat an. Die FAQ auf der Startseite derselben Website nennt für den Gratistarif 20.000 Zeichen pro Monat. Diese beiden Zahlen widersprechen einander, und beide widersprechen „keine Wortgrenze".
Es gibt eine zweite, engere Grenze, die im Alltag stärker wiegt: Zeichen pro Umwandlung. Im Gratistarif sind das 3.000 Zeichen — der Editor auf der Startseite zählt sichtbar bis 0 / 3000, noch bevor man sich anmeldet. Bezahlte Stufen heben das auf 20.000 pro Umwandlung. Zur Einordnung: 3.000 Zeichen entsprechen etwa einem Drei-Minuten-Skript. Alles darüber muss aufgeteilt werden.
Nichts davon macht Luvvoice zu einem schlechten Werkzeug. Es macht die Marketingaussage unzutreffend, und es bedeutet, dass man mit echten Zahlen statt mit der Schlagzeile planen sollte. Diese Seite verwendet durchgehend die dokumentierten Werte.
Das ist die andere Sache, die das Marketing nicht sagt, und sie steht klar in den Nutzungsbedingungen: Luvvoice erbringt die Sprachgenerierung derzeit über Microsoft Azure AI Speech, einschließlich Azures neuronaler Text-zu-Sprache-Technologie, über Google Cloud Text-to-Speech sowie über eigene Luvvoice-Sprachmodelle. Welches Modell oder welcher Anbieter zum Einsatz kommt, hängt von gewählter Stimme, Sprache, Funktion und Verfügbarkeit ab.
Anders gesagt: Ein großer Teil der Stimmbibliothek besteht aus Azure- und Google-Cloud-TTS, ausgeliefert über eine freundlichere Oberfläche, ergänzt um einige hauseigene Modelle. Das erklärt, wie ein kleiner Anbieter über 200 Stimmen in mehr als 70 Sprachen bereitstellen kann — diese Kataloge gehören Microsoft und Google.
Daraus folgen zwei praktische Konsequenzen. Erstens dürfte die Stimmqualität für gängige Sprachen weitgehend dem entsprechen, was man direkt bei Azure oder Google bekäme, denn vielfach ist es dieselbe Engine. Zweitens liegt der eigentliche Mehrwert von Luvvoice in der Verpackung: eine Browseroberfläche ohne Cloud-Konto und ohne API-Schlüssel, mit Dokument-Upload, Pausensteuerung, einer Stimmbibliothek zum Vorhören und MP3-Download. Für viele Nutzende ist diese Verpackung das Geld wert. Für Entwickelnde mit vorhandenem Azure-Konto womöglich nicht.
Dies in den Bedingungen offen zu benennen, spricht für das Unternehmen. Etliche TTS-Wiederverkäufer tun das nicht.
Der Kernablauf von Text zu Sprache ist einfach: Text einfügen, Stimme und Sprache wählen, generieren, MP3 herunterladen. Über die Grundumwandlung hinaus sind zwei Steuerungen wichtig für alles, was veröffentlicht werden soll.
Sprechtempo und Tonhöhe lassen sich über eine Einstellungsschaltfläche anpassen, sodass Lehrinhalte langsamer und Kurzvideos schneller laufen können.
Pausen stehen angemeldeten Nutzenden über eine Pauses-Schaltfläche in der Werkzeugleiste zur Verfügung und fügen Lücken von 0,5 bis 5 Sekunden ein. Das Unternehmen empfiehlt höchstens 20 Pausen pro Umwandlung. Pausensteuerung ist genau das, was brauchbare Erzählstimme von einer Wand ununterbrochener Sprache trennt — allein dafür lohnt sich ein Konto. Beachte den Vorbehalt unter Einschränkungen: Mindestens ein zahlender Nutzer berichtet, dass Pausen bei geklonten benutzerdefinierten Stimmen nicht verfügbar sind.
Statt Text einzufügen kannst du Dokumente hochladen. Unterstützt werden gängige Formate einschließlich PDF und TXT, und das Unternehmen gibt an, dass Dokumente mit Hunderttausenden Zeichen hochgeladen und in KI-Sprache umgewandelt werden können.
Liest man das gegen die Obergrenzen pro Umwandlung, klärt sich das Bild: Der Uploader akzeptiert große Dokumente, doch die Umwandlung wird weiterhin gegen dein monatliches Zeichenkontingent verrechnet. Ein Buch mit 200.000 Zeichen verbraucht von einem Lite-Kontingent über 700.000 Zeichen in einem Zug fast ein Drittel.
Das Unternehmen ist bei einem Fehlerfall ehrlich: PDFs, die nur Bilder enthalten oder durch Scannen entstanden sind, können bei der Textextraktion scheitern. Ist die Vorlage ein eingescanntes Buch, braucht es zuerst OCR, bevor Luvvoice damit etwas anfangen kann.
Klonen ist eine vollwertige Funktion mit eigener Seite, eigenem Guthabentopf und eigenen Vertragsklauseln. Der Ablauf hat drei Schritte:
Die Sprachabdeckung des Klonens ist enger als auf der TTS-Seite: Das Unternehmen nennt Englisch, Japanisch, Koreanisch, Chinesisch, Französisch, Deutsch, Arabisch und Spanisch als unterstützte Hauptsprachen. Brauchst du eine geklonte Stimme in einer Sprache außerhalb dieser Gruppe, prüfe das vor dem Kauf.
Geklonte Stimmen verbrauchen einen eigenen Topf an Custom Credits statt deines Standard-Zeichenkontingents. Der Gratistarif erlaubt genau eine benutzerdefinierte Stimme und 500 Custom Credits — genug, um die Funktion einmal auszuprobieren, nicht genug, um sie zu nutzen. Bezahlte Stufen erlauben unbegrenzt viele benutzerdefinierte Stimmen mit monatlich 10.000 bis 200.000 Custom Credits.
Die Seite veröffentlicht außerdem vorgestellte öffentliche benutzerdefinierte Stimmen — sofort einsetzbare Stimmen wie Wesley Ford, Clara Vale und Asher Lane, die jeder nutzen kann und die denselben Custom-Credit-Topf beanspruchen.
Eine neuere Fähigkeit wandelt E-Books in hörbuchartige Kapitel um, und sie ist in allen vier Stufen einschließlich der kostenlosen enthalten. Angesichts der monatlichen Grenze von 10.000 Zeichen im Gratistarif kommt „enthalten" hier einer Demonstration näher als einem Arbeitsablauf — ein typischer Roman umfasst mehrere Hunderttausend Zeichen. Ab Lite wird das wirklich nutzbar.
Für ein Endkundenwerkzeug dieser Größe ist die Entwicklerfläche ungewöhnlich breit. Es existieren drei getrennte Integrationswege: eine dokumentierte REST-API, ein MCP-Server zum Andocken an KI-Clients, die das Model Context Protocol sprechen, und ein AI Skill. Der API-Zugang ist auf die Stufen Plus und Enterprise beschränkt; Free und Lite enthalten ihn nicht.
Audio wird als MP3 heruntergeladen, bewusst gewählt, weil die meisten Geräte es ohne Umwandlung abspielen. Erzeugtes Audio wird 72 Stunden auf dem Dienst vorgehalten. Dieses Aufbewahrungsfenster ist kurz — behandle Luvvoice als Generator, nicht als Speicher, und lade Dateien laufend herunter.
Das Unternehmen nennt YouTube, TikTok, Podcasts, Bildung und Fernsehen als Zielkanäle. Kurzvideo passt am besten: Ein 60-Sekunden-Skript liegt selbst innerhalb der 3.000 Zeichen pro Umwandlung des Gratistarifs, die Pausensteuerung erlaubt, Takte auf Schnitte zu legen, und die MP3 landet direkt in jedem Schnittprogramm.
Für Podcastende sind Intros, Outros, Werbelesungen und Entwurfssprecher zum Prüfen des Tempos vor der Aufnahme die praktischen Anwendungen. Die Grenze von 20.000 Zeichen pro Umwandlung in bezahlten Stufen deckt in einem Durchgang etwa ein 20-minütiges Segment ab.
Für Studierende und alle mit großem Lesepensum ist der PDF- und TXT-Upload der Hauptreiz — Vorlesungsnotizen oder Aufsätze in Audio umwandeln und unterwegs hören. Zwei Randbedingungen prägen das: Gescannte PDFs funktionieren ohne OCR nicht, und dein monatliches Zeichenkontingent ist das eigentliche Budget.
Kurserstellende erhalten durchgängige Vertonung über Module hinweg, ohne bei jeder Skriptänderung erneut eine Sprecherin zu buchen. Die mehrsprachige Abdeckung macht lokalisierte Fassungen desselben Kurses praktikabel, und die Temposteuerung zählt hier mehr als in den meisten Zusammenhängen: Lehr-Audio profitiert davon, langsamer zu sein als Gesprächs-Audio.
Geschriebene Inhalte als Audio verfügbar zu machen, dient sehbehinderten Nutzenden und allen, die Informationen besser über das Ohr aufnehmen. Die auf der Seite gezeigten Nutzerstimmen führen genau diesen Zweck an.
Korrekte Aussprache in mehr als 70 Sprachen zu hören, ist ein echter Nutzen einer breiten Stimmbibliothek, und das einstellbare Sprechtempo erlaubt Lernenden, ungewohnte Sprache auf ein folgbares Maß zu verlangsamen.
Für Kreative, die ihre eigene Stimme über Inhalte legen wollen, für deren Aufnahme die Zeit fehlte, ist Klonen die entscheidende Funktion — mit dem wichtigen rechtlichen Vorbehalt, dass du jede geklonte Stimme besitzen oder vollständig berechtigt sein musst. Siehe Einschränkungen.
Der Editor auf der Startseite funktioniert ohne Anmeldung, begrenzt auf 3.000 Zeichen pro Umwandlung. Nutze das, um Stimmen in deiner Zielsprache vorzuhören und zu beurteilen, ob die Qualität deinem Anspruch genügt, bevor du weiter investierst.
Pausen liegen hinter der Anmeldung, und Pausensteuerung ist der größte Qualitätshebel bei Sprechertexten. Die Anmeldung hebt zudem deine Obergrenze pro Umwandlung, sofern du abonnierst.
Die Bibliothek umfasst über 70 Sprachen, doch die Qualität ist nicht einheitlich. Gängige Sprachen stützen sich auf ausgereifte neuronale Stimmen von Azure und Google; kleinere Sprachen bieten womöglich weniger Optionen. Höre mehrere Stimmen in deiner konkreten Sprache an, statt nach Namen zu wählen.
Da Pausen manuell eingefügt und nicht aus Satzzeichen abgeleitet werden, schreibe kürzere Sätze und setze Pausen bewusst an natürliche Atempunkte. Halte dich an das empfohlene Maximum von 20 Pausen pro Umwandlung.
Hier geht Sprachsynthese am häufigsten schief, und für genau diesen Dienst gibt es einen dokumentierten Fall: Ein Nutzer berichtete, die Engine lese den URL-Teil /pay als /privacy. Höre die Ausgabe stets vollständig ab, bevor du veröffentlichst, mit besonderem Blick auf Abkürzungen, URLs, Währungen und Daten. Wird ein Begriff falsch gelesen, schreibe ihn im Ausgangstext lautschriftlich.
Mit 3.000 Zeichen pro Umwandlung kostenlos und 20.000 bezahlt bedeutet Langform Aufteilung. Trenne an Kapitel- oder Abschnittsgrenzen statt an willkürlichen Zeichenzahlen, damit jedes Segment sauber beginnt und endet.
Dateien werden 72 Stunden vorgehalten. Baue das Herunterladen in deinen Ablauf ein, statt den Dienst als Bibliothek zu behandeln.
Die Erstattungsregelung ist ungewöhnlich präzise und lohnt bewusste Nutzung: Hast du keine Zeichen verbraucht, kannst du innerhalb von 30 Tagen eine Erstattung verlangen; hast du weniger als 1.000 Zeichen verbraucht, innerhalb von 7 Tagen. Über 1.000 Zeichen hinaus gibt es keine Erstattung. Wenn du also abonnierst, um bezahlte Stimmqualität zu prüfen, führe die Prüfung innerhalb dieses 1.000-Zeichen-Fensters durch.
Als KI-Stimmengenerator für den Alltag passen Kreative, die Kurzvideos produzieren, am klarsten. Skripte bleiben innerhalb der Obergrenzen pro Umwandlung, die Qualität gängiger Azure- und Google-Stimmen genügt sozialen Inhalten mehr als, und der Einstiegspreis ist null.
Studierende und Selbstlernende erhalten den Dokument-Upload, jene Funktion, die die meisten Werkzeuge teurer verkaufen. Lesestoff in Audio zu verwandeln, ist echte Zeitrückgewinnung, begrenzt durch das monatliche Zeichenbudget.
Lehrende und Kursbauende profitieren von durchgängiger Vertonung und mehrsprachiger Lokalisierung ohne Neuaufnahme. Die Temposteuerung zählt hier.
Podcastende finden es eher für begleitendes Audio nützlich — Intros, Werbelesungen, Tempoentwürfe — als für die Vertonung ganzer Folgen.
Entwicklerteams, die einfache Sprachsynthese in einer App wollen, werden ab Plus über API und MCP-Server bedient, allerdings ohne veröffentlichte Ratenbegrenzungen oder SLA und im Bewusstsein, womöglich eine Marge auf Azure oder Google darunter zu zahlen.
Weniger passend: professionelle Hörbuch- und Werbesprecher-Produktion. Das 72-Stunden-Fenster, die Obergrenzen pro Umwandlung, die Berichte zur Klonqualität und das Fehlen unabhängiger Prüfung machen dies zu einem Werkzeug für praktisches Alltagsaudio statt für hochwertige Veröffentlichungen. Wer erstklassige ausdrucksstarke Synthese braucht, schaut zu spezialisierten Anbietern.
Ebenfalls schlecht passend: wer eine bestimmte seltene Sprache zum Klonen benötigt. Die Liste klonbarer Sprachen ist weitaus kürzer als die TTS-Liste.
Web ist die primäre Plattform, unter luvvoice.com, in einem gewöhnlichen Browser ohne Installation. Generator, Stimmbibliothek, Verlauf und Preise liegen dort.
iOS verfügt über eine native App, LuvVoice: AI Text to Speech, veröffentlicht von Soundsynth Tech LLC. Der Download ist kostenlos mit In-App-Käufen. Die Version zum Redaktionszeitpunkt ist 1.3, veröffentlicht am 7. Juli 2026, vorausgesetzt wird iOS 17.0 oder neuer. Apple führt sie unter Foto und Video mit Produktivität als Zweitkategorie, Altersfreigabe 4+.
Android hat eine App bei Google Play als Luvvoice AI Voice, mit In-App-Käufen, Inhalt eingestuft als Everyone. Google Play zeigt eine Download-Spanne von 1.000+. Die Android-Beschreibung fasst das Produkt als KI-Sprachsynthese, Stimmklonung und Hörbücher in einer App zusammen.
API und MCP bieten programmatischen Zugang auf den Stufen Plus und Enterprise. Der MCP-Server ist bemerkenswert — er lässt KI-Assistenten, die das Model Context Protocol sprechen, die Sprachgenerierung direkt aufrufen.
Beachte die Lücke zwischen der Android-Download-Spanne von 1.000+ und der Behauptung der Seite, „Trusted by 100,000+ users". Träfen beide zu, fände die weit überwiegende Nutzung im Web statt und nicht mobil. Die Nutzerzahl ist herstellerseitig angegeben und nicht unabhängig geprüft.
| Tarif | Monatlich | Jährlich (pro Monat) | Standardzeichen/Monat | Custom Credits/Monat |
|---|---|---|---|---|
| Free | 0 $ | — | 10.000 | 500 |
| Lite | 8 $ | 4,75 $ (57 $/Jahr) | 700.000 | 10.000 |
| Plus | 13 $ | 7,75 $ (93 $/Jahr) | 1.500.000 | 30.000 |
| Enterprise | 45 $ | 27 $ (324 $/Jahr) | 6.000.000 | 200.000 |
Für die jährliche Abrechnung werden 40 Prozent Ersparnis beworben. Es gibt zudem eine Einmalkauf-Option, um Guthaben ohne Abonnement zu erwerben. Die Zahlung läuft über Stripe.
| Funktion | Free | Lite | Plus | Enterprise |
|---|---|---|---|---|
| Zeichen pro Umwandlung | 3.000 | 20.000 | 20.000 | 20.000 |
| Anzahl benutzerdefinierter Stimmen | 1 | Unbegrenzt | Unbegrenzt | Unbegrenzt |
| Verfügbare Stimmen | 200+ | 300+ | 300+ | 300+ |
| Sprachen | 70+ | 70+ | 70+ | 70+ |
| Ohne Werbung / ohne Captcha | — | Ja | Ja | Ja |
| Unbegrenzte kommerzielle Nutzung | — | — | Ja | Ja |
| API-Zugang | — | — | Ja | Ja |
| Dateitranskription | — | — | — | Ja |
| Dateispeicherung | — | 72 Stunden | 72 Stunden | 72 Stunden |
Drei Zeilen dieser Tabelle verdienen Aufmerksamkeit.
Zeichen pro Umwandlung ist die Grenze, die du täglich spürst. Der Wechsel vom Gratistarif in irgendeine bezahlte Stufe erhöht sie um fast das Siebenfache.
Werbung und Captchas sind im Gratistarif vorhanden. Für einen kostenlosen Dienst ist das üblich, wirkt sich aber auf den Durchsatz aus, wenn du häufig generierst.
Unbegrenzte kommerzielle Nutzung erscheint nur bei Plus und Enterprise. Lite ist trotz Bezahlung nicht markiert. Das passt schlecht zum uneingeschränkten Ja der Startseiten-FAQ zur kommerziellen Nutzung und wird unter Einschränkungen behandelt.
Klar benannt:
Dies ist eine der genauer formulierten Erstattungsregelungen dieser Kategorie, in Kraft seit dem 6. Juni 2026:
Die praktische Folgerung: Dein Prüffenster sind die ersten 1.000 Zeichen. Nutze es bewusst.
ElevenLabs ist der Bezugspunkt für ausdrucksstarke Qualität und die leistungsfähigere Option für Klonen und emotionale Bandbreite, zu höheren Kosten. Auf Trustpilot hält es 3,1 bei rund tausend Bewertungen — eine weit größere Stichprobe als alles, was zu Luvvoice verfügbar ist.
Microsoft Azure AI Speech und Google Cloud Text-to-Speech verdienen ausdrückliche Erwähnung, weil Luvvoice darauf läuft. Wer Cloud-Konten hat und mit API-Schlüsseln umgehen kann, entfernt durch den Direktweg den Zwischenhändler. Aufgegeben werden Oberfläche, Dokument-Upload, Stimmen-Vorhören und Pausenwerkzeuge — genau das, wofür Luvvoice Geld nimmt.
NaturalReader zielt auf dieselben Vorlese- und Barrierefreiheitsfälle, mit längerer Geschichte im Vorlesen von Dokumenten.
Fish Audio ist ein weiterer kleinerer Anbieter im selben Marktsegment.
Wo Luvvoice als kostenloses TTS mithält: sprachliche Breite zu niedrigem Preis, ein wirklich nutzbarer Gratistarif, Dokument-Upload ohne Bezahlschranke und eine ungewöhnlich klare Erstattungsregelung. Wo nicht: Ausdrucksqualität an der Spitze, Treue geklonter Stimmen laut Nutzerberichten, und jegliche Form unabhängiger Prüfung.
Der Seitentitel verspricht keine Wortgrenze, während Preistabelle und FAQ beide harte Obergrenzen nennen. Der Gratistarif liegt auf der Preisseite bei 10.000 Zeichen monatlich und in der FAQ bei 20.000 — intern widersprüchlich — mit in beiden Fällen 3.000 pro Umwandlung. Plane nach der Preistabelle und bestätige dein tatsächliches Kontingent im Konto.
Die FAQ sagt: Du hast das volle Eigentum an den erzeugten Audiodateien und kannst sie frei in YouTube-Videos, Podcasts, Social-Media-Inhalten oder jedem anderen kommerziellen Projekt nutzen, im Rahmen des Rechts. Die Vergleichstabelle markiert jedoch „unbegrenzte kommerzielle Nutzung" nur bei Plus und Enterprise.
Die stimmigste Lesart ist, dass das Eigentum an der Ausgabe allgemein gilt, während unbegrenzte kommerzielle Nutzung eine bezahlte Berechtigung darstellt — doch die Seite bringt beide Aussagen nicht zusammen, und das Wort „unbegrenzt" leistet dort unerklärte Arbeit. Wer monetarisierte Inhalte veröffentlicht, fährt mit einem Plus-Tarif oder einer schriftlichen Bestätigung des Supports für den eigenen Fall sicherer.
Die Sprachgenerierung läuft über Azure AI Speech, Google Cloud Text-to-Speech und eigene Modelle, je nach Stimme und Sprache. Zwei Folgerungen: Die Stimmqualität großer Sprachen dürfte diesen Plattformen folgen, und die Roadmap von Luvvoice hängt teils von Zulieferern ab, die es nicht kontrolliert. Ändert ein Anbieter Bedingungen oder Preise, sind Auswirkungen stromabwärts plausibel. Dies in den Bedingungen offenzulegen, ist mehr Transparenz, als die meisten Wiederverkäufer bieten.
Nirgends gibt es eine große oder belastbare Stichprobe:
Eine glatte 5,0 bei Google Play neben 2,2 auf Trustpilot ist eine große Spreizung. Keine der Stichproben trägt ein sicheres Urteil, und beide werden hier berichtet, damit du sie selbst abwägen kannst, statt einer einzelnen Zahl zu vertrauen.
Die konkreten, überprüfbaren Beschwerden sind nützlicher als die Noten. Ein Nutzer, der Custom Credits für geschäftliche Zwecke gekauft hatte, berichtete:
/pay als /privacy wieder — sie las etwas, das im Skript nicht standEin weiterer Rezensent berichtete, PayPal sei beworben, an der Kasse jedoch nur Kreditkarte akzeptiert worden.
Das sind funktionale Befunde statt bloßem Unmut, was ihnen trotz kleiner Stichprobe Gewicht gibt. Das Muster, das sich abzeichnet: Standardstimmen sind die Stärke des Produkts; bei geklonten Stimmen sollten die Erwartungen am niedrigsten liegen.
Weder Berichterstattung noch praktische Bewertung durch eine etablierte Technologiepublikation ließ sich auffinden. Die Suchergebnisse bestehen aus SEO-Content-Seiten, Werkzeug-Empfehlungsblogs und von Wettbewerbern verfassten Vergleichen, von denen keines eine unabhängige Prüfung darstellt. Folglich ruhen Aussagen wie „200+ Stimmen" oder „100.000+ Nutzer" allein auf dem Wort des Anbieters. Das macht sie nicht falsch; es heißt, dass niemand nachgeprüft hat.
Die Bedingungen sind eindeutig. Du darfst nur Stimmen klonen, die du besitzt oder für die du sämtliche Rechte, Lizenzen, Erlaubnisse und Einwilligungen hältst. Du darfst synthetisches Audio nicht als authentische Aufnahme einer realen Person ausgeben, es sei denn, du bist rechtlich befugt und der Kontext ist nicht irreführend, und du musst offenlegen, wo Gesetz, Plattformrichtlinie oder berechtigte Publikumserwartung es verlangen.
Entscheidend: Luvvoice überprüft nicht, ob du die notwendigen Rechte oder Einwilligungen für die Stimmklonung erlangt hast, sofern nicht ausdrücklich schriftlich anders erklärt. Es gibt keine Einwilligungsprüfung. Du bist allein verantwortlich für alle Sprachproben, Texte, erzeugten Audios, geklonten Stimmmodelle und deren Weiterverbreitung und stellst Luvvoice sowie Soundsynth Tech LLC von daraus entstehenden Ansprüchen frei.
Die Bedingungen untersagen Betrug, Phishing, Identitätsdiebstahl, Social Engineering, falsche Empfehlungen und irreführende Werbung; Belästigung, Drohungen, Erpressung und Verleumdung; sowie politische Manipulation, Wählerunterdrückung, täuschende Roboteranrufe und Störung von Notdiensten. Durchsetzungsmaßnahmen reichen von Inhaltsentfernung über Kontobeschränkung oder -kündigung bis zum Entzug des Zugriffs auf geklonte Stimmen und erzeugtes Audio, mit dauerhafter Kündigung ohne Vorwarnung bei schweren oder wiederholten Verstößen.
Deine Texte und Audios gehören dir, doch du erteilst Luvvoice eine begrenzte, weltweite, nicht ausschließliche Lizenz zum Hosten, Speichern, Übertragen, Verarbeiten, Vervielfältigen und Analysieren deiner Texte, Audios, Sprachproben, geklonten Stimmmodelle, erzeugten Audios, Prompts und Metadaten sowie zur Erstellung technischer Ableitungen — beschränkt auf das, was zur Bereitstellung, Wartung, Absicherung, Fehlerbehebung, Verbesserung, Abrechnung und Durchsetzung der Dienste vernünftigerweise erforderlich ist. „Verbesserung" ist das Wort, das auffällt. Die Datenschutzerklärung trifft keine gesonderte ausdrückliche Aussage dazu, ob Eingaben allgemeine Modelle trainieren, weshalb auch diese Seite in keine Richtung behauptet.
Erzeugtes Audio bleibt 72 Stunden bestehen. Zügig herunterladen.
Das Unternehmen dokumentiert zwei: Gescannte oder reine Bild-PDFs können bei der Textextraktion scheitern, und Browser-Erweiterungen — insbesondere Übersetzungs-Plugins — können Generierungsfehler verursachen.
Beide Seiten können die Vereinbarung jederzeit mit Mitteilung beenden, woraufhin der Zugang endet. Dienste und erzeugtes Audio werden im Ist-Zustand bereitgestellt, Gewährleistungen sind im gesetzlich zulässigen Rahmen ausgeschlossen.
Es ist tatsächlich kostenlos nutzbar, aber „keine Wortgrenze" trifft nicht zu. Die Preisseite nennt 10.000 Zeichen pro Monat im Gratistarif, die Startseiten-FAQ nennt 20.000 — die Seite widerspricht sich selbst. In beiden Fällen gibt es eine separate, engere Grenze von 3.000 Zeichen pro Umwandlung im Gratistarif, im Editor als Zähler 0 / 3000 sichtbar. Bezahlte Stufen heben die Umwandlung auf 20.000 und die Monatskontingente auf 700.000 bis 6.000.000 Zeichen.
Die FAQ sagt uneingeschränkt Ja: Du besitzt die erzeugten Dateien und darfst sie in YouTube-Videos, Podcasts, sozialen Medien oder jedem kommerziellen Projekt verwenden, im Rahmen des Rechts. Die Vergleichstabelle markiert „unbegrenzte kommerzielle Nutzung" jedoch nur bei Plus und Enterprise. Das Eigentum an der Ausgabe wirkt allgemein, unbegrenzte kommerzielle Nutzung wie eine bezahlte Berechtigung, ohne dass die Seite beides zusammenführt. Für monetarisierte Arbeit sind Plus oder eine schriftliche Bestätigung des Supports der sichere Weg.
Mehr als 70 Sprachen, mit 200+ Stimmen im Gratistarif und 300+ in bezahlten. Der Qualitätskontext zählt: Die Bedingungen legen offen, dass Sprache über Microsoft Azure AI Speech, Google Cloud Text-to-Speech und eigene Luvvoice-Modelle erzeugt wird, je nach Stimme und Sprache. Bei großen Sprachen hörst du also weitgehend neuronale Stimmen von Azure und Google, die stark sind. Höre vor der Festlegung in deiner konkreten Zielsprache vor.
Klonen nutzt einen eigenen Topf an Custom Credits: 500 Credits und eine benutzerdefinierte Stimme im Gratistarif, dann 10.000, 30.000 und 200.000 Credits mit unbegrenzten Stimmen bei Lite, Plus und Enterprise. Der Vorgang benötigt eine Sprachprobe von idealerweise über 10 Sekunden. Zur Qualität sollte man die Erwartungen dämpfen: Ein zahlender Nutzer berichtete von geklonten Stimmen, die selbst bei hochwertiger Aufnahme deutlich hinter den Standardstimmen zurückblieben, und davon, dass Pausen bei benutzerdefinierten Stimmen nicht verfügbar waren. Auch die Sprachunterstützung beim Klonen ist enger als bei TTS: Englisch, Japanisch, Koreanisch, Chinesisch, Französisch, Deutsch, Arabisch und Spanisch sind die genannten großen Sprachen.
Ja. Gängige Formate einschließlich PDF und TXT werden unterstützt, und das Unternehmen gibt an, Dokumente mit Hunderttausenden Zeichen entgegenzunehmen. Zwei Einschränkungen: Die Umwandlung zieht weiterhin von deinem monatlichen Zeichenkontingent ab, und gescannte oder reine Bild-PDFs können bei der Textextraktion scheitern — die brauchen zuerst OCR.
Erzeugtes Audio wird 72 Stunden gespeichert. Lade Dateien laufend herunter, statt dich auf den Dienst als Bibliothek zu verlassen.
Ja, in eng gefassten Grenzen. Keine Zeichen verbraucht: Erstattung innerhalb von 30 Tagen. Weniger als 1.000 Zeichen: innerhalb von 7 Tagen. Über 1.000 Zeichen keine Erstattung und keine Teilerstattungen. Nach 30 Tagen nichts. Eine Erstattung pro Konto, mit möglicher Sperre künftiger Käufe bei zweien. iOS-Käufe erstattet Apple, und Kündigung oder Kontolöschung erzeugen für sich genommen keine Erstattung. Führe deine Prüfung in den ersten 1.000 Zeichen durch.
Ja, nur bei Plus und Enterprise. Es gibt zudem einen MCP-Server für KI-Clients, die das Model Context Protocol unterstützen, sowie einen AI Skill. Veröffentlichte Ratenbegrenzungen und Service-Level-Zusagen waren zum Redaktionszeitpunkt nicht verfügbar; kläre Anforderungen daher mit dem Support, bevor du etwas darauf aufbaust.
Ja, auf beiden Plattformen. iOS erscheint als LuvVoice: AI Text to Speech von Soundsynth Tech LLC, kostenlos mit In-App-Käufen, erfordert iOS 17.0 oder neuer, freigegeben ab 4+. Android erscheint als Luvvoice AI Voice bei Google Play mit In-App-Käufen, eingestuft als Everyone, mit über 1.000 Downloads.
Nur mit deren Erlaubnis und dem rechtlichen Anspruch dazu. Die Bedingungen verlangen, dass du für jede geklonte Stimme alle notwendigen Rechte und Einwilligungen hältst, synthetisches Audio nicht als authentische Aufnahme einer realen Person ausgibst und die KI-Erzeugung offenlegst, wo Gesetz oder Plattformrichtlinie es verlangen. Entscheidend ist, dass Luvvoice nicht überprüft, ob du diese Einwilligungen erhalten hast — es gibt keine Schranke gegen Missbrauch, was bedeutet, dass die volle rechtliche Verantwortung einschließlich der Freistellung des Unternehmens bei dir liegt.