Toolso.AI
Toolso.AI
Alle ToolsKategorienIm TrendNeueste ToolsPreiseBlog
Toolso.AI
Toolso.AI

💌Abonnieren Sie AI Tools Weekly

Wöchentlich kuratierte Auswahl der neuesten und angesagtesten KI-Tools und Trends, direkt in Ihrem Posteingang Abonnieren

Toolso.AI
Toolso.AI

Entdecken Sie die besten KI-Tools, um Ihre Produktivität zu steigern

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Beliebte Kategorien

  • KI-Schreiben
  • KI-Bild
  • KI-Video
  • KI-Programmierung
  • Weitere Kategorien

Entdecken

  • Neueste Tools
  • Beliebte Tools
  • Mehr Tools
  • Tool einreichen
  • Preise

Über

  • Über uns
  • Kontakt
  • Blog
  • Änderungsprotokoll

Rechtliches

  • Cookie-Richtlinie
  • Datenschutzrichtlinie
  • Nutzungsbedingungen
  • Rückerstattungsrichtlinie
© 2026 Toolso.AI Alle Rechte vorbehalten
BefristetZeitlich begrenztHervorgehobener EintragPrüfung in 24 Std. · Kein Backlink · 30 Tage hervorgehoben$29.90danach $59.90Nach dem 31. Okt. steigt der Preis auf $59.90Endet in--:--:--Jetzt einreichen
  1. Startseite
  2. Alle Tools
  3. KI-Tools
  4. Fish Audio
Oberflächenvorschau von Fish AudioWebsite besuchen
Logo von Fish Audio

Fish Audio

Fish Audio ist eine Plattform für Sprachsynthese und Stimmklonen, die auf Emotionssteuerung bis auf Wortebene aufbaut. Sie klont eine Stimme aus einer zehnsekündigen Probe, streamt unter 300 Millisekunden und veröffentlicht die Gewichte des S2-Modells — allerdings unter einer Lizenz, die auf Forschung und nichtkommerzielle Zwecke beschränkt ist. Betreiber ist Hanabi AI Inc.

KI-ToolsAudio-GenerierungAudio-Tool#Text-zu-Sprache#Open Source#Mehrsprachig
Kostenlos testen
Gespeichert
Besuche
Aufrufe
Preis
Kostenlos
Veröffentlicht
25. Aug. 2026
Domain
fish.audio
Nutzerbewertung

Hast du dieses Tool genutzt? Bewerte es

Dieses Tool bewerten

Fish Audio Produktinformationen

Kostenlos testen
Tool-Informationen
Gespeichert
Besuche
Aufrufe
Preis
Kostenlos
Veröffentlicht
25. Aug. 2026
Domain
fish.audio
Nutzerbewertung

Hast du dieses Tool genutzt? Bewerte es

Dieses Tool bewerten

Empfohlene Tools

Verwandte Tools

Kostenlos testen

Was ist Fish Audio?

Fish Audio ist eine Sprach-KI-Plattform, die auf einer zentralen Einsicht ruht: Die Wörter richtig auszusprechen und einen Satz richtig vorzutragen sind zwei verschiedene Probleme, und die meisten Sprachsynthesesysteme haben stets nur das erste gelöst. Die Startseite ordnet die Fähigkeiten in drei Stränge — Sprachsynthese, Stimmklonen und Spracherkennung —, die alle auf einer Modellfamilie namens S2 aufsetzen.

Was dieses Produkt tatsächlich auszeichnet, ist die Steuerung des Ausdrucks bis hinunter auf die Wortebene. Das System liest Ihr Skript nicht gleichförmig herunter, sondern nimmt in den Text eingebettete Marken in natürlicher Sprache entgegen, und diese Marken bestimmen, wie eine Stelle gesprochen wird. Der Demobereich auf der Startseite legt den ganzen Satz an Emotionsmarken offen: Zorn und Trauer, Verlegenheit, Betonung, Flüstern, Sanftheit, Hauchigkeit und Aufregung, dazu eine eigene Gruppe besonderer Marken für Lachen, Schmunzeln, Räuspern, Schluchzen, Seufzen, Hecheln sowie kurze und lange Pausen. Die technische Beschreibung im Code-Repository des Projekts ist genauer als der Werbetext: Sie spricht von feingranularer Steuerung von Prosodie und Emotion unterhalb der Wortebene mittels Marken in natürlicher Sprache, bei nativer Unterstützung mehrerer Sprecher und mehrstufiger Dialoge.

Der Betreiber tritt nicht anonym auf, doch die Namensfrage sollte entwirrt werden. In der Fußzeile der Website steht, dass die Rechte bei Hanabi AI Inc. liegen. Die Open-Source-Lizenzdatei wiederum verlangt einen Urhebervermerk, der eine andere Einheit nennt; im Originaltext lautet er 39 AI, INC. Dieser Artikel hält beide Namen fest, ohne sie zusammenzuführen, denn die Website erklärt das Verhältnis zwischen ihnen nicht.

Finanzierung und Größenordnung stammen aus der Ankündigung des Unternehmens selbst. Fish Audio hat zum ersten Jahrestag 52 Millionen Dollar in einer Seed-Runde eingesammelt. Die Runde wurde gemeinsam von zwei Häusern angeführt: Das eine trägt den Namen Coreline Ventures, das andere heißt Capital Today. Zu den weiteren Beteiligten zählen unter anderem 359 Capital und Play Time sowie HF0 und 645 Ventures. Derselbe Beitrag berichtet vom Wachstum des Teams von drei auf zweiundzwanzig Personen, von wiederkehrenden Jahreserlösen, die von null auf 21 Millionen Dollar gestiegen sind, von mehr als 8 Millionen Kreativen und Entwicklern auf der Plattform und von mehr als 2 Millionen Stimmmodellen in der Community-Bibliothek. Diese Geschäftskennzahlen stammen sämtlich vom Anbieter selbst und wurden nicht unabhängig geprüft; sie sind daher als Aussagen des Unternehmens zu lesen und nicht als belegte Größen. Der Beitrag nennt auch die Führung: Geschäftsführerin Rissa Cao, die auf mehrere Jahre Sprach-KI bei Amazon und Meta verweist, sowie den wissenschaftlichen Leiter Shijia Liao, einen früheren Forschungsingenieur bei NVIDIA, der die Modelle zunächst in seinem Zimmer auf einer einzelnen Grafikkarte vom Typ 4090 trainierte.

Zwei Fragen, die vor dem Einsatz geklärt gehören

Zwei Dinge an diesem Produkt verdienen eine strengere Prüfung, als eine Funktionsliste sie leistet, und dieser Artikel behandelt beide ausführlich statt beiläufig. Erstens: Was die Plattform beim Klonen einer fremden Stimme tatsächlich an Einwilligung verlangt. Zweitens: Was „Open Source" hier bedeutet, denn die Lizenz gehört nicht zu jener freizügigen Sorte, die das Wort gewöhnlich nahelegt. Keine der beiden Antworten spricht gegen das Produkt, aber beide verändern, wie man es einsetzen sollte.

Kernfunktionen

Stimmklonen aus zehn Sekunden

Der Werbetext zum Klonen ist konkret und stützt sich, in dieser Kategorie ungewöhnlich, auf Zahlen statt auf Eigenschaftswörter. Die Produktseite nennt zehn Sekunden Referenzaudio als ausreichend, eine Streaming-Latenz von unter 300 Millisekunden von Ende zu Ende sowie sprachübergreifendes Klonen ohne vorheriges Beispiel in dreizehn Sprachen. Das heißt: einmal klonen, und dieselbe Stimme spricht die übrigen unterstützten Sprachen, ohne erneutes Training und ohne zweite Aufnahmesitzung.

Gerade diese letzte Eigenschaft verändert Arbeitsabläufe am stärksten. Herkömmliche Synchronisation verlangt entweder zweisprachige Sprecher oder pro Sprache eine eigene Stimme, sodass derselbe Inhalt in jedem Markt nach einer anderen Person klingt. Sprachübergreifendes Klonen ohne Beispiel bedeutet, dass eine einmal aufgenommene Stimmidentität einen ganzen Katalog durchziehen kann.

Sprachsynthese, die sich inszenieren lässt

Auf der Syntheseseite entfaltet das System der Emotionsmarken seine Wirkung. Statt aus einer festen Liste von Stilen zu wählen, versehen Sie den Text selbst mit Anmerkungen, und die Marken greifen genau dort, wo sie stehen. Deshalb ist die Rede von der Ebene unterhalb des Wortes von Belang: Ein einzelnes Wort innerhalb eines Satzes zu betonen ist etwas anderes, als dem ganzen Satz eine Stimmung zuzuweisen, und genau daran entscheidet sich, ob ein Vortrag nach Ablesen oder nach Darbietung klingt.

Spracherkennung und die weitere Produktpalette

Die Plattform reicht weit über einen Synthese-Endpunkt hinaus. Das Produktmenü führt acht eigenständige Werkzeuge auf: Sprachsynthese, Spracherkennung, Stimmklonen, Stimmveränderung, Story Studio, Stimmtrennung, Audioübersetzung und Erzeugung von Klangeffekten. Die Erkennungsseite wird damit beworben, dass die Transkription mehrere Sprecher, Emotionsmarken und eine Beschreibung in natürlicher Sprache enthält; das Ergebnis ist also eine strukturierte Abschrift statt eines bloßen Textblocks.

Die Stimmbibliothek der Community

Die Plattform beherbergt eine umfangreiche Bibliothek von Stimmen, die Nutzende hochgeladen haben — nach eigener Zählung mehr als 2.000.000 —, beschrieben als geeignet für kreatives Erzählen, Werbung und Hörbücher. In der Breite ist das ein echter Unterschied zum Wettbewerb. Zugleich ist dieser Teil des Produkts am engsten mit den weiter unten behandelten Einwilligungsfragen verflochten, denn eine Bibliothek dieser Größe wird von Nutzenden gefüllt und nicht vom Unternehmen Stück für Stück kuratiert.

Veröffentlichte Modellgewichte und Eigenbetrieb

Die Gewichte des Open-Source-Modells S2 sind veröffentlicht, und die Website bewirbt den Eigenbetrieb gleichrangig neben der gehosteten Schnittstelle. Gemessen an Community-Kennzahlen ist das Repository kein Randprojekt: Zum Erhebungszeitpunkt wies es 32.400 Sterne, 2.800 Abspaltungen, 101 Mitwirkende und 14 Veröffentlichungen aus und bezeichnet sich selbst als Open-Source-Sprachsyntheseprojekt der Spitzenklasse. Was diese Lizenz tatsächlich erlaubt, behandelt ein eigener Abschnitt weiter unten, und die Antwort fällt deutlich enger aus, als der Begriff gemeinhin nahelegt.

Anwendungsfälle

Hörbücher und lange Erzählstrecken. Das Unternehmen formuliert es so: Fünf Sekunden sind leicht, fünf Minuten sind die Prüfung. Sprachsynthese taugt auf Satzebene seit einem Jahrzehnt, doch mit zunehmender Länge treten die Risse hervor. Lange Erzählstrecken sind genau das Feld, auf dem Emotionsmarken und Tempoführung ihren Wert einlösen, denn ein flacher Vortrag wird lange vor dem zweiten Kapitel unerträglich.

Videovertonung im Produktionstakt. Ein Skript in eine zur Szene passende Erzählstimme zu verwandeln, ohne ein Tonstudio buchen zu müssen, ist der mengenmäßig größte Einsatzzweck solcher Werkzeuge. Dass man Tonfall wechseln und Emotion hinzufügen kann, ohne neu aufzunehmen, macht das wiederholte Überarbeiten billig.

Figurenstimmen für Spiele und Animation. Die Plattform zielt ausdrücklich darauf, und die Passung ist echt: Interaktive Medien brauchen viele unterschiedliche Stimmen, oft mehr, als ein Projekt an Sprechenden bezahlen kann, und alles muss neu erzeugt werden, sobald sich Dialoge ändern.

Dialogsysteme und Kundenbetreuung. Hier ist eine Streaming-Latenz von unter 300 Millisekunden keine Schaufensterzahl. Ein Sprachassistent, der vor jeder Antwort merklich stockt, wirkt defekt, wie gut die Stimme auch klingt; Latenz ist damit eine funktionale Anforderung und kein Zusatznutzen.

Mehrsprachige Lokalisierung aus einer einzigen Aufnahme. Sprachübergreifendes Klonen ohne Beispiel bedeutet, einmal aufzunehmen und dieselbe Stimmidentität über die unterstützten Sprachen hinweg zu behalten. Nützlich für Kreative mit Publikum in mehreren Regionen — den Abschnitt zur Sprachanzahl weiter unten sollte man allerdings zuerst lesen.

Eigenbetrieb aus Latenz- oder Datengründen. Da die Gewichte veröffentlicht sind, können Teams mit strengen Anforderungen an den Datenstandort oder mit eigener Inferenzinfrastruktur das Modell selbst betreiben, statt Audio an Dritte zu senden. Ob Ihr konkreter Zweck erlaubt ist, entscheidet allerdings die Lizenz — und darum geht es im entsprechenden Abschnitt.

So verwenden Sie Fish Audio

Schritt 1 — Testen Sie die Demo vor der Anmeldung. Auf der Startseite steht ein funktionierendes Eingabefeld für Sprachsynthese bereit, vorbelegt mit einem Text, der das Markensystem vorführt, mit einer Obergrenze von 30.000 Zeichen und sichtbaren Paletten für Emotions- und Sondermarken. Das ist der schnellste Weg zu beurteilen, ob diese Ausdruckssteuerung für Ihren Zweck trägt.

Schritt 2 — Legen Sie ein kostenloses Konto an. Der kostenlose Tarif verlangt keine Zahlungskarte und bietet monatlich 8.000 Guthabeneinheiten, bis zu sieben Minuten Erzeugung, höchstens 500 Zeichen je Vorgang und drei öffentliche Stimmplätze.

Schritt 3 — Entscheiden Sie zuerst zwischen Bibliothek und eigenem Klon. Für viele Aufgaben ist die vorhandene Bibliothek der schnellere Weg und umgeht die Einwilligungsfrage vollständig. Klonen ist für Fälle gedacht, in denen Sie eine bestimmte Stimmidentität wirklich brauchen — im Idealfall Ihre eigene oder eine, für die Ihnen eine dokumentierte Erlaubnis vorliegt.

Schritt 4 — Nehmen Sie zehn saubere Sekunden auf oder wählen Sie sie aus. Zehn Sekunden sind die genannte Untergrenze. Die Qualität der Referenz wiegt schwerer als ihre Länge: Je sauberer die Quelle, desto besser der Klon, und die Produktseite räumt ein, dass längere Proben bei sehr ausdrucksstarken Stimmen helfen können.

Schritt 5 — Schreiben Sie das Skript mit Marken, nicht nur mit Wörtern. Diesen Schritt schöpfen neue Nutzende am wenigsten aus. Die Betonung auf jenes eine Wort zu setzen, das den Satz wirklich trägt, oder eine lange Pause dort einzufügen, wo ein Mensch Luft holen würde — daran entscheidet sich, ob das Ergebnis maschinell erzeugt oder dargeboten klingt.

Schritt 6 — Prüfen Sie vor der Veröffentlichung Ihre kommerziellen Rechte. Das ist keine verzichtbare Formalie. Wie unten dargelegt, wird der kommerzielle Status des kostenlosen Tarifs auf der Website widersprüchlich beschrieben, und ein Irrtum bedeutet, monetarisierte Inhalte ohne die nötigen Rechte zu veröffentlichen.

Schritt 7 — Wechseln Sie zur Schnittstelle, wenn das Volumen es rechtfertigt. Entwicklerdokumentation und Schnittstellenreferenz liegen auf einer eigenen Unterdomäne, und die kostenpflichtigen Tarife bieten nutzungsabhängig abgerechneten Zugang.

Tipps und bewährte Vorgehensweisen

Setzen Sie Marken sparsam und gezielt. Emotionsmarken sind ein Regiewerkzeug, kein Zierrat. Jeden Teilsatz zu markieren lässt den Vortrag unstet klingen; nur jene zwei oder drei Stellen zu kennzeichnen, die das emotionale Gewicht eines Abschnitts wirklich tragen, wirkt dagegen beabsichtigt.

Stecken Sie Mühe in die Referenzaufnahme statt in Wiederholungen. Ein Klon erbt die Akustik seiner Quelle. Zehn Sekunden mit einem ordentlichen Mikrofon in einem stillen Raum schlagen eine Minute verrauschtes Telefonaudio, und keine noch so häufige Neuerzeugung rettet eine von vornherein mangelhafte Referenz.

Rechnen Sie in Guthaben, nicht in Minuten. Die veröffentlichte Umrechnung liegt bei etwa 600 bis 625 Einheiten je erzeugter Minute. Gemessen an den 8.000 Einheiten des kostenlosen Tarifs ergibt das nahezu genau die beworbenen sieben Minuten. Wer die Umrechnung kennt, vergleicht Tarife rechnerisch statt nach Gefühl.

Denken Sie daran, dass Guthaben nicht übertragen wird. Die monatlichen Kontingente werden zu Beginn jedes Abrechnungszyklus zurückgesetzt, und ungenutzte Minuten verfallen; ein Tarif, der auf Ihren Spitzenmonat zugeschnitten ist, ist in ruhigen Monaten also verschenkt.

Testen Sie Ihre Sprache, bevor Sie sich festlegen. Wie unten dargelegt, wird die Sprachunterstützung auf den eigenen Seiten auf vier verschiedene Weisen angegeben, und im offenen Repository liegen aktive Fehlermeldungen zu bestimmten Schriften vor. Eine repräsentative Probe in Ihrer Zielsprache kostet ein paar Guthabeneinheiten und klärt die Frage endgültig.

Nutzen Sie für alles Heikle private Stimmplätze. Die Lizenzbedingungen für öffentliche Beiträge sind merklich weiter als die für private, und öffentliche Inhalte können nach einer Kontolöschung verfügbar bleiben. Die Wahl des Platzes ist eine Rechtsentscheidung, keine Frage der Ablage.

Für wen ist Fish Audio gedacht?

Für Kreative mit hohem Ausstoß. Videoschaffende, Podcastende und Kursproduzierende, die regelmäßig sprechen, haben den deutlichsten Nutzen, weil die Ersparnis mit der Menge wächst.

Für Spiele- und Animationsteams mit vielen Rollen. Projekte mit großer Besetzung oder häufig wechselnden Dialogen profitieren stärker als solche mit kleinem, festem Skript.

Für Entwickelnde von Sprachagenten. Dokumentierte Schnittstelle, Streaming unter 300 Millisekunden und veröffentlichte Gewichte decken zusammen sowohl die gehostete als auch die selbstbetriebene Architektur ab.

Für Lokalisierungsteams. Sprachübergreifendes Klonen adressiert ein reales und teures Problem bei Inhalten für mehrere Märkte.

Für Forschende und Hobbynutzende. Die veröffentlichten Gewichte sind für Forschung und nichtkommerzielle Arbeit wirklich verwendbar — genau der Fall, für den die Lizenz geschrieben wurde.

Wer vorsichtig sein sollte. Wer einen kommerziellen Eigenbetrieb plant, muss zuerst den Lizenzabschnitt weiter unten lesen, denn die Antwort lautet dort im Regelfall nein. Wer aus Compliance-Gründen ausdrückliche Zusagen zum Umgang mit biometrischen Daten braucht, sollte darauf achten, was die Datenschutzerklärung sagt — und mehr noch, was sie nicht sagt. Und wer eine fremde Stimme klonen will, braucht den Abschnitt zur Einwilligung dringender als eine Funktionsliste.

Plattformen

Fish Audio ist in erster Linie eine Webanwendung, die sich ohne Installation in jedem aktuellen Browser nutzen lässt. Der Entwicklerzugang läuft über eine dokumentierte REST-Schnittstelle samt Entwicklungsbausteinen; Dokumentation und Schnittstellenreferenz liegen auf einer eigenen Unterdomäne.

Mobile Anwendungen existieren: Die Nutzungsbedingungen enthalten einen eigenen Abschnitt, der einräumt, dass deren Verfügbarkeit von Läden Dritter abhängt, ausdrücklich Apples App Store und den Android-Anwendungsmarkt nennt und verlangt, auch deren eigene Bedingungen einzuhalten.

Der Eigenbetrieb ist ein offiziell beworbener dritter Weg. Die Produktseite legt die Optionen unmittelbar nebeneinander: das Modell selbst betreiben, den Streaming-Endpunkt unter 300 Millisekunden ansprechen oder Stimmen in Ihre Agenten und Anwendungen einbinden. Welche dieser Optionen Ihnen offensteht, bestimmt die Lizenz.

Optionen für den Unternehmenseinsatz sind gesondert aufgeführt und umfassen den Betrieb in eigener Umgebung, den Verzicht auf Datenspeicherung und die Einhaltung von SOC2, bei mengenabhängiger Sonderpreisgestaltung mit jährlicher Abrechnung.

Noch eine Randnotiz zum Zugriff: Die robots.txt der Website gewährt den Suchprogrammen von Google, Apple und Bing vollen Zugang, während sie allgemeinen Suchprogrammen die Pfade für Anmeldung und Sprachsynthese verwehrt.

Preise und Tarife

Die Preise wurden unmittelbar auf der Tarifseite geprüft. Zu beachten ist, dass sich zum Erhebungszeitpunkt zwei Rabatte überlagerten: drei Freimonate bei Jahreszahlung sowie ein Jubiläumsnachlass von 50 Prozent. Die monatlichen Entsprechungen unten geben daher die Aktionspreise wieder; die Listenpreise stehen jeweils daneben.

Kostenloser Tarif. 0 Dollar, keine Zahlungskarte nötig. Enthält monatlich 8.000 Guthabeneinheiten, bis zu sieben Minuten Erzeugung, höchstens 500 Zeichen je Vorgang, drei öffentliche Stimmplätze, Standardgeschwindigkeit und verbessertes Stimmklonen.

Plus. Rechnerisch 5,5 Dollar im Monat bei jährlicher Abrechnung von 66 Dollar, gegenüber einem monatlichen Listenpreis von 15 Dollar. Enthält monatlich 250.000 Einheiten, bis zu 200 Minuten, höchstens 15.000 Zeichen je Vorgang, unbegrenzt öffentliche und zehn private Stimmplätze, bevorzugte Erzeugung, Zugang zu Voice Design und einen professionellen Stimmplatz.

Pro. Rechnerisch 37,5 Dollar im Monat bei jährlicher Abrechnung von 450 Dollar, gegenüber 100 Dollar Listenpreis. Enthält monatlich 2.000.000 Einheiten, bis zu 1.620 Minuten, drei Teamplätze, höchstens 30.000 Zeichen je Vorgang, unbegrenzte Stimmplätze, fünf professionelle Stimmplätze und eine Geld-zurück-Garantie über sieben Tage.

Max. Rechnerisch 749 Dollar im Monat bei jährlicher Abrechnung von 8.988 Dollar, gegenüber 999 Dollar Listenpreis. Enthält monatlich 25.000.000 Einheiten, bis zu 6.250 Minuten, zehn Teamplätze und fünfzehn professionelle Stimmplätze.

Unternehmen. Mengenabhängige Sonderpreise mit jährlicher Abrechnung, gerichtet an Organisationen mit Compliance-Anforderungen, mit nutzungsabhängiger Abrechnung samt Steuerung auf Organisationsebene, Verzicht auf Datenspeicherung, Betrieb in eigener Umgebung und Einhaltung von SOC2.

Wie das Guthabensystem funktioniert

Die veröffentlichte Umrechnung liegt bei etwa 600 bis 625 Einheiten je erzeugter Minute. Die monatlichen Kontingente werden zu Beginn jedes Abrechnungszyklus zurückgesetzt, ungenutzte Minuten verfallen.

Der Widerspruch bei den kommerziellen Rechten

Dieser Punkt gehört klar benannt, denn er entscheidet unmittelbar darüber, ob Sie veröffentlichen dürfen, was Sie erzeugen — und die Website widerspricht sich innerhalb derselben Seite.

In der Funktionsliste des kostenlosen Tarifs auf der Preisseite steht der Punkt „kommerzielle Nutzung". Die weiter unten auf derselben Seite stehenden häufigen Fragen behaupten das Gegenteil: Zahlende Abonnenten dürfen von ihnen selbst besessene, verifizierte Stimmen kommerziell nutzen, während Nutzende des kostenlosen Tarifs erzeugte Inhalte nur für persönliche, nichtkommerzielle Vorhaben verwenden dürfen. Die häufigen Fragen auf der Startseite folgen dieser einschränkenden Lesart und werden noch deutlicher: Der kostenlose Tarif sei allein für den persönlichen Gebrauch bestimmt, und wer monetarisieren oder Stimmen kommerziell einsetzen wolle, müsse auf einen kostenpflichtigen Tarif wechseln, um vollständige kommerzielle Rechte zu erhalten.

Zwei offizielle Quellen sagen also, kostenlos bedeute ausschließlich persönlichen Gebrauch, während eine offizielle Funktionsliste das Gegenteil behauptet. Dieser Artikel gibt beide Lesarten wieder, ohne sie in Einklang zu bringen, denn ein Ausgleich liefe auf Raten hinaus. Ratsam ist, die einschränkende Lesart als maßgeblich zu behandeln und vor jeder Monetarisierung von Ergebnissen des kostenlosen Tarifs beim Anbieter nachzufragen — die Folgen eines Irrtums trägt allein, wer veröffentlicht.

Alternativen

Der meistgenannte Vergleichspunkt dieser Kategorie ist ElevenLabs, und Fish Audio beteiligt sich unmittelbar an diesem Vergleich: Die Website führt einen eigenen Vergleichsbereich, und im eigenen Seitenverzeichnis findet sich eine Seite, die sich als Alternative zu diesem Wettbewerber positioniert. Sich ausdrücklich gegenüber diesem etablierten Anbieter aufzustellen ist eine bewusste Entscheidung, und Interessierte sollten im Blick behalten, dass eine von einem Anbieter veröffentlichte Vergleichsseite über seinen Wettbewerber Werbematerial ist und keine unabhängige Erhebung.

Die Angaben des Unternehmens in diesem Feld sind selbst berichtet und entsprechend zu lesen: Die Finanzierungsmitteilung besagt, S2.1 Pro sei in verdeckten Hörtests von 66 Prozent der Hörenden gegenüber führenden Wettbewerbsmodellen bevorzugt worden. Methodik, Stichprobengröße und Zusammensetzung der Hörergruppe werden in der Mitteilung nicht mitgeliefert, sodass sich die Angabe allein aus dieser Quelle nicht unabhängig prüfen lässt.

Die eigentliche Alternativachse ist allerdings nicht ein anderer gehosteter Anbieter, sondern die Wahl zwischen Eigenbau und Zukauf, die die veröffentlichten Gewichte eröffnen. Für Forschung und nichtkommerzielle Arbeit ist der Eigenbetrieb eine reale Option, die die meisten Wettbewerber nicht bieten. Für kommerzielle Arbeit erfordert diese Option eine gesonderte Lizenz, womit der Vergleich wieder auf eine gewöhnliche Bewertung eines gehosteten Dienstes zusammenfällt.

Einschränkungen und Hinweise

Einwilligung beim Stimmklonen: Was die Plattform tatsächlich verlangt

Das ist die wichtigste Frage, und die ehrliche Antwort lautet: Die Verantwortung liegt nahezu vollständig bei den Nutzenden, und die Plattform prüft vorab überhaupt nicht.

Die klarste Formulierung steht in den häufigen Fragen der Klonseite und verdient eine getreue Wiedergabe: Es liege bei Ihnen zu bestätigen, dass Ihnen für jede geklonte Stimme die erforderlichen Rechte, Einwilligungen und Offenlegungen vorliegen, und dass Sie das geltende Recht einhalten, einschließlich der Vorschriften zu Name, Bildnis und KI-erzeugten Inhalten in Ihrer Region. Dieselbe Antwort beschreibt auch die Durchsetzungshaltung: Man erteile keine vorherige Freigabe für einzelne Anwendungsfälle und könne Inhalte oder Konten entfernen, die gegen die Bedingungen oder geltendes Recht verstoßen. Der Mechanismus ist damit eine nachträgliche Entfernung und keine vorgeschaltete Prüfung.

Auffällig ist, dass in den rechtlich bindenden Dokumenten gerade keine Einwilligungspflicht steht. Der Abschnitt der Nutzungsbedingungen zu Erlaubnissen und Beschränkungen zählt siebzehn Verbote von (a) bis (q) auf, von denen keines die Einwilligung zum Stimmklonen eigens behandelt. Am nächsten kommt die allgemeine Klausel (a), die es untersagt, irgendetwas beizutragen, das Rechte des geistigen Eigentums oder sonstige Rechte anderer verletzt. Die Zusicherung zu Nutzerbeiträgen ist ebenso allgemein gehalten und untersagt Beiträge, die Urheber- oder sonstige Rechte Dritter verletzen, etwa Marken- oder Persönlichkeitsrechte. Keine von beiden begründet die konkrete Pflicht, eine dokumentierte Einwilligung für eine geklonte Stimme vorzuhalten.

Zwischen der Einwilligungsformulierung und dem Werbetext auf derselben Seite besteht überdies eine Spannung. Der Aufmachertext der Klonseite lädt genau zu jener Nutzung ein, vor der die Einwilligungsformulierung warnt: einen amtierenden Staatschef Ihre Partner-App besprechen zu lassen, mit der Stimme eines Technikmilliardärs Ihre schlechteste Idee zu präsentieren oder eine Sendung ausschließlich mit erfundenen Gästen zu bauen. Die häufigen Fragen derselben Seite verstärken diese Erwartung noch, indem sie anmerken, dass die meisten Ausschnitte öffentlicher Personen, Sendungsmitschnitte oder Aufnahmen in Telefonqualität schon beim ersten Versuch funktionieren. Das Klonen erkennbarer öffentlicher Personen an prominentester Stelle zu bewerben und daneben einen Hinweis zu setzen, man möge deren Einwilligung einholen, ist eine tatsächlich vorhandene Unstimmigkeit, und die Leserschaft sollte beide Seiten gegeneinander abwägen.

Eine verwandte Pflicht enthalten die Bedingungen sehr wohl: Inhalte dürfen nicht irreführend verbreitet werden, wozu auch zählt, sie als vollständig von Menschen erstellt darzustellen. Die Plattform ermutigt dazu, den Einsatz von KI von sich aus offenzulegen, formuliert dies aber als Anregung und nicht als Pflicht. In der Fußzeile findet sich ein Weg zur Meldung von Missbrauch.

Das praktische Fazit ist eindeutig. Wer die eigene Stimme klont, wird von alledem nicht eingeschränkt. Wer die Stimme eines anderen klont, wird von der Plattform weder gehindert noch überprüft; zugleich lehnt sie jedoch die Verantwortung ab und legt das rechtliche Risiko vollständig auf Ihre Seite — und je nach Rechtsordnung kann dieses Risiko erheblich sein.

Was „Open Source" hier bedeutet — und was nicht

Die Website stellt Offenheit wiederholt heraus: Das Open-Source-Modell S2 erscheint als Merkmal in Überschriftenrang, der Eigenbetrieb wird als unterstützter Weg dargestellt, und das Repository bezeichnet sich als Open-Source-Sprachsyntheseprojekt der Spitzenklasse, gestützt auf 32.400 Sterne. Die Gewichte sind tatsächlich veröffentlicht, und das ist echt. Die Lizenz ist jedoch nicht freizügig, und dieser Unterschied ist kommerziell entscheidend.

Das Repository schreibt es unmissverständlich: Dieser Quelltext und die zugehörigen Modellgewichte werden unter der FISH AUDIO RESEARCH LICENSE veröffentlicht, mit der Warnung, gegen jeden Verstoß vorzugehen. Diese zuletzt am 7. März 2026 aktualisierte Lizenz nennt ihre Absicht bereits in der Einleitung: Die Vereinbarung solle Forschung und nichtkommerzielle Nutzungen der Materialien kostenfrei ermöglichen, und jede kommerzielle Nutzung erfordere eine gesonderte Lizenz von Fish Audio.

Abschnitt III beseitigt jede Unklarheit: Jede Nutzung der Materialien oder abgeleiteter Werke zu einem kommerziellen Zweck erfordert eine gesonderte schriftliche Lizenzvereinbarung mit Fish Audio, und die vorliegende Vereinbarung gewährt keinerlei kommerzielle Rechte. Kommerzielle Lizenzen werden über die in der Lizenz genannte Geschäftsadresse verhandelt.

Die Bestimmung des „kommerziellen Zwecks" ist weit genug gefasst, um die meisten unternehmerischen Nutzungen zu erfassen: Sie umfasst das Erstellen, Verändern oder Verbreiten Ihres Produkts oder Dienstes, auch über einen gehosteten Dienst oder eine Programmierschnittstelle; den internen Betrieb Ihres Unternehmens oder Ihrer Organisation; und jede Nutzung im Zusammenhang mit einem Produkt oder Dienst, für den Sie ein Entgelt erheben oder mittelbar wie unmittelbar Erlöse erzielen. Schon der interne Einsatz in einem Unternehmen genügt — Sie müssen das Modell nicht weiterverkaufen.

Zwei weitere Abweichungen von freizügigen Lizenzen verdienen Beachtung. Die Forschungserlaubnis wird beschrieben als nicht ausschließlich, weltweit, nicht übertragbar, nicht unterlizenzierbar, widerruflich und gebührenfrei — widerruflich ist das entscheidende Wort und hat in den gängigen freizügigen Bedingungen keine Entsprechung. Und die Weitergabe ist mit Namensnennungspflichten verbunden: eine Hinweisdatei, die das Urheberrecht 39 AI, INC. zuschreibt, sowie die gut sichtbare Anzeige des Zusatzes „Built with Fish Audio" auf einer zugehörigen Website oder in der Produktdokumentation. Die Lizenz untersagt außerdem, die Materialien oder deren Ausgaben zu verwenden, um irgendein generatives KI-Basismodell zu erstellen oder zu verbessern.

Eine Lücke gehört festgehalten. Die Lizenz bindet eine Richtlinie zur zulässigen Nutzung durch Verweis ein und macht deren Einhaltung zur Lizenzbedingung — doch dieses Dokument war nicht auffindbar. Mehrere infrage kommende Pfade liefern durchweg den Fehler 404, und im statischen Seitenverzeichnis des Anbieters taucht keine solche Seite auf; dieses führt lediglich Startseite, Entdecken, Sprachgenerator, Kundenseite, Unternehmensseite, die Seite zur Wettbewerbsalternative sowie Bedingungen, Datenschutz und rechtliche Hinweise für Japan. Dass eine bindende Bedingung auf ein Dokument verweist, das Nutzende nicht einsehen können, ist ein Dokumentationsproblem, das man vor dem Vertrauen auf diese Lizenz beim Anbieter ansprechen sollte.

Kurzfassung: offene Gewichte, ja; Open Source im freizügigen Sinne, nein. Forschung und Hobbygebrauch sind kostenfrei und tatsächlich erlaubt. Jede kommerzielle Nutzung — den internen Unternehmenseinsatz eingeschlossen — verlangt eine gesonderte kostenpflichtige Vereinbarung, unabhängig davon, was die Werbeseite nahelegt.

Was die Datenschutzerklärung nicht behandelt

Die Datenschutzerklärung trägt als Datum des Inkrafttretens den 28. August 2024. Eine Volltextprüfung fand im Text kein einziges Vorkommen der Wörter „voice", „biometric" und „train". Für ein Produkt, dessen Kernfunktion darin besteht, menschliche Stimmen aufzunehmen und wiederzugeben, ist das Fehlen jeder stimmbezogenen oder biometrischen Bestimmung eine inhaltliche Lücke; es bedeutet zugleich, dass die Erklärung nichts darüber aussagt, ob Nutzerinhalte zum Trainieren oder Verbessern von Modellen verwendet werden. Nach der verfügbaren Beleglage lautet die redliche Formulierung, dass die Erklärung zu diesen Punkten schweigt — und nicht, dass ein bestimmter Schutz besteht oder nicht besteht.

Hochgeladene Audiodateien fallen unter die allgemeine Kategorie der Nutzerinhalte, die die Erklärung als personenbezogene Informationen in Eingaben, Dateiuploads oder Rückmeldungen an den Dienst definiert. Zu den für diese Kategorie genannten Dritten zählen Dienstleister, Werbepartner, Analysepartner und Geschäftspartner.

Welche Lizenz Sie an Ihren eigenen Uploads einräumen

Die Bedingungen sind bei den Rechten, die Sie abgeben, deutlich genauer als bei jenen, die Sie behalten. Die der Plattform an Nutzerbeiträgen eingeräumten Lizenzen sind gebührenfrei, unbefristet, unterlizenzierbar, unwiderruflich und weltweit.

Das Löschen ist entsprechend begrenzt. Bei Kontolöschung stellt die Plattform die Anzeige Ihrer Beiträge für andere Nutzende ein, ausdrücklich ausgenommen öffentliche Beiträge, die vollständig verfügbar bleiben können; zudem räumen die Bedingungen ein, dass eine vollständige Löschung aus den eigenen Aufzeichnungen möglicherweise nicht machbar ist.

Öffentliche Beiträge tragen die weitesten Bedingungen von allen: Sie umfassen das Recht, den öffentlichen Beitrag zu Marketing- und Werbezwecken zu nutzen, anzuzeigen, vorzuführen und zu verbreiten, sowie eine Lizenz an alle übrigen Nutzenden, darauf zuzugreifen und Rechte daran auszuüben. Das ist der konkrete Grund, weshalb die Wahl zwischen privatem und öffentlichem Platz eine Rechtsentscheidung ist. Es ist zugleich der nützliche Hintergrund zur Community-Bibliothek mit mehr als 2 Millionen Stimmen: Diese Bibliothek existiert, weil öffentliche Uploads eben diese Bedingungen tragen.

Die Sprachunterstützung wird auf vier Arten angegeben

Die offiziellen Seiten nennen vier miteinander unvereinbare Zahlen, und dieser Artikel führt alle vier an, ohne zu mitteln. Die Klonseite spricht von sprachübergreifendem Klonen ohne Beispiel in dreizehn Sprachen. Der Schnittstellenbereich der Startseite nennt über dreißig Sprachen. Die häufigen Fragen der Syntheseseite zählen lediglich acht auf — Englisch, Japanisch, Koreanisch, Chinesisch, Französisch, Deutsch, Arabisch und Spanisch — und werben getrennt mit automatischer Unterstützung für acht Sprachen mit muttersprachlichem Akzent. Die Finanzierungsmitteilung beansprucht mehr als 83 Sprachen mit muttersprachlicher Sprechmelodie.

Möglicherweise beschreiben diese Angaben Verschiedenes: Klonen gegenüber Synthese oder vollständige gegenüber bestmöglicher Unterstützung. Die Website erläutert den Unterschied jedoch nicht; prüfen Sie Ihre Sprache daher empirisch, statt einer einzelnen Zahl zu vertrauen.

Meldungen aus der Gemeinschaft stützen diese Vorsicht. Im offenen Repository liegen aktive Vorgänge, wonach die Eingabe in Gurmukhi für Panjabi Zeichen für Konsonantenverdopplung und Nasalierung fehlerhaft verarbeitet, samt einer zugehörigen Anfrage, die Aussprache des Panjabi durch eine diakritikabewusste lateinische Umschrift oder eine Umsetzung von Schriftzeichen in Laute zu verbessern. Zum Erhebungszeitpunkt wies das Repository 7 offene und 684 geschlossene Vorgänge aus — ein gesundes Pflegeverhältnis, zugleich aber ein Beleg für ungleichmäßige Qualität je nach Sprache.

Weitere Hinweise

Keine Inhaltsprüfung vor Veröffentlichung. Der rechtliche Hinweis des Repositorys formuliert es so: Man übernehme keine Verantwortung für eine rechtswidrige Nutzung des Quelltextes und verweise auf die örtlichen Gesetze, etwa zum digitalen Urheberrecht. Zusammen mit dem Verzicht auf Vorabfreigaben wird die Verantwortung durchgängig nach unten weitergereicht.

Rückentwicklung und Wettbewerbsmodelle sind untersagt. Die Bedingungen verbieten Versuche, an Quelltext, zugrunde liegende Modellbestandteile oder Algorithmen zu gelangen, und untersagen gesondert, Ausgaben des Dienstes zur Entwicklung konkurrierender Modelle zu verwenden.

Altersanforderungen. Nutzende müssen mindestens 13 Jahre alt sein, unter 18-Jährige brauchen die Erlaubnis der Eltern, und die Plattform erklärt, keine identifizierenden Angaben von Kindern unter 16 wissentlich zu erheben.

Verzeichnisangaben veralten schnell. Die für diesen Eintrag gespeicherte Kategorie lautete „Mode", mit Schlagwörtern wie „Mode" und „Vorlagen" — für ein Sprachsyntheseprodukt offensichtlich falsch —, und die gespeicherte Beschreibung nannte über 1.000 Stimmen, während die Website inzwischen über 2.000.000 angibt. Schnell fortschreitende Produkte hängen ihre Verzeichniseinträge ab; prüfen Sie aktuelle Zahlen auf der Website.

FAQ

Q1. Ist Fish Audio kostenlos nutzbar?

Es gibt einen echten kostenlosen Tarif ohne Zahlungskarte mit monatlich 8.000 Guthabeneinheiten, bis zu sieben Minuten Erzeugung, einer Grenze von 500 Zeichen je Vorgang und drei öffentlichen Stimmplätzen. Ob Sie das Ergebnis kommerziell nutzen dürfen, bleibt nach der Website tatsächlich unklar: Die Funktionsliste des kostenlosen Tarifs nennt kommerzielle Nutzung, während die häufigen Fragen auf derselben Seite und auf der Startseite beide festhalten, dass Ergebnisse des kostenlosen Tarifs nur persönlich und nichtkommerziell verwendet werden dürfen. Behandeln Sie die einschränkende Lesart als maßgeblich und fragen Sie vor jeder Monetarisierung beim Anbieter nach.

Q2. Brauche ich eine Erlaubnis, um die Stimme einer anderen Person zu klonen?

Die Plattform legt diese Verantwortung vollständig auf Sie und prüft vorab nicht. Die häufigen Fragen der Klonseite halten fest, dass es bei Ihnen liegt zu bestätigen, dass Ihnen für jede geklonte Stimme die erforderlichen Rechte, Einwilligungen und Offenlegungen vorliegen, und dass Sie die Vorschriften zu Name, Bildnis und KI-erzeugten Inhalten in Ihrer Region einhalten. Ebenso heißt es dort, man erteile keine vorherige Freigabe für einzelne Anwendungsfälle und könne Inhalte oder Konten nachträglich entfernen. Zu beachten: Die bindenden Nutzungsbedingungen enthalten keine Klausel, die eine Einwilligung zum Stimmklonen ausdrücklich verlangt — nur allgemeine Verbote, Rechte anderer zu verletzen — während der Werbetext derselben Produktseite das Klonen öffentlicher Personen aktiv nahelegt. Rechtlich tragen Sie das Risiko.

Q3. Ist das Modell wirklich Open Source?

Die Gewichte sind tatsächlich veröffentlicht, doch die Lizenz ist nicht freizügig. Quelltext und Modellgewichte erscheinen beide unter der Forschungslizenz von Fish Audio, die in ihrer Einleitung festhält, Forschung und nichtkommerzielle Nutzung kostenfrei erlauben zu wollen, während jede kommerzielle Nutzung eine gesonderte Lizenz erfordert. Abschnitt III gewährt überhaupt keine kommerziellen Rechte. Kostenfrei für Forschung, Studium und Hobby; gesonderte kostenpflichtige Vereinbarung für alles andere.

Q4. Darf ich es für mein Unternehmen selbst betreiben?

Unter der öffentlichen Lizenz nicht. Deren Bestimmung des kommerziellen Zwecks umfasst ausdrücklich das Erstellen, Verändern oder Verbreiten Ihres Produkts oder Dienstes, auch über einen gehosteten Dienst oder eine Schnittstelle, den internen Betrieb Ihrer Organisation sowie jede Nutzung im Zusammenhang mit einem Produkt oder Dienst, der mittelbar oder unmittelbar Erlöse erzielt. Schon der interne Unternehmenseinsatz löst sie aus. Erforderlich ist eine gesonderte schriftliche Vereinbarung, erhältlich über die in der Lizenz genannte Geschäftsadresse. Beachten Sie zudem, dass die Forschungserlaubnis widerruflich ist, anders als bei gängigen freizügigen Lizenzen.

Q5. Wie viel Audio brauche ich zum Klonen, und wie gut wird das Ergebnis?

Als Untergrenze nennt der Anbieter zehn Sekunden saubere Sprache; die Produktseite merkt an, dass längere Proben bei sehr ausdrucksstarken Stimmen helfen können. Die Qualität der Referenz zählt mehr als ihre Dauer: Eine saubere kurze Probe schlägt eine lange, verrauschte Aufnahme. Zusätzlich gibt die Plattform an, dass das Klonen sprachübergreifend ohne vorheriges Beispiel in dreizehn Sprachen funktioniert, sodass eine einzige Aufnahme ohne erneutes Training in die übrigen unterstützten Sprachen trägt.

Q6. Wie viele Sprachen werden tatsächlich unterstützt?

Die Website gibt vier verschiedene Antworten, und dieser Artikel wählt keine davon für Sie aus. Die Klonseite nennt dreizehn Sprachen für sprachübergreifendes Klonen, die Startseite über dreißig, die häufigen Fragen der Syntheseseite zählen acht Sprachen auf und werben mit automatischer Unterstützung für acht Sprachen mit muttersprachlichem Akzent, und die Finanzierungsmitteilung beansprucht mehr als 83. Wahrscheinlich beschreiben sie unterschiedliche Fähigkeiten, doch die Website sagt nicht, welche welche ist. Erzeugen Sie vor einer Festlegung eine Testprobe in Ihrer Zielsprache: Im offenen Repository liegen aktive Fehlermeldungen zu bestimmten Schriften vor, darunter die Behandlung von Konsonantenverdopplung und Nasalierung im Gurmukhi für Panjabi.

Q7. Was kostet es jenseits des kostenlosen Tarifs?

Zum Erhebungszeitpunkt waren vier kostenpflichtige Tarife gelistet, mit überlagerten Rabatten. Plus liegt rechnerisch bei 5,5 Dollar monatlich, jährlich mit 66 Dollar abgerechnet, gegenüber 15 Dollar Listenpreis, mit monatlich 250.000 Einheiten. Pro liegt rechnerisch bei 37,5 Dollar monatlich, jährlich mit 450 Dollar abgerechnet, gegenüber 100 Dollar Listenpreis, mit 2.000.000 Einheiten und drei Teamplätzen. Max liegt rechnerisch bei 749 Dollar monatlich, jährlich mit 8.988 Dollar abgerechnet, gegenüber 999 Dollar Listenpreis, mit 25.000.000 Einheiten und zehn Teamplätzen. Der Unternehmenstarif ist individuell und wird jährlich abgerechnet. Etwa 600 bis 625 Einheiten entsprechen einer erzeugten Minute, und ungenutztes Guthaben verfällt.

Q8. Wird meine hochgeladene Stimme zum Trainieren ihrer Modelle verwendet?

Die Datenschutzerklärung sagt dazu nichts. Eine Volltextprüfung fand weder „train" noch „voice" noch „biometric"; das Dokument trat am 28. August 2024 in Kraft. Es gibt zu diesem Punkt also keine veröffentlichte Zusage in die eine oder andere Richtung, und es wäre falsch, einen Schutz zu behaupten, den das Dokument nicht enthält. Hochgeladene Audiodateien fallen unter die allgemeine Kategorie der Nutzerinhalte, deren aufgeführte Empfänger Dienstleister sowie Werbe-, Analyse- und Geschäftspartner umfassen. Falls dies für Ihre Compliance zählt, fragen Sie unmittelbar beim Anbieter nach — und beachten Sie, dass der Unternehmenstarif den Verzicht auf Datenspeicherung als eigenes Merkmal ausweist.

Q9. Was geschieht mit meinen Stimmen, wenn ich mein Konto lösche?

Das Löschen ist teilweise und nicht vollständig. Die Bedingungen halten fest, dass die Plattform bei Kontolöschung Ihre Beiträge anderen Nutzenden nicht mehr anzeigt, nehmen öffentliche Beiträge aber ausdrücklich aus, die vollständig verfügbar bleiben können, und räumen ein, dass eine vollständige Löschung aus den Aufzeichnungen möglicherweise nicht machbar ist. Da die eingeräumten Lizenzen unbefristet, unterlizenzierbar und unwiderruflich sind und öffentliche Beiträge zusätzlich Werberechte sowie Zugriffsrechte für alle übrigen Nutzenden gewähren, ist die Wahl eines privaten statt eines öffentlichen Stimmplatzes eine inhaltliche Entscheidung und keine Frage der Ablage.

Q10. Wer steht hinter Fish Audio, und wie weit ist das Unternehmen?

Die Fußzeile nennt Hanabi AI Inc., während die Open-Source-Lizenz eine Namensnennung zugunsten von 39 AI, INC. verlangt. Beide Namen sind hier festgehalten; die Website erklärt das Verhältnis nicht. Das Unternehmen gab zum ersten Jahrestag 52 Millionen Dollar Seed-Finanzierung bekannt; eines der führenden Häuser dieser Runde trägt den Namen Coreline Ventures, das andere federführende Haus heißt Capital Today. Die eigene Mitteilung nennt ein Team von zweiundzwanzig Personen, 21 Millionen Dollar wiederkehrende Jahreserlöse, mehr als 8 Millionen Plattformnutzende und mehr als 2 Millionen Stimmmodelle in der Gemeinschaft und führt Geschäftsführerin Rissa Cao sowie den wissenschaftlichen Leiter Shijia Liao namentlich an. Diese Geschäftszahlen sind selbst berichtet und wurden nicht unabhängig geprüft.

Kennen Sie ein ähnliches Tool?
Wenn Sie andere großartige KI-Tools kennen, können Sie sie uns gerne einreichen