Hast du dieses Tool genutzt? Bewerte es
Hast du dieses Tool genutzt? Bewerte es
LALAL.AI ist ein Dienst zur Trennung von Audioquellen, der eine fertige Mischung wieder in ihre Einzelspuren zerlegt. Die Website beschreibt ihn als KI-Vocal-Remover mit professionellem Qualitätsanspruch, angetrieben von KI und Transformer-Technologie — eine Formulierung, die der Realität näher kommt als die meisten Werbetexte: Das Produkt macht eine technisch schwierige Sache gründlich und baut eine Funktionsfamilie darum herum.
Die Kernoperation ist die Stem-Trennung. Sie laden einen Song hoch, wählen aus, was extrahiert werden soll, und erhalten isolierte Spuren — den Gesang allein, das Instrumental ohne ihn, oder einzeln herausgelöste Instrumente. Um diesen Kern gruppieren sich sechs weitere Werkzeuge für Stimmbereinigung, Stimmveränderung und Voice Cloning, Echo- und Hallentfernung sowie die Trennung von Lead- und Backgroundgesang.
Betrieben wird der Dienst von der Omnisale GmbH, einem Schweizer Unternehmen mit Sitz in der Grundstrasse 10, 6343 Risch-Rotkreuz. Dieser Firmenname lässt sich an drei unabhängigen Stellen bestätigen — in der Fußzeile der Website, im Anbieterfeld des Apple App Store und im Entwicklerfeld von Google Play — was eine deutlich belastbarere Identitätsprüfung darstellt als eine einzelne Über-uns-Seite. Das Unternehmen datiert seinen Beginn auf 2020, als es sein erstes neuronales Netz baute, und nennt einen Anstieg der registrierten Nutzenden von 3,8 Millionen im Jahr 2024 auf 6,79 Millionen im Folgejahr. Diese Zahl stammt vom Anbieter selbst und wurde nicht unabhängig geprüft.
Die nächstliegenden Vergleiche sind Moises, RipX und das quelloffene Ultimate Vocal Remover, die jeweils anderes Terrain besetzen. Moises ist um Übungsfunktionen für Musizierende herum gebaut — Tempo- und Tonhöhenänderung, Akkorderkennung — wobei die Trennung nur ein Bestandteil ist. Ultimate Vocal Remover ist kostenlos und läuft lokal, verlangt aber technische Einrichtung und Hardware. LALAL.AI liegt dazwischen: enger gefasst als Moises, erheblich einfacher als eine lokale Installation, und am stärksten auf die Trennqualität selbst ausgerichtet.
Der handfesteste Beleg für diese Ausrichtung ist die Modelllinie. Das Unternehmen hat fast jedes Jahr ein neues Trennnetz veröffentlicht: Rocknet 2020, dann Cassiopeia, Phoenix, Orion, Perseus, Andromeda und Lynx im Jahr 2026. Sieben Generationen in sieben Jahren, mit Jahreszahlen, die sich zwischen dem offiziellen Repository, der Über-uns-Seite und dem Änderungsprotokoll decken, sind ein überprüfbarer Investitionsnachweis statt eines Werbeadjektivs.
Die Nutzerstimmung ist für diese Kategorie ungewöhnlich positiv und stützt sich auf eine große Stichprobe. Auf Trustpilot erreicht der Dienst 4,3 von 5 bei 4.194 Bewertungen, mit 68 Prozent Fünf-Sterne- und 7 Prozent Ein-Stern-Wertungen. Die Verteilung zählt hier ebenso viel wie der Mittelwert: Es ist nicht die polarisierte Spaltung, die bei KI-Abodiensten häufig auftritt, und mit über 4.000 Bewertungen übertrifft die Stichprobe die Schwelle, ab der Bewertungen aussagekräftig werden, deutlich.
Das Unternehmen antwortet zudem auf Bewertungen, auch auf kritische — erwähnenswert, weil ausbleibende Reaktion in diesem Markt ein häufiges Beschwerdemuster ist. Was fehlt, ist Berichterstattung der großen Techmedien: In der Recherche fand sich keine unabhängige Berichterstattung von TechCrunch, VentureBeat oder vergleichbaren Häusern. Das Unternehmen führt einen People's-Voice-Webby in der Kategorie „Best Use of AI & Machine Learning" an, was sich jedoch in der offiziellen Webby-Gewinnerdatenbank nicht unabhängig bestätigen ließ; die auffindbare externe Berichterstattung geht auf Pressemitteilungsverbreitung zurück.
Die zentrale Fähigkeit extrahiert bis zu zehn Stems: Gesang, Instrumental, Schlagzeug, Bass, Gitarren, Klavier, Synthesizer, Streicher und Bläser. Gitarren lassen sich weiter in akustisch und elektrisch aufteilen. Diese Granularität unterscheidet ein ernstzunehmendes Trennwerkzeug von einem simplen Karaoke-Vocal-Remover: Gesangsisolierung ist nur die unterste Stufe, während das saubere Herauslösen einer Basslinie aus einer dichten Mischung eine deutlich schwerere Aufgabe ist als das Stummschalten einer Stimme.
Andromeda ist die aktuelle Trennengine, vom Unternehmen als sechste Generation bezeichnet. Ihre Einführung ist dokumentiert statt vage: Andromeda kam im November 2025 für die Gesangsisolierung und erhielt im März 2026 Unterstützung für Schlagzeug- und Bass-Stems, nachdem sie zwischenzeitlich auf die Trennung von Stimme und Rauschen erweitert worden war. Diese schrittweise Ausweitung verrät etwas Nützliches: Neue Stem-Typen kommen nach und nach hinzu, sobald das Modell dafür trainiert ist. Der tatsächliche Funktionsumfang zu einem Zeitpunkt sollte daher im Änderungsprotokoll geprüft und nicht vorausgesetzt werden.
Zwei Ergänzungen aus 2026 erweitern den Rahmen. Lynx wurde mit einem Jahr händisch bereinigter Daten trainiert, während Lyra vollständig auf Ihrer eigenen Hardware ohne jeden Upload läuft. Lynx zielt speziell auf Stimmisolierung und gilt als kompakter und gleichmäßiger als die Vorgänger; Lyra löst eine ganz andere Einschränkung, die weiter unten beim Datenschutz behandelt wird.
Voice Cleaner entfernt Hintergrundgeräusche und Artefakte aus Sprachaufnahmen und eignet sich damit auch für die Nachbearbeitung von Podcasts und Interviews, nicht nur für Musik. Der Echo & Reverb Remover geht die in einer Aufnahme eingebrannte Raumakustik an — ein wirklich schwieriges Problem und eine der nützlichsten Funktionen für alle, die mit unzureichend aufgenommenem Material arbeiten.
Voice Changer und Voice Cloner verändern oder reproduzieren eine Stimme. In den bezahlten Stufen kommen sie mit Voice Pack Slots, einem bei Lite und dreien bei Pro, was auf eine mit Ressourcen ausgestattete Funktion statt einer Alibi-Ergänzung hindeutet. Damit gehen auch Pflichten einher, die im Abschnitt zu den Einschränkungen behandelt werden.
Der Lead/Back Splitter trennt die Leadstimme von Harmonien und Backgroundschichten. Im September 2025 auf Basis des Perseus-Netzes eingeführt, ist dies eine Nischenfähigkeit, die für eine bestimmte Gruppe erheblich zählt: für alle, die remixen, Coverversionen produzieren oder Playbacks vorbereiten, bei denen sich der Harmoniestapel unabhängig von der Leadstimme bewegen muss.
Der Web-Uploader nimmt bis zu 20 Dateien gleichzeitig in MP3, FLAC, MKV, MP4 und weiteren Formaten entgegen, Videocontainer eingeschlossen. Die Videounterstützung ist ein praktisches Detail: Sie können eine MP4 direkt einspeisen, ohne vorher die Tonspur zu extrahieren, was zu Synchronisations- und Lokalisierungsabläufen passt.
Für die Integration steht eine REST-API mit OpenAPI-Spezifikation und offiziellem Beispiel-Repository bereit, die Trennung, Stimmbereinigung, Cloning und Rauschentfernung abdeckt. Das Repository zählt rund 190 Sterne und weist API V1 als empfohlene Version aus. Öffentlich nennen die API-Seiten allerdings weder Preise noch Ratenbegrenzungen oder Kontingente — eine echte Lücke für alle, die eine Integration kalkulieren wollen.
Die wichtigste professionelle Anwendung ist das Zurückgewinnen von Stems aus Material, zu dem keine Mehrspur-Session mehr existiert: alte Aufnahmen, lizenzierte Samples oder Referenztracks. Produzierende nutzen isoliertes Schlagzeug und isolierten Bass zum Remixen, und dank VST-Plugin geschieht das innerhalb der DAW statt über den Umweg Export und Reimport.
Gesang zu entfernen, um ein Instrumental zu erhalten, ist die häufigste Anwendung im Privatbereich und der Grund, aus dem viele hier landen. Der Lead/Back Splitter geht weiter: Sie können Backgroundstimmen behalten und nur die Leadstimme entfernen, was ein weit brauchbareres Karaoke-Playback ergibt als ein komplettes Abziehen der Gesangsebene.
Voice Cleaner und die Hallentfernung eignen sich für gesprochene Inhalte genauso wie für Musik. Für Podcastende mit unzureichender Raumakustik oder lauten Außenaufnahmen ist dies oft die relevantere Hälfte des Produkts, und die Freigabe ab 4 Jahren wie auch die mehrsprachige App machen es einer breiten Nutzerschaft zugänglich.
Dialoge von Musik und Effekten zu trennen ist eine ständige Anforderung in der Lokalisierung. Direkte Videounterstützung und die Unternehmens-API machen das in großem Umfang praktikabel, und unter den genannten Firmenkunden finden sich Synchronisations- und Lokalisierungsunternehmen, was einen tatsächlich eingesetzten Anwendungsfall statt eines hypothetischen belegt.
Wer Arrangements studiert, nutzt Stem-Trennung, um zu hören, wie eine Stimme in der Mischung sitzt: eine Basslinie oder eine Synthieschicht isolieren, um sie herauszuhören oder zu lernen. Genau hier zahlt sich die Granularität nach Instrumenten gegenüber einer simplen Zweiteilung in Gesang und Instrumental aus.
Firmen, die Trennung in eigene Produkte einbetten, nutzen die API. Die Unternehmensstufe hebt die Obergrenze pro Datei auf 10 GB und nennt Kunden wie Loudly und Dubpro AI sowie Ollang, Saga, Slate und Voicecheap. Diese Namen stammen vom Anbieter und wurden nicht bei den Kunden selbst bestätigt.
Bezahlte Abos nutzen ein Zwei-Warteschlangen-Modell, das leicht falsch gelesen wird. Du erhältst unbegrenzte Minuten in der Relaxed Queue, während die Fast Queue bei Lite auf 90 Minuten monatlich und bei Pro auf 250 begrenzt ist. Die Relaxed Queue ist kein Testkontingent — sie hat tatsächlich keine monatliche Obergrenze. Was du mit Fast-Queue-Minuten kaufst, ist bevorzugte Verarbeitung, nicht Zugang.
Die praktische Folge: Wenn deine Arbeit nicht terminkritisch ist, kann ein Lite-Abo praktisch unbegrenztes Volumen verarbeiten, sofern du längere Wartezeiten akzeptierst. Halte Fast-Queue-Minuten für Aufträge zurück, bei denen Warten teuer ist.
Beginne mit der hochwertigsten Quelle, die du hast. Die Trennqualität wird durch die Eingangsqualität begrenzt, und ein MP3 mit 128 kbit/s erzeugt merklich mehr Artefakte als eine verlustfreie Datei. Wo möglich, verwende FLAC oder WAV.
Teste an einer schwierigen Passage statt an einer einfachen. Dichte Mischungen, starke Kompression und stark verhallte Stimmen sind genau die Stellen, an denen Modelle straucheln; eine Bewertung am schwersten Material ergibt ein wahrhaftigeres Bild als ein sauberer, luftiger Track. Genau dafür sind die kostenlosen Vorschauen da.
Achte beim Extrahieren mehrerer Stems auf die Reihenfolge, denn Nutzerberichte deuten darauf hin, dass die Abfolge das Ergebnis beeinflussen kann. Trennt sich ein bestimmtes Instrument schlecht, versuche es direkt zu isolieren, statt es aus einer Restspur abzuleiten.
Ist dein Material vertraulich oder unveröffentlicht, nutze Lyra in der Desktop-App oder im VST-Plugin: Die Verarbeitung bleibt auf deinem eigenen Rechner, nichts wird hochgeladen. Das setzt die Pro-Stufe und eine Desktop-Installation voraus; die mobilen Apps und die Weboberfläche bieten es nicht.
Für die programmatische Nutzung starte mit der OpenAPI-Spezifikation und dem offiziellen Beispiel-Repository, statt Anfragen selbst nachzubauen. Beachte, dass der API-Zugang in den einmaligen Minutenpaketen enthalten, bei den Abos aber Pro-exklusiv ist: Der günstigste Weg zur API hängt also von deinem Nutzungsmuster ab und nicht von der Stufenhöhe.
Das ist die wertvollste Gewohnheit bei diesem Werkzeug, und die Erstattungsregel macht sie notwendig statt bloß vernünftig. Kostenlose Vorschauen lassen dich die Trennqualität an deinem eigenen Material ohne Kosten beurteilen. Sobald gekauft und Minuten verbraucht sind, ist eine Erstattung weitgehend ausgeschlossen — die Vorschau ist also dein einziges echtes Bewertungsfenster.
Die beiden Kaufwege passen zu wirklich unterschiedlichen Mustern. Abos begünstigen stetige, fortlaufende Arbeit, besonders wenn du die Relaxed Queue akzeptierst. Einmalige Minutenpakete passen zu sporadischer, projektgetriebener Nutzung, da sie nicht monatlich verfallen wie ein zurückgesetztes Abokontingent. Das falsche Modell zu wählen ist hier der häufigste Weg, zu viel auszugeben.
Da bereits die Nutzung eines Teils deiner gekauften Minuten die meisten Erstattungsanträge ausschließt, birgt ein großes Paket für unsichere künftige Arbeit ein reales Risiko. Kaufe gegen zugesagte Projekte, und prüfe vor dem Aktivieren, ob die automatische Aufladung, die das gewählte Paket kauft, sobald dein Guthaben unter 150 Minuten fällt, wirklich zu dir passt.
Die Unterschiede betreffen nicht nur das Volumen. VST-Plugin, lokale Lyra-Verarbeitung und API-Zugang sind unter den Abos Pro-exklusiv. Ist eines davon dein eigentlicher Abschlussgrund, genügt Lite nicht, gleich wie viele Minuten es bietet.
Trennmodelle verbessern sich — sieben Generationen in sieben Jahren ist das belegte Tempo. Heute extrahierte Stems lassen sich in einem Jahr womöglich in höherer Qualität neu erzeugen, aber nur, wenn du die Originaldatei behalten hast.
Die Bedingungen sind eindeutig: Du bist allein verantwortlich für die Nutzung und Verbreitung hochgeladener und daraus entstandener Audiodateien. Einen kommerziellen Track zu trennen begründet kein Nutzungsrecht daran. Das betrifft vor allem alle, die Remixe oder Coverversionen kommerziell veröffentlichen: Das Werkzeug erzeugt die Stems, es klärt nicht die Rechte.
Wenn du Voice Cloner oder Voice Changer in veröffentlichten Arbeiten einsetzt, beachte die in den Bedingungen genannten Offenlegungspflichten für synthetische Inhalte nach dem EU-KI-Gesetz. Für europäisches Publikum ist das eine geltende Compliance-Anforderung, keine theoretische.
Produzierende und Mischende, die Stems aus fertigen Mastern brauchen. Die Granularität nach Instrumenten und die VST-Integration machen es zum praktikabelsten Musikproduktions-Tool, wenn keine Mehrspuraufnahme existiert.
Podcast- und Sprachcontent-Schnitt. Voice Cleaner und Hallentfernung adressieren genau die häufigsten Nachbearbeitungsprobleme bei Sprachaufnahmen und sind nicht auf Musikmaterial beschränkt.
Lokalisierungs- und Synchronisationsteams. Direkter Videoeingang plus skalierbare API entspricht exakt diesem Arbeitsablauf, und bestehende Firmenkunden sind in diesem Feld tätig.
Nutzende, die Verarbeitung auf dem eigenen Gerät brauchen. Für alle, denen vertraglich untersagt ist, Kundenmaterial in einen Clouddienst zu laden, ist Lyras lokaler Modus ein echtes Unterscheidungsmerkmal.
Nicht englischsprachige Nutzende. Der Store-Eintrag der mobilen App nennt 18 Oberflächensprachen, eine deutlich bessere Lokalisierung als bei den meisten Werkzeugen dieser Kategorie.
Alle, die perfekte Trennung erwarten. Bewertungen berichten durchgängig von Klangartefakten, roboterhaft klingenden Gesangs-Stems und verbleibenden Geräuschen in bearbeiteten Spuren. Die Technik ist gut, aber nicht fehlerfrei, und dichte oder stark bearbeitete Mischungen bleiben schwierig.
Nutzende, die Übungsfunktionen wollen. Wenn du Tempoänderung, Transponierung oder Akkorderkennung zusätzlich zur Trennung brauchst, ist Moises darum herum gebaut und dieses Produkt nicht.
Alle, die womöglich eine Erstattung brauchen. Alle gezahlten Beträge sind grundsätzlich nicht erstattungsfähig, einschließlich verbleibender Kontoguthaben und im Voraus gezahlter Gebühren. Wer flexible Erstattungsbedingungen schätzt, sollte das sorgfältig abwägen.
Alle, die mit der kostenlosen Stufe fertige Arbeiten erstellen wollen. Die kostenlose Stufe erzeugt nur Vorschauen und erlaubt kein Herunterladen fertiger Stems: ein Bewertungswerkzeug, kein nutzbarer Gratisdienst.
Teams mit zertifizierten Compliance-Anforderungen. Die Unternehmensseite behauptet vollständigen Datenschutz und Sicherheit, nennt jedoch keine SOC-2- oder ISO-Zertifizierung; Organisationen mit formalen Prüfanforderungen müssen also direkt nachfragen.
Die Abdeckung ist hier ungewöhnlich breit. Neben der Webanwendung gibt es Desktop-Versionen für Windows, macOS und Linux, Apps auf beiden Mobilplattformen und ein VST-Plugin für die DAW-Integration. Die Desktop-Installer lassen sich direkt von der Website herunterladen.
Unter iOS erreicht die App 4,38 von 5 bei 604 Bewertungen, trägt die Freigabe 4+ und erfordert iOS 15.0. Veröffentlicht wurde sie von der Omnisale GmbH im Juni 2023, sie wird weiterhin aktiv gepflegt und wurde im August 2026 aktualisiert. Bemerkenswert: Der Store-Eintrag nennt 18 Oberflächensprachen, darunter Chinesisch, Japanisch, Koreanisch, Französisch, Deutsch, Russisch, Spanisch und Portugiesisch.
Unter Android zeigt Google Play 4,0 Sterne bei rund 2.670 Bewertungen und mehr als 500.000 Downloads, Freigabe Everyone, aktualisiert im August 2026. Die drei Bewertungsquellen zusammen ergeben ein aufschlussreiches Gefälle statt einer einzelnen Zahl: Trustpilot 4,3 bei 4.194 Bewertungen, iOS 4,38 bei 604 und Google Play 4,0 bei 2.670. Android schneidet am schwächsten ab, was zu wissen lohnt, wenn das deine Hauptplattform ist.
Ein Versionsdetail sei erwähnt: Der Desktop-Installer trägt Version 2.18.0, der iOS-Build 2.17.0. Die Funktionsgleichheit zwischen den Plattformen ist nicht exakt, und die lokale Lyra-Verarbeitung bleibt insbesondere auf Desktop und VST beschränkt.
Das ist der am häufigsten missverstandene Aspekt des Produkts, deshalb sei es klar gesagt: LALAL.AI verkauft sowohl Abonnements als auch einmalige Minutenpakete, und beides ist aktiv. Was günstiger ist, hängt vollständig von deinem Nutzungsmuster ab.
Starter ist kostenlos, Lite kostet 7,50 $ pro Monat, jährlich mit 90 $ abgerechnet, und Pro 15 $ pro Monat, jährlich mit 180 $. Die Website bewirbt die Jahresvariante als Ersparnis von drei Monaten gegenüber der Monatszahlung.
Die Kontingente laufen über das Warteschlangensystem: unbegrenzte Minuten in der Relaxed Queue, Fast Queue begrenzt auf 90 Minuten monatlich bei Lite und 250 bei Pro. Die kostenlose Starter-Stufe erhält insgesamt 10 Minuten und überhaupt keinen Zugang zur Fast Queue.
Unter dem Reiter Top-Ups liegen Pakete, die nicht monatlich verfallen: Master mit 750 Minuten, Premium mit 3.000 Minuten für 190 $ und Enterprise mit 5.000 Minuten für 300 $. Master war zum Redaktionszeitpunkt mit 50 $ statt 100 $ ausgezeichnet — ein Aktionspreis, der nicht bestehen bleiben muss.
Alle drei Pakete enthalten API-Zugang, Stapel-Upload, Stem-Download, die schnelle Verarbeitungswarteschlange und ein Upload-Limit von 2 GB. Damit sind die Pakete für alle mit stoßweisem statt kontinuierlichem Volumen der günstigere Weg zur API als ein Pro-Abo.
Eine Option zur automatischen Aufladung kauft das gewählte Paket, sobald dein Guthaben unter 150 Minuten fällt. Reichen die Mittel nicht, verschickt das Unternehmen eine E-Mail und deaktiviert die Funktion, statt es erneut zu versuchen.
Die Stufenunterschiede reichen über das Volumen hinaus, und für viele entscheiden gerade sie. VST-Plugin, lokale Lyra-Verarbeitung und API-Zugang sind unter den Abos Pro-exklusiv. Ergebnis-Downloads und Stapelverarbeitung erfordern irgendeine bezahlte Stufe. Die Upload-Grenzen liegen bei 200 MB pro Datei in der kostenlosen Stufe gegenüber 2 GB bei Lite und Pro und steigen in Unternehmensvereinbarungen auf 10 GB.
Vor dem Kauf zu lesen. Alle gezahlten Beträge sind grundsätzlich nicht erstattungsfähig, einschließlich verbleibender Kontoguthaben und im Voraus gezahlter Gebühren. Erstattungen liegen im Ermessen und beschränken sich auf nach 30 Tagen ungelöste technische Störungen, versehentliche Doppelkäufe ohne verbrauchte Guthaben und Fehler bei der Zahlungsabwicklung.
Entscheidend: Bereits die Nutzung eines Teils deiner gekauften Minuten schließt die meisten Erstattungsanträge aus. Das gesetzliche Widerrufsrecht verlangt eine Kontaktaufnahme binnen 14 Tagen und vor Aktivierung des Plans — EU-Verbraucherinnen und -Verbraucher, die ihr Widerrufsrecht wahren wollen, dürfen den Dienst also nicht vorher nutzen. Bei Abos wird die Kündigung zum Ende des laufenden Abrechnungszeitraums wirksam, ohne Erstattung ungenutzter im Voraus bezahlter Minuten.
Moises ist der nächste Wettbewerber und die bessere Wahl für übende Musizierende, da es rund um seine Trennengine Tempo- und Tonhöhensteuerung, Akkorderkennung und ein Metronom bündelt. LALAL.AI ist enger gefasst und stärker auf die Trenntreue selbst konzentriert.
Ultimate Vocal Remover (UVR) ist kostenlos, quelloffen und läuft lokal ohne Upload, was es für vertrauliches Material und für Nutzende mit leistungsfähiger Hardware attraktiv macht. Der Preis dafür sind komplexe Einrichtung, manuelle Modellauswahl und fehlender Support — während LALAL.AI genau Bequemlichkeit und Beständigkeit in Rechnung stellt.
RipX DeepAudio geht weiter und erlaubt die Bearbeitung einzelner Noten innerhalb eines getrennten Stems. Es ist ein schwereres, teureres Werkzeug für detaillierte Audioreparatur statt für schnelles Extrahieren von Stems.
Audioshake richtet sich mit Unternehmensfokus an Rechteinhaber und Labels und lässt sich eher mit der Unternehmensstufe von LALAL.AI vergleichen als mit dessen Endkundentarifen.
Demucs, Metas quelloffenes Trennmodell, bildet die Grundlage etlicher kostenloser Werkzeuge und ist als technische Basislinie bekannt, auf der viele Dienste aufsetzen oder gegen die sie sich messen. Es selbst zu betreiben tauscht Geld gegen Einrichtungsaufwand.
Die durchgängigste Kritik auf breiter Bewertungsbasis betrifft die Ausgabequalität bei schwierigem Material: Klangartefakte, roboterhaft klingende Gesangs-Stems und verbleibende Geräusche in bearbeiteten Spuren. Konkrete Nutzerberichte ergänzen Details: Vor allem der Bass wird nicht immer sauber getrennt, und die Reihenfolge der Trennung beeinflusst das Ergebnis. Das sind inhärente Grenzen der heutigen Audioquellentrennung und keine produktspezifischen Mängel, aber sie machen eine Vorschau mit eigenem Material unverzichtbar.
Bewertungen benennen auch Reibung in der Bedienung: umständliche Navigation, unzureichende Anleitungen und gelegentliche Zugriffsfehler. Ein Nutzer merkte an, schon die Download-Schaltfläche kaum gefunden zu haben.
Das ist der schärfste praktische Vorbehalt. Alle gezahlten Beträge sind grundsätzlich nicht erstattungsfähig, einschließlich verbleibender Kontoguthaben und im Voraus gezahlter Gebühren, und bereits die Nutzung eines Teils deiner gekauften Minuten schließt die meisten Anträge aus. Bei einem Produkt, bei dem Kapazität im Voraus gekauft wird, verlagert diese Kombination das Risiko auf die Käuferseite. Das 14-tägige gesetzliche Widerrufsfenster schließt sich mit der Aktivierung, nicht mit Fristablauf.
Die Bedingungen halten fest, dass du allein für die Nutzung und Verbreitung hochgeladener und daraus entstandener Audiodateien verantwortlich bist. Achte auf das Fehlende: Es gibt keine positive Einräumung kommerzieller Rechte an deinen Ergebnissen, denn das Urheberrecht an der Originalaufnahme liegt in der Regel bei dessen Inhaber. Einen Track zu trennen erzeugt Stems, keine Lizenz. Wer die Ergebnisse monetarisiert, muss die Rechte anderweitig geklärt haben.
Beim Einsatz von Voice Cloning oder Stimmveränderung verweisen die Bedingungen auf Offenlegungspflichten für synthetische Inhalte nach dem EU-KI-Gesetz. Weder der Einwilligungsprozess beim Cloning noch ein Missbrauchsschutz sind öffentlich dokumentiert, und weder eine Mindestlänge der Stimmprobe noch eine Prüfung der Stimmberechtigung wird beschrieben.
Das Positive ist wirklich bemerkenswert: Die Richtlinie erklärt, der Dienst nutze Nutzerdateien nicht für das Training künstlicher Intelligenz und teile urheberrechtlich geschütztes Material sowie andere hochgeladene Mediendateien nicht mit Dritten. Beides sind positive Zusagen, die zweite ist in diesem Markt ungewöhnlich.
Die Lücken sind ebenso real. Es gibt weder eine konkrete Aufbewahrungsdauer noch eine Löschfrist für hochgeladene Audiodateien — nur einen Verweis auf eine gesetzliche Aufbewahrungsfrist — und kein genannter Auftragsverarbeiter für die Audioinfrastruktur. Die DSGVO-Rechte einschließlich Löschung ohne unangemessene Verzögerung sind vollständig dargelegt, passend zum schweizerisch-europäischen Kontext. Für Material, das den eigenen Bereich wirklich nicht verlassen darf, hält Lyra die Trennung auf deinem eigenen Rechner, was bei unveröffentlichtem oder vertraulichem Material zählt und die Frage von vornherein umgeht.
Die Bedingungen nennen kein anwendbares Recht, während der Urheberrechtsbeauftragte in Florida und der Betreiber in der Schweiz sitzt. Diese Aufteilung wird nicht erläutert, sodass der Streitbeilegungsort offenbleibt.
Die Bedingungen verlangen lediglich, dass du das gesetzliche Alter für einen bindenden Vertrag hast, ohne einen Prüfmechanismus zu beschreiben. Die Store-Freigaben sind mit 4+ bei iOS und Everyone bei Google Play großzügig. Da Voice Cloning angeboten wird, ist das vollständige Fehlen einer Alters- oder Identitätsprüfung erwähnenswert, auch wenn die Inhalte selbst harmlos sind.
Einiges ist schlicht nicht veröffentlicht und wird hier daher nicht bewertet: API-Preise, Ratenbegrenzungen und Kontingente, die Aufbewahrungsdauer von Audio, die Anforderungen und Schutzmechanismen beim Voice Cloning sowie jede Sicherheitszertifizierung durch Dritte. Wo das Unternehmen nichts veröffentlicht hat, sagt dieser Artikel das, statt zu schätzen.
Für dieses Produkt fand sich keine unabhängige Berichterstattung der Techpresse. Der beanspruchte Webby People's Voice ließ sich in der offiziellen Gewinnerdatenbank nicht bestätigen, und die externe Berichterstattung geht auf Pressemitteilungsverbreitung zurück. Die starken Belege sind hier Nutzerbewertungen im großen Maßstab und eine überprüfbare Entwicklungshistorie — keine mediale Bestätigung.
Es gibt eine kostenlose Starter-Stufe mit 10 Minuten und 200 MB pro Datei, doch sie ist eher ein Bewertungswerkzeug als ein nutzbarer Gratisdienst: Die kostenlose Stufe erzeugt nur Vorschauen und erlaubt kein Herunterladen fertiger Stems, Stapelverarbeitung fehlt ebenfalls. Du kannst die Trennqualität an eigenem Material kostenlos beurteilen, was wirklich nützlich ist, aber ohne Zahlung nimmst du kein fertiges Ergebnis mit.
Zwei Modelle laufen parallel. Abos: Starter kostenlos, Lite 7,50 $ monatlich bei jährlicher Abrechnung von 90 $, Pro 15 $ monatlich bei 180 $ jährlich, wobei die Jahreszahlung als Ersparnis von drei Monaten beworben wird. Einmalpakete: Master mit 750 Minuten, Premium mit 3.000 Minuten für 190 $, Enterprise mit 5.000 Minuten für 300 $. Pakete passen zu sporadischer Nutzung, da sie nicht monatlich zurückgesetzt werden; Abos passen zu stetiger Nutzung, besonders wenn du die Relaxed Queue akzeptierst.
Es bezieht sich nur auf die Relaxed Queue. Bezahlte Abos bieten unbegrenzte Minuten in der Relaxed Queue, während die Fast Queue bei Lite auf 90 Minuten monatlich und bei Pro auf 250 begrenzt ist. Das Volumen ist bei bezahlten Plänen also wirklich unbegrenzt, gemessen wird die bevorzugte Verarbeitung. Ist deine Arbeit nicht zeitkritisch, ist Lite deutlich mehr wert, als die genannte Minutenzahl vermuten lässt.
Bis zu zehn Stems: Gesang, Instrumental, Schlagzeug, Bass, Gitarren, Klavier, Synthesizer, Streicher und Bläser, wobei Gitarren weiter in akustisch und elektrisch aufteilbar sind. Zusätzlich gibt es einen Lead/Back Splitter zur Trennung von Lead- und Backgroundgesang. Die verfügbaren Stem-Typen sind über die Zeit gewachsen, daher ist das Änderungsprotokoll maßgeblich dafür, was eine bestimmte Engine aktuell unterstützt.
Das Werkzeug kann keine Rechte einräumen, die es nicht besitzt. Die Bedingungen stellen fest, dass du allein für die Nutzung und Verbreitung hochgeladener und entstandener Audiodateien verantwortlich bist, und eine positive kommerzielle Einräumung fehlt, weil das Urheberrecht an der Originalaufnahme bei dessen Inhaber liegt. Hast du deine eigene Aufnahme getrennt, gelten deine bestehenden Rechte. War es das Werk eines Dritten, brauchst du dessen Erlaubnis, unabhängig davon, was dieses Werkzeug erzeugt hat.
Nein. Die Datenschutzrichtlinie erklärt, der Dienst nutze Nutzerdateien nicht für das Training künstlicher Intelligenz und teile urheberrechtlich geschütztes Material sowie andere hochgeladene Mediendateien nicht mit Dritten. Nicht angegeben ist eine konkrete Aufbewahrungsdauer oder Löschfrist. Für Material, das deinen Rechner gar nicht verlassen darf, verarbeitet der Lyra-Modus der Pro-Stufe lokal ohne Upload.
In der Regel nicht. Alle gezahlten Beträge sind grundsätzlich nicht erstattungsfähig, einschließlich verbleibender Kontoguthaben und im Voraus gezahlter Gebühren, und bereits die Nutzung eines Teils deiner gekauften Minuten schließt die meisten Anträge aus. Erstattungen liegen im Ermessen und beschränken sich auf nach 30 Tagen ungelöste technische Störungen, Doppelkäufe mit unbenutzten Guthaben und Zahlungsfehler. Der gesetzliche EU-Widerruf verlangt Kontakt binnen 14 Tagen und vor Aktivierung. Nutze die kostenlosen Vorschauen zur Bewertung vor dem Kauf.
Im Web, dazu Desktop-Versionen für Windows, macOS und Linux, Apps auf beiden Mobilplattformen und ein VST-Plugin. Die iOS-App erreicht 4,38 von 5 bei 604 Bewertungen, ist ab 4 Jahren freigegeben, erfordert iOS 15.0 und bietet 18 Oberflächensprachen. Google Play zeigt 4,0 Sterne bei rund 2.670 Bewertungen und über 500.000 Downloads. Die lokale Lyra-Verarbeitung ist auf Desktop und VST beschränkt.
Besser als die meisten, aber nicht fehlerfrei. Die große Bewertungsbasis ist positiv — 4,3 von 5 bei 4.194 Bewertungen, mit 68 Prozent Fünf-Sterne- und 7 Prozent Ein-Stern-Wertungen — doch die wiederkehrende Kritik ist konkret und glaubwürdig: Klangartefakte, roboterhafte Gesangs-Stems und verbleibende Geräusche, wobei die Basstrennung ausdrücklich als unbeständig genannt wird. Die Qualität hängt stark vom Ausgangsmaterial ab, teste also über die kostenlose Vorschau einen schwierigen statt einen sauberen Track.
Ja, eine REST-API mit OpenAPI-Spezifikation und offiziellem Beispiel-Repository, die Trennung, Stimmbereinigung, Cloning und Rauschentfernung abdeckt. Der Zugang ist unter den Abos Pro-exklusiv, in allen drei einmaligen Minutenpaketen aber enthalten; für zeitweise programmatische Nutzung können Pakete daher günstiger sein. Zu beachten ist, dass API-Preise, Ratenbegrenzungen und Kontingente nicht öffentlich sind.