Hast du dieses Tool genutzt? Bewerte es
Hast du dieses Tool genutzt? Bewerte es
WaveSpeedAI ist eine gehostete KI-Inferenz-API und ein Modell-Hub, der Zugriff auf generative Modelle pro Anfrage verkauft. Laut Unternehmen bietet die Plattform über 1.000 Modelle für Bild-, Video-, Audio- und 3D-Generierung sowie über 290 LLMs, aufgeteilt in eine Medien-Inferenz-API und eine separate OpenAI-kompatible LLM-API.
Nach Angaben des Unternehmens wurde WaveSpeedAI 2025 von CEO Zeyi Cheng gegründet und hat seinen Hauptsitz in Singapur. Die Nutzungsbedingungen nennen zwei Vertragspartner: die in Singapur eingetragene WaveSpeedAI PTE. LTD. und die in Hongkong eingetragene WaveSpeedAI LIMITED.
Das Versprechen ist Bündelung: ein Endpunktformat, ein Schlüssel und ein Prepaid-Guthaben statt separater Konten bei jedem Modellanbieter. Da WaveSpeedAI eine Serving-Schicht ist, hängen Ausgabequalität, Inhaltsregeln und Bedingungen für kommerzielle Nutzung weiterhin vom jeweils aufgerufenen Modell ab, und der Durchsatz richtet sich nach der Kontostufe statt nach einem Monatstarif.
Die Medien-API arbeitet aufgabenbasiert. Standardmäßig nutzt WaveSpeedAI den asynchronen Modus: Eine Übermittlung liefert eine Task-ID, danach fragt Ihre Anwendung den Ergebnis-Endpunkt ab oder empfängt einen Webhook. Das passt zu einer KI-Videogenerierungs-API, bei der lange Videojobs die Dauer einer HTTP-Anfrage überschreiten können.
enable_sync_mode-Flag wartet auf das Ergebnis, doch die API kann eine Timeout-Antwort liefern, während die Aufgabe weiterläuft; die Option gibt es nur über die API und nur bei einigen Modellen.Der LLM-Teil läuft unter einer separaten Basis-URL. Der Dienst stellt OpenAI-kompatible Endpunkte für Chat Completions und Responses sowie einen Anthropic-kompatiblen Messages-Endpunkt bereit. Ein WaveSpeedAI-API-Schlüssel deckt alle gelisteten LLM-Anbieter ab; zum Modellwechsel ändern Sie nur den model-Wert.
Mit LoRA-Training verfeinern Sie unterstützte Modelle mit eigenen Bildern, um personalisierte Stile oder konsistente Figuren zu erhalten. Der Leitfaden empfiehlt einen Datensatz aus 10-20 vielfältigen Bildern. Typische Schätzungen liegen bei etwa 8 Minuten für 1000 Schritte und etwa 25 Minuten für 3000 Schritte; ein Timeout oder Systemfehler während des Trainings wird automatisch erstattet.
Der asynchrone Modus wird für Produktionsintegrationen, lang laufende Aufgaben, Videogenerierung, instabile Netzwerke und Workflows empfohlen, die Ergebnisse zuverlässig wiederherstellen müssen. Der synchrone Modus lässt sich in derselben Anfrage nicht mit einem Webhook kombinieren.
Die CLI meldet sich über den Browser an oder, auf Rechnern ohne Bildschirm, mit einem API-Schlüssel. Die dokumentierte Arbeitsreihenfolge lautet models, schema, price, run, danach download oder history – so steht vor jedem kostenpflichtigen Lauf ein Preisangebot.
Diese Szenarien stammen aus WaveSpeedAIs eigener Dokumentation und zeigen beabsichtigte Nutzung, keine verifizierten Ergebnisse.
Weniger geeignet ist es für Einzelpersonen, die monatliche Rechnungen wünschen: Einzelnutzer ohne Produkt oder Projekt erhalten keine monatlichen Kreditlinien und müssen im Voraus zahlen.
WaveSpeedAI rechnet nutzungsbasiert ab, ohne Monatsgebühren oder Bindung: Sie laden Guthaben auf, und jeder Lauf wird zum Tarif des jeweiligen Modells berechnet. Berechtigte Neukonten erhalten ohne Kreditkarte $1 Gratisguthaben, doch manche Premium-Modelle sind mit Testguthaben möglicherweise nicht nutzbar.
Die folgenden Startpreise und Einheiten stammen von der Preisseite, erfasst am 28. September 2026; „Ausgabe pro $1“ ist die Angabe der Seite selbst.
| Bildmodell | Startpreis | Ausgabe pro $1 |
|---|---|---|
| Seedream 5.0 Pro | $0.045/Bild | 22 Bilder |
| Nano Banana Pro | $0.14/Bild | 7 Bilder |
| GPT Image 2.5 | $0.01/Bild | 100 Bilder |
| Z-Image Turbo | $0.005/Bild | 200 Bilder |
| Videomodell | Startpreis | Ausgabe pro $1 |
|---|---|---|
| Seedance 2.5 | $0.18/Sekunde | 5,5 Sekunden |
| Wan 3.0 | $0.05/Sekunde | 20 Sekunden |
| Veo 3.1 Fast | $0.10/Sekunde | 10 Sekunden |
| InfiniteTalk | $0.03/Sekunde | 33,3 Sekunden |
Startpreise sind Listenpreise bei der niedrigsten Auflösung oder Qualität. Die tatsächlichen Kosten hängen von Auflösung, Dauer und weiteren Parametern ab, und Rabatte können gelten; den genauen Preis eines Jobs zeigt die Modellseite oder liefert die Preis-API.
| LLM | Kontextfenster | Eingabe pro 1 Mio. Token | Ausgabe pro 1 Mio. Token |
|---|---|---|---|
| Claude Opus 5.5 | 1M | $4 | $20 |
| Gemini 3.8 Flash | 1M | $1.5 | $7.5 |
| GPT-6 Luna | 1.05M | $0.1 | $0.5 |
| DeepSeek V4.1 Flash | 1M | $0.15 | $0.6 |
Manche LLMs haben über diese Basistarife hinaus Staffelpreise, Cache-Preise oder andere Abrechnungsregeln. Für Open-Source-Modelle gibt WaveSpeedAI an, dass seine Preise denen der ursprünglichen Anbieter entsprechen.
| Stufe | Vorhersagen/Min. | Max. Parallelität | Wie erreicht |
|---|---|---|---|
| Bronze | 5 | 2 | Standard für neue Nutzer |
| Silver | 500 | 300 | Jede erfolgreiche Einzelaufladung unter $1,000 |
| Gold | 3.000 | 3.000 | Eine Einzelaufladung von $1,000–$4,999 |
| Ultra | 5.000 | 10.000 | Eine Einzelaufladung ab $5,000 |
Hochstufungen richten sich nach dem Betrag einer Einzelaufladung und erfolgen nur nach oben.
Ein Verzeichnis für Softwarealternativen nennt fal, Replicate.com und KLING AI als wichtigste Konkurrenten von WaveSpeedAI. Die Videomodelle von KLING AI sind selbst auf WaveSpeedAI gehostet, daher sind fal und Replicate die näheren Vergleiche.
Ja, mit Einschränkungen. Berechtigte Neukonten erhalten ohne Kreditkarte $1 Testguthaben, einige Premium-Modelle sind jedoch ausgenommen, und die Registrierung mit einer neuen E-Mail-Adresse garantiert keine Berechtigung.
Nein. Die Richtlinie zur akzeptablen Nutzung verbietet pornografische und sexuell explizite Inhalte, der Safety Checker im Web ist standardmäßig aktiv, und für die API-Nutzung gelten dieselben Regeln.
Neue Konten starten bei Bronze mit 5 Vorhersagen pro Minute und 2 parallelen Aufgaben; jede erfolgreiche Einzelaufladung hebt ein nicht eingeschränktes Konto mindestens auf Silver.