Vous avez utilisé cet outil ? Notez-le
Vous avez utilisé cet outil ? Notez-le
WaveSpeedAI est une API d’inférence IA hébergée et un catalogue de modèles qui vend l’accès à des modèles génératifs à la requête. L’entreprise dit proposer 1 000+ modèles de génération d’images, de vidéo, d’audio et de 3D, ainsi que 290+ LLM, répartis entre une API d’inférence média et une API LLM distincte compatible OpenAI.
Selon l’entreprise, WaveSpeedAI a été fondée en 2025 par son CEO Zeyi Cheng et a son siège à Singapour. Les conditions d’utilisation nomment deux entités contractantes : WaveSpeedAI PTE. LTD., immatriculée à Singapour, et WaveSpeedAI LIMITED, immatriculée à Hong Kong.
L’argument est la consolidation : un seul format d’endpoint, une seule clé et un seul solde prépayé, au lieu de comptes séparés chez chaque éditeur de modèle. Comme WaveSpeedAI est une couche de service, la qualité des sorties, les règles de contenu et les conditions d’usage commercial dépendent toujours du modèle appelé, et le débit dépend du niveau de votre compte plutôt que d’un forfait mensuel.
L’API média fonctionne par tâches. Par défaut, WaveSpeedAI utilise le mode asynchrone : une soumission renvoie un ID de tâche, puis votre application interroge l’endpoint de résultat ou reçoit un webhook. Cette conception convient à une API de génération vidéo IA, où les longues tâches vidéo peuvent dépasser la durée d’une requête HTTP.
enable_sync_mode attend le résultat, mais l’API peut renvoyer une réponse de timeout pendant que la tâche continue ; l’option est réservée à l’API et n’est prise en charge que par certains modèles.La partie LLM utilise une URL de base distincte. Le service expose des endpoints Chat Completions et Responses compatibles OpenAI, ainsi qu’un endpoint Messages compatible Anthropic. Une seule clé API WaveSpeedAI couvre tous les fournisseurs de LLM listés, et changer de modèle revient à modifier la valeur de model.
L’entraînement LoRA permet d’affiner des modèles pris en charge sur vos propres images pour obtenir des styles personnalisés ou des personnages cohérents. Le guide recommande un jeu de données de 10-20 images variées. Estimations typiques : environ 8 minutes pour 1000 étapes et environ 25 minutes pour 3000 ; un timeout ou une erreur système pendant l’entraînement est remboursé automatiquement.
Le mode asynchrone est recommandé pour les intégrations en production, les tâches longues, la génération vidéo, les réseaux instables et les workflows qui doivent récupérer les résultats de manière fiable. Le mode synchrone ne peut pas être combiné avec un webhook dans la même requête.
La CLI se connecte via le navigateur, ou avec une clé API sur les machines sans interface graphique. L’ordre de travail documenté est models, schema, price, run, puis download ou history, ce qui place un devis de prix avant chaque exécution payante.
Ces scénarios proviennent de la documentation de WaveSpeedAI et illustrent un usage prévu, pas des résultats vérifiés.
L’outil convient moins aux particuliers qui veulent une facturation mensuelle : les utilisateurs individuels sans produit ni projet ne peuvent pas obtenir de ligne de crédit mensuelle et doivent payer d’avance.
WaveSpeedAI applique une tarification à l’usage, sans frais mensuels ni engagement : vous rechargez des crédits et chaque exécution est facturée au tarif du modèle utilisé. Les nouveaux comptes éligibles reçoivent $1 de crédits gratuits sans carte bancaire, mais certains modèles premium peuvent ne pas être accessibles avec les crédits d’essai.
Les prix de départ et unités ci-dessous proviennent de la page de tarifs telle que relevée le 28 septembre 2026 ; la colonne « Sortie pour $1 » reprend le chiffre de la page.
| Modèle d’image | Prix de départ | Sortie pour $1 |
|---|---|---|
| Seedream 5.0 Pro | $0.045/image | 22 images |
| Nano Banana Pro | $0.14/image | 7 images |
| GPT Image 2.5 | $0.01/image | 100 images |
| Z-Image Turbo | $0.005/image | 200 images |
| Modèle vidéo | Prix de départ | Sortie pour $1 |
|---|---|---|
| Seedance 2.5 | $0.18/seconde | 5,5 secondes |
| Wan 3.0 | $0.05/seconde | 20 secondes |
| Veo 3.1 Fast | $0.10/seconde | 10 secondes |
| InfiniteTalk | $0.03/seconde | 33,3 secondes |
Les prix de départ sont des prix catalogue à la résolution ou à la qualité la plus basse. Le coût réel dépend de la résolution, de la durée et d’autres paramètres, et des remises peuvent s’appliquer ; le prix exact d’une tâche est affiché sur la page du modèle ou renvoyé par l’API de tarification.
| LLM | Fenêtre de contexte | Entrée par million de tokens | Sortie par million de tokens |
|---|---|---|---|
| Claude Opus 5.5 | 1M | $4 | $20 |
| Gemini 3.8 Flash | 1M | $1.5 | $7.5 |
| GPT-6 Luna | 1.05M | $0.1 | $0.5 |
| DeepSeek V4.1 Flash | 1M | $0.15 | $0.6 |
Certains LLM appliquent une tarification par paliers, un prix pour le cache ou d’autres règles de facturation en plus de ces tarifs de base. Pour les modèles open source, WaveSpeedAI affirme s’aligner sur les prix des fournisseurs d’origine.
| Niveau | Prédictions/min | Concurrence max. | Comment l’atteindre |
|---|---|---|---|
| Bronze | 5 | 2 | Par défaut pour les nouveaux utilisateurs |
| Silver | 500 | 300 | Toute recharge unique réussie inférieure à $1,000 |
| Gold | 3 000 | 3 000 | Une recharge unique de $1,000–$4,999 |
| Ultra | 5 000 | 10 000 | Une recharge unique de $5,000 ou plus |
Les montées de niveau reposent sur le montant d’une recharge unique et ne se font que vers le haut.
Un annuaire d’alternatives logicielles cite fal, Replicate.com et KLING AI comme principaux concurrents de WaveSpeedAI. Les modèles vidéo de KLING AI sont eux-mêmes hébergés sur WaveSpeedAI ; les comparaisons les plus proches sont donc fal et Replicate.
Oui, avec des limites. Les nouveaux comptes éligibles reçoivent $1 de crédit d’essai sans carte bancaire, mais certains modèles premium sont exclus et l’inscription avec une nouvelle adresse e-mail ne garantit pas l’éligibilité.
Non. La politique d’utilisation acceptable interdit les contenus pornographiques et sexuellement explicites, le Safety Checker web est activé par défaut et les mêmes règles s’appliquent à l’usage de l’API.
Les nouveaux comptes démarrent au niveau Bronze, qui autorise 5 prédictions par minute et 2 tâches simultanées ; toute recharge unique réussie fait passer un compte sans restriction au moins au niveau Silver.