WaveSpeedAIは、生成モデルへのアクセスをリクエスト単位で販売するホスト型のAI推論APIおよびモデルハブです。同社は、1,000以上の画像・動画・音声・3D生成モデルと290以上のLLMを提供し、メディア推論APIと別建てのOpenAI互換LLM APIに分かれていると説明しています。
同社によると、WaveSpeedAIは2025年にCEOのZeyi Chengが創業し、本社はシンガポールにあります。利用規約には2つの契約主体が記載されています。シンガポールで設立されたWaveSpeedAI PTE. LTD.と、香港で設立されたWaveSpeedAI LIMITEDです。
売りは集約です。モデル提供元ごとに別々のアカウントを持つ代わりに、1つのエンドポイント形式、1つのキー、1つの前払い残高で済みます。WaveSpeedAIはサービング層なので、出力品質、コンテンツルール、商用利用条件は呼び出す個々のモデルに依存し、スループットは月額プランではなくアカウントレベルで決まります。
メディアAPIはタスクベースです。WaveSpeedAIはデフォルトで非同期モードを使います。送信するとタスクIDが返り、アプリケーションは後で結果エンドポイントをポーリングするか、webhookを受け取ります。長い動画ジョブはHTTPリクエスト1回の時間を超えることがあるため、AI動画生成APIに適した設計です。
enable_sync_mode フラグは結果を待ちますが、タスクが実行中のままAPIがタイムアウトの本文を返すことがあります。このオプションはAPI専用で、一部のモデルでのみサポートされます。LLM側は別のbase URLで動いています。OpenAI互換のChat CompletionsとResponsesのエンドポイントに加え、Anthropic互換のMessagesエンドポイントを提供します。WaveSpeedAIのAPIキー1つで掲載されているすべてのLLMプロバイダーを使え、モデルの切り替えはmodelの値を変えるだけです。
LoRA学習では、対応モデルを自分の画像でファインチューニングし、パーソナライズしたスタイルや一貫したキャラクターを得られます。ガイドは多様な画像10-20枚のデータセットを推奨しています。目安は1000ステップで約8分、3000ステップで約25分で、学習中のタイムアウトやシステムエラーは自動的に返金されます。
本番環境の統合、長時間のタスク、動画生成、不安定なネットワーク、結果を確実に回収する必要があるワークフローには非同期モードが推奨されています。同期モードは同じリクエスト内でwebhookと併用できません。
CLIはブラウザ経由でサインインするか、ヘッドレスマシンではAPIキーでサインインします。ドキュメントに記された作業順はmodels、schema、price、run、その後にdownloadまたはhistoryで、有料の実行の前に毎回価格の見積もりを挟む形になります。
以下のシナリオはWaveSpeedAI自身のドキュメントによるもので、検証済みの成果ではなく想定される用途を示しています。
月次請求を望む個人にはあまり向きません。製品やプロジェクトを持たない個人ユーザーは月次のクレジットラインを得られず、前払いが必要です。
WaveSpeedAIは月額料金も契約縛りもない従量課金です。クレジットをチャージし、実行のたびにそのモデルの料金で差し引かれます。対象となる新規アカウントはクレジットカードなしで$1の無料クレジットを受け取れますが、一部のプレミアムモデルは試用クレジットでは使えない場合があります。
以下の開始価格と単位は2026年9月28日に取得した価格ページに基づき、「$1あたりの出力」はそのページ自体の数値です。
| 画像モデル | 開始価格 | $1あたりの出力 |
|---|---|---|
| Seedream 5.0 Pro | $0.045/枚 | 22枚 |
| Nano Banana Pro | $0.14/枚 | 7枚 |
| GPT Image 2.5 | $0.01/枚 | 100枚 |
| Z-Image Turbo | $0.005/枚 | 200枚 |
| 動画モデル | 開始価格 | $1あたりの出力 |
|---|---|---|
| Seedance 2.5 | $0.18/秒 | 5.5秒 |
| Wan 3.0 | $0.05/秒 | 20秒 |
| Veo 3.1 Fast | $0.10/秒 | 10秒 |
| InfiniteTalk | $0.03/秒 | 33.3秒 |
開始価格は最低解像度または最低品質での定価です。実際のコストは解像度、長さなどのパラメータで変わり、割引が適用されることもあります。個々のジョブの正確な価格はモデルページに表示されるか、料金APIが返します。
| LLM | コンテキストウィンドウ | 入力100万トークンあたり | 出力100万トークンあたり |
|---|---|---|---|
| Claude Opus 5.5 | 1M | $4 | $20 |
| Gemini 3.8 Flash | 1M | $1.5 | $7.5 |
| GPT-6 Luna | 1.05M | $0.1 | $0.5 |
| DeepSeek V4.1 Flash | 1M | $0.15 | $0.6 |
一部のLLMには、これらの基本料金以外に段階制料金、キャッシュ料金、その他の課金ルールがあります。オープンソースモデルについて、WaveSpeedAIは元の提供元と同じ価格だとしています。
| レベル | 1分あたりの予測数 | 最大同時実行数 | 到達条件 |
|---|---|---|---|
| Bronze | 5 | 2 | 新規ユーザーのデフォルト |
| Silver | 500 | 300 | $1,000未満の1回のチャージが成功 |
| Gold | 3,000 | 3,000 | 1回のチャージが$1,000–$4,999 |
| Ultra | 5,000 | 10,000 | 1回のチャージが$5,000以上 |
レベルの引き上げは1回のチャージ額に基づき、上がる方向にしか変わりません。
あるソフトウェア代替サービスのディレクトリは、fal、Replicate.com、KLING AIをWaveSpeedAIの主な競合に挙げています。KLING AIの動画モデル自体がWaveSpeedAI上でホストされているため、より近い比較対象はfalとReplicateです。
はい、ただし制限があります。対象となる新規アカウントはクレジットカードなしで$1の試用クレジットを受け取れますが、一部のプレミアムモデルは対象外で、新しいメールアドレスで登録しても対象になるとは限りません。
いいえ。利用ポリシーはポルノや性的に露骨なコンテンツを禁止しており、WebのSafety Checkerはデフォルトでオンで、API利用にも同じルールが適用されます。
新規アカウントはBronzeから始まり、1分あたり5回の予測と2つの同時タスクまでです。制限のないアカウントは、1回のチャージが1度でも成功すれば少なくともSilverに上がります。