Já usou esta ferramenta? Avalie-a
Já usou esta ferramenta? Avalie-a
WaveSpeedAI é uma API de inferência de IA hospedada e um hub de modelos que vende acesso a modelos generativos por requisição. A empresa descreve a plataforma como oferecendo mais de 1.000 modelos de geração de imagem, vídeo, áudio e 3D, além de mais de 290 LLMs, divididos entre uma API de inferência de mídia e uma API LLM compatível com OpenAI separada.
Segundo a empresa, a WaveSpeedAI foi fundada em 2025 pelo CEO Zeyi Cheng e tem sede em Singapura. Os Termos de Serviço citam duas entidades contratantes: WaveSpeedAI PTE. LTD., constituída em Singapura, e WaveSpeedAI LIMITED, constituída em Hong Kong.
A proposta é a consolidação: um formato de endpoint, uma chave e um saldo pré-pago em vez de contas separadas com cada dono de modelo. Como a WaveSpeedAI é uma camada de serviço, qualidade da saída, regras de conteúdo e termos de uso comercial ainda dependem do modelo específico chamado, e a vazão depende do nível da conta, não de um plano mensal.
A API de mídia é baseada em tarefas. Por padrão, a WaveSpeedAI usa o modo assíncrono: um envio retorna um ID de tarefa, e sua aplicação depois consulta o endpoint de resultado ou recebe um webhook. Esse desenho serve a uma API de geração de vídeo com IA, em que jobs longos de vídeo podem durar mais que uma requisição HTTP.
enable_sync_mode aguarda o resultado, mas a API pode retornar uma resposta de timeout enquanto a tarefa continua rodando; a opção é exclusiva da API e só é suportada por alguns modelos.A parte de LLM roda em uma URL base separada. O serviço expõe endpoints Chat Completions e Responses compatíveis com OpenAI, além de um endpoint Messages compatível com Anthropic. Uma chave de API da WaveSpeedAI cobre todos os provedores de LLM listados, e trocar de modelo significa mudar o valor de model.
O treinamento LoRA permite ajustar modelos compatíveis com suas próprias imagens para obter estilos personalizados ou personagens consistentes. O guia recomenda um conjunto de dados de 10-20 imagens variadas. As estimativas típicas são de cerca de 8 minutos para 1000 passos e cerca de 25 minutos para 3000 passos; timeout ou erro de sistema durante o treinamento é reembolsado automaticamente.
O modo assíncrono é recomendado para integrações em produção, tarefas longas, geração de vídeo, redes instáveis e fluxos que precisam recuperar resultados de forma confiável. O modo síncrono não pode ser combinado com webhook na mesma requisição.
A CLI faz login pelo navegador ou, em máquinas sem interface gráfica, com uma chave de API. A ordem de trabalho documentada é models, schema, price, run e depois download ou history, o que coloca uma cotação de preço antes de cada execução paga.
Estes cenários vêm da própria documentação da WaveSpeedAI e mostram uso pretendido, não resultados verificados.
É menos indicado para pessoas físicas que querem faturamento mensal: usuários individuais sem produto ou projeto não conseguem linhas de crédito mensais e precisam pagar antecipadamente.
A WaveSpeedAI cobra por uso, sem mensalidade nem compromisso: você recarrega créditos e cada execução é cobrada pela tarifa daquele modelo. Contas novas elegíveis recebem $1 em créditos grátis sem cartão de crédito, embora alguns modelos premium possam não estar disponíveis com créditos de teste.
Os preços iniciais e unidades abaixo vêm da página de preços capturada em 28 de setembro de 2026; "Saída por $1" é o número da própria página.
| Modelo de imagem | Preço inicial | Saída por $1 |
|---|---|---|
| Seedream 5.0 Pro | $0.045/imagem | 22 imagens |
| Nano Banana Pro | $0.14/imagem | 7 imagens |
| GPT Image 2.5 | $0.01/imagem | 100 imagens |
| Z-Image Turbo | $0.005/imagem | 200 imagens |
| Modelo de vídeo | Preço inicial | Saída por $1 |
|---|---|---|
| Seedance 2.5 | $0.18/segundo | 5,5 segundos |
| Wan 3.0 | $0.05/segundo | 20 segundos |
| Veo 3.1 Fast | $0.10/segundo | 10 segundos |
| InfiniteTalk | $0.03/segundo | 33,3 segundos |
Preços iniciais são preços de tabela na menor resolução ou qualidade. O custo real depende de resolução, duração e outros parâmetros, e descontos podem se aplicar; o preço exato de um job aparece na página do modelo ou é retornado pela API de preços.
| LLM | Janela de contexto | Entrada por 1M tokens | Saída por 1M tokens |
|---|---|---|---|
| Claude Opus 5.5 | 1M | $4 | $20 |
| Gemini 3.8 Flash | 1M | $1.5 | $7.5 |
| GPT-6 Luna | 1.05M | $0.1 | $0.5 |
| DeepSeek V4.1 Flash | 1M | $0.15 | $0.6 |
Alguns LLMs têm preços escalonados, preços de cache ou outras regras de cobrança além dessas tarifas base. Para modelos de código aberto, a WaveSpeedAI diz que seus preços são iguais aos dos provedores originais.
| Nível | Predições/min | Concorrência máx. | Como é alcançado |
|---|---|---|---|
| Bronze | 5 | 2 | Padrão para novos usuários |
| Silver | 500 | 300 | Qualquer recarga única bem-sucedida abaixo de $1,000 |
| Gold | 3.000 | 3.000 | Uma recarga única de $1,000–$4,999 |
| Ultra | 5.000 | 10.000 | Uma recarga única de $5,000 ou mais |
Os upgrades se baseiam no valor de uma recarga única e só vão para cima.
Um diretório de alternativas de software lista fal, Replicate.com e KLING AI como principais concorrentes da WaveSpeedAI. Os modelos de vídeo da KLING AI estão hospedados na própria WaveSpeedAI, então as comparações mais próximas são fal e Replicate.
Sim, com limites. Contas novas elegíveis recebem $1 em crédito de teste sem cartão de crédito, mas alguns modelos premium ficam de fora, e cadastrar um novo e-mail não garante elegibilidade.
Não. A Política de Uso Aceitável proíbe conteúdo pornográfico e sexualmente explícito, o Safety Checker da web vem ativado por padrão e as mesmas regras valem para o uso da API.
Contas novas começam no Bronze, que permite 5 predições por minuto e 2 tarefas simultâneas; qualquer recarga única bem-sucedida leva uma conta sem restrições pelo menos ao Silver.