WaveSpeedAI는 생성형 모델을 요청 단위로 판매하는 호스팅형 AI 추론 API이자 모델 허브입니다. 회사는 이 플랫폼이 1,000개 이상의 이미지·영상·오디오·3D 생성 모델과 290개 이상의 LLM을 제공하며, 미디어 추론 API와 별도의 OpenAI 호환 LLM API로 나뉜다고 설명합니다.
회사에 따르면 WaveSpeedAI는 2025년 CEO Zeyi Cheng이 설립했으며 본사는 싱가포르에 있습니다. 서비스 약관은 두 계약 주체를 명시합니다. 싱가포르에서 설립된 WaveSpeedAI PTE. LTD.와 홍콩에서 설립된 WaveSpeedAI LIMITED입니다.
핵심 제안은 통합입니다. 모델 제공사마다 따로 계정을 만드는 대신 하나의 엔드포인트 형식, 하나의 키, 하나의 선불 잔액을 씁니다. WaveSpeedAI는 서빙 계층이므로 출력 품질, 콘텐츠 규칙, 상업적 이용 조건은 여전히 호출하는 개별 모델에 따라 달라지며, 처리량은 월 요금제가 아니라 계정 등급에 따라 정해집니다.
미디어 API는 작업(task) 기반입니다. WaveSpeedAI는 기본적으로 비동기 모드를 사용합니다. 요청을 제출하면 작업 ID가 반환되고, 애플리케이션은 이후 결과 엔드포인트를 폴링하거나 webhook을 받습니다. 긴 영상 작업은 HTTP 요청 하나의 시간을 넘길 수 있으므로 AI 영상 생성 API에 맞는 설계입니다.
enable_sync_mode 플래그는 결과를 기다리지만, 작업이 계속 실행되는 동안 API가 타임아웃 응답을 반환할 수 있습니다. 이 옵션은 API 전용이며 일부 모델에서만 지원됩니다.LLM 쪽은 별도의 base URL에서 운영됩니다. OpenAI 호환 Chat Completions 및 Responses 엔드포인트와 Anthropic 호환 Messages 엔드포인트를 제공합니다. WaveSpeedAI API 키 하나로 목록의 모든 LLM 제공사를 쓸 수 있고, 모델을 바꾸려면 model 값만 변경하면 됩니다.
LoRA 학습으로 지원 모델을 자신의 이미지로 미세 조정해 개인화된 스타일이나 일관된 캐릭터를 얻을 수 있습니다. 가이드는 다양한 이미지 10-20장으로 된 데이터셋을 권장합니다. 일반적인 예상 시간은 1000스텝에 약 8분, 3000스텝에 약 25분이며, 학습 중 타임아웃이나 시스템 오류가 나면 자동으로 환불됩니다.
프로덕션 통합, 오래 걸리는 작업, 영상 생성, 불안정한 네트워크, 결과를 안정적으로 복구해야 하는 워크플로에는 비동기 모드가 권장됩니다. 동기 모드는 같은 요청에서 webhook과 함께 쓸 수 없습니다.
CLI는 브라우저로 로그인하거나, 헤드리스 머신에서는 API 키로 로그인합니다. 문서에 나온 작업 순서는 models, schema, price, run, 그다음 download 또는 history이므로, 유료 실행 전마다 가격 견적을 먼저 거치게 됩니다.
아래 시나리오는 WaveSpeedAI 자체 문서에서 나온 것으로, 검증된 결과가 아니라 의도된 용도를 보여 줍니다.
월 단위 청구서를 원하는 개인에게는 덜 맞습니다. 제품이나 프로젝트가 없는 개인 사용자는 월 크레딧 한도를 받을 수 없고 선불로 결제해야 합니다.
WaveSpeedAI는 월 요금이나 약정 없는 종량제입니다. 크레딧을 충전하면 실행할 때마다 해당 모델의 요율로 차감됩니다. 자격을 갖춘 신규 계정은 신용카드 없이 $1의 무료 크레딧을 받지만, 일부 프리미엄 모델은 체험 크레딧으로 쓰지 못할 수 있습니다.
아래 시작가와 단위는 2026년 9월 28일에 수집한 가격 페이지 기준이며, '$1당 결과물'은 해당 페이지의 수치입니다.
| 이미지 모델 | 시작가 | $1당 결과물 |
|---|---|---|
| Seedream 5.0 Pro | $0.045/이미지 | 22장 |
| Nano Banana Pro | $0.14/이미지 | 7장 |
| GPT Image 2.5 | $0.01/이미지 | 100장 |
| Z-Image Turbo | $0.005/이미지 | 200장 |
| 영상 모델 | 시작가 | $1당 결과물 |
|---|---|---|
| Seedance 2.5 | $0.18/초 | 5.5초 |
| Wan 3.0 | $0.05/초 | 20초 |
| Veo 3.1 Fast | $0.10/초 | 10초 |
| InfiniteTalk | $0.03/초 | 33.3초 |
시작가는 가장 낮은 해상도나 품질 기준의 정가입니다. 실제 비용은 해상도, 길이 등 여러 파라미터에 따라 달라지고 할인이 적용될 수도 있으며, 특정 작업의 정확한 가격은 모델 페이지에 표시되거나 가격 API가 반환합니다.
| LLM | 컨텍스트 윈도 | 입력 100만 토큰당 | 출력 100만 토큰당 |
|---|---|---|---|
| Claude Opus 5.5 | 1M | $4 | $20 |
| Gemini 3.8 Flash | 1M | $1.5 | $7.5 |
| GPT-6 Luna | 1.05M | $0.1 | $0.5 |
| DeepSeek V4.1 Flash | 1M | $0.15 | $0.6 |
일부 LLM에는 이 기본 요율 외에 구간별 가격, 캐시 가격 또는 기타 과금 규칙이 있습니다. 오픈 소스 모델의 경우 WaveSpeedAI는 원 제공사와 같은 가격이라고 밝힙니다.
| 등급 | 분당 예측 수 | 최대 동시 실행 | 도달 조건 |
|---|---|---|---|
| Bronze | 5 | 2 | 신규 사용자 기본값 |
| Silver | 500 | 300 | $1,000 미만의 1회 충전 성공 |
| Gold | 3,000 | 3,000 | 1회 충전 $1,000–$4,999 |
| Ultra | 5,000 | 10,000 | 1회 충전 $5,000 이상 |
등급 상향은 1회 충전 금액을 기준으로 하며 올라가기만 합니다.
한 소프트웨어 대안 디렉터리는 fal, Replicate.com, KLING AI를 WaveSpeedAI의 주요 경쟁 서비스로 꼽습니다. KLING AI의 영상 모델 자체가 WaveSpeedAI에 호스팅되어 있으므로, 더 가까운 비교 대상은 fal과 Replicate입니다.
네, 제한이 있습니다. 자격을 갖춘 신규 계정은 신용카드 없이 $1의 체험 크레딧을 받지만 일부 프리미엄 모델은 제외되며, 새 이메일로 가입한다고 자격이 보장되지는 않습니다.
아니요. 허용 가능한 사용 정책은 음란물과 성적으로 노골적인 콘텐츠를 금지하고, 웹 Safety Checker는 기본으로 켜져 있으며, API 사용에도 같은 규칙이 적용됩니다.
신규 계정은 Bronze에서 시작하며 분당 5회 예측과 2개 동시 작업이 허용됩니다. 성공한 1회 충전이 한 번이라도 있으면 제한되지 않은 계정은 최소 Silver로 올라갑니다.