Vast.ai는 컴퓨팅 자원이 필요한 사람과 하드웨어를 빌려주는 호스트를 연결하는 GPU 임대 마켓플레이스입니다. 회사는 이 서비스를 컴퓨팅 집약적 워크로드의 가격을 낮추는 데 초점을 둔 클라우드 컴퓨팅·매칭·집계 서비스라고 설명합니다.
구조는 양면 시장입니다. 호스트는 Vast.ai의 관리 소프트웨어를 실행해 머신을 등록하고 가격을 직접 정합니다. 임차인은 오퍼를 검색해 머신을 빌린 뒤 몇 번의 클릭으로 명령을 실행하거나 SSH 세션을 엽니다. 임차인 쪽 GPU Cloud 제품은 40개 이상의 데이터센터와 20,000개 이상의 GPU에 걸친 온디맨드 인스턴스를 제공하며, CLI, SDK 또는 API로 배포할 수 있습니다. 회사는 AI 에이전트가 스스로 컴퓨팅을 조달하는 데 쓸 수 있는 인프라라고도 내세우며, API 네이티브 프로비저닝, 실시간 가격, 초 단위 과금을 제공합니다.
처음 빌리는 사람에게 가장 중요한 사실은 구조에 있습니다. Vast.ai는 자신이 마켓플레이스일 뿐이며 하드웨어를 관리하거나 제공하지 않는다고 밝힙니다. 따라서 가격, 가동 시간, 보안, 네트워크 품질은 어떤 호스트를 고르느냐에 달려 있습니다.
Jake Cannell과 Christian Horne은 2016년 6월 28일 Vast.ai를 델라웨어주 C 코퍼레이션으로 설립했습니다.
| 임대 유형 | 우선순위 | 가격 책정 방식 |
|---|---|---|
| 온디맨드 | 높음 | 호스트가 정한 고정 가격, 자원 보장 |
| 예약 | 높음 | 온디맨드 임대를 선불 결제로 할인 요금으로 전환 |
| 중단 가능 | 낮음 | 최저 비용, 입찰 기반, 일시 중지될 수 있음 |
중단 가능 인스턴스는 더 높은 입찰에 밀리거나 누군가 해당 머신을 온디맨드로 요청하면 일시 중지될 수 있습니다. 일시 중지 중에도 데이터는 보존되지만, 우선순위를 되찾아 자동으로 재개될 때까지 인스턴스는 작동하지 않습니다. 한 번 빌린 인스턴스는 유형을 바꿀 수 없으며, 허용되는 유일한 전환은 할인을 위해 온디맨드를 예약으로 바꾸는 것입니다.
모든 오퍼 카드에는 품질 신호도 표시됩니다. 신뢰도 점수는 머신의 과거 가동 시간과 상태를 측정하며, 모든 머신은 60%에서 시작합니다. DLPerf는 일반적인 딥러닝 작업의 성능을 추정하는 Vast.ai 자체 점수 함수입니다. 오퍼 카드에는 사양, 가격, 최대 임대 기간도 나오며, 임대하면 해당 오퍼의 현재 조건에 따라 호스트와 계약이 맺어집니다.
인스턴스는 템플릿에서 시작합니다. 사전 구성된 환경에는 PyTorch, TensorFlow, ComfyUI가 있고, 사용자 지정 템플릿도 만들 수 있습니다.
Vast.ai는 Docker 컨테이너 외에, init 관리자, 중첩 컨테이너화 또는 프로세스 추적이 필요한 워크로드를 위해 완전한 가상 머신도 제공합니다. 대가는 구체적입니다. 생성과 부팅이 더 느리고, 디스크 오버헤드가 더 크며, 사용 가능한 머신과 사전 구성 템플릿이 더 적고, 실행 모드는 SSH뿐입니다.
Serverless는 모델을 엔드포인트로 배포하고 GPU 유형별로 자동 벤치마크를 수행하며, 0까지 자동 축소할 수 있습니다. 일반 GPU 인스턴스와 같은 가격으로 초 단위 과금됩니다. Clusters는 InfiniBand 네트워킹을 갖춘 전용 멀티노드 GPU 클러스터로, 대규모 학습을 겨냥합니다.
예약 인스턴스는 직접 빌릴 수 없습니다. 먼저 온디맨드로 빌린 다음, 인스턴스 카드의 할인 배지에서 전환하고 선불 기간을 선택합니다.
문서는 임대 유형마다 맞는 워크로드를 연결합니다.
홈페이지는 이 플랫폼이 학습부터 추론까지, 파인튜닝부터 렌더링까지 모두 다룬다고 소개합니다.
벤더가 공개한 두 사례는 Vast.ai가 노리는 구매자 유형을 보여 줍니다. AI 앱 회사 Creatix Technology는 일일 사용자 20만 명 규모로 성장하면서 인프라 비용을 60% 넘게 줄였다고 합니다. 글로벌 종양학 데이터 플랫폼 PAICON은 이 GPU 클라우드로 Athena 모델을 반복 개선하면서 연구 단계 학습 비용을 크게 낮췄습니다.
잘 맞는 경우:
덜 맞는 경우:
페이지 간 설명이 완전히 일치하지는 않습니다. 일반 FAQ는 Vast.ai가 Linux Docker 인스턴스만 제공하고 원격 데스크톱 인터페이스는 없다고 하지만, VM 가이드는 완전한 Linux VM을 설명하고 그래픽 환경을 갖춘 Ubuntu 데스크톱이라고 소개된 템플릿을 나열합니다. 두 페이지 모두 플랫폼이 Linux 전용이라는 점에는 일치합니다.
Vast.ai 가격은 고정 요금표가 아닙니다. 플랫폼은 호스트가 가격을 직접 정하는 마켓플레이스 모델을 쓰므로 요금은 호스트마다 다르고 수요에 따라 움직입니다. 모든 임대 청구서는 세 가지 요금으로 구성됩니다.
| 요금 | 단위 | 부과 시점 |
|---|---|---|
| GPU(활성 임대) | $/시간, 초 단위 과금 | 인스턴스가 활성 또는 연결 상태인 매초 |
| 스토리지 | $/GB/시간 | 인스턴스가 존재하고 온라인인 매초, 중지 상태 포함 |
| 대역폭 | $/TB | 송수신하는 모든 바이트, 인스턴스 상태와 무관 |
대역폭은 과소평가하기 쉽습니다. 업로드·다운로드 비용은 일정 요금이 아니라 사용량에 따라 부과되므로 $/시간이나 $/일 내역에 표시되지 않습니다.
계정은 선불 크레딧으로 운영되며, Stripe를 통한 카드 결제나 BitPay와 Crypto.com을 통한 암호화폐 결제로 충전합니다. 최소 입금액은 $5입니다. Autobilling(자동 결제)은 잔액이 부족해지면 저장된 신용카드로 잔액을 충전할 수 있습니다. 마켓플레이스 요금의 참고 기준으로, 2026년 10월 4일 확인 당시 GPU Cloud 페이지는 H100을 시간당 최저 $0.90에 이용할 수 있다고 광고했습니다.
결제 페이지와 이용약관은 환불을 세 가지 다른 방식으로 설명하며, 어느 쪽도 사용한 크레딧은 환불하지 않습니다.
마켓플레이스 가격은 임차인과 무관한 이유로도 움직일 수 있습니다. 2026년 6월 한 IT 매체는 연구 프리프린트를 다룬 보도에서 Vast.ai의 저가 GPU 임대 가격이 약 38% 뛴 원인을 한 암호화폐 채굴 네트워크의 수요로 돌렸으며, 이용률은 57%에서 94%로 올랐습니다.
흔히 비교되는 대상은 하이퍼스케일 클라우드입니다. Vast.ai의 GPU Cloud 페이지는 AWS, Azure 또는 GCP 대비 최대 80% 절약을 주장하고, 일반 FAQ는 비용 절감 폭을 약 3~5배로 제시합니다. 둘 다 벤더의 주장입니다.
GPU 특화 클라우드 중에서는 Runpod가 구조적으로 가장 가깝습니다. Runpod의 Pod 문서는 Secure Cloud 옵션과 Community Cloud 옵션을 비교합니다. Runpod는 Community Cloud에 더 이상 새 호스트를 받지 않지만, 기존 Community Cloud 자원은 계속 이용할 수 있다고도 밝힙니다. Salad는 소비자용 하드웨어 쪽으로 한발 더 나아갑니다. Salad의 Community Cloud는 유휴 소비자용 GPU로 이뤄진 분산형 풀로, 190개 이상 국가에 걸친 용량을 갖추고 있습니다.
사용자 피드백은 양쪽으로 갈립니다. 2026년 10월 4일 확인 당시 한 서드파티 리뷰 플랫폼은 리뷰 257건에 평점 3.9를 표시했고, 별 5개가 78%, 별 1개가 15%였습니다. 이 플랫폼이 리뷰 82건을 AI로 요약한 내용에는 지원과 가격에 대한 칭찬과 함께, 간헐적인 성능 저하, 예상치 못한 인터넷 대역폭 요금, 기술 문제 발생 시 느린 응답에 대한 불만이 담겨 있습니다.
아니요. Vast.ai는 인스턴스가 "Loading"으로 표시되는 동안에는 요금이 없으며, 활성 상태가 되면 GPU 요금이 시작된다고 말합니다.
아니요. 초 단위 과금이므로 10분 후 서버를 삭제하면 10분 사용분과 사용한 대역폭 요금이 부과됩니다.
아니요. Vast.ai는 계정에 표시되는 인스턴스는 잔액이 음수이거나 0이어도 절대 무료가 아니라고 밝힙니다. 인스턴스를 삭제할 때까지 스토리지 요금이 계속 쌓이기 때문입니다.