Vast.ai 是一個 GPU 租賃市集,把需要算力的人與出租硬體的主機方串連起來。公司將這項服務描述為雲端運算、媒合與彙整服務,重點在於降低運算密集型工作負載的價格。
它採用雙邊模式。主機方執行 Vast.ai 的管理軟體,上架機器並自行定價;租用方搜尋報價、租下機器,接著點幾下就能執行指令或開啟 SSH 工作階段。在租用方這一側,GPU Cloud 產品提供隨需執行個體,涵蓋 40+ 座資料中心與 20,000+ 張 GPU,可透過 CLI、SDK 或 API 部署。公司也把自己定位為 AI 代理可用來自行採購算力的基礎設施,提供 API 原生的資源佈建、即時定價與按秒計費。
對第一次租用的人來說,最重要的事實在於結構:Vast.ai 表示自己只是一個市集,不管理也不提供硬體。因此價格、上線時間、安全性與網路品質,都取決於你選擇的主機。
Jake Cannell 與 Christian Horne 於 2016 年 6 月 28 日將 Vast.ai 登記為德拉瓦州 C 型公司。
| 租用類型 | 優先順序 | 計價方式 |
|---|---|---|
| 隨需 | 高 | 主機設定的固定價格,資源有保證 |
| 預留 | 高 | 由隨需租用透過預付款轉為折扣價 |
| 可中斷 | 低 | 成本最低,依出價競標,可能遭到暫停 |
可中斷執行個體在被更高出價超越,或有人以隨需方式要求該機器時,可能遭到暫停。暫停期間資料會保留,但執行個體無法運作,直到重新取得優先順序並自動恢復。執行個體一旦租下就不能更改類型;唯一允許的切換是把隨需轉為預留以取得折扣。
每張報價卡也附有品質訊號。可靠度分數衡量機器的歷史上線時間與健康狀況,每台機器起始為 60%。DLPerf 是 Vast.ai 自有的評分函式,用來估計典型深度學習任務上的效能。報價卡還會顯示規格、價格與最長租用期間;租用即依報價的現行條款與主機訂立合約。
執行個體從範本啟動。預建環境包括 PyTorch、TensorFlow 與 ComfyUI,也可以自建範本。
除了 Docker 容器,Vast.ai 也為需要 init 管理程式、巢狀容器化或程序追蹤的工作負載提供完整虛擬機器。代價很具體:建立與開機較慢、磁碟額外負擔較高、可用機器與預先設定的範本較少,而且只能以 SSH 模式啟動。
Serverless 把模型部署為端點,在不同 GPU 類型間自動進行基準測試,並可自動縮減到零。它按秒計費,價格與一般 GPU 執行個體相同。Clusters 是採用 InfiniBand 網路的專屬多節點 GPU 叢集,鎖定大規模訓練。
預留執行個體無法直接租用。必須先以隨需方式租用,再透過執行個體卡片上的折扣標章轉換,並選擇預付期間。
官方文件把每種租用類型對應到一類工作負載:
首頁將平台描述為涵蓋從訓練到推論、從微調到算圖的所有環節。
兩個由廠商發布的案例顯示了 Vast.ai 鎖定的買家類型。AI 應用程式公司 Creatix Technology 據稱已擴展到每日 20 萬名使用者,同時將基礎架構成本降低 60% 以上。全球腫瘤資料平台 PAICON 使用這個 GPU 雲端迭代其 Athena 模型,同時大幅降低研究階段的訓練成本。
適合:
較不適合:
各頁面的說法並不完全一致。一般 FAQ 表示 Vast.ai 只提供 Linux Docker 執行個體、沒有遠端桌面介面,而虛擬機器指南描述了完整的 Linux 虛擬機器,並列出一個被描述為具備圖形環境的 Ubuntu 桌面範本。兩個頁面都同意平台僅支援 Linux。
Vast.ai 價格不是固定的價目表。平台採用市集模式,由主機自行定價,因此價格因主機而異,並隨需求波動。每筆租用帳單都由三項費用組成:
| 費用 | 單位 | 何時計費 |
|---|---|---|
| GPU(使用中租用) | $/小時,按秒計費 | 執行個體處於使用中或連線狀態的每一秒 |
| 儲存空間 | $/GB/小時 | 執行個體存在且上線的每一秒,包括停止期間 |
| 頻寬 | $/TB | 傳送或接收的每個位元組,不論執行個體處於何種狀態 |
頻寬很容易被低估:上傳與下載費用不會顯示在 $/小時或 $/天的費用明細中,因為它們依用量計費,而不是固定費率。
帳戶以預付點數運作,可透過 Stripe 刷卡付款,或透過 BitPay 與 Crypto.com 以加密貨幣付款。最低儲值金額為 $5。餘額不足時,Autobilling(自動扣款)可從已儲存的信用卡儲值。作為市集價格的參考,依 2026 年 10 月 4 日擷取的頁面,GPU Cloud 頁面宣傳 H100 最低只要 $0.90/小時。
帳單頁面與使用條款對退款有三種不同說法,但都不退還已花用的點數:
市集價格也可能因與租用者無關的原因波動。2026 年 6 月一篇 IT 媒體針對某研究預印本的報導,將 Vast.ai 上平價 GPU 租用價格約 38% 的漲幅歸因於某加密貨幣挖礦網路的需求,使用率從 57% 升至 94%。
最常見的比較對象是超大規模雲端。Vast.ai 的 GPU Cloud 頁面宣稱,與 AWS、Azure 或 GCP 相比最多可省 80%,而其一般 FAQ 給出的降幅約為 3 到 5 倍;兩者都是廠商說法。
在 GPU 專用雲端中,Runpod 在結構上最接近:其 Pod 文件比較了 Secure Cloud 與 Community Cloud 兩種選項。Runpod 也表示 Community Cloud 已不再接受新主機,但現有的 Community Cloud 資源仍可使用。Salad 則更偏向消費級硬體:其 Community Cloud 是由閒置消費級 GPU 組成的分散式資源池,容量遍及 190+ 個國家。
使用者回饋褒貶不一。依 2026 年 10 月 4 日擷取的頁面,某第三方評論平台顯示評分 3.9,共 257 則評論,五星佔 78%,一星佔 15%。其針對 82 則評論的 AI 生成摘要提到,使用者稱讚支援與價格,也抱怨偶發的效能下滑、意料之外的網際網路頻寬費用,以及技術問題期間回應緩慢。
不會。Vast.ai 表示執行個體顯示「Loading」時不收費;執行個體進入使用中狀態後才開始收取 GPU 費用。
不用。計費按秒進行,10 分鐘後刪除伺服器就按 10 分鐘用量收費,另加使用的頻寬。
不免費。Vast.ai 表示帳戶中顯示的執行個體永遠不是免費的,即使餘額為負或為零也一樣,因為在執行個體刪除之前,儲存空間費用會持續累計。