このツールを使いましたか?評価してください
Runpodは、ハードウェアを買うことも企業契約を結ぶこともなく高速な計算資源を必要とする開発者のためのGPUクラウドです。自らをAI開発者クラウドと称しており、その実体は一つのアカウントのもとで同じGPUカタログを共有する三つの製品ラインです。Podsは常駐する計算と開発のためのGPUインスタンス、Serverlessは待機中にゼロまで縮む自動スケーリングのGPUエンドポイント、Clustersは学習と大規模バッチ推論のためのマルチGPU分散計算です。三つとも契約も最低利用額もなく必要なときに使え、公表されている設計目標は、段階ごとにプラットフォームを乗り換えることなく実験から本番まで進むことです。
会社の出自は、この製品が誰のためのものかをよく説明します。元Comcastの開発者だったZhen LuとPardeep Singhは、2021年末にニュージャージーの自宅地下室にあった暗号資産のマイニング機材をAIサーバーへ作り替えました。動機はLu自身の言葉で、GPUの上でソフトウェアを開発する実際の体験が「まったくのひどい代物だった」というものです。2022年初め、二人はAI関連のサブレディットに投稿し、フィードバックと引き換えにGPUを無料で提供しました。公開から九か月のうちに勤めを辞め、売上100万ドルに到達しています。開発者を第一に据え、コミュニティから始まったこの性格は、計算資源の供給方法の一部を含め、今も製品に残っています。
その後到達した規模はかなりのもので、数字の動きが速いため時点を添えて述べる必要があります。TechCrunchは2026年1月、Runpodの年間経常収益が1億2000万ドルに達し、31の地域にわたって50万人の開発者顧客を抱え、機関投資を受ける前に自力で2400万ドル超の売上を上げていたと報じました。2026年6月のシリーズA発表時点――Summit Partnersが主導した1億ドルの調達で企業価値10億ドル、2024年5月にIntel CapitalとDell Technologies Capitalが共同主導した2000万ドルのシードを含めて累計1億2200万ドル――では、開発者数は100万人超とされ、公開以来処理した推論リクエストは200億件を超えています。名前の挙がっている顧客にはReplit、Cursor、OpenAI、Perplexity、Wix、Zillowが含まれます。
Runpodはウェブのダッシュボードとコマンドラインインターフェース、REST APIから利用し、ドキュメントはAPI v1とv2に加えてモデルとCLIの参照を扱います。配備の単位はDockerコンテナであり、フレームワークも依存関係もコードもそのまま持ち込めます。プラットフォームが掲げる立場は、決められた実行環境ではなく「あなたのコンテナ、あなたのフレームワーク、あなたのコード」です。
インフラは31の地域と30種類を超えるGPUに及び、性格の異なる二つの区分に分かれています。Community Cloudは審査を経た第三者ホストからピアツーピアの形で容量を調達し、podはソフトウェア水準のコンテナ分離のもとでホストマシンを共有します。Secure Cloudはティア3とティア4のデータセンターで専有のマシンとGPU、より良いSLA、NVMeに基づく永続ネットワークボリュームを提供します。両者は同じGPUについて価格表に並べて示されており、どちらを選ぶかはコストの判断であると同時に、信頼性と分離水準の判断でもあります。
連携の面では、Serverlessエンドポイントはそれ自体がHTTP APIです。ジョブを投入し、状態を問い合わせ、結果を取得します。短い処理には同期呼び出しも使えます。ロードバランシングエンドポイントでは、好みのHTTPフレームワークを持ち込んで経路を自分で定義できます。リアルタイムのログと監視、メトリクスは追加の計装なしに得られ、Runpod skills packageは配備とリソース管理をClaude CodeやCursorを含むコーディングエージェントにまで広げます。
Runpodは時間または秒単位で課金し、サブスクリプションの段階はありません。使った計算に対して支払う方式で、料金ページの最終更新表記は2026年7月27日です。
PodsはGPUの機種ごとに価格が付きます。上位ではB300が1時間7.89ドル、B200が6.79ドル、H200が4.59ドル、H100 SXMが3.29ドル、H100 PCIeが2.89ドル、H100 NVLが3.19ドルです。中位ではA100 SXMが1.59ドル、A100 PCIeが1.39ドル、RTX Pro 6000が2.09ドル、L40Sが0.99ドル、RTX 6000 Adaが0.84ドルです。入門帯ではRTX 4090が0.74ドル、RTX 3090が0.50ドル、L4が0.49ドル、A40が0.44ドル、RTX A5000が0.27ドルです。同じ表が二つのインフラ区分を別々の列として示すため、実際の価格はどちらを選ぶかで変わります。
Serverlessは別立ての価格で、同じ機種でも1時間あたりの価格は一貫してPodsより高くなります。これが最初に腹に落としておくべき価格の事実です。H100はServerlessで1時間4.79ドル、Podとしては3.29ドル。A100は2.72ドルに対して1.59ドル。RTX 4090は1.10ドルに対して0.74ドルです。16GB帯は0.58ドル、24GBの共有帯は0.69ドルです。Runpodはこれがflexワーカーで他のサーバーレスクラウド事業者より25%安いとしています。余分に払う分で買っているのは自動スケーリングと待機時ゼロであり、尖ったトラフィックには見合いますが、安定した負荷では無駄になります。
Clustersはオンデマンド価格を二つしか公開していません。H200 SXMが1時間4.31ドル、A100 SXMが1.79ドルで、L40SとH100 SXM、B200はいずれも営業へ問い合わせと表示されます。Reserved Clustersはどの期間にも公開価格がなく、1、3、6、12か月およびそれ以上のすべての欄が営業へ問い合わせです。
ストレージは独立して課金されます。コンテナディスクが1GBあたり月0.10ドル、ボリュームディスクが稼働中0.10ドルで待機時0.20ドル、ネットワークストレージが1TB未満で0.07ドル、1TB超で0.05ドル、高性能帯で0.14ドルです。Public Endpointsは呼び出しごとの課金で、モデルと形式によって幅があります。
公開価格について一点、注意があります。Public Endpointsの言語モデルの区画は、Deep Cogito v2 Llama 70Bを100万トークンあたり0.00001ドルと表示していますが、同じ区画のQwen3 32B AWQは10.00ドル、IBM Granite 4.0 H Smallは1.00ドルです。一つの表の中で百万倍の開きがあるのは、実際の価格というよりページの誤りである可能性が非常に高く、ここでは調整せず見つかったまま報告します。Runpodは価格哲学を「GPUの可用性を保つために価格を動かす」と述べてもいるので、すべての数字をある時点のスナップショットとして扱い、実際のページで確認してください。
何と比べるべきかは、Runpodのどの面を吟味しているかによります。大手クラウドであるAWS、Azure、GCPと比べると、調達の摩擦と価格を、エコシステムの厚みと企業契約と引き換えにする構図です。Runpodは計算コストが最大90%低くエグレス料金がないと主張する一方、あちらはRunpodがそもそも手を出さない統合サービスを備えています。AIに特化したGPUクラウドであるCoreWeaveやLambdaと比べると、容量規模と企業向け契約の力は概して規模の大きい側に傾き、Runpodはセルフサービスでの利用しやすさとGPU機種の幅で戦います。サーバーレス推論の専業事業者であるModal、Replicate、Baseten、Togetherと比べると、勝負どころはコールドスタートの挙動と開発者体験、トークン単位か秒単位かという価格の形であり、独立したベンチマークはモデルの大きさや負荷の形によって順位が変わることを示しています。マーケットプレイス型のGPUレンタルであるVast.aiと比べると、RunpodのCommunity Cloudが近い位置を占め、Secure Cloudは純粋なマーケットプレイスには通常ないデータセンター水準の選択肢を加えます。実務的な評価方法は、自分の実際のモデルで二、三社のベンチマークを取ることです。公開されたコールドスタートや処理量の数字は、具体的なワークロードに触れるとまず持ちこたえないからです。
200ミリ秒未満というコールドスタートの主張には前提条件を添える必要があります。 Runpodのトップページは、FlashBootによる200ミリ秒未満のコールドスタートを宣伝しています。自社のドキュメントははるかに正確で、コールドスタートはコンテナの起動、モデルのGPUメモリへの読み込み、実行環境の初期化にまたがり、モデルが大きいほど読み込みに時間がかかってコールドスタートが延びると明記しています。VRAMを56GB要するQwen Image fp16に対する独立検証では、コールドスタート全体が約120〜160秒、実際の生成が30〜40秒と測られ、三〜四倍の上乗せになりました。両者は矛盾しません。マーケティングの数字はモデルがキャッシュされたウォーム経路を、実測は大きなモデルが何もない状態から始まる場合を指しています。ただしトップページだけを読んだ購入者は遅延の見積もりを誤ります。なおそのベンチマークの筆者は、自社のプラットフォームも比較対象に含まれていることを開示しています。
独立した評価は中程度で、しかも大きく二極化しています。 RunpodはTrustpilotで302件のレビューに基づき5点満点中3.7点で、うち156件が直近12か月のものです。目を引くのは分布です。5つ星が65%、1つ星が19%で、その中間がほとんどありません。この二峰形は、利用体験が「まずまず」のあたりに集まるのではなく、はっきり割れていることを示唆します。当該プロフィールは顧客にレビューを依頼していると表示されており、総合点を読む際にはこの選択の偏りを併せて考える必要があります。
繰り返し現れる運用面の苦情は具体的で一貫しています。 アカウント残高が尽きるとpodは停止ではなく削除され、まるごと作り直して設定をやり直すことになるという報告があります。ほかにも、GPUが著しく逼迫した時期、課金と実際に提供された仕様の食い違い(1TBのメモリ代を払って300GBしか得られなかったというレビュー)、NVSwitchが壊れている、GPUがロックされている、メモリが足りない、ディスクがマウントされていないといった機体に当たった例が語られ、ある評者はこれをルーレットに喩えています。別の第三者によるレビュー集計は、podの起動に最大30分かかる、あるいは初期化に失敗しながら課金は続くという事例と、迅速な対応から完全な無反応まで幅のあるサポート品質を記録しています。
未解決の課金紛争が一件あり、知っておく価値があります。 あるTrustpilotの評者は、自分はRunpodの顧客だったことが一度もないのに、支払い手段がアカウント開設に使われて二週間で810ドルの無断請求が発生したと述べています。Runpodは第三者アクセスを理由にそのアカウントを凍結しながら、第三者アクセスの証拠は見つからなかったとして返金を拒んだ、というのがその主張です。これは一利用者が語る紛争であり、確立した事実としてではなくそのまま報告します。
二つのインフラ区分は互いに置き換えられません。 Community Cloudは審査を経た第三者ホストから容量を得ており、podはコンテナ水準でのみ分離された状態でホストを共有し、信頼性はホスト次第で変わります。Secure Cloudはティア3と4のデータセンターで専有ハードウェアを提供します。Runpodのドキュメントは機微なワークロードにSecure Cloudを勧めています。利用体験の大きな分かれ方は、その相当部分がこの選択に由来すると考えられ、価格表が二列を並べて見せるために、何を手放しているかを意識しないまま価格だけで選びやすくなっています。
準拠は一括ではなく条件付きです。 RunpodはSOC 2 Type 2を完了しており、Trust CenterはSOC 2 Type 2、SOC 3、HIPAA、GDPR、2026年のブリッジレターを掲げ、一部の文書は承認を経て初めて入手できます。しかしコンプライアンスのページは、適用範囲がワークロード、地域、提供事業者、配備形態によって変わりうるため、セキュリティ審査の段階で具体的な要件を確認するようはっきり述べており、報告書や認証、パートナーの適用範囲は時間とともに変わりうるとも記しています。したがって会社水準の認証はデューデリジェンスの出発点であって結論ではありません。
サイトが二つの異なる稼働率を示しています。 トップページの企業向け区画は99.9%の稼働率を、同じページのFAQは99.99%の稼働保証を掲げています。Runpodはこの差について説明を公表しておらず、ここでは両方を見つかったまま並記します。
公開価格のうち少なくとも一つは誤りのように見えます。 Deep Cogito v2 Llama 70Bは100万トークンあたり0.00001ドルと表示されていますが、同じ区画の同種のモデルは100万トークンあたり1.00ドルと10.00ドルです。ページの誤りである可能性がほぼ確実であり、正しい数字がいくらであるかについては一切の推測をしません。
ServerlessはGPU時間あたりの費用がPodsより高くなります。 これは欠陥ではなく設計ですが、サーバーレスは当然安いはずだと考えるチームが足をすくわれる箇所です。安定して予測できる負荷ならPodのほうが明らかに安く、Serverlessは待機時間が相当を占める場合にのみその割増に見合います。
ロードバランシングエンドポイントはキューを柔軟性と引き換えにしています。 好みのHTTPフレームワークを持ち込める一方、標準のエンドポイントと違ってリクエストの滞留に対するキュー機構がありません。突発的な負荷のもとでは、あふれたリクエストが待つのか失敗するのかがこの違いで決まります。
報告されている数字には時点という但し書きが付きます。 開発者数は2026年1月の報道で50万人、2026年6月には100万人超であり、ここでは調整せずそれぞれ時点とともに引用しています。規模の数字や配備成功率、継続率は会社が示したもので独立監査を受けておらず、インフラ請求の90%削減といった顧客申告の節約額も同様です。
Podsは常駐する計算と開発のためのGPUインスタンスで、保証されたReservedと、中断されうるが安価なSpotに分かれます。Serverlessは待機中にゼロへ縮む自動スケーリングのGPUエンドポイントで、稼働していなければ課金されません。Clustersは学習と大規模バッチ推論のためのマルチGPU分散計算で、必要に応じて最大64基まで、それ以上は予約方式で拡張します。三つは一つのアカウントのもとで同じGPUカタログを共有しており、想定されている道筋は、プラットフォームを乗り換えずに段階ごとに使い分けることです。
すべての場合ではなく、特定の条件を指しています。モデルがキャッシュされたウォーム経路でなら、FlashBootは実際にそれだけ速くなりえます。Runpod自身のドキュメントは、コールドスタートにコンテナの起動、モデルのGPUメモリへの読み込み、実行環境の初期化が含まれ、モデルが大きいほど時間がかかると述べています。VRAMを56GB要する画像モデルに対する独立検証では、コールドスタートが約120〜160秒、生成が30〜40秒と測られました。見出しの数字を軸に遅延を見積もるのではなく、自分のモデルでベンチマークを取ってください。
Runpodのドキュメントによれば三つの手立てがあります。モデルをキャッシュすること――重みをワーカーイメージに焼き込むか、ネットワークボリュームに置いて、リクエスト時に取得しないようにします。FlashBootを有効にすること。そして常駐ワーカー数をゼロより大きくすることです。三つ目は最初のリクエストのコールドスタートを消しますが、待機時ゼロの節約は手放します。これはコストと遅延の直接的な取引であり、どちらを選ぶかはトラフィックが尖っているか安定しているかに完全に依存します。
Community Cloudは審査を経た第三者ホストからピアツーピアでGPUを調達します。podはコンテナ水準のソフトウェア分離のもとでホストを共有し、価格は低く、信頼性はホスト次第です。Secure Cloudはティア3とティア4のデータセンターで専有のマシンとGPU、より良いSLA、NVMeに基づく永続ネットワークボリュームを提供します。Runpodのドキュメントは機微なワークロードにSecure Cloudを勧めており、本番の信頼性という観点でも、より妥当な既定値です。
PodsはGPU機種ごとの時間課金です。たとえばB300が7.89ドル、H200が4.59ドル、H100 SXMが3.29ドル、A100 SXMが1.59ドル、L40Sが0.99ドル、RTX 4090が0.74ドル、RTX A5000が0.27ドルで、二つのインフラ区分が別々の列に示されます。Serverlessは別立てでより高く、H100が1時間4.79ドル、A100が2.72ドルです。ストレージは1GBあたり月0.05ドルから別に課金されます。Clustersはオンデマンド価格を二つだけ公開し、残りは営業へ問い合わせ、Reserved Clustersは公開価格がありません。価格は意図的に動かされるので、実際のページで確認してください。
買っているものが違うからです。Podは保有して継続的に支払う専有の容量です。Serverlessのワーカーは必要に応じて現れ、自動で伸縮し、待機中は課金されない容量であり、その弾力性に時間あたりの割増が乗っています。エンドポイントの大半が待機なら経済性はServerlessに、負荷が安定していればPodsに傾きます。どちらの既定の思い込みよりも、自分の実際の稼働率で計算してみるほうが確かです。
条件付きで向いています。RunpodはSOC 2 Type 2を完了し、Trust CenterはSOC 3やHIPAA、GDPRの資料を掲げ、Secure Cloudがネットワーク分離を加え、FAQは99.99%の稼働SLAに言及しています。もっとも同じトップページの別の箇所は99.9%と記しています。最も重要な但し書きはRunpod自身のコンプライアンスのページから来ます。適用範囲はワークロード、地域、提供事業者、配備形態によって変わるため、セキュリティ審査の段階で確認すべきだというものです。認証はデューデリジェンスの始まりとして扱い、結論にはしないでください。
複数の利用者レビューによれば、残高が尽きるとpodは停止ではなく削除され、新しいpodを作って設定を一から組み直すことになります。保存していない作業に実際の影響が及ぶ利用者報告の挙動であるため、残高に余裕を持たせ、価値のあるものはpodのローカルディスクではなくネットワークストレージに置き、podを立てたままにするなら残高を監視してください。
独立した手がかりは入り混じっており、二極化しています。Trustpilotは302件で3.7点、5つ星が65%、1つ星が19%で中間がほとんどなく、プロフィールはレビューを依頼する形式です。繰り返される苦情には、GPUの逼迫、ハードウェア障害のある機体に当たること、課金と提供仕様の食い違い、podの起動の遅さや失敗にもかかわらず続く課金、そしてばらつきのあるサポートが含まれます。この二峰分布は、二つのインフラ区分の違いとGPU供給の変動で最もよく説明できるため、体験はどちらのインフラを選び、どの機種を必要とするかにかなりの程度左右されます。
大手クラウドと比べると、Runpodは価格――計算コストが最大90%低くエグレス料金がないという主張――と、調達を経ないセルフサービスの利用しやすさで戦い、その代わりに周辺のサービス群を手放します。CoreWeaveのようなAIクラウドと比べると、規模の大きい事業者が容量とエンタープライズ契約で先行し、Runpodはセルフサービスで選べるGPUの幅で先行します。ModalやReplicateのようなサーバーレス推論の専業と比べると、決め手は自分のモデルでのコールドスタートの挙動、開発者体験、価格の形であり、独立したベンチマークはすべてのモデル規模で勝ち切る事業者がないことを示しています。自分のワークロードで試してください。