ModalはGPUとCPU上でPythonコードを実行し秒単位で課金するサーバーレスクラウドで、同社はAIアプリを大規模に開発・学習・提供するチーム向けクラウドインフラだと説明しています。
Modalはコードをコンテナに入れてクラウドで実行し、トラフィックが増えると自動でコンテナを追加します。主要クラウドの容量を束ね、各ジョブの実行場所を選びます。コンテナイメージとGPUの要求はPythonコードで記述するため、ModalアプリにはYAMLのデプロイファイルがありません。
modal.comはModal Labsが運営しています。独立系テックメディアの報道によると、Modalは2021年にCEOのErik BernhardssonとCTOのAkshat Bubnaが創業しました。同社はGeneral CatalystやRedpoint Venturesなどの投資家から4億6,600万ドル超を調達したとしています。2026年9月28日、匿名の情報筋を引用したあるテックニュースの報道は、Modal Labs(同報道はAI推論インフラ事業者と表現)がAccel主導の7億5,000万ドルの資金調達ラウンドを評価額157億5,000万ドルでまとめる寸前だと伝えました。Modal Labsはコメントを控えています。
Modalは、同社のいう1秒未満のコールドスタートによる推論、並列バッチジョブ、学習と微調整、AI生成コード用の隔離サンドボックス、GPU搭載の共同編集Notebooksをカバーします。
gpu引数はT4、L4、A10、L40S、A100(汎用、40 GBまたは80 GB)、RTX PRO 6000、H100(またはH100!)、H200、B200(またはB200+)、B300を受け付けます。B300、B200、H200、H100、A100、L4、T4、L40Sはコンテナあたり最大8基(GPU RAMは最大2,304 GB)を使え、A10は4基・96 GBが上限です。
ベンチマークに影響する自動アップグレードが2つあります。H100の要求はH200で、A100の要求は80 GBのA100で、元の価格で実行される場合があり、H100!を要求するとH200へのアップグレードを回避できます。関数にGPUタイプを優先順に列挙することもでき、Modalはリストの順にフォールバックします。
Modal Sandboxesは実行時に定義する安全なコンテナで、信頼できないユーザーやエージェントのコードの実行に使います。Modalによれば、プログラムから1分以内に数百万個を作成でき、高速起動用のスナップショットと復元にも対応します。
サーバーレス料金、アイドル時の自動停止、Modal GPU、リアルタイム共同編集を備えたホスト型Jupyterノートブックです。
Modalは2026年10月1日、@modal.clusteredデコレーターによるModal Clustersの一般提供を発表しました。RDMAを備えたマルチノードGPUグループで、共有容量プールからギャングスケジューリングされ、秒単位で課金されます。
pip install modalを実行し、続いてmodal setupで認証します(最初の形式が失敗する場合はpython -m modal setup)。@app.function(...)デコレーターを付けたPython関数を書いてコンテナイメージとGPUを指定し、modal run path/to/file.pyでファイルを実行します。Modalはコンテナが約1秒で起動するとしていますが、インポートなどのグローバルスコープの初期化が済んで初めてウォーム状態になるため、準備完了まで数秒から数分かかることがあります。次の3つの設定で、遅延とアイドル時の支出を天秤にかけます。
scaledown_window:アイドルのコンテナを2秒から20分まで維持します。期間が長いほどコールドスタートは減りますが、アイドル中のリソースは課金されます。min_containersとbuffer_containers:前者はウォームコンテナの下限を保ち関数がゼロにスケールしないようにし、後者は関数のアクティブ時に予備コンテナを追加します。usのような広域リージョンは狭域リージョンより大きなリソースプールを持ち、コールドスタート時間と可用性が向上します。Modalはコンテナ化できるあらゆるPythonアプリをデプロイでき、水平スケールする計算負荷の高い処理、つまり大規模なML推論、モデルの学習と微調整、データパイプライン、科学計算、ジョブキューを対象とします。
上記3件の顧客の声はホームページの推薦コメントで、独立した事例研究ではありません。
今回見つかった独立レビューの手がかりは限られています。ローンチ系コミュニティのレビュープラットフォームでは、2026年10月5日の取得時点でModalは61件のレビューに基づき5.0でした。同プラットフォームのAI要約は、レビュアーの大半が創業者で、レビューに批判的な意見がほとんどないとしています。
routing_regionではus-west(オレゴン)、eu-west(ダブリン)、ap-south(ムンバイ)も指定できます。Modalは月額プランに、秒単位のGPU料金と従量制のCPU・メモリ料金を組み合わせています。以下の定価は2026年10月5日に取得しました。
| プラン | プラットフォーム料金 | 含まれる計算資源 | シート | コンテナ / GPU同時実行数 | ログ保持 | 含まれる送信転送量 |
|---|---|---|---|---|---|---|
| Starter | 月額 $0 + 計算資源 | 月額 $30 | 3 | 100 / 10 | 1日 | 月 1 TiB |
| Team | 月額 $250 + 計算資源 | 月額 $100 | 無制限 | 5000 / 50 | 30日 | 月 10 TiB |
| Enterprise | 個別対応 | 個別対応 | 無制限 | より高いGPU同時実行数 | 個別対応 | 月 100 TiB |
Enterpriseでは、数量割引、組み込み型のMLエンジニアリングサービス、専用Slackサポート、監査ログ、Okta SSO、HIPAAが追加されます。Starterではデプロイ済みアプリ200個とデプロイ済みcronジョブ5個まで使え、カスタムドメイン、デプロイのロールバック、環境単位の予算、静的IPプロキシ、RBACは含まれません。Teamはロールバック用に3バージョンを保持します。
| リソース | 1秒あたりの価格 |
|---|---|
| Nvidia B300 | $0.001972 |
| Nvidia B200 | $0.001736 |
| Nvidia H200 SXM | $0.001261 |
| Nvidia H100 SXM5 | $0.001097 |
| Nvidia RTX PRO 6000 | $0.000842 |
| Nvidia A100、80 GB | $0.000694 |
| Nvidia A100、40 GB | $0.000583 |
| Nvidia L40S | $0.000542 |
| Nvidia A10 | $0.000306 |
| Nvidia L4 | $0.000222 |
| Nvidia T4 | $0.000164 |
| CPU、物理コアあたり(2 vCPU) | $0.0000131 |
| メモリ、GiBあたり | $0.00000222 |
CPUはコンテナあたり最低0.125コアです。サンドボックスとNotebooksには高めのCPU・メモリ料金が適用され、1秒あたりコアごとに$0.00003942、GiBごとに$0.00000667で、GPUは標準価格です。Volumesは1 TiBの無料枠を超えると月額GiBあたり$0.09、プランの許容量を超える送信転送量はGiBあたり$0.04です。Modalの試算例では、A10GでのStable Diffusionは画像1,000枚あたり約$0.491です。
nonpreemptible=TrueはCPUとメモリの定価を3倍にし、GPU関数では使えません。以下のサーバーレスGPUプラットフォームは、主にアイドル時間の課金方法とGPUの選択肢の広さでModalと異なります。
| 選択肢 | GPUの選択肢 | ゼロへのスケール | アイドルと課金のルール |
|---|---|---|---|
| Google Cloud Run(GPU) | RTX PRO 6000 Blackwell(96 GB)またはL4(24 GB) | 可 | インスタンスベースの課金。最小インスタンスはアイドル時も全額課金 |
| RunPod Serverless | 今回の比較では対象外 | フレックスワーカーは可、アクティブワーカーは常時稼働 | ワーカーの起動から完全停止まで秒単位で課金、切り上げ |
| Replicate | 今回の比較では対象外 | 公開モデルは可 | 大半の非公開モデルは専用ハードウェアで動き、準備、アイドル、アクティブの時間が課金対象 |
RunPodのフレックスとアクティブの区分はModalのmin_containersの選択に相当します。Replicateは大半の公開モデルを実行時間で、一部を入出力で課金します。Modalの差別化要素は、Pythonで定義するインフラと同じアカウント内のサンドボックス、そしてCloud Runより長いGPUリストです。
routing_regionは関数の初回デプロイ時にしか設定できず、2 MiBを超える入出力は引き続きus-eastのオブジェクトストレージを経由します。Modalの契約は、暗号資産のマイニングや関連するブロックチェーン活動、サービス拒否攻撃、ピアツーピアのファイル共有、汎用のファイルホスティングやメディア配信プラットフォームを禁止しています。
Starterにはプラットフォーム料金がなく、毎月$30の計算資源が含まれますが、請求ガイドは支払い方法の登録を求めており、共有エンドポイントのトークンは最初のリクエストから課金されます。
ゼロにスケールした後は課金されません。既定の60秒のキープアライブと、長めのscaledown_window内のアイドル時間は課金され、min_containersを使うと関数がゼロになりません。
関数とサンドボックスは1.15倍または1.75倍の倍率でEUリージョンに固定し、eu-west経由でルーティングできますが、アプリログは米国に残り、大きな入出力はus-eastを経由し、共有エンドポイントは固定できません。