Toolso.AI
Toolso.AI
すべてのツールカテゴリ急上昇最新ツール料金プランブログ
Toolso.AI
Toolso.AI

💌AIツールウィークリーを購読

最新かつ最も注目されるAIツールとトレンドの週次厳選セレクションをメールボックスにお届けします 購読

Toolso.AI
Toolso.AI

生産性を向上させる最高のAIツールを発見する

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

人気カテゴリ

  • AI執筆
  • AI画像
  • AI動画
  • AIコーディング
  • 他のカテゴリ

探索

  • 最新ツール
  • 人気ツール
  • 他のツール
  • ツールを提出
  • 料金

会社概要

  • 会社概要
  • お問い合わせ
  • ブログ
  • 変更履歴

法的情報

  • クッキーポリシー
  • プライバシーポリシー
  • 利用規約
  • 返金ポリシー
© 2026 Toolso.AI 無断転載を禁じます
期間限定期間限定注目掲載24時間優先審査・被リンク不要・30日間注目表示$29.90終了後 $59.9010月31日以降 $59.90に値上げ終了まで--:--:--今すぐ投稿
  1. ホーム
  2. すべてのツール
  3. 開発ツール
  4. Modal
Modalのインターフェースプレビュー
Modalのロゴ

Modal

ModalはPython関数、推論エンドポイント、隔離されたサンドボックス、Notebooksを秒単位課金のGPUとCPUで実行し、月$30のコンピュート付き$0のStarterから個別契約のEnterpriseまで用意しています。

開発ツールAI開発AIトレーニングプラットフォーム#機械学習#バッチ処理#OpenAI 互換 API
無料で試す
保存
アクセス数
閲覧数
価格
無料
公開日
2026年10月5日
ドメイン
modal.com
ユーザー評価

このツールを使いましたか?評価してください

このツールを評価する

Modal 製品情報

無料で試す
ツール情報
保存
アクセス数
閲覧数
価格
無料
公開日
2026年10月5日
ドメイン
modal.com
ユーザー評価

このツールを使いましたか?評価してください

このツールを評価する

注目のツール

関連ツール

無料で試す

Modalとは?

ModalはGPUとCPU上でPythonコードを実行し秒単位で課金するサーバーレスクラウドで、同社はAIアプリを大規模に開発・学習・提供するチーム向けクラウドインフラだと説明しています。

Modalはコードをコンテナに入れてクラウドで実行し、トラフィックが増えると自動でコンテナを追加します。主要クラウドの容量を束ね、各ジョブの実行場所を選びます。コンテナイメージとGPUの要求はPythonコードで記述するため、ModalアプリにはYAMLのデプロイファイルがありません。

modal.comはModal Labsが運営しています。独立系テックメディアの報道によると、Modalは2021年にCEOのErik BernhardssonとCTOのAkshat Bubnaが創業しました。同社はGeneral CatalystやRedpoint Venturesなどの投資家から4億6,600万ドル超を調達したとしています。2026年9月28日、匿名の情報筋を引用したあるテックニュースの報道は、Modal Labs(同報道はAI推論インフラ事業者と表現)がAccel主導の7億5,000万ドルの資金調達ラウンドを評価額157億5,000万ドルでまとめる寸前だと伝えました。Modal Labsはコメントを控えています。

主な機能

Modalは、同社のいう1秒未満のコールドスタートによる推論、並列バッチジョブ、学習と微調整、AI生成コード用の隔離サンドボックス、GPU搭載の共同編集Notebooksをカバーします。

関数、エンドポイント、バッチジョブ

  • HTTPSエンドポイント:どの関数も、トラフィックに応じてスケールしアイドル時はゼロになるHTTPSエンドポイントにできます。
  • ファンアウトとバックグラウンド処理:ジョブはオーケストレーション層なしで数千基のGPUにファンアウトでき、非同期バッチ処理の起動もできます。
  • ストレージ:Volumesはイメージ、モデルの重み、データセット用の分散ファイルシステムとして機能します。
  • 可観測性:コンテナごとのログとメトリクスを提供し、DatadogなどのOpenTelemetryプロバイダーへ出力できます。

GPUの選択

gpu引数はT4、L4、A10、L40S、A100(汎用、40 GBまたは80 GB)、RTX PRO 6000、H100(またはH100!)、H200、B200(またはB200+)、B300を受け付けます。B300、B200、H200、H100、A100、L4、T4、L40Sはコンテナあたり最大8基(GPU RAMは最大2,304 GB)を使え、A10は4基・96 GBが上限です。

ベンチマークに影響する自動アップグレードが2つあります。H100の要求はH200で、A100の要求は80 GBのA100で、元の価格で実行される場合があり、H100!を要求するとH200へのアップグレードを回避できます。関数にGPUタイプを優先順に列挙することもでき、Modalはリストの順にフォールバックします。

推論エンドポイント

  • 共有エンドポイント(Shared Endpoints):Modal Libraryのモデルの一部をModal管理のプールで提供し、トークン単位で課金します。各モデルは、隔離または構成可能な容量のために専用エンドポイント(Dedicated Endpoint)でも実行できます。
  • OpenAI互換の提供:ModalはオープンモデルのOpenAI互換エンドポイントをうたっています。

Modal Sandboxes

Modal Sandboxesは実行時に定義する安全なコンテナで、信頼できないユーザーやエージェントのコードの実行に使います。Modalによれば、プログラムから1分以内に数百万個を作成でき、高速起動用のスナップショットと復元にも対応します。

Notebooks

サーバーレス料金、アイドル時の自動停止、Modal GPU、リアルタイム共同編集を備えたホスト型Jupyterノートブックです。

学習とマルチノードクラスター

Modalは2026年10月1日、@modal.clusteredデコレーターによるModal Clustersの一般提供を発表しました。RDMAを備えたマルチノードGPUグループで、共有容量プールからギャングスケジューリングされ、秒単位で課金されます。

ガイド

はじめ方

  1. modal.comでアカウントを作成します。
  2. pip install modalを実行し、続いてmodal setupで認証します(最初の形式が失敗する場合はpython -m modal setup)。
  3. @app.function(...)デコレーターを付けたPython関数を書いてコンテナイメージとGPUを指定し、modal run path/to/file.pyでファイルを実行します。

コールドスタートとアイドルコストの調整

Modalはコンテナが約1秒で起動するとしていますが、インポートなどのグローバルスコープの初期化が済んで初めてウォーム状態になるため、準備完了まで数秒から数分かかることがあります。次の3つの設定で、遅延とアイドル時の支出を天秤にかけます。

  • scaledown_window:アイドルのコンテナを2秒から20分まで維持します。期間が長いほどコールドスタートは減りますが、アイドル中のリソースは課金されます。
  • min_containersとbuffer_containers:前者はウォームコンテナの下限を保ち関数がゼロにスケールしないようにし、後者は関数のアクティブ時に予備コンテナを追加します。
  • 広域リージョン:usのような広域リージョンは狭域リージョンより大きなリソースプールを持ち、コールドスタート時間と可用性が向上します。

ユースケースと事例

Modalはコンテナ化できるあらゆるPythonアプリをデプロイでき、水平スケールする計算負荷の高い処理、つまり大規模なML推論、モデルの学習と微調整、データパイプライン、科学計算、ジョブキューを対象とします。

  • 全社的なAIプラットフォーム:DoorDash共同創業者のAndy Fangは、同社のAIプラットフォームが推論、エージェント用サンドボックス、カスタムコード用の計算資源にModalを使っていると述べています。
  • 強化学習とサービング:Cognition CEOのScott Wuは、同社のRLインフラと本番推論の両方をModalが動かしていると述べています。
  • エージェント評価:Rampの応用AI責任者は、Modalの高速なサンドボックスがなければ同社のInspectツールは構築が難しかっただろうと述べています。
  • 参考プロジェクト:Kyutai STTによるリアルタイム文字起こし、Fluxの微調整、サンドボックスとLangGraphで動くコーディングエージェント、小規模言語モデルの学習、S3上でのParquetの並列処理の例があります。

上記3件の顧客の声はホームページの推薦コメントで、独立した事例研究ではありません。

対象ユーザー

  • Python開発者とMLエンジニア:関数はPythonで定義します。JavaScript/TypeScriptとGoからは関数の呼び出し、サンドボックスの実行、リソース管理ができます。
  • 需要の波が大きいチーム:Modalは、急増する、または予測しにくいリクエスト量では、時間あたりの料金は高く見えるかもしれないが総コストは低くなると主張しています。
  • 小規模チームから大規模組織まで:Starterは小規模チームと個人開発者、Teamはスタートアップとより大きな組織、Enterpriseはセキュリティとサポートを重視する組織を対象とします。
  • スタートアップと研究者:初期段階のスタートアップは無料の計算資源クレジットに申請でき、学術関係者は最大$10kのクレジットを得られます。

今回見つかった独立レビューの手がかりは限られています。ローンチ系コミュニティのレビュープラットフォームでは、2026年10月5日の取得時点でModalは61件のレビューに基づき5.0でした。同プラットフォームのAI要約は、レビュアーの大半が創業者で、レビューに批判的な意見がほとんどないとしています。

プラットフォーム

  • Python SDKとCLI:操作の大半は、オープンソースのmodalコマンドラインツールとPythonクライアントライブラリで行います。
  • JavaScript/TypeScriptとGoのSDK:ベータ版で、関数の定義は今後もPythonのみとなる見込みです。
  • ブラウザー:Notebooksはmodal.com/notebooksで開き、.ipynbファイルをアップロードできます。
  • 容量リージョン:米国、EU、アジア太平洋、日本、オーストラリア、英国、カナダ、中東、南米、アフリカ、メキシコで、20を超えるクラウドにまたがります。
  • リクエストのルーティング:関数の入力は既定でus-east(バージニア)を経由し、routing_regionではus-west(オレゴン)、eu-west(ダブリン)、ap-south(ムンバイ)も指定できます。
  • クラウドマーケットプレイス:Enterprise顧客は、コミット済みの支出を活用するためAWSとGCPのマーケットプレイス経由で購入できます。

価格

Modalは月額プランに、秒単位のGPU料金と従量制のCPU・メモリ料金を組み合わせています。以下の定価は2026年10月5日に取得しました。

プラン

プランプラットフォーム料金含まれる計算資源シートコンテナ / GPU同時実行数ログ保持含まれる送信転送量
Starter月額 $0 + 計算資源月額 $303100 / 101日月 1 TiB
Team月額 $250 + 計算資源月額 $100無制限5000 / 5030日月 10 TiB
Enterprise個別対応個別対応無制限より高いGPU同時実行数個別対応月 100 TiB

Enterpriseでは、数量割引、組み込み型のMLエンジニアリングサービス、専用Slackサポート、監査ログ、Okta SSO、HIPAAが追加されます。Starterではデプロイ済みアプリ200個とデプロイ済みcronジョブ5個まで使え、カスタムドメイン、デプロイのロールバック、環境単位の予算、静的IPプロキシ、RBACは含まれません。Teamはロールバック用に3バージョンを保持します。

秒単位のGPU料金

リソース1秒あたりの価格
Nvidia B300$0.001972
Nvidia B200$0.001736
Nvidia H200 SXM$0.001261
Nvidia H100 SXM5$0.001097
Nvidia RTX PRO 6000$0.000842
Nvidia A100、80 GB$0.000694
Nvidia A100、40 GB$0.000583
Nvidia L40S$0.000542
Nvidia A10$0.000306
Nvidia L4$0.000222
Nvidia T4$0.000164
CPU、物理コアあたり(2 vCPU)$0.0000131
メモリ、GiBあたり$0.00000222

CPUはコンテナあたり最低0.125コアです。サンドボックスとNotebooksには高めのCPU・メモリ料金が適用され、1秒あたりコアごとに$0.00003942、GiBごとに$0.00000667で、GPUは標準価格です。Volumesは1 TiBの無料枠を超えると月額GiBあたり$0.09、プランの許容量を超える送信転送量はGiBあたり$0.04です。Modalの試算例では、A10GでのStable Diffusionは画像1,000枚あたり約$0.491です。

課金対象になるもの

  • ロード時間とアイドル時間:Modalはロードと処理の時間に加え、最後の入力後の既定60秒(変更可能)のキープアライブを課金します。ゼロにスケールしたアプリは課金されません。
  • 要求量か使用量か:CPUとメモリは要求量と使用量のうち高い方で課金され、コンテナあたり最低128 MiBと0.125コアです。
  • リージョン固定:コンテナのリージョンを固定すると、広域リージョンは基本価格の1.15倍、狭域リージョンは1.75倍で、両方を混ぜると小さい方の倍率が適用されます。
  • プリエンプションなしの実行:nonpreemptible=TrueはCPUとメモリの定価を3倍にし、GPU関数では使えません。
  • 共有エンドポイントのトークン:含まれる計算資源の対象外で、2026年9月1日以降はStarterでも最初のリクエストからトークンが課金されます。
  • 支払い方法:請求ガイドはModalを使うだけで支払い方法の登録を求める一方、GPUガイドはこれをGPUの利用に結び付けており、両ページで対象範囲が異なります。
  • 請求サイクルと上限:請求は月次で、使用量が一定のしきい値を初めて超えたときに自動請求も行われます。支出上限に達すると、追加の自己負担額を生むワークロードは停止されます。
  • クラウドクレジットと返金:AWS、GCP、Azureのクレジットは適用できず、2026年5月発効のModalのSaaS契約は、第3.2条に記載された場合を除き料金は返金されないと定めています。

Modalの代替サービス

以下のサーバーレスGPUプラットフォームは、主にアイドル時間の課金方法とGPUの選択肢の広さでModalと異なります。

選択肢GPUの選択肢ゼロへのスケールアイドルと課金のルール
Google Cloud Run(GPU)RTX PRO 6000 Blackwell(96 GB)またはL4(24 GB)可インスタンスベースの課金。最小インスタンスはアイドル時も全額課金
RunPod Serverless今回の比較では対象外フレックスワーカーは可、アクティブワーカーは常時稼働ワーカーの起動から完全停止まで秒単位で課金、切り上げ
Replicate今回の比較では対象外公開モデルは可大半の非公開モデルは専用ハードウェアで動き、準備、アイドル、アクティブの時間が課金対象

RunPodのフレックスとアクティブの区分はModalのmin_containersの選択に相当します。Replicateは大半の公開モデルを実行時間で、一部を入出力で課金します。Modalの差別化要素は、Pythonで定義するインフラと同じアカウント内のサンドボックス、そしてCloud Runより長いGPUリストです。

制限事項

実行時の制限

  • 既定でプリエンプション対象:どの関数もプリエンプトされる可能性があり、同じ入力で再起動されます。実行時間が長くなるほど中断の可能性が高まります。
  • タイムアウト:関数の実行は既定300秒で、1秒から24時間まで設定できます。サンドボックスの既定寿命は5分で、24時間まで延長できます。
  • 同時実行数:ワークスペースの同時コンテナ数とGPU数の上限はプランに従い、1つの関数には同時コンテナ4,000個の厳格な上限があります。
  • 大規模なGPU要求:コンテナあたり2基を超えるGPUは、通常待ち時間が長くなります。
  • CUDAの下限:B300にはCUDA 13.1以降が必要です。
  • 共有エンドポイントの流量制限:モデルごとの同時実行数の上限がワークスペース全体に適用され、上限を超えたリクエストにはHTTP 429が返ります。
  • マルチノードの状況が不一致:GPUガイドは依然としてマルチノード学習を非公開ベータとしている一方、2026年10月1日の発表はModal Clustersを一般提供としています。

リージョンとデータ所在地

  • 厳格な固定:リージョン固定のワークロードは、そのリージョンの容量が尽きても他へ移されません。
  • ルーティングの制約:routing_regionは関数の初回デプロイ時にしか設定できず、2 MiBを超える入出力は引き続きus-eastのオブジェクトストレージを経由します。
  • 共有エンドポイント:選択可能なコンテナリージョンやルーティングリージョンはなく、トラフィックはus-westを経由してグローバルな計算プール全体にルーティングされます。
  • ログ:関数、サンドボックス、サーバーのアプリログは米国に保存されます。

利用規定

Modalの契約は、暗号資産のマイニングや関連するブロックチェーン活動、サービス拒否攻撃、ピアツーピアのファイル共有、汎用のファイルホスティングやメディア配信プラットフォームを禁止しています。

プライバシー、セキュリティ、データの権利

  • データへのアクセス:Modalはソースコード、関数の入出力、イメージやVolumesに保存されたデータに決してアクセスせず使用もしないとしています。アプリのログとメタデータには、障害対応のためユーザーの許可がある場合のみアクセスします。
  • 保持:関数の入出力は保存時に暗号化され、最大7日のTTL内に削除されます。Modal Inferenceのエンドポイントはデータ保持ゼロで、ペイロードはディスクに書き込まれません。
  • 所有権:顧客は顧客データのすべての権利を保持し、サービス提供のための限定的なライセンスをModalに付与します。Modalは集計済みまたは恒久的に匿名化されたサービス指標を、契約期間中も終了後も自社の事業目的に使用できます。
  • 処理場所:顧客は処理を指定したリージョンに限定でき、Modalは事前の書面同意なしに他の場所で顧客データを処理しません。
  • 認証:ModalはSOC 2 Type 2監査を完了しており、報告書はセキュリティポータルで請求できます。
  • HIPAA:PHIを送信する前に、Enterpriseで利用できる事業提携契約を締結しておく必要があります。Volumes v1、イメージ(ファイルシステムとディレクトリのスナップショットを除く)、メモリスナップショット、ユーザーコードは対象外で、Volumes v2は対象です。
  • 隔離と暗号化:計算ジョブはgVisorで仮想化され、サンドボックスは安全なVMランタイムで動く場合もあります。ユーザーデータは転送中も保存時も暗号化され、公開APIはTLS 1.3を使います。
  • 責任共有:自社データのバックアップは顧客の責任です。
  • プライバシーポリシー:最終更新は2023年5月17日で、サービスは13歳未満を対象としていないとしています。

よくある質問

Q1. Modalに無料プランはありますか?

Starterにはプラットフォーム料金がなく、毎月$30の計算資源が含まれますが、請求ガイドは支払い方法の登録を求めており、共有エンドポイントのトークンは最初のリクエストから課金されます。

Q2. アプリがアイドル状態でも課金されますか?

ゼロにスケールした後は課金されません。既定の60秒のキープアライブと、長めのscaledown_window内のアイドル時間は課金され、min_containersを使うと関数がゼロになりません。

Q3. ワークロードをEU内にとどめられますか?

関数とサンドボックスは1.15倍または1.75倍の倍率でEUリージョンに固定し、eu-west経由でルーティングできますが、アプリログは米国に残り、大きな入出力はus-eastを経由し、共有エンドポイントは固定できません。

類似のツールをご存知ですか?
他の素晴らしいAIツールをご存知でしたら、ぜひ私たちに提出してください