Toolso.AI
Toolso.AI
모든 도구카테고리인기최신 도구가격블로그
Toolso.AI
Toolso.AI

💌AI 도구 위클리 구독

매주 선별된 최신 및 핫한 AI 도구와 트렌드를 받은편지함으로 받아보세요 구독

Toolso.AI
Toolso.AI

생산성을 높일 최고의 AI 도구 발견

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

인기 카테고리

  • AI 글쓰기
  • AI 이미지
  • AI 비디오
  • AI 코딩
  • 더 많은 카테고리

탐색

  • 최신 도구
  • 인기 도구
  • 더 많은 도구
  • 도구 제출
  • 요금

회사 소개

  • 회사 소개
  • 문의하기
  • 블로그
  • 변경 로그

법률

  • 쿠키 정책
  • 개인정보 보호정책
  • 서비스 약관
  • 환불 정책
© 2026 Toolso.AI 모든 권리 보유
기간 한정기간 한정 프로모션추천 등록24시간 우선 심사 · 백링크 불필요 · 30일 추천 노출$29.90이후 $59.9010월 31일 이후 $59.90로 인상종료까지--:--:--지금 제출
  1. 홈
  2. 모든 도구
  3. 개발 도구
  4. Modal
Modal 인터페이스 미리보기
Modal 로고

Modal

Modal은 초 단위로 과금되는 GPU와 CPU에서 Python 함수, 추론 엔드포인트, 격리된 샌드박스, Notebooks를 실행하며, 월 $30 컴퓨팅이 포함된 $0 Starter 플랜부터 맞춤형 Enterprise 계약까지 제공합니다.

개발 도구AI 개발AI 훈련 플랫폼#머신 러닝#일괄 처리#OpenAI 호환 API
무료로 사용해보기
저장
방문 횟수
조회수
가격
무료
출시일
2026년 10월 5일
도메인
modal.com
사용자 평점

이 도구를 사용해 보셨나요? 평점을 남겨 주세요

이 도구 평가하기

Modal 제품 정보

무료로 사용해보기
도구 정보
저장
방문 횟수
조회수
가격
무료
출시일
2026년 10월 5일
도메인
modal.com
사용자 평점

이 도구를 사용해 보셨나요? 평점을 남겨 주세요

이 도구 평가하기

추천 도구

관련 도구

무료로 사용해보기

Modal, 어떤 도구인가요?

Modal은 GPU와 CPU에서 Python 코드를 실행하고 초 단위로 과금하는 서버리스 클라우드이며, 회사는 이를 AI 애플리케이션을 대규모로 개발·학습·서빙하는 팀용 클라우드 인프라라고 설명합니다.

Modal은 코드를 컨테이너에 넣어 클라우드에서 실행하고, 트래픽이 늘면 컨테이너를 자동 추가하며, 주요 클라우드 전반의 용량을 모아 각 작업의 실행 위치를 고릅니다. 컨테이너 이미지와 GPU 요청을 Python 코드로 작성하므로 Modal 앱에는 YAML 배포 파일이 없습니다.

Modal Labs가 modal.com을 운영합니다. 독립 기술 매체 보도에 따르면 Modal은 2021년 CEO Erik Bernhardsson과 CTO Akshat Bubna가 설립했으며, 회사는 General Catalyst와 Redpoint Ventures 등 투자사로부터 4억 6,600만 달러 이상을 유치했다고 밝힙니다. 2026년 9월 28일, 익명 소식통을 인용한 한 기술 뉴스 보도는 Modal Labs(보도는 AI 추론 인프라 제공업체로 지칭)가 Accel이 주도하는 7억 5,000만 달러 투자 라운드를 기업가치 157억 5,000만 달러로 성사 직전에 두고 있다고 전했으며, Modal Labs는 논평을 거부했습니다.

핵심 기능

Modal은 추론(회사 표현으로는 1초 미만의 콜드 스타트), 병렬 배치 작업, 학습과 파인튜닝, AI 생성 코드용 격리 샌드박스, GPU 기반 협업 Notebooks를 다룹니다.

함수, 엔드포인트, 배치 작업

  • HTTPS 엔드포인트: 어떤 함수든 트래픽에 따라 확장되고 유휴 시 0으로 줄어드는 HTTPS 엔드포인트가 될 수 있습니다.
  • 팬아웃과 백그라운드 작업: 작업 하나를 오케스트레이션 계층 없이 GPU 수천 개로 팬아웃하거나 비동기 배치 작업을 생성할 수 있습니다.
  • 스토리지: Volumes는 이미지, 모델 가중치, 데이터셋용 분산 파일 시스템 역할을 합니다.
  • 관측 가능성: 컨테이너별 로그와 지표를 제공하고 Datadog 같은 OpenTelemetry 제공업체로 내보낼 수 있습니다.

GPU 선택

gpu 인수는 T4, L4, A10, L40S, A100(일반, 40 GB 또는 80 GB), RTX PRO 6000, H100(또는 H100!), H200, B200(또는 B200+), B300을 받습니다. B300, B200, H200, H100, A100, L4, T4, L40S는 컨테이너당 최대 8개 GPU(GPU RAM 최대 2,304 GB)를 쓸 수 있고, A10은 GPU 4개와 96 GB가 한도입니다.

벤치마크에 영향을 주는 자동 업그레이드가 두 가지 있습니다. H100 요청은 H200에서, A100 요청은 80 GB A100에서 원래 가격으로 실행될 수 있으며, H100!을 요청하면 H200 업그레이드에서 제외됩니다. 함수에 GPU 유형을 선호 순으로 나열할 수도 있으며, Modal은 목록 순서대로 대체합니다.

추론 엔드포인트

  • 공유 엔드포인트(Shared Endpoints): Modal Library 모델 중 일부를 Modal 관리형 풀에서 서빙하고 토큰 단위로 과금합니다. 각 모델은 격리되거나 구성 가능한 용량을 위해 전용 엔드포인트(Dedicated Endpoint)에서도 실행할 수 있습니다.
  • OpenAI 호환 서빙: Modal은 오픈 모델용 OpenAI 호환 엔드포인트를 내세웁니다.

Modal Sandboxes

Modal Sandboxes는 런타임에 정의되는 보안 컨테이너로, 신뢰할 수 없는 사용자나 에이전트 코드를 실행합니다. Modal은 1분 안에 프로그래밍 방식으로 수백만 개를 만들 수 있고 빠른 시작을 위한 스냅샷과 복원을 지원한다고 말합니다.

Notebooks

서버리스 요금, 유휴 시 자동 종료, Modal GPU, 실시간 공동 편집을 갖춘 호스팅형 Jupyter 노트북입니다.

학습과 멀티노드 클러스터

Modal은 2026년 10월 1일 Modal Clusters가 @modal.clustered 데코레이터를 통해 정식 출시되었다고 발표했습니다. RDMA를 갖춘 멀티노드 GPU 그룹으로, 공유 용량 풀에서 갱 스케줄링되며 초 단위로 과금됩니다.

가이드

시작하기

  1. modal.com에서 계정을 만듭니다.
  2. pip install modal을 실행한 뒤 modal setup으로 인증합니다(첫 번째 형식이 실패하면 python -m modal setup).
  3. @app.function(...) 데코레이터를 붙인 Python 함수를 작성해 컨테이너 이미지와 GPU를 지정하고, modal run path/to/file.py로 파일을 실행합니다.

콜드 스타트와 유휴 비용 조정

Modal은 컨테이너가 약 1초 만에 부팅된다고 말하지만, 임포트 등 전역 범위 설정이 실행된 뒤에야 웜 상태가 되므로 준비까지 몇 초에서 몇 분이 걸릴 수 있습니다. 다음 세 가지 설정으로 지연 시간과 유휴 비용을 맞바꿉니다.

  • scaledown_window: 유휴 컨테이너를 2초에서 20분까지 살려 둡니다. 창이 길수록 콜드 스타트는 줄지만 유휴 리소스가 과금됩니다.
  • min_containers와 buffer_containers: 전자는 웜 컨테이너 하한을 유지해 함수가 0으로 줄지 않게 하고, 후자는 함수가 활성 상태일 때 여분의 컨테이너를 추가합니다.
  • 광역 리전: us 같은 광역 리전은 협역 리전보다 리소스 풀이 커서 콜드 스타트 시간과 가용성이 개선됩니다.

사용 사례와 예시

Modal은 컨테이너화할 수 있는 모든 Python 애플리케이션을 배포할 수 있으며, 수평 확장되는 연산 집약적 작업, 즉 대규모 ML 추론, 모델 학습과 파인튜닝, 데이터 파이프라인, 과학 계산, 작업 큐를 겨냥합니다.

  • 전사 AI 플랫폼: DoorDash 공동 창업자 Andy Fang은 자사 AI 플랫폼이 추론, 에이전트용 샌드박스, 맞춤 코드용 컴퓨팅에 Modal을 쓴다고 말합니다.
  • 강화 학습과 서빙: Cognition CEO Scott Wu는 Modal이 자사 RL 인프라와 프로덕션 추론을 모두 실행한다고 말합니다.
  • 에이전트 평가: Ramp의 응용 AI 책임자는 빠른 Modal 샌드박스가 없었다면 자사 Inspect 도구를 만들기 어려웠을 것이라고 말합니다.
  • 참고 프로젝트: Kyutai STT를 이용한 실시간 전사, Flux 파인튜닝, 샌드박스와 LangGraph 기반 코딩 에이전트, 소형 언어 모델 학습, S3에서의 병렬 Parquet 처리 예시가 있습니다.

위 세 고객 발언은 홈페이지 추천사이며 독립 사례 연구가 아닙니다.

누구를 위한 것인가

  • Python 개발자와 ML 엔지니어: 함수는 Python으로 정의하며, JavaScript/TypeScript와 Go로는 함수 호출, 샌드박스 실행, 리소스 관리가 가능합니다.
  • 수요가 급변하는 팀: Modal은 요청량이 급증하거나 예측하기 어려운 경우 시간당 요금은 더 높아 보일 수 있지만 총비용은 더 낮다고 주장합니다.
  • 소규모 팀부터 대규모 조직까지: Starter는 소규모 팀과 개인 개발자, Team은 스타트업과 더 큰 조직, Enterprise는 보안과 지원을 중시하는 조직을 대상으로 합니다.
  • 스타트업과 연구자: 초기 단계 스타트업은 무료 컴퓨팅 크레딧을 신청할 수 있고, 학계 연구자는 최대 $10k 크레딧을 받을 수 있습니다.

이번 조사에서 찾은 독립 리뷰 신호는 제한적입니다. 한 런칭 커뮤니티 리뷰 플랫폼에서 2026년 10월 5일 수집 기준 Modal은 리뷰 61건으로 5.0점을 받았고, 해당 플랫폼의 AI 요약은 리뷰어가 대부분 창업자이며 리뷰에 비판적 피드백이 거의 없다고 말합니다.

플랫폼

  • Python SDK와 CLI: 대부분의 상호작용은 오픈소스 modal 명령줄 도구와 Python 클라이언트 라이브러리로 이뤄집니다.
  • JavaScript/TypeScript 및 Go SDK: 베타 단계이며, 함수 정의는 Python 전용으로 남을 가능성이 높습니다.
  • 브라우저: Notebooks는 modal.com/notebooks에서 열리며 .ipynb 파일을 업로드할 수 있습니다.
  • 용량 리전: 미국, EU, 아시아 태평양, 일본, 호주, 영국, 캐나다, 중동, 남미, 아프리카, 멕시코로, 20개가 넘는 클라우드에 걸쳐 있습니다.
  • 요청 라우팅: 함수 입력은 기본적으로 us-east(버지니아)를 거치며, routing_region은 us-west(오리건), eu-west(더블린), ap-south(뭄바이)도 받습니다.
  • 클라우드 마켓플레이스: Enterprise 고객은 약정 지출을 활용하기 위해 AWS와 GCP 마켓플레이스에서 구매할 수 있습니다.

가격

Modal은 월간 플랜에 초 단위 GPU 요금과 사용량 기반 CPU·메모리 요금을 결합합니다. 아래 정가는 2026년 10월 5일에 수집했습니다.

플랜

플랜플랫폼 요금포함 컴퓨팅좌석컨테이너 / GPU 동시 실행로그 보존포함 송신 트래픽
Starter월 $0 + 컴퓨팅월 $303100 / 101일월 1 TiB
Team월 $250 + 컴퓨팅월 $100무제한5000 / 5030일월 10 TiB
Enterprise맞춤맞춤무제한더 높은 GPU 동시 실행맞춤월 100 TiB

Enterprise에는 사용량 기반 할인, 임베디드 ML 엔지니어링 서비스, 비공개 Slack 지원, 감사 로그, Okta SSO, HIPAA가 추가됩니다. Starter는 배포된 앱 200개와 배포된 크론 작업 5개를 허용하며 커스텀 도메인, 배포 롤백, 환경 수준 예산, 고정 IP 프록시, RBAC는 제외되고, Team은 롤백 버전 3개를 보관합니다.

초 단위 GPU 요금

리소스초당 가격
Nvidia B300$0.001972
Nvidia B200$0.001736
Nvidia H200 SXM$0.001261
Nvidia H100 SXM5$0.001097
Nvidia RTX PRO 6000$0.000842
Nvidia A100, 80 GB$0.000694
Nvidia A100, 40 GB$0.000583
Nvidia L40S$0.000542
Nvidia A10$0.000306
Nvidia L4$0.000222
Nvidia T4$0.000164
CPU, 물리 코어당(2 vCPU)$0.0000131
메모리, GiB당$0.00000222

CPU는 컨테이너당 최소 0.125코어입니다. 샌드박스와 Notebooks는 더 높은 CPU·메모리 요금인 초당 코어당 $0.00003942와 GiB당 $0.00000667를 적용하며 GPU는 표준 가격입니다. Volumes는 1 TiB 무료 이후 월 GiB당 $0.09이고, 플랜 허용량을 넘는 송신 트래픽은 GiB당 $0.04입니다. Modal의 계산 예시에서 A10G의 Stable Diffusion은 이미지 1,000장당 약 $0.491입니다.

청구에 포함되는 항목

  • 로드와 유휴 시간: Modal은 로드·처리 시간과 마지막 입력 후 기본 60초(구성 가능)의 킵얼라이브를 과금하며, 0으로 축소된 앱은 과금되지 않습니다.
  • 요청량 또는 사용량: CPU와 메모리는 요청량과 사용량 중 더 높은 쪽으로 과금되며, 컨테이너당 최소 128 MiB와 0.125코어입니다.
  • 리전 고정: 컨테이너 리전을 고정하면 광역 리전은 기본 가격의 1.15배, 협역 리전은 1.75배이며, 둘을 섞으면 더 작은 배수가 적용됩니다.
  • 선점 불가 실행: nonpreemptible=True는 CPU와 메모리 정가를 3배로 만들며 GPU 함수에는 사용할 수 없습니다.
  • 공유 엔드포인트 토큰: 포함 컴퓨팅으로 충당되지 않으며, 2026년 9월 1일부터는 Starter에서도 첫 요청부터 토큰이 과금됩니다.
  • 결제 수단: 청구 가이드는 Modal을 사용하는 것 자체에 결제 수단 등록을 요구하는 반면, GPU 가이드는 이를 GPU 사용과 연결합니다. 두 페이지의 적용 범위가 다릅니다.
  • 청구 주기와 한도: 청구는 월 단위이며, 사용량이 특정 임계값을 처음 넘을 때 자동 청구가 추가됩니다. 지출 한도에 도달하면 추가 자기 부담 요금을 발생시킬 워크로드가 중지됩니다.
  • 클라우드 크레딧과 환불: AWS, GCP, Azure 크레딧은 적용할 수 없으며, 2026년 5월 시행된 Modal의 서비스형 소프트웨어 계약은 제3.2조에 기술된 경우를 제외하고 요금을 환불하지 않는다고 명시합니다.

Modal 대안

아래 서버리스 GPU 플랫폼들은 주로 유휴 시간 과금 방식과 GPU 선택 폭에서 Modal과 다릅니다.

옵션GPU 선택0으로 축소유휴 및 과금 규칙
Google Cloud Run(GPU)RTX PRO 6000 Blackwell(96 GB) 또는 L4(24 GB)예인스턴스 기반 과금, 최소 인스턴스는 유휴 상태여도 전액 과금
RunPod Serverless이번 비교에서 다루지 않음플렉스 워커는 예, 액티브 워커는 24시간 상시 실행워커 시작부터 완전히 멈출 때까지 초 단위 과금, 올림 처리
Replicate이번 비교에서 다루지 않음공개 모델은 예대부분의 비공개 모델은 전용 하드웨어에서 실행되며 설정, 유휴, 활성 시간이 과금됨

RunPod의 플렉스와 액티브 구분은 Modal의 min_containers 선택과 닮았습니다. Replicate는 대부분의 공개 모델을 실행 시간으로, 일부는 입력과 출력 기준으로 과금합니다. Modal의 차별점은 Python으로 정의하는 인프라와 같은 계정 안의 샌드박스, 그리고 Cloud Run보다 긴 GPU 목록입니다.

제한 사항

런타임 제한

  • 기본적으로 선점 가능: 어떤 함수든 선점될 수 있으며 같은 입력으로 다시 시작됩니다. 실행 시간이 길어질수록 중단될 가능성이 커집니다.
  • 타임아웃: 함수 실행은 기본 300초로 1초에서 24시간까지 설정할 수 있고, 샌드박스 기본 수명은 5분으로 24시간까지 연장할 수 있습니다.
  • 동시성: 워크스페이스의 동시 컨테이너와 GPU 한도는 플랜을 따르며, 단일 함수의 동시 컨테이너 하드 한도는 4,000개입니다.
  • 대규모 GPU 요청: 컨테이너당 GPU가 2개를 넘으면 대개 대기 시간이 길어집니다.
  • CUDA 최소 버전: B300에는 CUDA 13.1 이상이 필요합니다.
  • 공유 엔드포인트 스로틀링: 모델별 동시성 한도가 워크스페이스 전체에 적용되며, 한도를 넘는 요청은 HTTP 429를 받습니다.
  • 엇갈리는 멀티노드 상태: GPU 가이드는 여전히 멀티노드 학습이 비공개 베타라고 하는 반면, 2026년 10월 1일 발표는 Modal Clusters가 정식 출시되었다고 밝힙니다.

리전과 데이터 상주

  • 엄격한 고정: 리전 고정 워크로드는 해당 리전의 용량이 바닥나더라도 다른 곳으로 절대 옮겨지지 않습니다.
  • 라우팅 제약: routing_region은 함수를 처음 배포할 때만 설정할 수 있으며, 2 MiB보다 큰 입력과 출력은 여전히 us-east의 객체 스토리지로 갑니다.
  • 공유 엔드포인트: 선택 가능한 컨테이너·라우팅 리전이 없으며, 트래픽은 us-west를 거쳐 글로벌 컴퓨팅 풀 전반으로 라우팅됩니다.
  • 로그: 함수, 샌드박스, 서버의 애플리케이션 로그는 미국에 저장됩니다.

허용되는 사용

Modal의 계약은 암호화폐 채굴 또는 관련 블록체인 활동, 서비스 거부 공격, P2P 파일 공유, 범용 파일 호스팅 또는 미디어 서빙 플랫폼을 금지합니다.

개인정보, 보안, 데이터 권리

  • 데이터 접근: Modal은 소스 코드, 함수 입력이나 출력, 이미지나 Volumes에 저장된 데이터에 절대 접근하거나 사용하지 않는다고 말하며, 앱 로그와 메타데이터는 문제 해결을 위해 사용자 허락이 있을 때만 접근합니다.
  • 보존: 함수 입력과 출력은 저장 시 암호화되고 최대 7일의 TTL 안에 삭제됩니다. Modal Inference 엔드포인트는 제로 데이터 보존이며 페이로드를 디스크에 절대 기록하지 않습니다.
  • 소유권: 고객은 고객 데이터에 대한 모든 권리를 보유하고 Modal에 서비스 제공을 위한 제한적 라이선스를 부여합니다. Modal은 계약 기간 중과 종료 후에 집계되거나 영구 익명화된 서비스 지표를 자체 사업 목적으로 사용할 수 있습니다.
  • 처리 위치: 고객은 처리를 지정한 리전으로 제한할 수 있으며, Modal은 사전 서면 동의 없이 다른 곳에서 고객 데이터를 처리하지 않습니다.
  • 인증: Modal은 SOC 2 Type 2 감사를 완료했으며, 보고서는 보안 포털에서 요청할 수 있습니다.
  • HIPAA: PHI 제출 전에 Enterprise에서 제공하는 비즈니스 제휴 계약이 체결되어 있어야 합니다. Volumes v1, 이미지(파일 시스템 및 디렉터리 스냅샷 제외), 메모리 스냅샷, 사용자 코드는 그 범위 밖이며 Volumes v2는 적용 대상입니다.
  • 격리와 암호화: 컴퓨팅 작업은 gVisor로 가상화되고, 샌드박스는 보안 VM 런타임에서 실행될 수도 있으며, 사용자 데이터는 전송 중과 저장 시 모두 암호화되고 공개 API는 TLS 1.3을 사용합니다.
  • 공동 책임: 자체 데이터의 백업은 고객 책임입니다.
  • 개인정보 처리방침: 마지막 업데이트는 2023년 5월 17일이며, 서비스가 13세 미만을 대상으로 하지 않는다고 밝힙니다.

FAQ

Q1. Modal에 무료 요금제가 있나요?

Starter는 플랫폼 요금이 없고 매월 $30의 컴퓨팅이 포함되지만, 청구 가이드는 결제 수단 등록을 요구하며 공유 엔드포인트 토큰은 첫 요청부터 과금됩니다.

Q2. 앱이 유휴 상태일 때도 요금이 부과되나요?

0으로 축소된 뒤에는 부과되지 않습니다. 기본 60초 킵얼라이브와 더 긴 scaledown_window 안의 유휴 시간은 과금되며, min_containers를 쓰면 함수가 결코 0에 도달하지 않습니다.

Q3. 워크로드를 EU 안에 유지할 수 있나요?

함수와 샌드박스는 1.15배 또는 1.75배 배수로 EU 리전에 고정하고 eu-west를 통해 라우팅할 수 있지만, 애플리케이션 로그는 미국에 남고, 큰 입력과 출력은 us-east를 거치며, 공유 엔드포인트는 고정할 수 없습니다.

비슷한 도구를 아시나요?
다른 훌륭한 AI 도구를 알고 계시다면 저희에게 제출해 주세요