Toolso.AI
Toolso.AI
FerramentasCategoriasTendênciaNovidadesPreçosBlog
Toolso.AI
Toolso.AI

💌Subscreva a Ferramentas de IA Semanal

Seleção semanal das últimas e mais populares ferramentas e tendências de IA, entregues na sua caixa de correio Subscrever

Toolso.AI
Toolso.AI

Descubra as melhores ferramentas de IA para impulsionar a sua produtividade

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Categorias Populares

  • Escrita com IA
  • Imagem IA
  • Vídeo IA
  • Programação IA
  • Mais Categorias

Explorar

  • Últimas Ferramentas
  • Ferramentas Populares
  • Mais Ferramentas
  • Submeter Ferramenta
  • Preços

Sobre

  • Sobre Nós
  • Contacto
  • Blog
  • Registo de Alterações

Legal

  • Política de Cookies
  • Política de Privacidade
  • Termos de Serviço
  • Política de Reembolso
© 2026 Toolso.AI Todos os Direitos Reservados
Oferta limitadaOferta por tempo limitadoDestaque promocionalRevisão em 24 h · Sem backlink · 30 dias em destaque$29.90depois $59.90Sobe para $59.90 após 31 de out.Termina em--:--:--Enviar agora
  1. Início
  2. Todas as Ferramentas
  3. Ferramentas de desenvolvimento
  4. Modal
Prévia da interface do Modal
Logotipo do Modal

Modal

O Modal executa funções Python, endpoints de inferência, sandboxes isoladas e notebooks em GPUs e CPUs cobradas por segundo, do plano Starter de $0 com $30 de computação mensal a contratos Enterprise personalizados.

Ferramentas de desenvolvimentoDesenvolvimento de IAPlataforma de Treinamento de IA#Aprendizado de máquina#Processamento em lote#API compatível com OpenAI
Experimentar Grátis
Salvos
Visitas
Visualizações
Preço
Grátis
Publicado
5 de out. de 2026
Domínio
modal.com
Avaliação dos utilizadores

Já usou esta ferramenta? Avalie-a

Avaliar esta ferramenta

Informação do Produto Modal

Experimentar Grátis
Informações da Ferramenta
Salvos
Visitas
Visualizações
Preço
Grátis
Publicado
5 de out. de 2026
Domínio
modal.com
Avaliação dos utilizadores

Já usou esta ferramenta? Avalie-a

Avaliar esta ferramenta

Ferramentas em Destaque

Ferramentas Relacionadas

Experimentar Grátis

O que é Modal?

Modal é uma nuvem serverless que executa código Python em GPUs e CPUs com cobrança por segundo; a empresa a descreve como infraestrutura de nuvem para equipes que desenvolvem, treinam e servem aplicações de IA em escala.

O Modal coloca seu código em um contêiner, executa-o na nuvem e adiciona contêineres automaticamente quando o tráfego cresce, reunindo capacidade das principais nuvens para escolher onde cada tarefa roda. Imagens de contêiner e solicitações de GPU são escritas em Python, então um app do Modal não tem arquivos de implantação YAML.

A Modal Labs opera o modal.com. Segundo a imprensa de tecnologia independente, o Modal foi fundado em 2021 pelo CEO Erik Bernhardsson e pelo CTO Akshat Bubna; a empresa diz ter captado mais de 466 milhões de dólares de investidores como General Catalyst e Redpoint Ventures. Em 28 de setembro de 2026, uma reportagem de tecnologia que citava uma fonte anônima disse que a Modal Labs, que ela chamou de provedora de infraestrutura de inferência de IA, estava perto de fechar uma rodada de 750 milhões de dólares liderada pela Accel, com avaliação de 15,75 bilhões de dólares; a Modal Labs não quis comentar.

Principais funcionalidades

O Modal cobre inferência com o que chama de partidas a frio abaixo de um segundo, jobs em lote paralelos, treinamento e ajuste fino, Sandboxes isoladas para código gerado por IA e Notebooks colaborativos com GPU.

Funções, endpoints e jobs em lote

  • Endpoints HTTPS: toda função pode virar um endpoint HTTPS que escala com o tráfego e fica em zero quando ociosa.
  • Distribuição em massa e tarefas de fundo: um job pode se espalhar por milhares de GPUs sem camada de orquestração ou disparar trabalho em lote assíncrono.
  • Armazenamento: os Volumes servem de sistema de arquivos distribuído para imagens, pesos de modelos e conjuntos de dados.
  • Observabilidade: logs e métricas por contêiner, exportáveis para provedores de OpenTelemetry como o Datadog.

Escolha de GPU

O argumento gpu aceita T4, L4, A10, L40S, A100 (genérica, 40 GB ou 80 GB), RTX PRO 6000, H100 (ou H100!), H200, B200 (ou B200+) e B300. B300, B200, H200, H100, A100, L4, T4 e L40S permitem até 8 GPUs por contêiner (até 2.304 GB de RAM de GPU); a A10 para em 4 GPUs e 96 GB.

Dois upgrades automáticos importam para benchmarks: uma solicitação de H100 pode rodar em uma H200 e uma de A100 em uma A100 de 80 GB, pelo preço original, enquanto solicitar H100! exclui o upgrade para H200. Uma função também pode listar tipos de GPU em ordem de preferência, e o Modal desce pela lista.

Endpoints de inferência

  • Endpoints compartilhados (Shared Endpoints): um subconjunto de modelos da Modal Library servidos de pools gerenciados pelo Modal e cobrados por token; cada um também pode rodar em um endpoint dedicado (Dedicated Endpoint) para capacidade isolada ou configurável.
  • Serviço compatível com OpenAI: o Modal divulga endpoints compatíveis com OpenAI para modelos abertos.

Modal Sandboxes

Modal Sandboxes são contêineres seguros, definidos em tempo de execução, para executar código não confiável de usuários ou agentes. O Modal diz que é possível criar milhões programaticamente em menos de um minuto, com snapshot e restauração para inicializar rápido.

Notebooks

Notebooks Jupyter hospedados com preços serverless, desligamento automático por ociosidade, GPUs do Modal e edição colaborativa em tempo real.

Treinamento e clusters multinó

O Modal anunciou em 1º de outubro de 2026 que o Modal Clusters está disponível para todos pelo decorador @modal.clustered: grupos de GPUs multinó com RDMA, agendados em bloco de um pool de capacidade compartilhado e cobrados por segundo.

Guia

Primeiros passos

  1. Crie uma conta em modal.com.
  2. Execute pip install modal e depois modal setup para se autenticar (ou python -m modal setup se a primeira forma falhar).
  3. Escreva uma função Python decorada com @app.function(...), indicando a imagem de contêiner e a GPU, e execute o arquivo com modal run path/to/file.py.

Ajustando partidas a frio e custo ocioso

O Modal diz que os contêineres inicializam em cerca de um segundo, mas só ficam aquecidos depois de executadas as importações e outras configurações de escopo global, então ficar pronto pode levar de segundos a minutos. Três configurações equilibram latência e gasto ocioso:

  • scaledown_window: mantém contêineres ociosos ativos de 2 segundos a 20 minutos; janelas mais longas dão menos partidas a frio, mas os recursos ociosos são cobrados.
  • min_containers e buffer_containers: o primeiro mantém um piso de contêineres aquecidos para que a função nunca escale a zero; o segundo adiciona contêineres de reserva enquanto ela está ativa.
  • Regiões amplas: uma região ampla como us oferece um pool de recursos maior que uma estreita, melhorando o tempo de partida a frio e a disponibilidade.

Casos de uso e exemplos

O Modal pode implantar qualquer aplicação Python conteinerizável e mira computação intensiva com escala horizontal: inferência de ML em escala, treinamento e ajuste fino de modelos, pipelines de dados, computação científica e filas de jobs.

  • Plataformas de IA para a empresa inteira: Andy Fang, cofundador da DoorDash, diz que a plataforma de IA da empresa usa o Modal para inferência, sandboxes para agentes e computação para código próprio.
  • Aprendizado por reforço e serviço de modelos: Scott Wu, CEO da Cognition, diz que o Modal executa tanto a infraestrutura de RL quanto a inferência em produção da empresa.
  • Avaliação de agentes: o chefe de IA aplicada da Ramp diz que a ferramenta Inspect da empresa teria sido difícil de construir sem as sandboxes rápidas do Modal.
  • Projetos de referência: os exemplos cobrem transcrição em tempo real com Kyutai STT, ajuste fino do Flux, um agente de programação com Sandboxes e LangGraph, o treinamento de um modelo de linguagem pequeno e o processamento paralelo de Parquet no S3.

As três citações de clientes são depoimentos da página inicial, não estudos de caso independentes.

Para Quem É

  • Desenvolvedores Python e engenheiros de ML: as funções são definidas em Python; JavaScript/TypeScript e Go podem chamar funções, executar Sandboxes e gerenciar recursos.
  • Equipes com demanda irregular: o Modal argumenta que suas tarifas por hora podem parecer mais altas, enquanto o custo total é menor para volumes de solicitações com picos ou imprevisíveis.
  • De equipes pequenas a grandes organizações: o Starter é voltado a equipes pequenas e desenvolvedores independentes, o Team a startups e organizações maiores, e o Enterprise a organizações que priorizam segurança e suporte.
  • Startups e pesquisadores: startups em estágio inicial podem solicitar créditos de computação gratuitos, e acadêmicos podem obter até $10k em créditos.

Os sinais de avaliações independentes desta rodada são limitados: em uma plataforma de avaliações ligada a uma comunidade de lançamentos, o Modal tinha nota 5,0 com 61 avaliações em 5 de outubro de 2026, e seu resumo por IA diz que os avaliadores são sobretudo fundadores e que quase não há críticas.

Plataformas

  • SDK Python e CLI: a maioria das interações passa pela ferramenta de linha de comando de código aberto modal e pela biblioteca cliente Python.
  • SDKs de JavaScript/TypeScript e Go: em beta; definir funções provavelmente continuará exclusivo do Python.
  • Navegador: os Notebooks abrem em modal.com/notebooks, e é possível enviar arquivos .ipynb.
  • Regiões de capacidade: EUA, UE, Ásia-Pacífico, Japão, Austrália, Reino Unido, Canadá, Oriente Médio, América do Sul, África e México, em mais de 20 nuvens.
  • Roteamento de solicitações: as entradas de funções passam por padrão por us-east (Virgínia); routing_region também aceita us-west (Oregon), eu-west (Dublin) e ap-south (Mumbai).
  • Marketplaces de nuvem: clientes Enterprise podem comprar pelos marketplaces da AWS e do GCP para usar gastos comprometidos.

Preços

O Modal combina um plano mensal com preços de GPU por segundo e CPU e memória medidas por uso; os preços de tabela abaixo foram registrados em 5 de outubro de 2026.

Planos

PlanoTaxa de plataformaComputação incluídaAssentosContêineres / concorrência de GPURetenção de logsTráfego de saída incluído
Starter$0 + computação / mês$30 / mês3100 / 101 dia1 TiB / mês
Team$250 + computação / mês$100 / mêsIlimitados5.000 / 5030 dias10 TiB / mês
EnterprisePersonalizadoPersonalizadoIlimitadosMaior concorrência de GPUPersonalizada100 TiB / mês

O Enterprise adiciona descontos por volume, serviços de engenharia de ML incorporados, suporte privado no Slack, logs de auditoria, SSO com Okta e HIPAA. O Starter permite 200 apps implantados e 5 jobs cron implantados e exclui domínios personalizados, reversões de implantação, orçamentos por ambiente, o proxy de IP estático e RBAC; o Team mantém 3 versões para reversão.

Preços de GPU por segundo

RecursoPreço por segundo
Nvidia B300$0.001972
Nvidia B200$0.001736
Nvidia H200 SXM$0.001261
Nvidia H100 SXM5$0.001097
Nvidia RTX PRO 6000$0.000842
Nvidia A100, 80 GB$0.000694
Nvidia A100, 40 GB$0.000583
Nvidia L40S$0.000542
Nvidia A10$0.000306
Nvidia L4$0.000222
Nvidia T4$0.000164
CPU, por núcleo físico (2 vCPU)$0.0000131
Memória, por GiB$0.00000222

A CPU tem mínimo de 0,125 núcleo por contêiner. Sandboxes e Notebooks usam tarifas de CPU e memória mais altas, $0.00003942 por núcleo e $0.00000667 por GiB por segundo, com GPUs a preço padrão. Os Volumes custam $0.09 por GiB por mês após 1 TiB grátis, e o tráfego de saída além da franquia do plano custa $0.04 por GiB. O exemplo de cálculo do Modal coloca o Stable Diffusion em uma A10G em cerca de $0.491 por 1.000 imagens.

O que entra na conta

  • Tempo de carga e ociosidade: o Modal cobra o tempo de carga e processamento mais um keep-alive padrão e configurável de 60 segundos após a última entrada; um app escalado a zero não é cobrado.
  • Solicitação ou uso: CPU e memória são cobradas pelo maior valor entre o solicitado e o usado, com mínimo de 128 MiB e 0,125 núcleo por contêiner.
  • Fixação de região: fixar a região de um contêiner custa 1,15 vez os preços base em uma região ampla e 1,75 vez em uma estreita; misturar as duas aplica o multiplicador menor.
  • Execução não preemptiva: nonpreemptible=True triplica os preços de tabela de CPU e memória e não está disponível para funções com GPU.
  • Tokens dos endpoints compartilhados: a computação incluída não os cobre; desde 1º de setembro de 2026, os tokens são cobrados desde a primeira solicitação, mesmo no Starter.
  • Forma de pagamento: o guia de faturamento exige uma cadastrada para usar o Modal de qualquer forma, enquanto o guia de GPU a vincula ao uso de GPU; as páginas diferem em escopo.
  • Ciclo de cobrança e limites: a cobrança é mensal, com cobranças automáticas adicionais quando o uso ultrapassa certos limites pela primeira vez; um limite de gastos atingido interrompe cargas de trabalho que gerariam cobranças do próprio bolso.
  • Créditos de nuvem e reembolsos: créditos da AWS, do GCP ou do Azure não podem ser aplicados, e o contrato de software como serviço do Modal, em vigor desde maio de 2026, diz que as taxas não são reembolsáveis, exceto o descrito em sua seção 3.2.

Alternativas ao Modal

Cada plataforma de GPU serverless abaixo difere do Modal principalmente em como o tempo ocioso é cobrado e na amplitude do cardápio de GPUs.

OpçãoEscolha de GPUEscala a zeroRegra de ociosidade e cobrança
Google Cloud Run (GPU)RTX PRO 6000 Blackwell (96 GB) ou L4 (24 GB)SimCobrança por instância; instâncias mínimas cobradas integralmente mesmo ociosas
RunPod ServerlessNão tratado aquiWorkers flex sim; workers ativos rodam 24/7Cobrado por segundo do início do worker até ele parar por completo, arredondado para cima
ReplicateNão tratado aquiModelos públicos simA maioria dos modelos privados roda em hardware dedicado e é cobrada pelo tempo de configuração, ociosidade e atividade

A divisão entre workers flex e ativos do RunPod espelha a escolha de min_containers no Modal. O Replicate cobra a maioria dos modelos públicos por tempo de execução e alguns por entrada e saída. Os diferenciais do Modal são a infraestrutura definida em Python e as Sandboxes na mesma conta, além de uma lista de GPUs mais longa que a do Cloud Run.

Limitações

Limites de execução

  • Preempção por padrão: qualquer função pode sofrer preempção e é reiniciada com a mesma entrada; a interrupção fica mais provável quanto mais longa a execução.
  • Tempos limite: execuções de funções têm padrão de 300 segundos, configuráveis de 1 segundo a 24 horas; as Sandboxes têm vida útil padrão de 5 minutos, extensível a 24 horas.
  • Concorrência: os limites do workspace para contêineres e GPUs simultâneos seguem o plano, e uma única função tem limite rígido de 4.000 contêineres simultâneos.
  • Solicitações grandes de GPU: mais de 2 GPUs por contêiner costuma significar esperas mais longas.
  • Versão mínima de CUDA: a B300 exige CUDA 13.1 ou posterior.
  • Limitação dos endpoints compartilhados: limites de concorrência por modelo valem em todo o workspace, e solicitações acima do limite recebem HTTP 429.
  • Status multinó inconsistente: o guia de GPU ainda diz que o treinamento multinó está em beta privado, enquanto o anúncio de 1º de outubro de 2026 chama o Modal Clusters de disponível para todos.

Regiões e residência de dados

  • Fixação estrita: cargas fixadas em uma região nunca são movidas para outro lugar, mesmo que essa região fique sem capacidade.
  • Restrições de roteamento: routing_region só pode ser definido na primeira implantação de uma função, e entradas e saídas maiores que 2 MiB ainda vão para o armazenamento de objetos em us-east.
  • Endpoints compartilhados: não há região de contêiner nem de roteamento selecionável; o tráfego passa por us-west pelo pool de computação global.
  • Logs: os logs de aplicação de funções, Sandboxes e servidores são armazenados nos EUA.

Uso aceitável

O contrato do Modal proíbe mineração de criptomoedas ou atividades de blockchain relacionadas, ataques de negação de serviço, compartilhamento de arquivos ponto a ponto e plataformas genéricas de hospedagem de arquivos ou de distribuição de mídia.

Privacidade, segurança e direitos sobre dados

  • Acesso aos dados: o Modal diz que nunca acessará nem usará seu código-fonte, as entradas ou saídas das funções ou os dados armazenados em imagens ou Volumes; logs e metadados de apps só são acessados com sua permissão, para solução de problemas.
  • Retenção: entradas e saídas de funções são criptografadas em repouso e excluídas em um TTL máximo de 7 dias; os endpoints do Modal Inference têm retenção zero de dados, e os payloads nunca são gravados em disco.
  • Propriedade: os clientes mantêm todos os direitos sobre os dados do cliente e concedem ao Modal uma licença limitada para prestar o serviço; o Modal pode usar métricas de serviço agregadas ou permanentemente anonimizadas para seus próprios fins comerciais durante e após o contrato.
  • Locais de processamento: os clientes podem restringir o processamento a regiões definidas, e o Modal não processará dados do cliente em outro lugar sem consentimento prévio por escrito.
  • Certificações: o Modal concluiu uma auditoria SOC 2 Type 2; o relatório pode ser solicitado pelo seu portal de segurança.
  • HIPAA: um acordo de associado comercial, disponível no Enterprise, precisa estar em vigor antes do envio de qualquer PHI; Volumes v1, imagens (exceto snapshots de sistema de arquivos e de diretório), snapshots de memória e código de usuário ficam fora dele, enquanto os Volumes v2 são cobertos.
  • Isolamento e criptografia: jobs de computação são virtualizados com gVisor, as Sandboxes também podem rodar em um ambiente de execução de VM seguro, os dados de usuário são criptografados em trânsito e em repouso, e as APIs públicas usam TLS 1.3.
  • Responsabilidade compartilhada: os clientes são responsáveis pelos backups dos próprios dados.
  • Política de privacidade: atualizada pela última vez em 17 de maio de 2023; diz que os serviços não se destinam a ninguém com menos de 13 anos.

FAQ

Q1. O Modal tem plano gratuito?

O Starter não tem taxa de plataforma e inclui $30 de computação por mês, mas o guia de faturamento exige uma forma de pagamento cadastrada, e os tokens dos endpoints compartilhados são cobrados desde a primeira solicitação.

Q2. Sou cobrado quando meu app está ocioso?

Não depois que ele escala a zero. O keep-alive padrão de 60 segundos e o tempo ocioso dentro de um scaledown_window mais longo são cobrados, e min_containers impede que a função chegue a zero.

Q3. Posso manter as cargas de trabalho dentro da UE?

Funções e Sandboxes podem ser fixadas em regiões da UE com multiplicador de 1,15 ou 1,75, com roteamento por eu-west, mas os logs de aplicação ficam nos EUA, entradas e saídas grandes passam por us-east e os endpoints compartilhados não podem ser fixados.

Conhece uma Ferramenta Semelhante?
Se conhece outras ótimas ferramentas de IA, sinta-se à vontade para as submeter-nos