Toolso.AI
Toolso.AI
ИнструментыКатегорииПопулярныеНовинкиЦеныБлог
Toolso.AI
Toolso.AI

💌Подпишитесь на AI Tools Weekly

Еженедельно отобранная подборка последних и самых популярных AI-инструментов и трендов, доставляемая на вашу почту Подписаться

Toolso.AI
Toolso.AI

Откройте для себя лучшие AI-инструменты для повышения вашей продуктивности

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Популярные категории

  • AI-письмо
  • AI-изображения
  • AI-видео
  • AI-кодирование
  • Больше категорий

Исследовать

  • Новые инструменты
  • Популярные инструменты
  • Больше инструментов
  • Предложить инструмент
  • Цены

О нас

  • О нас
  • Контакты
  • Блог
  • История изменений

Правовая информация

  • Политика использования файлов cookie
  • Политика конфиденциальности
  • Условия использования
  • Политика возврата
© 2026 Toolso.AI Все права защищены
АкцияОграниченное предложениеПродвигаемое размещениеПроверка за 24 ч · Без обратной ссылки · 30 дней продвижения$29.90затем $59.90После 31 окт. цена вырастет до $59.90До конца--:--:--Отправить
  1. Главная
  2. Все инструменты
  3. Инструменты разработки
  4. Modal
Предпросмотр интерфейса Modal
Логотип Modal

Modal

Modal запускает функции на Python, эндпоинты для инференса, изолированные песочницы и блокноты на GPU и CPU с посекундной оплатой — от плана Starter за $0 с вычислениями на $30 в месяц до индивидуальных контрактов Enterprise.

Инструменты разработкиРазработка ИИПлатформа обучения ИИ#Машинное обучение#Пакетная обработка#API, совместимая с OpenAI
Попробовать бесплатно
Сохранений
Посещений
Просмотров
Цена
Бесплатно
Опубликовано
5 окт. 2026 г.
Домен
modal.com
Оценка пользователей

Пользовались этим инструментом? Оцените его

Оценить этот инструмент

Информация о продукте Modal

Попробовать бесплатно
Информация об инструменте
Сохранений
Посещений
Просмотров
Цена
Бесплатно
Опубликовано
5 окт. 2026 г.
Домен
modal.com
Оценка пользователей

Пользовались этим инструментом? Оцените его

Оценить этот инструмент

Рекомендуемые инструменты

Похожие инструменты

Попробовать бесплатно

Что такое Modal?

Modal — бессерверное облако, запускающее Python-код на GPU и CPU с посекундной оплатой; компания описывает его как облачную инфраструктуру для команд, разрабатывающих, обучающих и обслуживающих ИИ-приложения в больших масштабах.

Modal помещает ваш код в контейнер, выполняет его в облаке и автоматически добавляет контейнеры при росте трафика, объединяя мощности крупных облаков и выбирая, где запускать каждую задачу. Образы контейнеров и запросы GPU задаются кодом на Python, поэтому у приложения Modal нет YAML-файлов развёртывания.

Сайтом modal.com управляет Modal Labs. По данным независимых технологических СМИ, Modal основали в 2021 году CEO Эрик Бернхардссон и CTO Акшат Бубна; по словам компании, она привлекла более 466 млн долларов от инвесторов, включая General Catalyst и Redpoint Ventures. 28 сентября 2026 года в технологической новостной статье со ссылкой на неназванный источник сообщалось, что Modal Labs, которую статья назвала поставщиком инфраструктуры ИИ-инференса, близка к привлечению раунда на 750 млн долларов под руководством Accel при оценке в 15,75 млрд долларов; в Modal Labs от комментариев отказались.

Ключевые функции

Modal охватывает инференс с холодным стартом, который компания называет субсекундным, параллельные пакетные задачи, обучение и дообучение, изолированные песочницы для сгенерированного ИИ кода и совместные Notebooks с GPU.

Функции, эндпоинты и пакетные задачи

  • HTTPS-эндпоинты: любую функцию можно превратить в HTTPS-эндпоинт, который масштабируется с трафиком и в простое сокращается до нуля.
  • Распараллеливание и фоновая работа: задачу можно разветвить на тысячи GPU без слоя оркестрации или запустить асинхронную пакетную обработку.
  • Хранилище: Volumes служат распределённой файловой системой для образов, весов моделей и наборов данных.
  • Наблюдаемость: логи и метрики каждого контейнера с экспортом в OpenTelemetry-провайдеры вроде Datadog.

Выбор GPU

Аргумент gpu принимает T4, L4, A10, L40S, A100 (общий вариант, 40 ГБ или 80 ГБ), RTX PRO 6000, H100 (или H100!), H200, B200 (или B200+) и B300. B300, B200, H200, H100, A100, L4, T4 и L40S допускают до 8 GPU на контейнер (до 2 304 ГБ памяти GPU); A10 ограничен 4 GPU и 96 ГБ.

Для бенчмарков важны два автоматических апгрейда: запрос H100 может выполниться на H200, а запрос A100 — на A100 с 80 ГБ, по исходной цене; запрос H100! отключает апгрейд до H200. Функция также может перечислить типы GPU в порядке предпочтения, и Modal откатывается вниз по списку.

Эндпоинты для инференса

  • Общие эндпоинты (Shared Endpoints): часть моделей из Modal Library обслуживается из управляемых Modal пулов с оплатой за токены; каждую из них можно также запустить на выделенном эндпоинте (Dedicated Endpoint) с изолированной или настраиваемой мощностью.
  • OpenAI-совместимое обслуживание: Modal продвигает OpenAI-совместимые эндпоинты для открытых моделей.

Modal Sandboxes

Modal Sandboxes — защищённые контейнеры, определяемые во время выполнения, для запуска недоверенного кода пользователей или агентов. По словам Modal, миллионы песочниц можно программно создать менее чем за минуту, а снимки и восстановление ускоряют запуск.

Notebooks

Размещённые блокноты Jupyter с бессерверной оплатой, автоматическим отключением при простое, GPU от Modal и совместным редактированием в реальном времени.

Обучение и многоузловые кластеры

1 октября 2026 года Modal объявила, что Modal Clusters общедоступны через декоратор @modal.clustered: многоузловые группы GPU с RDMA, планируемые совместно из общего пула мощностей с посекундной оплатой.

Руководство

Начало работы

  1. Создайте аккаунт на modal.com.
  2. Выполните pip install modal, затем modal setup для аутентификации (или python -m modal setup, если первый вариант не сработает).
  3. Напишите функцию на Python с декоратором @app.function(...), указав образ контейнера и GPU, и запустите файл командой modal run path/to/file.py.

Настройка холодного старта и затрат на простой

Modal утверждает, что контейнеры загружаются примерно за секунду, но прогретыми они становятся лишь после импортов и прочей инициализации в глобальной области видимости, поэтому готовность может занять от секунд до минут. Три настройки балансируют задержку и расходы на простой:

  • scaledown_window: держит простаивающие контейнеры активными от 2 секунд до 20 минут; чем длиннее окно, тем меньше холодных стартов, но простаивающие ресурсы оплачиваются.
  • min_containers и buffer_containers: первый держит минимум прогретых контейнеров, чтобы функция никогда не сокращалась до нуля, второй добавляет запасные контейнеры, пока она активна.
  • Широкие регионы: широкий регион, например us, даёт больший пул ресурсов, чем узкий, что улучшает время холодного старта и доступность.

Сценарии использования и примеры

Modal может развернуть любое контейнеризуемое приложение на Python и ориентирован на ресурсоёмкие задачи с горизонтальным масштабированием: масштабный ML-инференс, обучение и дообучение моделей, конвейеры данных, научные вычисления и очереди задач.

  • ИИ-платформы на уровне компании: сооснователь DoorDash Энди Фанг говорит, что ИИ-платформа компании использует Modal для инференса, песочниц для агентов и вычислений для собственного кода.
  • Обучение с подкреплением и обслуживание моделей: CEO Cognition Скотт Ву говорит, что Modal запускает и RL-инфраструктуру компании, и её продакшен-инференс.
  • Оценка агентов: руководитель прикладного ИИ в Ramp говорит, что инструмент компании Inspect было бы трудно создать без быстрых песочниц Modal.
  • Эталонные проекты: примеры охватывают транскрипцию в реальном времени с Kyutai STT, дообучение Flux, агента-программиста на песочницах и LangGraph, обучение небольшой языковой модели и параллельную обработку Parquet на S3.

Эти три цитаты клиентов — отзывы с главной страницы, а не независимые кейсы.

Для кого предназначен

  • Python-разработчики и ML-инженеры: функции определяются на Python; из JavaScript/TypeScript и Go можно вызывать функции, запускать песочницы и управлять ресурсами.
  • Команды с всплесками нагрузки: Modal утверждает, что его почасовые тарифы могут выглядеть выше, тогда как общая стоимость ниже при пиковых или непредсказуемых объёмах запросов.
  • От небольших команд до крупных организаций: Starter рассчитан на небольшие команды и независимых разработчиков, Team — на стартапы и более крупные организации, Enterprise — на организации, для которых важны безопасность и поддержка.
  • Стартапы и исследователи: стартапы на ранней стадии могут запросить бесплатные вычислительные кредиты, а учёные — получить кредиты до $10k.

Независимых сигналов от отзывов в этом раунде мало: на платформе отзывов при сообществе запусков продуктов у Modal на 5 октября 2026 года была оценка 5,0 по 61 отзыву, а ИИ-сводка платформы говорит, что авторы в основном основатели и критики почти нет.

Платформы

  • Python SDK и CLI: большинство действий идёт через открытую CLI-утилиту modal и клиентскую библиотеку Python.
  • SDK для JavaScript/TypeScript и Go: в бета-версии; определение функций, вероятно, останется только на Python.
  • Браузер: Notebooks открываются на modal.com/notebooks, можно загружать файлы .ipynb.
  • Регионы мощностей: США, ЕС, Азиатско-Тихоокеанский регион, Япония, Австралия, Великобритания, Канада, Ближний Восток, Южная Америка, Африка и Мексика — более чем в 20 облаках.
  • Маршрутизация запросов: входные данные функций по умолчанию идут через us-east (Вирджиния); routing_region также принимает us-west (Орегон), eu-west (Дублин) и ap-south (Мумбаи).
  • Облачные маркетплейсы: клиенты Enterprise могут покупать через маркетплейсы AWS и GCP, чтобы использовать обязательства по расходам.

Ценообразование

Modal сочетает месячный план с посекундной тарификацией GPU и учётом CPU и памяти по факту использования; прейскурантные цены ниже зафиксированы 5 октября 2026 года.

Планы

ПланПлата за платформуВключённые вычисленияМестаКонтейнеры / параллельность GPUХранение логовВключённый исходящий трафик
Starter$0 + вычисления / месяц$30 / месяц3100 / 101 день1 ТиБ / месяц
Team$250 + вычисления / месяц$100 / месяцБез ограничений5 000 / 5030 дней10 ТиБ / месяц
EnterpriseИндивидуальноИндивидуальноБез ограниченийПовышенная параллельность GPUИндивидуально100 ТиБ / месяц

Enterprise добавляет скидки за объём, встроенные услуги ML-инженеров, приватную поддержку в Slack, журналы аудита, Okta SSO и HIPAA. Starter допускает 200 развёрнутых приложений и 5 развёрнутых cron-задач и не включает собственные домены, откаты развёртываний, бюджеты на уровне окружений, прокси со статическим IP и RBAC; Team хранит 3 версии для отката.

Посекундная тарификация GPU

РесурсЦена за секунду
Nvidia B300$0.001972
Nvidia B200$0.001736
Nvidia H200 SXM$0.001261
Nvidia H100 SXM5$0.001097
Nvidia RTX PRO 6000$0.000842
Nvidia A100, 80 ГБ$0.000694
Nvidia A100, 40 ГБ$0.000583
Nvidia L40S$0.000542
Nvidia A10$0.000306
Nvidia L4$0.000222
Nvidia T4$0.000164
CPU, за физическое ядро (2 vCPU)$0.0000131
Память, за ГиБ$0.00000222

Минимум CPU — 0,125 ядра на контейнер. Для песочниц и Notebooks действуют повышенные тарифы на CPU и память: $0.00003942 за ядро и $0.00000667 за ГиБ в секунду, GPU — по стандартным ценам. Volumes стоят $0.09 за ГиБ в месяц сверх бесплатного 1 ТиБ, а исходящий трафик сверх лимита плана — $0.04 за ГиБ. В расчётном примере Modal Stable Diffusion на A10G обходится примерно в $0.491 за 1 000 изображений.

Что входит в счёт

  • Загрузка и простой: Modal тарифицирует время загрузки и обработки плюс поддержание активности после последнего входного запроса (по умолчанию 60 секунд, настраивается); приложение, сокращённое до нуля, не оплачивается.
  • Запрос или использование: CPU и память тарифицируются по большему из значений — запрошенному или использованному, с минимумом 128 МиБ и 0,125 ядра на контейнер.
  • Закрепление региона: закреплённый регион контейнера стоит в 1,15 раза дороже базовых цен для широкого региона и в 1,75 раза — для узкого; при сочетании обоих применяется меньший множитель.
  • Выполнение без вытеснения: nonpreemptible=True утраивает прейскурантные цены на CPU и память и недоступно для GPU-функций.
  • Токены общих эндпоинтов: включённые вычисления их не покрывают; с 1 сентября 2026 года токены оплачиваются с первого запроса, даже на Starter.
  • Способ оплаты: руководство по биллингу требует привязать его, чтобы вообще пользоваться Modal, тогда как руководство по GPU связывает его с использованием GPU; охват этих страниц различается.
  • Расчётный цикл и лимиты: оплата ежемесячная, плюс автоматические списания, когда использование впервые превышает определённые пороги; достигнутый лимит расходов останавливает нагрузки, которые добавили бы расходы из своего кармана.
  • Облачные кредиты и возвраты: кредиты AWS, GCP или Azure применить нельзя, а соглашение Modal о программном обеспечении как услуге, действующее с мая 2026 года, гласит, что платежи не возвращаются, кроме случаев, описанных в его разделе 3.2.

Альтернативы Modal

Каждая бессерверная GPU-платформа ниже отличается от Modal главным образом тем, как оплачивается простой и насколько широк выбор GPU.

ВариантВыбор GPUСокращение до нуляПравило оплаты простоя
Google Cloud Run (GPU)RTX PRO 6000 Blackwell (96 ГБ) или L4 (24 ГБ)ДаОплата по экземплярам; минимальные экземпляры оплачиваются полностью даже в простое
RunPod ServerlessЗдесь не рассматриваетсяГибкие воркеры — да; активные воркеры работают круглосуточноПосекундная оплата от запуска воркера до полной остановки с округлением вверх
ReplicateЗдесь не рассматриваетсяПубличные модели — даБольшинство приватных моделей работают на выделенном оборудовании с оплатой времени настройки, простоя и активной работы

Деление на гибкие и активные воркеры у RunPod соответствует выбору min_containers в Modal. Replicate тарифицирует большинство публичных моделей по времени выполнения, а некоторые — по входным и выходным данным. Отличия Modal — инфраструктура, заданная на Python, и песочницы в том же аккаунте, а также более длинный список GPU, чем у Cloud Run.

Ограничения

Ограничения выполнения

  • Вытеснение по умолчанию: любая функция может быть вытеснена и перезапущена с тем же входом; вероятность прерывания растёт с длительностью выполнения.
  • Тайм-ауты: выполнение функции по умолчанию ограничено 300 секундами и настраивается от 1 секунды до 24 часов; песочницы по умолчанию живут 5 минут, срок продлевается до 24 часов.
  • Параллельность: лимиты рабочего пространства на одновременные контейнеры и GPU зависят от плана, а у отдельной функции есть жёсткий лимит в 4 000 одновременных контейнеров.
  • Крупные запросы GPU: более 2 GPU на контейнер обычно означает более долгое ожидание.
  • Минимальная версия CUDA: B300 требует CUDA 13.1 или новее.
  • Ограничение общих эндпоинтов: лимиты параллельности для каждой модели действуют на всё рабочее пространство, а запросы сверх лимита получают HTTP 429.
  • Противоречивый статус многоузлового режима: руководство по GPU по-прежнему относит многоузловое обучение к закрытой бете, тогда как объявление от 1 октября 2026 года называет Modal Clusters общедоступными.

Регионы и размещение данных

  • Строгое закрепление: нагрузки, закреплённые за регионом, никогда не переносятся в другое место, даже если мощности региона исчерпаны.
  • Ограничения маршрутизации: routing_region можно задать только при первом развёртывании функции, а входные и выходные данные больше 2 МиБ по-прежнему проходят через объектное хранилище в us-east.
  • Общие эндпоинты: регион контейнера или маршрутизации выбрать нельзя; трафик идёт через us-west по глобальному вычислительному пулу.
  • Логи: логи приложений из функций, песочниц и серверов хранятся в США.

Допустимое использование

Соглашение Modal запрещает майнинг криптовалют или связанную с ним блокчейн-активность, DoS-атаки, пиринговый обмен файлами, а также универсальные платформы файлового хостинга или раздачи медиа.

Конфиденциальность, безопасность и права на данные

  • Доступ к данным: Modal заявляет, что никогда не будет обращаться к вашему исходному коду, входным или выходным данным функций или данным в образах или Volumes и использовать их; к логам приложений и метаданным обращаются только с вашего разрешения для устранения неполадок.
  • Хранение: входные и выходные данные функций шифруются при хранении и удаляются в пределах максимального TTL в 7 дней; эндпоинты Modal Inference не хранят данные, а полезная нагрузка никогда не записывается на диск.
  • Права собственности: клиенты сохраняют все права на клиентские данные и предоставляют Modal ограниченную лицензию для оказания услуги; Modal может использовать агрегированные или безвозвратно анонимизированные служебные метрики в собственных деловых целях во время действия соглашения и после него.
  • Места обработки: клиенты могут ограничить обработку указанными регионами, и без предварительного письменного согласия Modal не будет обрабатывать клиентские данные в других местах.
  • Сертификация: Modal прошла аудит SOC 2 Type 2; отчёт можно получить по запросу через её портал безопасности.
  • HIPAA: до передачи любой PHI должно быть заключено соглашение с деловым партнёром, доступное на Enterprise; Volumes v1, образы (кроме снимков файловой системы и каталогов), снимки памяти и пользовательский код им не охватываются, а Volumes v2 охватываются.
  • Изоляция и шифрование: вычислительные задачи виртуализируются через gVisor, песочницы могут также работать в защищённой среде выполнения на базе ВМ, пользовательские данные шифруются при передаче и хранении, а публичные API используют TLS 1.3.
  • Совместная ответственность: за резервное копирование собственных данных отвечают клиенты.
  • Политика конфиденциальности: последнее обновление — 17 мая 2023 года; в ней сказано, что сервисы не предназначены для лиц младше 13 лет.

ЧаВо

Q1. Есть ли у Modal бесплатный тариф?

У Starter нет платы за платформу и есть $30 вычислений в месяц, но руководство по биллингу требует привязать способ оплаты, а токены общих эндпоинтов оплачиваются с первого запроса.

Q2. Платят ли за приложение, когда оно простаивает?

Нет, если оно уже сократилось до нуля. Поддержание активности по умолчанию в 60 секунд и простой внутри более длинного scaledown_window оплачиваются, а min_containers не даёт функции опуститься до нуля.

Q3. Можно ли держать нагрузки в пределах ЕС?

Функции и песочницы можно закрепить за регионами ЕС с множителем 1,15 или 1,75 и маршрутизацией через eu-west, но логи приложений остаются в США, крупные входные и выходные данные проходят через us-east, а общие эндпоинты закрепить нельзя.

Знаете похожий инструмент?
Если вы знаете другие отличные AI-инструменты, не стесняйтесь предлагать их нам