Пользовались этим инструментом? Оцените его
Пользовались этим инструментом? Оцените его
Together AI — облачная платформа для запуска, настройки и обучения моделей ИИ с открытым исходным кодом и открытыми весами через API и арендуемую GPU-инфраструктуру. Компания продвигает её как ИИ-нативное облако — полностековую ИИ-платформу, основанную на передовых исследованиях. Для большинства разработчиков точкой входа служит API открытых LLM.
Сервисом управляет Together Computer, Inc., корпорация из Делавэра; её условия охватывают API и веб-интерфейсы для размещения, использования, дообучения и обучения крупных моделей ИИ. Независимые ИТ-издания описывали Together AI как ИИ-неооблако, сдающее в аренду кластеры GPU Nvidia, и сообщали о серии C на 800 млн $ при оценке 8,3 млрд $. Согласно тому же материалу, компания заявляет о тысячах платящих клиентов, среди которых Cursor, Cognition и Decagon.
Большинство решений определяют три факта: бесплатного пробного периода нет, а доступ начинается с покупки кредитов на $5; промпты по умолчанию хранятся, если не включено нулевое хранение данных; общая бессерверная мощность работает по принципу best-effort, без гарантий.
Together AI делит продукты на инференс, вычисления и настройку моделей; всё оплачивается из одного предоплаченного баланса кредитов.
Компания утверждает, что её бессерверный инференс gpt-oss-20B почти в 2 раза быстрее, чем у следующего по скорости провайдера. Это бенчмарк самого вендора, а модель позже запланировали удалить из бессерверного каталога.
Поэтому дообучение LLM даёт результат, который работает на выделенном оборудовании или уходит с платформы в виде весов, а не в бессерверный каталог с потокенной оплатой.
Для первого вызова API нужны пополненный аккаунт, API-ключ и официальный SDK либо существующий клиент OpenAI:
Стоимость дообучения можно проверить до трат: CLI выводит оценочную цену и запрашивает подтверждение перед отправкой задания.
Эти клиентские показатели опубликованы Together AI на собственных страницах и не проверялись независимо для этого обзора.
Together AI подходит разработчикам и ML-командам, уверенно работающим с API, SDK и инструментами командной строки и желающим использовать модели с открытыми весами без собственного стека инференса.
Выбор между двумя режимами инференса зависит от загрузки. Выделенный инференс моделей обычно дешевле, если реплика занята большую часть дня, а бессерверный — если трафик низкий или так неравномерен, что выделенная реплика большую часть времени простаивала бы. На странице цен также отмечено, что большинство команд начинают с бессерверного инференса и переходят на выделенные эндпоинты с ростом масштаба.
Сервис хуже подходит тем, кто хочет попробовать модели до оплаты, так как бесплатного пробного периода нет, а также приложениям на основе Assistants API от OpenAI, который слой совместимости не реализует.
Together AI используется через веб-консоль, SDK, CLI и REST API, а не через потребительское приложение.
Все цены Together AI зависят от использования и требуют полной предоплаты. Сейчас Together AI не предлагает бесплатного пробного периода, а для доступа к платформе нужно купить кредиты минимум на $5. Для работы с платформой требуется положительный баланс кредитов. Предоплаченные кредиты на балансе сейчас не имеют срока действия. Автопополнение может автоматически пополнять баланс, но только если способ оплаты по умолчанию — кредитная или дебетовая карта. Согласно Условиям обслуживания, уплаченные сборы не возвращаются, если условия или форма заказа не предусматривают иного.
Бессерверные цены указываются за 1 млн токенов и часто меняются. Типичные строки ниже зафиксированы 5 октября 2026 года.
| Модель | Вход | Кэшированный вход | Выход |
|---|---|---|---|
| MiniMax M3 | $0.30 | $0.06 | $1.20 |
| Kimi K3 | $3.00 | $0.30 | $15.00 |
| gpt-oss-120B | $0.15 | Не указано | $0.60 |
| Llama 3.3 70B | $1.04 | Не указано | $1.04 |
Пакетный API рекламирует скидку до 50 % от бессерверных тарифов и отдельный пул лимитов запросов. Однако таблица моделей со скидкой в документации по пакетам перечисляет со скидкой 50 % только вариант Llama 3.3 70B Turbo и Whisper Large v3, а модели вне списка работают по стандартным тарифам.
Все цены GPU-кластеров указаны за один GPU в час.
| GPU | Прерываемые | По требованию | Резерв 7–30 дней | 31–90 дней | 91–180 дней | От 181 дня |
|---|---|---|---|---|---|---|
| NVIDIA HGX H100 | $1.99 | $3.99 | $3.69 | $3.45 | $3.19 | Свяжитесь с нами |
| NVIDIA HGX H200 | $2.99 | $5.99 | $4.99 | $4.15 | $3.99 | Свяжитесь с нами |
| NVIDIA HGX B200 | $4.09 | $8.19 | $7.99 | $7.79 | $6.79 | Свяжитесь с нами |
Резервирование оплачивается за весь зарезервированный срок с момента подготовки кластера, а использование сверх зарезервированной мощности — по тарифам по требованию. Кредиты акселератора для стартапов не распространяются на зарезервированные GPU-кластеры.
Выделенная реплика тарифицируется, только пока она готова и способна обслуживать трафик, поэтому время подготовки и холодного старта не оплачивается. Тариф на H100 различается на официальных страницах: в таблице выделенного инференса на странице цен указано $5.49 за GPU-час по требованию. Запись в журнале изменений документации, напротив, сообщает, что оборудование H100 80GB для выделенных эндпоинтов теперь стоит $3.99 в час после снижения с $5.49.
Дообучение оплачивается по обработанным токенам, то есть по размеру обучающего датасета, умноженному на число эпох, плюс токены оценки, если они есть; для каждого задания действует минимальная плата, зависящая от модели. Первая таблица дообучения на странице цен, на вкладках «LoRA» и «Полное дообучение», указывает для Qwen3.5 0.8B $0.34 за 1 млн токенов при контролируемом дообучении, $0.84 при DPO и минимум $4.00. Ниже в той же таблице для GLM-5.2 указаны $40.00 за контролируемое дообучение, $100.00 за DPO и минимум $60.00. Отменённые или досрочно остановленные задания оплачиваются только за завершённые шаги. Размещение дообученной модели на выделенном эндпоинте оплачивается отдельно, поминутно.
Сопоставимые провайдеры инференса открытых моделей различаются в основном тем, как тарифицируют дообученные модели и дают ли новым аккаунтам бесплатные кредиты.
На их фоне Together AI требует первой покупки на $5 без бесплатного пробного периода и поминутно тарифицирует размещение дообученных моделей на выделенном оборудовании. Взамен один аккаунт охватывает бессерверные модели, пакетные задания, выделенные эндпоинты, GPU-кластеры, песочницы и хранилище.
Независимые СМИ и источники отзывов, проверенные для этой страницы, не показали сообщений о сбоях или проблемах безопасности на уровне продукта, а выборки насчитывали менее 20 отзывов — слишком мало для выводов о качестве.
Нет. Для доступа нужно купить кредиты минимум на $5, а бесплатного пробного периода нет. Стартапы, принятые в программу акселерации, могут вместо этого получить кредиты платформы, но они не распространяются на зарезервированные GPU-кластеры.
Да, для чата, текстовых завершений, обработки изображений, генерации изображений, синтеза речи и эмбеддингов: направьте клиент OpenAI на базовый URL Together и перейдите на идентификаторы моделей Together с пространством имён. Assistants, Threads и Runs недоступны, а пакетные задания используют собственный пакетный API Together.
По умолчанию нет. Использование для обучения — настройка с явным согласием, которая остаётся выключенной, пока её не включат. При этом промпты и ответы по умолчанию всё равно хранятся, если не включено нулевое хранение данных.
Доступ к API приостанавливается, пока вы не пополните кредиты. GPU-кластеры по требованию приостанавливаются, а затем выводятся из эксплуатации, если кредиты не восстановлены; существующие резервирования GPU-кластеров остаются активными до запланированной даты окончания.
Да. По завершении задания модель можно обслуживать на выделенном эндпоинте Together или скачать как чекпойнт для локального инференса или другого хостинга.