Toolso.AI
Toolso.AI
すべてのツールカテゴリ急上昇最新ツール料金プランブログ
Toolso.AI
Toolso.AI

💌AIツールウィークリーを購読

最新かつ最も注目されるAIツールとトレンドの週次厳選セレクションをメールボックスにお届けします 購読

Toolso.AI
Toolso.AI

生産性を向上させる最高のAIツールを発見する

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

人気カテゴリ

  • AI執筆
  • AI画像
  • AI動画
  • AIコーディング
  • 他のカテゴリ

探索

  • 最新ツール
  • 人気ツール
  • 他のツール
  • ツールを提出
  • 料金

会社概要

  • 会社概要
  • お問い合わせ
  • ブログ
  • 変更履歴

法的情報

  • クッキーポリシー
  • プライバシーポリシー
  • 利用規約
  • 返金ポリシー
© 2026 Toolso.AI 無断転載を禁じます
期間限定期間限定注目掲載24時間優先審査・被リンク不要・30日間注目表示$29.90終了後 $59.9010月31日以降 $59.90に値上げ終了まで--:--:--今すぐ投稿
  1. ホーム
  2. すべてのツール
  3. 開発ツール
  4. Together AI
Together AIのインターフェースプレビュー
Together AIのロゴ

Together AI

Together AIは、OpenAI互換のサーバーレスAPIでオープンウェイトモデルを実行し、専用エンドポイント、ファインチューニング、GPUクラスター、サンドボックスも提供します。費用はすべて前払いクレジットから支払います。

開発ツールAI開発AIトレーニングプラットフォーム#バッチ処理#SDK#LLM
無料で試す
保存
アクセス数
閲覧数
価格
フリーミアム
公開日
2026年10月6日
ドメイン
together.ai
ユーザー評価

このツールを使いましたか?評価してください

このツールを評価する

Together AI 製品情報

無料で試す
ツール情報
保存
アクセス数
閲覧数
価格
フリーミアム
公開日
2026年10月6日
ドメイン
together.ai
ユーザー評価

このツールを使いましたか?評価してください

このツールを評価する

注目のツール

関連ツール

無料で試す

Together AIとは?

Together AIは、APIとレンタルGPUインフラで、オープンソースおよびオープンウェイトのAIモデルを実行・カスタマイズ・学習できるクラウド基盤です。同社はこれを、最先端の研究に支えられたフルスタックAI基盤「AIネイティブクラウド」として打ち出しています。大半の開発者の入口は、オープンソースLLM APIです。

運営元はデラウェア州法人のTogether Computer, Inc.で、規約は大規模AIモデルをホスト・利用・ファインチューニング・学習するためのAPIとWebインターフェースを対象とします。独立系テックメディアはTogether AIを、Nvidia GPUクラスターを貸し出すAIネオクラウドと評し、評価額83億ドルでの8億ドルのシリーズC調達を報じました。同じ報道によれば、同社は数千社の有料顧客を抱えると主張し、その中にCursor、Cognition、Decagonを挙げています。

判断の大半を左右する事実は3つです。無料トライアルがなく利用は$5のクレジット購入から始まる点、ゼロデータ保持を有効にしない限りプロンプトがデフォルトで保存される点、共有のサーバーレス容量がベストエフォートである点です。

主な機能

Together AIは製品を推論、コンピュート、モデル調整に分け、いずれも同じ前払いクレジット残高から課金します。

推論オプション

  • サーバーレス推論: 開発者は何もデプロイ・管理せずに単一のAPIでオープンウェイトモデルを呼び出し、使ったトークン分だけ支払います。カタログはテキスト、画像、動画、コード、音声のモデルを含みます。
  • バッチ推論: 大規模な非同期ジョブはモデルごとに300億トークンまで拡張でき、任意のサーバーレスモデルかプライベートデプロイを使えます。
  • プロビジョンドスループット: コミット型の推論容量に、トークン単位の料金、予約スループット、99%の稼働率SLAが付きます。
  • 専用エンドポイントとコンテナ: 専用モデル推論は予約済みの分離ハードウェアでモデルを実行し、専用コンテナ推論は動画・音声・画像モデルなどの生成メディアワークロード向けです。

同社はgpt-oss-20Bのサーバーレス推論で、次に速いプロバイダーの2倍近い速度を出したとしています。これはベンダー自身のベンチマークで、同モデルはその後サーバーレスからの削除が予定されました。

ファインチューニングとモデル調整

  • モデルの持ち込み: Together AIによれば、Hugging Face Hubの任意のオープンソースモデルを形式変換なしでファインチューニングできます。
  • ツール呼び出しデータ: ツール呼び出しの学習では既存のエージェントログをそのまま使え、関数定義とツール呼び出しをデータセットに直接含めます。
  • ビジョンのファインチューニング: ビジョンモデルは特別な前処理なしで生のPNG、JPEG、WEBP画像から直接学習でき、LoRAかフルファインチューニングを使います。
  • 持ち出せる成果物: 完成したモデルはTogetherの専用エンドポイントでホストするか、単体のチェックポイントとしてダウンロードできます。

そのため、LLMファインチューニングの成果物はトークン課金のサーバーレスカタログには加わらず、専用ハードウェアで動かすか、重みとしてプラットフォーム外へ持ち出すことになります。

コンピュート、サンドボックス、ストレージ

  • GPUクラスター: 学習や推論提供向けに、8基から4,000基超までのGPUを予約できます。
  • コードサンドボックス: サンドボックスVMはAI開発環境向けで、2〜64 vCPU、1〜128 GBのRAMの範囲です。
  • マネージドストレージ: エグレス料金なしで、オブジェクトストレージと並列ファイルシステムを提供します。

ガイド

最初のAPI呼び出しには、入金済みアカウント、APIキー、公式SDKか既存のOpenAIクライアントが必要です。

  1. Together AIのコンソールで登録し、請求設定から最低$5のクレジットを追加します。
  2. プロジェクトのAPIキーページでキーを作成します。新しいAPIキーは一度しか表示されないので、値をすぐ保存してください。
  3. 公式のPythonまたはTypeScript SDKをインストールするか、既存のOpenAIクライアントのままベースURLを変更し、キーを環境変数に設定します。
  4. クイックスタートのサンプルを実行すると、MiniMax M3にチャット補完リクエストが送信され、応答が出力されます。
  5. オフラインのワークロードでは、バッチAPIが、アップロードした1つのJSONLファイルから多数の独立したリクエストを非同期で実行します。

ファインチューニングの費用は支払い前に確認できます。CLIがジョブ送信前に見積価格を表示し、確認を求めるからです。

Together AIのユースケースと事例

  • オフラインのバッチ処理: バッチジョブは、大規模データセットの分類、評価実行、合成データ生成、オフライン要約など、レイテンシを許容できるタスク向きです。
  • リアルタイム音声エージェント: DecagonのサブセカンドボイスAIを扱ったTogether AIの顧客事例は、gpt-5 mini比で1ターンあたり6倍のコスト削減を示しています。
  • 低レイテンシの本番API: Salesforce AI Researchの顧客の声は、レイテンシの2倍の短縮と約3分の1のコスト削減を挙げています。
  • 研究と学習の実行: GPUクラスターは、数分でクラスターを立ち上げて仮説を検証し、実験後に停止する用途で訴求されています。
  • オープンモデルのコーディングエージェント: Together Linkは、Togetherがホストするモデル上で6つのコーディングエージェントを動かします。対象はターミナルのClaude Code、Codex、OpenCode、Pi Code、さらにClaude DesktopとChatGPT Desktopです。

上記の顧客数値はTogether AIが自社ページで公開したもので、本掲載では独立検証をしていません。

対象ユーザー

Together AIは、API、SDK、コマンドラインツールを使いこなし、自前の推論スタックを運用せずにオープンウェイトモデルを使いたい開発者やMLチーム向きです。

  • プロトタイピングと変動トラフィック: サーバーレス推論は、変動が大きいか予測しにくいトラフィック、迅速なプロトタイピング、コスト重視または初期段階の本番ワークロードに最適とうたわれています。
  • 安定したレイテンシ重視の本番環境: 専用モデル推論は、予測可能なトラフィック、レイテンシに敏感なアプリケーション、高スループットの本番ワークロード向けです。
  • 資金調達済みのスタートアップ: 選考制のアクセラレーターは、調達額$5M以下のスタートアップに最大$15K、$5M–$10Mなら最大$30K、$10M超なら最大$50Kのプラットフォームクレジットを提供します。

2つの推論モードの選択は稼働率次第です。レプリカが1日の大半稼働し続けるなら通常は専用モデル推論が、トラフィックが少ないか断続的で専用レプリカがほとんどの時間アイドルになるなら通常はサーバーレスが安くなります。料金ページは、大半のチームがサーバーレス推論から始め、規模拡大に伴い専用エンドポイントに移行するとも説明します。

無料トライアルがないため、支払い前にモデルを試したい人にはあまり向きません。互換レイヤーがOpenAIのAssistants APIを実装していないため、それで構築したアプリにもあまり向きません。

プラットフォーム

Together AIは消費者向けアプリではなく、Webコンソール、SDK、CLI、REST APIで利用します。

  • SDKとAPI: Together AIはPythonとTypeScript向けの公式SDKを公開し、OpenAI SDKや、任意の言語からの素のREST呼び出しも使えます。
  • OpenAI互換性: APIはチャット、補完、ビジョン、画像生成、音声合成、埋め込みで、OpenAIのREST APIおよびSDKと互換です。
  • バッチ用ツール: バッチジョブはコンソール、APIまたはSDK、あるいはCLIから開始できます。
  • クラスター管理: GPUクラスターへのアクセスは、CLI、SDK、API、TerraformまたはWebコンソールから、プロジェクト単位のRBACで管理します。
  • リージョン: サーバーレスエンドポイントではリージョンを選べません。プライベートネットワークや、EUリージョンを含むVPCベースのデプロイは、専用構成で利用できます。

価格

Together AI 料金は使用量ベースで、全額前払いです。Together AIは現在無料トライアルを提供しておらず、プラットフォームの利用には最低$5のクレジット購入が必要です。利用には、クレジット残高がプラスである必要があります。前払いの残高クレジットには現在有効期限がありません。オートチャージで残高を自動補充できますが、デフォルトの支払い方法がクレジットカードかデビットカードの場合のみです。利用規約では、規約または注文書に別段の定めがない限り、支払済みの料金は返金されません。

サーバーレスのトークン料金

サーバーレス料金は100万トークンあたりで提示され、頻繁に変わります。以下の代表的な行は2026年10月5日に取得しました。

モデル入力キャッシュ入力出力
MiniMax M3$0.30$0.06$1.20
Kimi K3$3.00$0.30$15.00
gpt-oss-120B$0.15記載なし$0.60
Llama 3.3 70B$1.04記載なし$1.04

バッチAPIは、サーバーレス料金から最大50%割引と、別枠のレート制限プールをうたっています。ただし、バッチドキュメントの割引対象モデル表には、Llama 3.3 70B TurboのバリアントとWhisper Large v3しか50%割引として載っておらず、記載のないモデルは通常料金で実行されます。

GPUクラスター

GPUクラスターの料金はすべて、GPU 1基・1時間あたりです。

GPUプリエンプティブルオンデマンド予約 7–30日31–90日91–180日181日以上
NVIDIA HGX H100$1.99$3.99$3.69$3.45$3.19要問合せ
NVIDIA HGX H200$2.99$5.99$4.99$4.15$3.99要問合せ
NVIDIA HGX B200$4.09$8.19$7.99$7.79$6.79要問合せ

予約は、クラスターのプロビジョニング時点で予約期間全体分が課金され、予約容量の超過分はオンデマンド料金で請求されます。スタートアップアクセラレーターのクレジットは、予約GPUクラスターには適用されません。

専用推論

専用レプリカは、準備が整いトラフィックを処理できる間だけ課金されるため、プロビジョニングとコールドスタートの時間は請求されません。H100の料金は公式ページ間で異なります。料金ページの専用推論の表では、オンデマンドでGPU時間あたり$5.49です。一方、ドキュメントの変更履歴のエントリは、H100 80GBの専用エンドポイント用ハードウェアが$5.49から値下げされ、現在1時間あたり$3.99だとしています。

ファインチューニング

ファインチューニングは処理トークン数、つまり学習データセットのサイズ×エポック数に評価トークン(ある場合)を加えた量で課金され、各ジョブにはモデルごとの最低料金がかかります。料金ページ最初のファインチューニング表(タブはLoRAとフルファインチューニング)では、Qwen3.5 0.8Bが教師ありファインチューニングで100万トークンあたり$0.34、DPOで$0.84、最低料金$4.00です。同じ表のさらに下では、GLM-5.2が教師ありファインチューニング$40.00、DPO $100.00、最低料金$60.00です。キャンセルまたは早期停止したジョブは、完了したステップ分のみ課金されます。微調整済みモデルを専用エンドポイントでホストする費用は、分単位で別途請求されます。

Together AIの代替ツール

同種のオープンモデル推論プロバイダーの主な違いは、微調整済みモデルの課金方法と、新規アカウントに無料クレジットが付くかどうかです。

  • Fireworks AI: Fireworks AIは、微調整済みモデルをベースモデルと同じ価格で提供するとしています。同社のサーバーレス推論は、前払い・従量制でトークン単位に課金されます。
  • Baseten: Basetenによれば、新規アカウントにはデプロイを無料で試せるクレジットが付きます。専用デプロイは、使用したコンピュート分だけを分単位で課金します。

これらと比べ、Together AIは無料トライアルなしで初回$5の購入を求め、微調整済みモデルのホスティングを専用ハードウェアで分単位で課金します。その代わり、1つのアカウントでサーバーレスモデル、バッチジョブ、専用エンドポイント、GPUクラスター、サンドボックス、ストレージを扱えます。

制限事項

サービスの制限

  • ベストエフォートのサーバーレス: サーバーレスの性能はベストエフォートで、確約されたスループットにはプロビジョンドスループットが必要です。
  • スロットリング: 需要が高いとTogetherはリクエストを制限することがあり、クライアントは429 Too Many Requestsまたは503 Service Unavailableの応答を受けることがあります。
  • モデルの入れ替わり: ある変更履歴のエントリは、openai/gpt-oss-20bなどのモデルを2026年9月14日にサーバーレスから削除する予定としていました。同エントリのモデルは1つを除き、トークンではなくハードウェア時間で課金されるオンデマンド専用エンドポイントで引き続き利用できました。
  • 部分的なOpenAI互換: OpenAI APIのAssistants、Threads、Runsは実装されていません。gpt-4oやtext-embedding-3-largeなどのOpenAIモデル名は、Togetherでは404を返します。
  • バッチの上限: 1つのバッチには最大50,000件のリクエストを含められます。バッチの入力・出力・エラーファイルは7日間保持されるため、その期間内に結果のダウンロードが必要です。

課金とサポートの範囲

  • 残高ゼロ: 残高がゼロになると、クレジットを追加するまでAPIアクセスが停止されます。
  • オンデマンドクラスター: 完全オンデマンドのGPUクラスターは、クレジットが尽きるとまず一時停止され、クレジットが回復しなければその後廃止されます。
  • サポートのティア: サポートページは今もティア別サポートを説明し、BuildティアのユーザーにはコミュニティのDiscordでのサポートがあります。しかし、ある変更履歴のエントリは、Buildティア1–5、Scale、Enterpriseというティア名を廃止したとしています。

プライバシー、データ利用、所有権

  • デフォルトの保存: デフォルトでは、Togetherはプロンプトとモデルの応答を保存し、製品改善に利用することがあります。
  • 学習: 顧客データのモデル学習への利用は別のオプトイン項目で、デフォルトではオフです。プライバシーポリシーには、明示的なオプトインの同意なしに、収集したデータを同社モデルの学習に使わないと記載があります。
  • ゼロデータ保持: ゼロデータ保持はデフォルトでは無効です。ZDRを有効にすると、プロンプトと出力はTogetherに保存されず、いかなる二次的目的にも使われません。ZDRは有効にした時点からのみ適用され、それ以前に処理されたデータには影響しません。ファインチューニングやバッチAPI用にアップロードしたファイルは、API、CLI、Webコンソールから削除するまで残ります。
  • パススルーモデル: リクエストを外部プロバイダーに転送するパススルーモデルはデフォルトで許可され、そのプロバイダー自身のデータポリシーに従います。
  • ホスト型サードパーティモデル: DeepSeek、Qwen、Mistralなど外部作者のモデルはTogether自身のインフラ上で動作し、モデル作者側を呼び出しません。
  • 所有権とコンプライアンス: 利用規約上、顧客は自らのコンテンツと出力を独占的に所有します。Together AIはSOC 2 Type II、HIPAAに沿ったオプション、転送時および保存時の暗号化を掲げています。

本ページで確認した独立系メディアやレビュー情報源では、製品レベルの障害やセキュリティ報告は見つからず、レビューのサンプルは20件未満で、品質を判断するには少なすぎました。

よくある質問

Q1. Together AIに無料プランや無料トライアルはありますか?

ありません。利用には最低$5のクレジット購入が必要で、無料トライアルもありません。アクセラレータープログラムに採択されたスタートアップは代わりにプラットフォームクレジットを受け取れますが、そのクレジットは予約GPUクラスターには使えません。

Q2. Together AIでOpenAI SDKを使えますか?

はい。チャット、補完、ビジョン、画像生成、音声合成、埋め込みでは使えます。OpenAIクライアントをTogetherのベースURLに向け、Togetherの名前空間付きモデルIDに切り替えてください。Assistants、Threads、Runsは利用できず、バッチジョブはTogether独自のバッチAPIを使います。

Q3. Together AIは私のプロンプトで学習しますか?

デフォルトではしません。学習への利用はオプトイン設定で、有効にしない限りオフのままです。ただし、ゼロデータ保持をオンにしない限り、プロンプトと応答はデフォルトで保存されます。

Q4. クレジットがなくなるとどうなりますか?

クレジットを追加するまでAPIアクセスが停止されます。オンデマンドのGPUクラスターは一時停止され、クレジットが回復しなければその後廃止されます。一方、既存のGPUクラスター予約は予定の終了日まで有効です。

Q5. ファインチューニングしたモデルを他所へ持ち出せますか?

はい。ジョブ完了後、モデルはTogetherの専用エンドポイントで提供するか、ローカル推論や他のホスティング先向けにチェックポイントとしてダウンロードできます。

類似のツールをご存知ですか?
他の素晴らしいAIツールをご存知でしたら、ぜひ私たちに提出してください