Toolso.AI
Toolso.AI
所有工具分類熱門榜單最新工具價格部落格
Toolso.AI
Toolso.AI

💌訂閱 AI 工具週報

每週精選最新、最熱門的AI工具和行業動態,直達您的信箱 訂閱

Toolso.AI
Toolso.AI

發現最好的AI工具,提升你的工作效率

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

熱門分類

  • AI寫作
  • AI影象
  • AI影片
  • AI程式設計
  • 更多分類

探索發現

  • 最新收錄
  • 熱門推薦
  • 更多工具
  • 提交工具
  • 價格

關於

  • 關於我們
  • 聯絡我們
  • 部落格
  • 更新日誌

法律

  • Cookie政策
  • 隱私政策
  • 服務條款
  • 退款政策
© 2026 Toolso.AI 保留所有權利
限時推廣限時推廣加速推廣24h 優先審核 · 無需反鏈 · 30 天推薦展示$29.90到期後 $59.9010月31日後漲價至 $59.90距結束--:--:--立即提交
  1. 首頁
  2. 所有工具
  3. 開發工具
  4. Together AI
Together AI介面預覽
Together AI標誌

Together AI

Together AI 透過相容 OpenAI 的無伺服器 API 執行開放權重模型,並提供專用端點、微調、GPU 叢集與沙箱,全部從預付額度扣款。

開發工具AI開發AI訓練平台#批次處理#SDK#大語言模型
免費試用
收藏
訪問次數
瀏覽次數
定價
免費增值
發布日期
2026年10月6日
網域
together.ai
使用者評分

用過這個工具嗎?為它評分

為這個工具評分

Together AI 工具資訊

免費試用
工具資訊
收藏
訪問次數
瀏覽次數
定價
免費增值
發布日期
2026年10月6日
網域
together.ai
使用者評分

用過這個工具嗎?為它評分

為這個工具評分

推薦工具

相關工具推薦

免費試用

Together AI 是什麼?

Together AI 是一個雲端平台,透過 API 與可租用的 GPU 基礎設施執行、客製化及訓練開源與開放權重 AI 模型。公司將其宣傳為 AI 原生雲,也就是由前沿研究驅動的全端 AI 平台。對多數開發者來說,入口是開源 LLM API。

這項服務由 Together Computer, Inc. 營運,這是一家德拉瓦州公司,其條款涵蓋用於託管、使用、微調與訓練大型 AI 模型的 API 與網頁介面。獨立科技媒體將 Together AI 描述為出租輝達 GPU 叢集的 AI 新型雲端業者(neocloud),並報導其以 83 億美元估值完成 8 億美元 C 輪募資。同一篇報導指出,公司自稱擁有數千家付費客戶,並點名其中包括 Cursor、Cognition 與 Decagon。

三個事實左右了大多數決定:沒有免費試用,使用前須先購買 $5 額度;除非啟用零資料保留,提示詞預設會被儲存;共享的無伺服器容量為盡力而為(best-effort)。

核心功能

Together AI 將產品分為推論、運算與模型調校三類,全部從同一個預付額度餘額扣款。

推論選項

  • 無伺服器推論: 開發者透過單一 API 呼叫開放權重模型,不必部署或管理任何東西,只為實際使用的 token 付費。模型目錄涵蓋文字、影像、影片、程式碼與語音模型。
  • 批次推論: 大型非同步工作每個模型可擴充至 300 億 token,可使用任一無伺服器模型或私有部署。
  • 佈建輸送量: 承諾的推論容量採按 token 計價,提供保留輸送量與 99% 可用性 SLA。
  • 專用端點與容器: 專用模型推論在保留的隔離硬體上執行模型,專用容器推論則鎖定影片、音訊與影像模型等生成式媒體工作負載。

公司表示,其 gpt-oss-20B 無伺服器推論速度達到次快服務商的近 2 倍。這是廠商自測的基準,且該模型後來已被排定從無伺服器服務下架。

微調與模型調校

  • 自帶模型: Together AI 表示,Hugging Face Hub 上的任何開源模型都能微調,不需格式轉換。
  • 工具呼叫資料: 工具呼叫訓練可原樣接收既有的代理程式日誌,函式定義與工具呼叫直接放在資料集中。
  • 視覺微調: 視覺模型可直接以原始 PNG、JPEG 或 WEBP 影像訓練,不需特殊前處理,可採用 LoRA 或完整微調。
  • 成果可攜: 訓練完成的模型可託管在 Together 專用端點上,也能下載為獨立檢查點。

因此,LLM 微調的產出不是在專用硬體上執行,就是以權重形式帶離平台,而不會加入按 token 計費的無伺服器模型目錄。

運算、沙箱與儲存

  • GPU 叢集: 客戶可保留 8 張到 4,000 多張 GPU,用於訓練或推論服務。
  • 程式碼沙箱: 沙箱虛擬機配置為 2 到 64 個 vCPU、1 到 128 GB 記憶體,用於 AI 開發環境。
  • 代管儲存: 代管儲存提供物件儲存與平行檔案系統,且不收取輸出流量費用。

使用指南

第一次呼叫 API 需要一個已儲值的帳戶、一組 API 金鑰,以及官方 SDK 或既有的 OpenAI 用戶端:

  1. 在 Together AI 主控台註冊,並在帳單設定中儲值至少 $5 額度。
  2. 在專案的 API 金鑰頁面建立金鑰;新的 API 金鑰只會顯示一次,請立即保存。
  3. 安裝官方 Python 或 TypeScript SDK,或保留既有的 OpenAI 用戶端並修改其基礎 URL,再將金鑰設為環境變數。
  4. 執行快速入門範例,它會向 MiniMax M3 送出一則聊天補全請求並印出回應。
  5. 離線工作負載可使用批次 API,從單一上傳的 JSONL 檔案以非同步方式執行大量獨立請求。

微調費用可在花錢之前確認,因為 CLI 會在送出工作前印出預估價格並要求確認。

Together AI 使用情境與範例

  • 離線批次作業: 批次工作適合對延遲不敏感的任務,例如為大型資料集分類、執行評估、產生合成資料與離線摘要。
  • 即時語音代理: Together AI 關於 Decagon 次秒級語音 AI 的客戶案例列出,相較 gpt-5 mini,每輪對話成本降低 6 倍。
  • 低延遲正式環境 API: Salesforce AI Research 的客戶推薦提到延遲降低 2 倍、成本削減約三分之一。
  • 研究與訓練工作: GPU 叢集主打幾分鐘內啟動叢集、驗證假設,並在實驗結束時關閉。
  • 以開放模型執行的程式設計代理: Together Link 在 Together 託管的模型上執行六個程式設計代理,包括終端機中的 Claude Code、Codex、OpenCode 與 Pi Code,以及 Claude Desktop 與 ChatGPT Desktop。

以上客戶數據由 Together AI 在自家頁面上發布,本條目未經獨立查證。

適用人群

Together AI 適合熟悉 API、SDK 與命令列工具、想使用開放權重模型又不想自建推論架構的開發者與機器學習團隊。

  • 原型開發與波動流量: 無伺服器推論被宣傳為最適合流量多變或難以預測、快速原型開發,以及重視成本或處於早期階段的正式環境工作負載。
  • 穩定且重視延遲的正式環境: 專用模型推論鎖定可預測流量、延遲敏感型應用與高輸送量正式環境工作負載。
  • 已獲募資的新創公司: 一項需經甄選的加速器計畫為募資不超過 $5M 的新創公司提供最高 $15K 平台額度,募資 $5M–$10M 者最高 $30K,超過 $10M 者最高 $50K。

在兩種推論模式之間選擇,關鍵在使用率。若副本一天中大部分時間都處於忙碌狀態,專用模型推論通常較便宜;若流量低或突發性高,以致專用副本大部分時間閒置,無伺服器通常較便宜。定價頁也指出,多數團隊先從無伺服器推論開始,規模擴大後再轉向專用端點。

對想先試用模型再付費的人來說,它不太合適,因為沒有免費試用;以 OpenAI Assistants API 建構的應用程式也不太合適,因為相容層並未實作該 API。

支援平台

Together AI 透過網頁主控台、SDK、CLI 與 REST API 使用,而不是消費級 App。

  • SDK 與 API: Together AI 提供 Python 與 TypeScript 官方 SDK,也可使用 OpenAI SDK,或從任何程式語言直接發出 REST 呼叫。
  • OpenAI 相容: 該 API 在聊天、補全、視覺、影像生成、文字轉語音與嵌入方面相容 OpenAI REST API 及 SDK。
  • 批次工具: 批次工作可從主控台、透過 API 或 SDK,或使用 CLI 啟動。
  • 叢集管理: GPU 叢集存取透過 CLI、SDK、API、Terraform 或網頁主控台,以專案層級 RBAC 管理。
  • 區域: 無伺服器端點不提供區域選擇。私有網路與以 VPC 為基礎的部署(包括歐盟區域)可透過專用方案取得。

價格套餐

Together AI 價格按用量計費,且完全預付。Together AI 目前不提供免費試用,使用平台至少需購買 $5 額度。使用平台須維持正的額度餘額。預付餘額額度目前沒有到期日。自動儲值可自動補足餘額,但僅限預設付款方式為信用卡或簽帳金融卡時。依服務條款,已付費用不予退還,除非條款或訂購單另有規定。

無伺服器 token 價格

無伺服器價格以每 100 萬 token 報價,且經常變動。以下代表性資料擷取於 2026 年 10 月 5 日。

模型輸入快取輸入輸出
MiniMax M3$0.30$0.06$1.20
Kimi K3$3.00$0.30$15.00
gpt-oss-120B$0.15未列出$0.60
Llama 3.3 70B$1.04未列出$1.04

批次 API 宣傳最多可比無伺服器費率便宜 50%,並有獨立的速率限制池。不過,批次文件中的折扣模型表只列出一個 Llama 3.3 70B Turbo 變體與 Whisper Large v3 享有 50% 折扣,未列出的模型按標準費率計費。

GPU 叢集

所有 GPU 叢集價格皆以每 GPU 每小時計。

GPU可搶占隨選保留 7–30 天31–90 天91–180 天181 天以上
NVIDIA HGX H100$1.99$3.99$3.69$3.45$3.19聯絡我們
NVIDIA HGX H200$2.99$5.99$4.99$4.15$3.99聯絡我們
NVIDIA HGX B200$4.09$8.19$7.99$7.79$6.79聯絡我們

叢集佈建完成後,保留方案按完整保留期間收費,超出保留容量的用量按隨選費率計費。新創加速器額度不適用於保留型 GPU 叢集。

專用推論

專用副本僅在就緒並可處理流量時計費,因此佈建與冷啟動時間不收費。H100 費率在不同官方頁面之間有所出入:定價頁的專用推論表列出隨選每 GPU 小時 $5.49。而一則文件更新日誌則表示,H100 80GB 專用端點硬體現為每小時 $3.99,由 $5.49 調降。

微調

微調按處理的 token 計費,也就是訓練資料集大小乘以訓練輪數,再加上評估 token(如有),且每項工作都有依模型設定的最低收費。定價頁上的第一張微調價格表(分頁標示為 LoRA 與完整微調)列出 Qwen3.5 0.8B 的監督式微調價格為每 100 萬 token $0.34、DPO 為 $0.84,最低收費 $4.00。同一張表較下方的 GLM-5.2 列出監督式微調 $40.00、DPO $100.00,最低收費 $60.00。已取消或提前停止的工作只按已完成的步驟收費。在專用端點上託管微調模型另按分鐘計費。

Together AI 替代方案

同類開放模型推論服務商的主要差異在於微調模型如何計費,以及新帳戶是否附帶免費額度。

  • Fireworks AI: Fireworks AI 表示,微調模型的服務價格與基礎模型相同。其無伺服器推論按 token 計費,採預付、按用量計費方式。
  • Baseten: Baseten 表示,新帳戶附帶可免費試驗部署的額度。其專用部署只對實際使用的運算收費,精確到分鐘。

與這些選項相比,Together AI 要求首次購買 $5 且無免費試用,並在專用硬體上按分鐘對微調模型託管計費。作為交換,一個帳戶即可涵蓋無伺服器模型、批次工作、專用端點、GPU 叢集、沙箱與儲存。

注意事項

服務限制

  • 盡力而為的無伺服器: 無伺服器效能為盡力而為,需要承諾輸送量時須使用佈建輸送量。
  • 限流: 需求高時,Together 可能限制請求,用戶端可能收到 429 Too Many Requests 或 503 Service Unavailable 回應。
  • 模型異動: 一則更新日誌將 openai/gpt-oss-20b 等模型排定於 2026 年 9 月 14 日從無伺服器下架。該則日誌中除一個模型外,其餘模型仍可透過隨選專用端點使用,按硬體時間而非 token 計費。
  • 部分相容 OpenAI: OpenAI API 中的 Assistants、Threads 與 Runs 並未實作。gpt-4o 或 text-embedding-3-large 等 OpenAI 模型名稱在 Together 上會回傳 404。
  • 批次上限: 單一批次最多可包含 50,000 個請求。批次的輸入、輸出與錯誤檔案保留 7 天,結果須在此期間內下載。

計費與支援界線

  • 餘額為零: 餘額歸零時,API 存取會被暫停,直到儲值為止。
  • 隨選叢集: 對於完全隨選的 GPU 叢集,額度用完後叢集會先被暫停,若額度未恢復則隨後被撤除。
  • 支援等級: 支援頁面仍按等級說明支援服務,Build 級使用者可獲得 Discord 社群協助。但一則更新日誌表示,Build 1–5 級、Scale 級與 Enterprise 級等級標籤已停用。

隱私、資料使用與所有權

  • 預設儲存: 預設情況下,Together 會儲存提示詞與模型回應,並可能將其用於產品改進。
  • 訓練: 將客戶資料用於模型訓練是另行選擇加入的項目,預設關閉。隱私權政策聲明,未經明確的選擇加入同意,所收集的資料不會用於訓練公司的模型。
  • 零資料保留: 零資料保留預設未啟用。開啟 ZDR 後,提示詞與輸出不會被 Together 儲存,也不會用於任何次要目的。ZDR 只從啟用時起生效,不影響先前已處理的資料。為微調或批次 API 上傳的檔案會一直保存,直到透過 API、CLI 或網頁主控台刪除。
  • 轉送模型: 轉送模型會將請求轉發給第三方供應商,預設允許使用,並受該供應商自身的資料政策規範。
  • 託管的第三方模型: DeepSeek、Qwen 或 Mistral 等第三方作者的模型在 Together 自有基礎設施上執行,不會呼叫模型作者的服務。
  • 所有權與合規: 依服務條款,客戶獨家擁有其內容與輸出。Together AI 列出 SOC 2 Type II、HIPAA 對齊選項,以及傳輸中與靜態加密。

本頁查核的獨立媒體與評測來源未發現產品層面的故障或資安報告,評測樣本不到 20 則,數量過少,無法得出品質結論。

FAQ

Q1. Together AI 有免費方案或免費試用嗎?

沒有。使用須購買至少 $5 額度,且不提供免費試用。獲准加入加速器計畫的新創公司可改為取得平台額度,但這些額度不適用於保留型 GPU 叢集。

Q2. 可以在 Together AI 上使用 OpenAI SDK 嗎?

可以,適用於聊天、補全、視覺、影像生成、文字轉語音與嵌入:將 OpenAI 用戶端指向 Together 的基礎 URL,並改用 Together 帶命名空間的模型 ID。Assistants、Threads 與 Runs 無法使用,批次工作則使用 Together 自己的批次 API。

Q3. Together AI 會用我的提示詞訓練嗎?

預設不會。訓練用途是選擇加入的設定,除非啟用,否則維持關閉。但除非開啟零資料保留,提示詞與回應仍會預設被儲存。

Q4. 額度用完會怎樣?

API 存取會被暫停,直到你儲值為止。隨選 GPU 叢集會被暫停,若額度未恢復則隨後被撤除;既有的 GPU 叢集保留則維持有效,直到預定結束日期。

Q5. 微調後的模型可以帶到別處嗎?

可以。工作完成後,模型可在 Together 專用端點上提供服務,也能下載為檢查點,用於本機推論或其他託管服務。

發現類似工具?
如果你知道其他優秀的AI工具,歡迎提交給我們