Toolso.AI
Toolso.AI
所有工具分类热门榜单最新工具价格博客
Toolso.AI
Toolso.AI

💌订阅 AI 工具周报

每周精选最新、最热门的AI工具和行业动态,直达您的邮箱 订阅

Toolso.AI
Toolso.AI

发现最好的AI工具,提升你的工作效率

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

热门分类

  • AI写作
  • AI图像
  • AI视频
  • AI编程
  • 更多分类

探索发现

  • 最新收录
  • 热门推荐
  • 更多工具
  • 提交工具
  • 价格

关于

  • 关于我们
  • 联系我们
  • 博客
  • 更新日志

法律

  • Cookie政策
  • 隐私政策
  • 服务条款
  • 退款政策
© 2026 Toolso.AI 保留所有权利
限时推广限时推广加速推广24h 优先审核 · 无需反链 · 30 天推荐展示$29.90到期后 $59.9010月31日后涨价至 $59.90距结束--:--:--立即提交
  1. 首页
  2. 所有工具
  3. 开发工具
  4. Together AI
Together AI界面预览
Together AI标志

Together AI

Together AI 通过兼容 OpenAI 的无服务器 API 运行开放权重模型,并提供专用端点、微调、GPU 集群和沙箱,全部从预付额度中扣费。

开发工具AI开发AI训练平台#批量处理#SDK#大语言模型
免费试用
收藏
访问次数
浏览次数
定价
免费增值
发布日期
2026年10月6日
域名
together.ai
用户评分

用过这个工具吗?给它评分

为这个工具评分

Together AI 工具信息

免费试用
工具信息
收藏
访问次数
浏览次数
定价
免费增值
发布日期
2026年10月6日
域名
together.ai
用户评分

用过这个工具吗?给它评分

为这个工具评分

推荐工具

相关工具推荐

免费试用

Together AI 是什么?

Together AI 是一个云平台,通过 API 和可租用的 GPU 基础设施运行、定制和训练开源及开放权重 AI 模型。公司将其宣传为 AI 原生云,即由前沿研究驱动的全栈 AI 平台。对多数开发者而言,入口是开源大模型 API。

该服务由 Together Computer, Inc. 运营,这是一家特拉华州公司,其条款涵盖用于托管、使用、微调和训练大型 AI 模型的 API 与网页界面。独立科技媒体将 Together AI 描述为出租英伟达 GPU 集群的 AI 新型云厂商(neocloud),并报道其以 83 亿美元估值完成 8 亿美元 C 轮融资。同一报道称,公司自称拥有数千家付费客户,并点名其中包括 Cursor、Cognition 和 Decagon。

三个事实决定了大多数选择:没有免费试用,使用前须先购买 $5 额度;除非启用零数据留存,提示词默认会被存储;共享的无服务器容量为尽力而为(best-effort)。

核心功能

Together AI 将产品分为推理、算力和模型定制三类,全部从同一个预付额度余额中扣费。

推理选项

  • 无服务器推理: 开发者通过单一 API 调用开放权重模型,无需部署或管理任何东西,只为实际使用的 token 付费。模型目录涵盖文本、图像、视频、代码和语音模型。
  • 批量推理: 大型异步任务每个模型可扩展至 300 亿 token,可使用任意无服务器模型或私有部署。
  • 预配吞吐量: 承诺的推理容量采用按 token 计价,提供预留吞吐量和 99% 可用性 SLA。
  • 专用端点与容器: 专用模型推理在预留的隔离硬件上运行模型,专用容器推理则面向视频、音频和图像模型等生成式媒体工作负载。

公司称,其 gpt-oss-20B 无服务器推理速度达到次快服务商的近 2 倍。这是厂商自测基准,且该模型之后已被安排从无服务器服务下架。

微调与模型定制

  • 自带模型: Together AI 称,Hugging Face Hub 上的任何开源模型都可微调,无需格式转换。
  • 工具调用数据: 工具调用训练可按原样接收现有智能体日志,函数定义和工具调用直接放在数据集中。
  • 视觉微调: 视觉模型可直接用原始 PNG、JPEG 或 WEBP 图像训练,无需特殊预处理,可采用 LoRA 或全量微调。
  • 结果可迁移: 训练完成的模型可托管在 Together 专用端点上,也可下载为独立检查点。

因此,大模型微调的产出要么运行在专用硬件上,要么以权重形式带离平台,而不会加入按 token 计费的无服务器模型目录。

算力、沙箱与存储

  • GPU 集群: 客户可预留 8 块到 4,000 多块 GPU,用于训练或推理服务。
  • 代码沙箱: 沙箱虚拟机配置为 2 到 64 个 vCPU、1 到 128 GB 内存,用于 AI 开发环境。
  • 托管存储: 托管存储提供对象存储和并行文件系统,且不收取出站流量费用。

使用指南

首次调用 API 需要一个已充值的账户、一个 API 密钥,以及官方 SDK 或现有的 OpenAI 客户端:

  1. 在 Together AI 控制台注册,并在账单设置中充值至少 $5 额度。
  2. 在项目的 API 密钥页面创建密钥;新 API 密钥只显示一次,请立即保存。
  3. 安装官方 Python 或 TypeScript SDK,或保留现有 OpenAI 客户端并修改其基础 URL,然后将密钥设为环境变量。
  4. 运行快速入门示例,它会向 MiniMax M3 发送一条聊天补全请求并打印响应。
  5. 对于离线工作负载,批处理 API 可从单个上传的 JSONL 文件异步运行大量独立请求。

微调费用可在花钱之前查看,因为 CLI 会在提交任务前打印预估价格并请求确认。

Together AI 用例与示例

  • 离线批处理: 批处理任务适合对延迟不敏感的工作,例如对大型数据集分类、运行评估、生成合成数据和离线摘要。
  • 实时语音智能体: Together AI 关于 Decagon 亚秒级语音 AI 的客户案例列出,与 gpt-5 mini 相比,每轮对话成本降低 6 倍。
  • 低延迟生产 API: Salesforce AI Research 的客户推荐语提到延迟降低 2 倍、成本削减约三分之一。
  • 研究与训练任务: GPU 集群主打几分钟内启动集群、验证假设,并在实验结束时关闭。
  • 基于开放模型的编程智能体: Together Link 在 Together 托管的模型上运行六个编程智能体,包括终端中的 Claude Code、Codex、OpenCode 和 Pi Code,以及 Claude Desktop 和 ChatGPT Desktop。

以上客户数据由 Together AI 在其自有页面上发布,本条目未经独立核实。

适用人群

Together AI 适合熟练使用 API、SDK 和命令行工具、希望使用开放权重模型却不想自建推理栈的开发者和机器学习团队。

  • 原型开发与波动流量: 无服务器推理被宣传为最适合流量波动或不可预测、快速原型开发,以及对成本敏感或处于早期阶段的生产工作负载。
  • 稳定且延迟敏感的生产环境: 专用模型推理面向可预测流量、延迟敏感型应用和高吞吐量生产工作负载。
  • 已获融资的初创公司: 一项需经遴选的加速器计划为融资不超过 $5M 的初创公司提供最高 $15K 平台额度,融资 $5M–$10M 的最高 $30K,超过 $10M 的最高 $50K。

在两种推理模式之间选择,关键在利用率。若副本一天中大部分时间都处于忙碌状态,专用模型推理通常更便宜;若流量低或突发性强,以致专用副本大部分时间闲置,无服务器通常更便宜。定价页还指出,大多数团队从无服务器推理起步,规模扩大后再转向专用端点。

对想先试用模型再付费的人来说,它不太合适,因为没有免费试用;基于 OpenAI Assistants API 构建的应用也不太合适,因为兼容层没有实现该 API。

支持平台

Together AI 通过网页控制台、SDK、CLI 和 REST API 使用,而不是消费级应用。

  • SDK 与 API: Together AI 发布了 Python 和 TypeScript 官方 SDK,也可使用 OpenAI SDK,或从任何语言直接发起 REST 调用。
  • OpenAI 兼容: 该 API 在聊天、补全、视觉、图像生成、文本转语音和嵌入方面兼容 OpenAI REST API 及 SDK。
  • 批处理工具: 批处理任务可从控制台、通过 API 或 SDK,或使用 CLI 启动。
  • 集群管理: GPU 集群访问通过 CLI、SDK、API、Terraform 或网页控制台,以项目级 RBAC 进行管理。
  • 区域: 无服务器端点不支持选择区域。私有网络和基于 VPC 的部署(包括欧盟区域)可通过专用方案获得。

价格套餐

Together AI 价格按用量计费,且完全预付。Together AI 目前不提供免费试用,使用平台至少需购买 $5 额度。使用平台须保持额度余额为正。预付余额额度目前没有有效期。自动充值可自动补足余额,但仅限默认支付方式为信用卡或借记卡时。根据服务条款,已付费用不予退还,除非条款或订购单另有规定。

无服务器 token 价格

无服务器价格按每 100 万 token 报价,且经常变动。以下代表性数据采集于 2026 年 10 月 5 日。

模型输入缓存输入输出
MiniMax M3$0.30$0.06$1.20
Kimi K3$3.00$0.30$15.00
gpt-oss-120B$0.15未列出$0.60
Llama 3.3 70B$1.04未列出$1.04

批处理 API 宣传最多可比无服务器费率便宜 50%,并有独立的速率限制池。不过,批处理文档中的折扣模型表只列出一个 Llama 3.3 70B Turbo 变体和 Whisper Large v3 享受 50% 折扣,未列出的模型按标准费率计费。

GPU 集群

所有 GPU 集群价格均按每 GPU 每小时计。

GPU可抢占按需预留 7–30 天31–90 天91–180 天181 天以上
NVIDIA HGX H100$1.99$3.99$3.69$3.45$3.19联系我们
NVIDIA HGX H200$2.99$5.99$4.99$4.15$3.99联系我们
NVIDIA HGX B200$4.09$8.19$7.99$7.79$6.79联系我们

集群开通后,预留按完整预留期限收费,超出预留容量的用量按按需费率计费。初创公司加速器额度不适用于预留 GPU 集群。

专用推理

专用副本仅在就绪并可处理流量时计费,因此开通和冷启动时间不收费。H100 费率在不同官方页面之间存在差异:定价页的专用推理表列出按需每 GPU 小时 $5.49。而一条文档更新日志则称,H100 80GB 专用端点硬件现为每小时 $3.99,由 $5.49 下调。

微调

微调按处理的 token 计费,即训练数据集大小乘以轮数,再加上评估 token(如有),且每个任务都有按模型设定的最低收费。定价页上的第一张微调价格表(页签为 LoRA 与全量微调)列出 Qwen3.5 0.8B 的监督微调价格为每 100 万 token $0.34、DPO 为 $0.84,最低收费 $4.00。同一表格靠后的 GLM-5.2 列出监督微调 $40.00、DPO $100.00,最低收费 $60.00。已取消或提前停止的任务仅按已完成的步骤收费。在专用端点上托管微调模型另按分钟计费。

Together AI 替代方案

同类开放模型推理服务商的主要区别在于微调模型如何计费,以及新账户是否附带免费额度。

  • Fireworks AI: Fireworks AI 表示,微调模型的服务价格与基础模型相同。其无服务器推理按 token 计费,采用预付、按用量计费的方式。
  • Baseten: Baseten 称,新账户附带可免费试验部署的额度。其专用部署只对实际使用的算力收费,精确到分钟。

与这些选项相比,Together AI 要求首次购买 $5 且无免费试用,并在专用硬件上按分钟对微调模型托管计费。作为交换,一个账户即可覆盖无服务器模型、批处理任务、专用端点、GPU 集群、沙箱和存储。

注意事项

服务限制

  • 尽力而为的无服务器: 无服务器性能为尽力而为,需要承诺吞吐量时须使用预配吞吐量。
  • 限流: 需求高时,Together 可能限制请求,客户端可能收到 429 Too Many Requests 或 503 Service Unavailable 响应。
  • 模型变动: 一条更新日志将 openai/gpt-oss-20b 等模型安排于 2026 年 9 月 14 日从无服务器下架。该条目中除一个模型外,其余模型仍可通过按需专用端点使用,按硬件时长而非 token 计费。
  • 部分兼容 OpenAI: OpenAI API 中的 Assistants、Threads 和 Runs 未实现。gpt-4o 或 text-embedding-3-large 等 OpenAI 模型名称在 Together 上会返回 404。
  • 批处理上限: 单个批次最多可包含 50,000 个请求。批处理的输入、输出和错误文件保留 7 天,结果须在此期限内下载。

计费与支持边界

  • 余额为零: 余额归零时,API 访问会被暂停,直到充值为止。
  • 按需集群: 对于完全按需的 GPU 集群,额度用完后集群会先被暂停,若额度未恢复则随后被撤除。
  • 支持等级: 支持页面仍按等级描述支持服务,Build 级用户可获得 Discord 社区帮助。但一条更新日志称,Build 1–5 级、Scale 级和 Enterprise 级等级标签已停用。

隐私、数据使用与所有权

  • 默认存储: 默认情况下,Together 会存储提示词和模型响应,并可能将其用于产品改进。
  • 训练: 将客户数据用于模型训练是单独的选择加入项,默认关闭。隐私政策声明,未经明确的选择加入同意,收集的数据不会用于训练公司的模型。
  • 零数据留存: 零数据留存默认未启用。开启 ZDR 后,提示词和输出不会被 Together 存储,也不会用于任何次要目的。ZDR 仅从启用时起生效,不影响此前已处理的数据。为微调或批处理 API 上传的文件会一直保存,直到通过 API、CLI 或网页控制台删除。
  • 透传模型: 透传模型会将请求转发给第三方提供商,默认允许使用,并受该提供商自身的数据政策约束。
  • 托管的第三方模型: DeepSeek、Qwen 或 Mistral 等第三方作者的模型运行在 Together 自有基础设施上,不会调用模型作者的服务。
  • 所有权与合规: 根据服务条款,客户独占拥有其内容和输出。Together AI 列出 SOC 2 Type II、HIPAA 对齐选项,以及传输中和静态加密。

本页核查的独立媒体和评测来源未发现产品层面的故障或安全报告,评测样本不足 20 条,数量太少,无法得出质量结论。

FAQ

Q1. Together AI 有免费套餐或免费试用吗?

没有。使用须购买至少 $5 额度,且不提供免费试用。获准加入加速器计划的初创公司可改为获得平台额度,但这些额度不适用于预留 GPU 集群。

Q2. 能在 Together AI 上使用 OpenAI SDK 吗?

可以,适用于聊天、补全、视觉、图像生成、文本转语音和嵌入:将 OpenAI 客户端指向 Together 的基础 URL,并改用 Together 带命名空间的模型 ID。Assistants、Threads 和 Runs 不可用,批处理任务使用 Together 自己的批处理 API。

Q3. Together AI 会用我的提示词训练吗?

默认不会。训练用途是选择加入设置,除非启用,否则保持关闭。但除非开启零数据留存,提示词和响应仍会默认被存储。

Q4. 额度用完会怎样?

API 访问会被暂停,直到你充值。按需 GPU 集群会被暂停,若额度未恢复则随后被撤除;现有 GPU 集群预留则保持有效,直到其预定结束日期。

Q5. 微调后的模型能带到别处吗?

可以。任务完成后,模型可在 Together 专用端点上提供服务,也可下载为检查点,用于本地推理或其他托管方。

发现类似工具?
如果你知道其他优秀的AI工具,欢迎提交给我们