Toolso.AI
Toolso.AI
所有工具分类热门榜单最新工具价格博客
Toolso.AI
Toolso.AI

💌订阅 AI 工具周报

每周精选最新、最热门的AI工具和行业动态,直达您的邮箱 订阅

Toolso.AI
Toolso.AI

发现最好的AI工具,提升你的工作效率

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

热门分类

  • AI写作
  • AI图像
  • AI视频
  • AI编程
  • 更多分类

探索发现

  • 最新收录
  • 热门推荐
  • 更多工具
  • 提交工具
  • 价格

关于

  • 关于我们
  • 联系我们
  • 博客
  • 更新日志

法律

  • Cookie政策
  • 隐私政策
  • 服务条款
  • 退款政策
© 2026 Toolso.AI 保留所有权利
限时推广限时推广加速推广24h 优先审核 · 无需反链 · 30 天推荐展示$29.90到期后 $59.9010月31日后涨价至 $59.90距结束--:--:--立即提交
  1. 首页
  2. 所有工具
  3. 开发工具
  4. Nebius
Nebius界面预览
Nebius标志

Nebius

Nebius 出租 NVIDIA GPU 虚拟机和集群,提供托管 Kubernetes 与 Slurm,并通过 Token Factory 兼容 OpenAI 的 API 提供开放模型服务。

开发工具AI开发AI训练平台#机器学习#大语言模型#OpenAI 兼容 API
查看定价
收藏
访问次数
浏览次数
定价
付费
发布日期
2026年10月6日
域名
nebius.com
用户评分

用过这个工具吗?给它评分

为这个工具评分

Nebius 工具信息

查看定价
工具信息
收藏
访问次数
浏览次数
定价
付费
发布日期
2026年10月6日
域名
nebius.com
用户评分

用过这个工具吗?给它评分

为这个工具评分

推荐工具

相关工具推荐

查看定价

Nebius 是什么?

Nebius 是一家 AI 云服务商,出租 NVIDIA GPU 虚拟机和多节点集群,同时提供托管 Kubernetes、托管 Slurm、存储,以及面向开放模型的托管推理服务。Nebius 自称是一家 AI 云公司,其平台覆盖数据、模型训练与调优、生产运行时和部署。

Nebius 在纳斯达克上市,股票代码 NBIS,总部位于阿姆斯特丹。产品分为两款,计费方式不同。Nebius AI Cloud 是基础设施:你创建虚拟机、集群、磁盘和存储桶,按它们占用的时间和容量付费。Nebius Token Factory 是模型 API:你把提示词发给托管的开放模型,按 token 而不是按服务器付费。

选择前有三点值得注意:GPU 标价已于 2026 年 10 月 1 日调整;按需容量没有合同保证;除非开启零数据保留,Token Factory 会保留提示词用于推测解码。

核心功能

GPU 计算

  • 非虚拟化 GPU:Nebius 的虚拟实例不对 GPU 和网络接口做虚拟化,公司称其性能可与业界最佳基准相当。
  • 集群规模:Nebius 计算资源可从单节点实例扩展到千卡级集群,运行在无阻塞的 NVIDIA Quantum-2 InfiniBand 网络上。
  • GPU 产品线:机架级 GB300 NVL72 与 GB200 NVL72 系统,HGX B300、B200、H200 和 H100 服务器,RTX PRO 6000 与 L40S 实例,另有仅含 CPU 的 AMD EPYC Genoa 与 Intel Ice Lake 虚拟机。HGX H200 每块 GPU 配有 141 GB 显存。
  • 按需与可抢占虚拟机:所有 GPU 虚拟机平台都能运行可抢占虚拟机;它们更便宜,但可能被回收。

编排

  • 托管 Kubernetes:全托管的容器编排层,Nebius 称其已针对 AI 工作负载预先优化。
  • Soperator(托管 Slurm):Nebius 称,在控制台完成配置后,20–30 分钟即可就绪一个生产规模的 Slurm 集群,节点、依赖项和 NVIDIA 驱动都会自动处理。
  • 开源代码:Soperator 由 Nebius 自研并在 GitHub 开源,也可以自行部署到任何云上。
  • SkyPilot:Nebius 托管 SkyPilot API 服务器,因此团队配置和作业历史保存在云环境中,而不是本地服务器上。

无服务器 AI

无服务器 AI 包含三项服务:Devlabs 提供带 Jupyter 和 VS Code 的交互式环境;作业服务运行会启动、执行并结束的容器化工作负载;端点服务通过 HTTP 提供自定义模型。无服务器 AI 只在工作负载运行时计费,没有 GPU 闲置费用。

存储

Nebius 存储包括共享文件系统、WEKA 文件系统、块存储卷、本地 SSD 磁盘,以及设有标准、智能和增强层级的对象存储。对象存储兼容 Amazon S3 API,现有的 S3 工具可以复用。

Nebius Token Factory

  • API 访问:Nebius Token Factory 提供在线试用界面和兼容 OpenAI 的 API,用于推理和微调,支持文本到文本、嵌入和视觉类模型。
  • 两种部署模式:无服务器推理适合评估和流量波动的场景;专用端点运行在隔离容量上,便于控制性能、扩缩容、模型配置或区域。
  • 基础版与快速版:两者输出完全相同,但 token 价格和延迟不同;在模型名后加上 -fast 即选择快速版。
  • 后训练:你可以用自己的数据调整开放模型,再把得到的模型部署到 Token Factory。

使用指南

Nebius AI Cloud 入门

  1. 打开网页控制台,用 Google、GitHub 或 Microsoft 账号登录。
  2. 填写姓名和邮箱并接受使用条款;Nebius 随后会自动创建一个项目和一个租户。
  3. 在“计费”中选择以公司还是个人身份为资源付费。添加银行卡会触发一笔 $25 扣款,这笔钱计入账户余额。
  4. 在“计算 → 虚拟机”下创建虚拟机:在“计算”步骤选择“带 GPU”;如需竞价容量,把虚拟机类型设为“可抢占”,再选择平台和预设配置。
  5. 对于可抢占虚拟机,可以选择一个为每小时竞价价格设上限的定价策略,也可以选择“跟随竞价价格”。
  6. 工作完成后,删除虚拟机及其卷,因为已停止的虚拟机仍会产生存储费用。

Token Factory 入门

  1. 注册 Token Factory,并在引导流程中创建计费账户;这一步不能跳过,且需要银行卡。
  2. 创建 API 密钥,把任意兼容 OpenAI 的客户端指向 Token Factory 的基础 URL。
  3. 选择模型;如果延迟比 token 成本更重要,就在模型名后加上 -fast。
  4. 如需停止保留提示词,在账户个人资料页开启零数据保留。

Nebius 使用场景与客户案例

以下案例来自 Nebius 在自家网站发布的客户故事,属于厂商挑选的结果,并非独立审计。

  • 欺诈检测与客服自动化:Revolut 在 200 多块 NVIDIA H100 GPU 和 Token Factory 上运行 FinCrime 智能体、聊天编排,以及其基于事件的交易模型 PRAGMA。
  • 物理 AI 与机器人:RoboForce 在采用 NVIDIA Blackwell 基础设施的 Nebius AI Cloud 上运行物理 AI 工作流;该案例把 AI 搭建流水线耗时缩短 70% 归功于这一平台。
  • 基于 Slurm 的大规模训练:Photoroom 在 Nebius 上使用 Slurm 集群,其案例称长达数月的训练任务运行中没有中断。
  • 大批量开放模型服务:Prosus 通过 Token Factory 专用端点运行大批量开放模型工作负载。

适用人群

  • AI 构建者与企业:Nebius 称其服务的客户来自医疗与生命科学、机器人与物理 AI、金融服务、媒体与娱乐、零售及其他行业。
  • 工作负载长期稳定的公司:承诺折扣仅向注册为公司的账户提供,因此个人账户仍按量付费。
  • 没有专职 DevOps 人员的机器学习团队:编排工具负责开通和配置集群,机器学习工程师无需 DevOps 专业知识即可调度作业。
  • 可容忍中断的作业:可抢占虚拟机不保证可用性,因此适合能承受被停止的工作负载。
  • 想要 API 而非服务器的开发者:Token Factory 无服务器推理让你通过熟悉的 API 起步,无需预先规划基础设施,面向评估、原型开发和波动的工作负载。
  • 初创公司:目前只能通过 Nebius 的风险投资合作伙伴获得额度优惠。

对于需要保证按需容量却不想签承诺合约的买家,或不想在每次实验后跟踪并删除存储的用户,Nebius 不太合适。

支持平台

  • 使用入口:网页控制台、CLI、Terraform 提供程序和 API。对象存储兼容 Amazon S3 API,而 Nebius API、CLI 和 Terraform 提供程序的功能覆盖最完整。
  • 公共区域:eu-north1(芬兰)、eu-south1(西班牙马德里)、eu-west1 和 eu-west2(法国)、me-west1(以色列)、us-central1(密苏里州堪萨斯城)、us-north1(明尼苏达州伍德伯里),以及 uk-south1 和 uk-south2(英国)。
  • 私有区域:位于冰岛的 eu-north2 仅向已在该区域有部署的用户开放。
  • GPU 分布:B300 虚拟机仅在 uk-south1、eu-west2 和 us-north1 提供,H200 虚拟机在 eu-north1、eu-north2、eu-west1 和 us-central1 提供,H100 虚拟机仅在 eu-north1 提供,所以你要用的 GPU 决定了区域。
  • 服务覆盖:服务可用性取决于项目所在区域,你可以请支持团队为某个区域添加缺少的服务。
  • Token Factory 区域:专用端点的数据中心区域在端点配置中固定,公共端点则显示为“全球”区域。
  • 技术支持:Nebius AI Cloud 提供免费技术支持,严重级别工单的首次响应目标为 30 分钟。

价格套餐

Nebius 的 GPU 云价格默认按量付费。运行中虚拟机上的 GPU 按秒计费、按小时定价,因此 30 分钟的费用是小时单价的一半。除以色列公司以 ILS 计费外,所有客户均以 USD 计价。标价不含适用税费,包括增值税。

GPU 实例价格

实例vCPU内存(GB)按需,每 GPU 小时每 GPU 小时(2026 年 10 月 1 日起生效)
NVIDIA GB300 NVL72112800联系我们联系我们
NVIDIA HGX B30024346$7.85$9.50
NVIDIA GB200 NVL72112800联系我们联系我们
NVIDIA HGX B20020224$7.15$8.50
NVIDIA HGX H20016200$4.50$5.40
NVIDIA HGX H10016200$3.85$4.50
NVIDIA RTX PRO 600024218$1.80$1.80
NVIDIA L40S(搭配 Intel CPU)8-4032-160$1.55 起$1.55 起
NVIDIA L40S(搭配 AMD CPU)16-19296-1152$1.82 起$1.82 起

按 2026 年 10 月 5 日的页面抓取,AI Cloud 价格页并排显示两列 GPU 小时价格,分别标注为“按需”和“2026 年 10 月 1 日起生效”。计算服务定价文档列出 H100 NVLink 自 2026 年 10 月 1 日起为每 GPU 小时 $4.50,此前为 $3.85。同一文档称,此次调整覆盖搭载 B300、B200、H200 和 H100 GPU 的虚拟机。

竞价、承诺合约及其他费用

  • 不同页面的竞价价格不一致:价格页列出可抢占 HGX H100 容量每 GPU 小时 $0.79 起,并称竞价价格是动态的;计算服务定价文档列出的可抢占 H100 NVLink 价格为每 GPU 小时 $2.15。
  • 竞价波动:竞价价格最快可能每 15 分钟变动一次,其上限保持低于同一平台的常规按量价格。
  • 承诺合约:预留大规模集群数月,费用最多可比按需价格低 35%。承诺折扣一般为预付。
  • 免费项目:托管 Kubernetes、托管 Soperator(免费软件,按消耗计价)、出站和入站流量以及公网 IP 地址均列为免费。
  • 存储:共享文件系统每 GiB 每月 $0.0800,标准对象存储每 GiB 每月 $0.0147。
  • 额度:Nebius 特别优惠中的促销码可为 AI Cloud 资源增加免费额度。

Token Factory 计费

Token Factory 在首次注册时赠送 $1 试用额度,有效期 30 天。在余额为负的月份月初,或达到计费阈值时,系统会自动从银行卡扣款;扣款失败会导致账户被暂停。

Nebius 替代方案

  • CoreWeave:销售可直接访问硬件、没有虚拟化开销的裸金属计算,与 Nebius 的非虚拟化 GPU 虚拟机形成对照。CoreWeave 还推出零出站费迁移计划,迁入数据时无需支付出站费用。
  • Lambda:提供由 HGX B200 和 H100 GPU 组成的 1-Click 集群用于分布式训练,另有几分钟内即可启动的实例供原型开发使用。
  • AWS 及其他超大规模云厂商:Nebius 宣传其微调 TCO 比 AWS 好 43%,推理 TCO 好 112%,两项都标有星号;这些是厂商自己的数据。

一份 2026 年 9 月的独立 GPU 云评级报告称,Nebius 在许多技术方面以及与 NVIDIA 和前沿实验室的关系上仍落后于 CoreWeave。

注意事项

容量与中断

  • 按需容量无保证:服务协议允许 Nebius 根据可用容量、价格、集群利用率或其他运营考量,拒绝提供按需和可抢占服务。
  • 可抢占虚拟机会被停止:可抢占虚拟机可能随时被停止;计算服务会在停止虚拟机前 60 秒发送 SIGTERM 信号。
  • 虚拟机类型固定:现有虚拟机无法在常规与可抢占之间切换,必须新建一台。
  • 配额:配额从默认值起步,并按区域分别设定。对于长期远低于上限的配额,Nebius 也可能在宽限期(通常为两天)结束后将其调低。

计费风险

  • 存储持续计费:已停止的虚拟机不收计算费用,但其存储卷在删除前仍会计费。
  • 阈值扣款:如果银行卡无法支付计费阈值扣款,账户及资源访问可能被暂停。
  • 退出承诺合约:只有在附录允许的情况下才能缩短或取消承诺合约,且 Nebius 可以拒绝该请求。

Token Factory 的边界

  • 速率限制:限额会随持续使用自动提高,但最高停在基础配额的 20 倍;超出后 Nebius 要求使用企业版方案。
  • 优化模型:Token Factory 会采用量化等技术,并称优化后的模型保留原模型约 99% 的质量。
  • 公共端点:公共端点不承诺区域,并非面向需要稳定、可预测区域的生产用例。

独立测试

一份 2026 年 9 月发布的独立评级报告称 Nebius 是行业领导者,在每个类别都有强劲产品,并有能力收取显著的价格溢价。报告还以传闻形式描述了强硬的谈判:价格高,一年期承诺的预付款可达 100%。在报告自己的测试中,故障 GB300 节点自动恢复服务的功能可用,但耗时 8 小时 40 分钟。测试者起初还在一个集群数据文件系统上遇到 4 KiB 写入缓慢和 EEXIST 错误,直到 Nebius 根据其反馈重新调优。

隐私、数据与权利

  • Token Factory 数据保留:除非开启零数据保留,输入和输出会被保留用于推测解码;Nebius 称两种模式下内容都不会用于训练模型。
  • 零数据保留:开启 ZDR 后,提示词和响应在每次请求后不会被存储,但开启它可能降低推理速度等服务水平。
  • 存储位置:被保留的 Token Factory 输入和输出存储在芬兰。所有微调数据集、产物和模型输出都存储在欧盟数据中心。
  • 所有权:你保有输入、输出和微调模型的所有权,但输出可能并不唯一,其他用户可能收到类似的输出。
  • AI Cloud 数据:根据服务协议,Nebius 仅为履行该协议及相关条款而使用上传的客户数据。终止后,客户数据会随平台资源一起被标记并在 72 小时内删除,除非法律要求不同期限。
  • 敏感数据:除非服务明确支持且已有附加条款,客户不得上传敏感个人数据。
  • 认证:Nebius 列出含 HIPAA 的 SOC 2 Type II、ISO 27001、ISO 42001 及其他标准,并称其执行符合 GDPR 和 CCPA 的政策。

FAQ

Q1. Nebius 的 GPU 按秒计费吗?

是的。运行中虚拟机上的 GPU 计费单位为 1 秒,定价单位为 1 小时。

Q2. 个人能获得承诺折扣吗?

不能。承诺折扣要求账户注册为公司;个人账户仍按量付费。

Q3. Token Factory 会用我的提示词训练模型吗?

Nebius 称 Token Factory 的客户内容不会用于训练任何模型。未开启零数据保留时,提示词和输出仍会被存储并用于推测解码。

Q4. 有免费试用吗?

Token Factory 会提供 $1 试用额度,有效期 30 天。在 AI Cloud 上,免费额度来自促销码,初创公司也可通过合作风投基金获得。

发现类似工具?
如果你知道其他优秀的AI工具,欢迎提交给我们