Toolso.AI
Toolso.AI
所有工具分類熱門榜單最新工具價格部落格
Toolso.AI
Toolso.AI

💌訂閱 AI 工具週報

每週精選最新、最熱門的AI工具和行業動態,直達您的信箱 訂閱

Toolso.AI
Toolso.AI

發現最好的AI工具,提升你的工作效率

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

熱門分類

  • AI寫作
  • AI影象
  • AI影片
  • AI程式設計
  • 更多分類

探索發現

  • 最新收錄
  • 熱門推薦
  • 更多工具
  • 提交工具
  • 價格

關於

  • 關於我們
  • 聯絡我們
  • 部落格
  • 更新日誌

法律

  • Cookie政策
  • 隱私政策
  • 服務條款
  • 退款政策
© 2026 Toolso.AI 保留所有權利
限時推廣限時推廣加速推廣24h 優先審核 · 無需反鏈 · 30 天推薦展示$29.90到期後 $59.9010月31日後漲價至 $59.90距結束--:--:--立即提交
  1. 首頁
  2. 所有工具
  3. 開發工具
  4. Nebius
Nebius介面預覽
Nebius標誌

Nebius

Nebius 出租 NVIDIA GPU 虛擬機器與叢集,提供代管 Kubernetes 與 Slurm,並透過 Token Factory 相容 OpenAI 的 API 提供開放模型服務。

開發工具AI開發AI訓練平台#機器學習#大語言模型#OpenAI 兼容 API
查看定價
收藏
訪問次數
瀏覽次數
定價
付費
發布日期
2026年10月6日
網域
nebius.com
使用者評分

用過這個工具嗎?為它評分

為這個工具評分

Nebius 工具資訊

查看定價
工具資訊
收藏
訪問次數
瀏覽次數
定價
付費
發布日期
2026年10月6日
網域
nebius.com
使用者評分

用過這個工具嗎?為它評分

為這個工具評分

推薦工具

相關工具推薦

查看定價

Nebius 是什麼?

Nebius 是一家 AI 雲端服務供應商,出租 NVIDIA GPU 虛擬機器與多節點叢集,同時提供代管 Kubernetes、代管 Slurm、儲存,以及針對開放模型的託管推論服務。Nebius 自稱是一家 AI 雲端公司,旗下平台涵蓋資料、模型訓練與調校、正式環境執行階段及部署。

Nebius 在那斯達克掛牌,股票代號 NBIS,總部設於阿姆斯特丹。產品分成兩項,計費方式不同。Nebius AI Cloud 是基礎架構:你建立虛擬機器、叢集、磁碟和儲存貯體,依它們占用的時間與容量付費。Nebius Token Factory 是模型 API:你把提示詞送給託管的開放模型,按 token 而不是按伺服器付費。

選擇前有三點要留意:GPU 牌價已在 2026 年 10 月 1 日調整;隨需容量沒有合約保證;除非開啟零資料保留,Token Factory 會保留提示詞用於推測解碼。

核心功能

GPU 運算

  • 未虛擬化的 GPU:Nebius 的虛擬執行個體不對 GPU 與網路介面做虛擬化,該公司表示其效能可媲美業界最佳基準。
  • 叢集規模:Nebius 的運算資源可從單節點執行個體擴展到千張 GPU 等級的叢集,建置在無阻塞的 NVIDIA Quantum-2 InfiniBand 網路上。
  • GPU 產品線:機架級 GB300 NVL72 與 GB200 NVL72 系統,HGX B300、B200、H200 與 H100 伺服器,RTX PRO 6000 與 L40S 執行個體,另有僅含 CPU 的 AMD EPYC Genoa 與 Intel Ice Lake 虛擬機器。HGX H200 每顆 GPU 配備 141 GB 記憶體。
  • 隨需與可搶占虛擬機器:所有 GPU 虛擬機器平台都能執行可搶占虛擬機器;價格較低,但可能被收回。

協調調度

  • 代管 Kubernetes:全代管的容器協調層,Nebius 表示已針對 AI 工作負載預先最佳化。
  • Soperator(代管 Slurm):Nebius 表示,在主控台完成設定後,20–30 分鐘內即可備妥一個正式環境規模的 Slurm 叢集,節點、相依套件與 NVIDIA 驅動程式都會自動處理。
  • 開放原始碼:Soperator 由 Nebius 自行開發並在 GitHub 開源,也能自行部署到任何雲端。
  • SkyPilot:Nebius 託管 SkyPilot API 伺服器,因此團隊設定與工作歷程保存在雲端環境,而不是本機伺服器。

無伺服器 AI

無伺服器 AI 包含三項服務:Devlabs 提供內建 Jupyter 與 VS Code 的互動式環境;工作服務執行會啟動、運行並結束的容器化工作負載;端點服務透過 HTTP 提供自訂模型。無伺服器 AI 只在工作負載執行時計費,沒有 GPU 閒置費用。

儲存

Nebius 的儲存服務包括共用檔案系統、WEKA 檔案系統、區塊磁碟區、本機 SSD 磁碟,以及設有標準、智慧與增強層級的物件儲存。物件儲存相容 Amazon S3 API,現有的 S3 工具可以沿用。

Nebius Token Factory

  • API 存取:Nebius Token Factory 提供線上試用介面與相容 OpenAI 的 API,可用於推論與微調,支援文字轉文字、嵌入與視覺類模型。
  • 兩種部署模式:無伺服器推論適合評估與流量起伏的情境;專用端點在隔離容量上運行,方便控制效能、擴充、模型設定或區域。
  • 基礎版與快速版:兩者輸出完全相同,但 token 價格與延遲不同;在模型名稱後加上 -fast 即選用快速版。
  • 後訓練:你可以用自己的資料調整開放模型,再把產出的模型部署到 Token Factory。

使用指南

Nebius AI Cloud 入門

  1. 開啟網頁主控台,以 Google、GitHub 或 Microsoft 帳號登入。
  2. 填寫姓名與電子郵件並接受使用條款;Nebius 接著會自動建立一個專案與一個租用戶。
  3. 在「帳務」中選擇以公司或個人身分支付資源費用。新增銀行卡會觸發一筆 $25 扣款,這筆金額會存入帳戶餘額。
  4. 在「運算 → 虛擬機器」下建立虛擬機器:在「運算」步驟選擇「含 GPU」;若要使用競價容量,把虛擬機器類型設為「可搶占」,再挑選平台與預設組態。
  5. 對於可搶占虛擬機器,可以選擇為每小時競價價格設上限的定價政策,也可以選擇「跟隨競價價格」。
  6. 工作完成後,刪除虛擬機器及其磁碟區,因為已停止的虛擬機器仍會產生儲存費用。

Token Factory 入門

  1. 註冊 Token Factory,並在新手引導流程中建立帳務帳戶;這一步無法略過,且需要銀行卡。
  2. 建立 API 金鑰,將任何相容 OpenAI 的用戶端指向 Token Factory 的基礎 URL。
  3. 選擇模型;如果延遲比 token 成本更重要,就在模型名稱後加上 -fast。
  4. 若要停止保留提示詞,請在帳戶個人資料頁開啟零資料保留。

Nebius 使用情境與客戶案例

以下案例出自 Nebius 在自家網站發布的客戶故事,屬於廠商挑選的成果,並非獨立稽核。

  • 詐欺偵測與客服自動化:Revolut 在 200 多張 NVIDIA H100 GPU 與 Token Factory 上執行 FinCrime 代理、聊天協調,以及其事件導向的交易模型 PRAGMA。
  • 實體 AI 與機器人:RoboForce 在採用 NVIDIA Blackwell 基礎架構的 Nebius AI Cloud 上執行實體 AI 工作流程;該案例將 AI 建置流水線時間縮短 70% 歸功於這個平台。
  • 以 Slurm 進行大規模訓練:Photoroom 在 Nebius 上使用 Slurm 叢集,其案例指出長達數月的訓練作業執行期間沒有中斷。
  • 大量開放模型服務:Prosus 透過 Token Factory 專用端點執行大量的開放模型工作負載。

適用人群

  • AI 開發者與企業:Nebius 表示其客戶來自醫療與生命科學、機器人與實體 AI、金融服務、媒體與娛樂、零售及其他產業。
  • 工作負載長期穩定的公司:承諾折扣只提供給以公司身分註冊的帳戶,因此個人帳戶仍採隨用隨付。
  • 沒有專職 DevOps 人員的機器學習團隊:協調工具負責佈建與設定叢集,機器學習工程師不需 DevOps 專業也能排程工作。
  • 可容忍中斷的工作:可搶占虛擬機器不保證可用性,因此適合能承受被停止的工作負載。
  • 想要 API 而非伺服器的開發者:Token Factory 無伺服器推論讓你透過熟悉的 API 起步,不必事先規劃基礎架構,鎖定評估、原型開發與起伏不定的工作負載。
  • 新創公司:目前只能透過 Nebius 的創投合作夥伴取得額度優惠。

對於需要保證隨需容量、卻不想簽承諾合約的買方,或不想在每次實驗後追蹤並刪除儲存空間的使用者,Nebius 較不合適。

支援平台

  • 使用介面:網頁主控台、CLI、Terraform 提供者與 API。物件儲存相容 Amazon S3 API,而 Nebius API、CLI 與 Terraform 提供者的功能涵蓋最完整。
  • 公有區域:eu-north1(芬蘭)、eu-south1(西班牙馬德里)、eu-west1 與 eu-west2(法國)、me-west1(以色列)、us-central1(密蘇里州堪薩斯市)、us-north1(明尼蘇達州伍德伯里),以及 uk-south1 與 uk-south2(英國)。
  • 私有區域:位於冰島的 eu-north2 只開放給已在當地有部署的使用者。
  • GPU 分布:B300 虛擬機器僅在 uk-south1、eu-west2 與 us-north1 提供,H200 虛擬機器在 eu-north1、eu-north2、eu-west1 與 us-central1 提供,H100 虛擬機器僅在 eu-north1 提供,所以你要用的 GPU 決定了區域。
  • 服務涵蓋:服務能否使用取決於專案所在區域,你可以請支援團隊為某個區域加入缺少的服務。
  • Token Factory 區域:專用端點的資料中心區域在端點設定中固定,公用端點則顯示為「全球」區域。
  • 技術支援:Nebius AI Cloud 提供免費技術支援,嚴重等級工單的首次回應目標為 30 分鐘。

價格套餐

Nebius 的 GPU 雲端價格預設採隨用隨付。執行中虛擬機器上的 GPU 按秒計費、按小時定價,因此 30 分鐘的費用是每小時費率的一半。除以色列公司以 ILS 計費外,所有客戶均以 USD 計價。牌價不含適用稅費,包括加值稅。

GPU 執行個體價格

執行個體vCPU記憶體(GB)隨需,每 GPU 小時每 GPU 小時(2026 年 10 月 1 日起生效)
NVIDIA GB300 NVL72112800聯絡我們聯絡我們
NVIDIA HGX B30024346$7.85$9.50
NVIDIA GB200 NVL72112800聯絡我們聯絡我們
NVIDIA HGX B20020224$7.15$8.50
NVIDIA HGX H20016200$4.50$5.40
NVIDIA HGX H10016200$3.85$4.50
NVIDIA RTX PRO 600024218$1.80$1.80
NVIDIA L40S(搭配 Intel CPU)8-4032-160$1.55 起$1.55 起
NVIDIA L40S(搭配 AMD CPU)16-19296-1152$1.82 起$1.82 起

依 2026 年 10 月 5 日的頁面擷取,AI Cloud 價格頁並列顯示兩欄 GPU 小時價格,分別標示為「隨需」與「2026 年 10 月 1 日起生效」。運算服務定價文件列出 H100 NVLink 自 2026 年 10 月 1 日起為每 GPU 小時 $4.50,在此之前為 $3.85。同一份文件表示,此次調整涵蓋搭載 B300、B200、H200 與 H100 GPU 的虛擬機器。

競價、承諾合約與其他費用

  • 不同頁面的競價價格不一致:價格頁列出可搶占 HGX H100 容量每 GPU 小時 $0.79 起,並稱競價價格是動態的;運算服務定價文件列出的可搶占 H100 NVLink 價格為每 GPU 小時 $2.15。
  • 競價波動:競價價格最快可能每 15 分鐘變動一次,其上限維持低於同一平台的一般隨用隨付價格。
  • 承諾合約:預留大規模叢集數個月,費用最多可比隨需價格低 35%。承諾折扣一般為預付。
  • 免費項目:代管 Kubernetes、代管 Soperator(免費軟體,依用量計價)、輸出與輸入流量以及公用 IP 位址都列為免費。
  • 儲存:共用檔案系統每 GiB 每月 $0.0800,標準物件儲存每 GiB 每月 $0.0147。
  • 額度:Nebius 特別優惠中的促銷碼可為 AI Cloud 資源增加免費額度。

Token Factory 帳務

Token Factory 在首次註冊時贈送 $1 試用額度,有效期 30 天。在餘額為負的月份月初,或達到帳務門檻時,系統會自動向銀行卡扣款;扣款失敗會導致帳戶遭停權。

Nebius 替代方案

  • CoreWeave:販售可直接存取硬體、沒有虛擬化負擔的裸機運算,與 Nebius 未虛擬化 GPU 的虛擬機器形成對照。CoreWeave 也推出零輸出費用遷移計畫,移入資料時不必支付輸出費用。
  • Lambda:提供由 HGX B200 與 H100 GPU 組成的 1-Click 叢集供分散式訓練使用,另有幾分鐘內即可啟動的執行個體供原型開發。
  • AWS 及其他超大規模雲端業者:Nebius 宣傳其微調 TCO 比 AWS 好 43%,推論 TCO 好 112%,兩項都標有星號;這些是廠商自己的數據。

一份 2026 年 9 月的獨立 GPU 雲端評級報告指出,Nebius 在許多技術面向,以及與 NVIDIA 和前沿實驗室的關係上,仍落後 CoreWeave。

注意事項

容量與中斷

  • 隨需容量無保證:服務協議允許 Nebius 依可用容量、價格、叢集使用率或其他營運考量,拒絕提供隨需與可搶占服務。
  • 可搶占虛擬機器會被停止:可搶占虛擬機器可能隨時被停止;運算服務會在停止虛擬機器前 60 秒送出 SIGTERM 訊號。
  • 虛擬機器類型固定:既有虛擬機器無法在一般與可搶占之間切換,必須另建一台。
  • 配額:配額從預設值起算,並按區域個別設定。對於長期遠低於上限的配額,Nebius 也可能在寬限期(通常為兩天)結束後調降。

帳務風險

  • 儲存持續計費:已停止的虛擬機器不收運算費用,但其儲存磁碟區在刪除前仍會計費。
  • 門檻扣款:若銀行卡無法支付帳務門檻扣款,帳戶與資源存取權可能遭停權。
  • 退出承諾合約:只有在附錄允許時才能縮短或取消承諾合約,且 Nebius 可以拒絕該請求。

Token Factory 的邊界

  • 速率限制:限額會隨持續使用自動提高,但上限停在基礎配額的 20 倍;超過後 Nebius 要求改用企業版方案。
  • 最佳化模型:Token Factory 會採用量化等技術,並表示最佳化後的模型保有原模型約 99% 的品質。
  • 公用端點:公用端點不承諾區域,並非為需要穩定、可預測區域的正式環境用途而設計。

獨立測試

一份 2026 年 9 月發布的獨立評級報告稱 Nebius 是產業領導者,每個類別都有強勁產品,並有能力收取可觀的價格溢價。報告也以傳聞形式描述了強勢的談判:價格高,一年期承諾的預付款可達 100%。在報告自己的測試中,故障 GB300 節點自動恢復服務的功能可以運作,但耗時 8 小時 40 分鐘。測試人員起初還在一個叢集資料檔案系統上遇到 4 KiB 寫入緩慢與 EEXIST 錯誤,直到 Nebius 依其意見回饋重新調校。

隱私、資料與權利

  • Token Factory 資料保留:除非開啟零資料保留,輸入與輸出會被保留用於推測解碼;Nebius 表示兩種模式下內容都不會用來訓練模型。
  • 零資料保留:開啟 ZDR 後,提示詞與回應在每次請求後不會被儲存,但開啟後可能降低推論速度等服務水準。
  • 儲存位置:被保留的 Token Factory 輸入與輸出存放在芬蘭。所有微調資料集、產出物與模型輸出都存放在歐盟資料中心。
  • 所有權:你保有輸入、輸出與微調模型的所有權,但輸出可能並非獨一無二,其他使用者也可能收到類似的輸出。
  • AI Cloud 資料:根據服務協議,Nebius 僅為履行該協議及相關條款而使用上傳的客戶資料。終止後,客戶資料會連同平台資源一起標記,並在 72 小時內刪除,除非法律要求不同期限。
  • 敏感資料:除非服務明確支援且已有附加條款,客戶不得上傳敏感個人資料。
  • 認證:Nebius 列出含 HIPAA 的 SOC 2 Type II、ISO 27001、ISO 42001 及其他標準,並表示其執行符合 GDPR 與 CCPA 的政策。

FAQ

Q1. Nebius 的 GPU 按秒計費嗎?

是的。執行中虛擬機器上的 GPU 計費單位為 1 秒,定價單位為 1 小時。

Q2. 個人能取得承諾折扣嗎?

不能。承諾折扣要求帳戶以公司身分註冊;個人帳戶仍採隨用隨付計費。

Q3. Token Factory 會用我的提示詞訓練模型嗎?

Nebius 表示 Token Factory 的客戶內容不會用來訓練任何模型。未開啟零資料保留時,提示詞與輸出仍會被儲存並用於推測解碼。

Q4. 有免費試用嗎?

Token Factory 會提供 $1 試用額度,有效期 30 天。在 AI Cloud 上,免費額度來自促銷碼,新創公司也可透過合作創投基金取得。

發現類似工具?
如果你知道其他優秀的AI工具,歡迎提交給我們