Hast du dieses Tool genutzt? Bewerte es
Hast du dieses Tool genutzt? Bewerte es
Nebius ist ein KI-Cloud-Anbieter, der virtuelle Maschinen mit NVIDIA-GPUs und Multi-Node-Cluster vermietet, zusammen mit verwaltetem Kubernetes, verwaltetem Slurm, Speicher und einem gehosteten Inferenzdienst für offene Modelle. Nebius beschreibt sich selbst als KI-Cloud-Unternehmen, dessen Plattform Daten, Modelltraining und -tuning, Produktionslaufzeit und Bereitstellung abdeckt.
Nebius ist an der Nasdaq unter dem Kürzel NBIS notiert und hat seinen Hauptsitz in Amsterdam. Das Angebot teilt sich in zwei Produkte, die unterschiedlich abgerechnet werden. Nebius AI Cloud ist Infrastruktur: Sie erstellen VMs, Cluster, Datenträger und Buckets und zahlen für die Zeit und Kapazität, die diese belegen. Nebius Token Factory ist eine Modell-API: Sie senden Prompts an gehostete offene Modelle und zahlen für Tokens statt für Server.
Vor der Wahl sind drei Punkte wichtig: Die GPU-Listenpreise haben sich am 1. Oktober 2026 geändert, Kapazität nach Bedarf ist vertraglich nicht garantiert, und Token Factory speichert Prompts für spekulatives Decoding, sofern die Null-Datenaufbewahrung nicht aktiviert ist.
Serverlose KI umfasst drei Dienste. Devlabs bietet interaktive Umgebungen mit Jupyter und VS Code, der Job-Dienst führt containerisierte Workloads aus, die starten, laufen und enden, und der Endpunkt-Dienst stellt eigene Modelle über HTTP bereit. Serverlose KI wird nur abgerechnet, solange Workloads laufen, ohne Kosten für ungenutzte GPUs.
Der Speicher von Nebius umfasst ein gemeinsames Dateisystem, ein WEKA-Dateisystem, Block-Volumes, lokale SSD-Datenträger und Objektspeicher mit den Stufen Standard, Intelligent und Erweitert. Der Objektspeicher ist mit der Amazon S3 API kompatibel, sodass vorhandene S3-Tools weiterverwendet werden können.
Die folgenden Beispiele stammen aus Kundengeschichten, die Nebius auf der eigenen Website veröffentlicht; es sind vom Anbieter ausgewählte Ergebnisse, keine unabhängigen Prüfungen.
Weniger geeignet ist Nebius für Käufer, die garantierte Kapazität nach Bedarf ohne Abnahmeverpflichtung brauchen, oder für Nutzer, die Speicher nicht nach jedem Experiment nachverfolgen und löschen wollen.
Die GPU-Cloud-Preise von Nebius werden standardmäßig nutzungsbasiert abgerechnet. GPUs auf laufenden VMs werden sekundengenau abgerechnet und pro Stunde bepreist, 30 Minuten kosten also den halben Stundensatz. Die Preise gelten in USD für alle Kunden außer Unternehmen aus Israel, die in ILS abgerechnet werden. Die Listenpreise enthalten keine anfallenden Steuern, auch keine Mehrwertsteuer.
| Instanz | vCPUs | RAM, GB | Nach Bedarf, GPU-Stunde | GPU-Stunde (gültig ab 1. Oktober 2026) |
|---|---|---|---|---|
| NVIDIA GB300 NVL72 | 112 | 800 | Kontakt aufnehmen | Kontakt aufnehmen |
| NVIDIA HGX B300 | 24 | 346 | $7.85 | $9.50 |
| NVIDIA GB200 NVL72 | 112 | 800 | Kontakt aufnehmen | Kontakt aufnehmen |
| NVIDIA HGX B200 | 20 | 224 | $7.15 | $8.50 |
| NVIDIA HGX H200 | 16 | 200 | $4.50 | $5.40 |
| NVIDIA HGX H100 | 16 | 200 | $3.85 | $4.50 |
| NVIDIA RTX PRO 6000 | 24 | 218 | $1.80 | $1.80 |
| NVIDIA L40S mit Intel-CPU | 8-40 | 32-160 | ab $1.55 | ab $1.55 |
| NVIDIA L40S mit AMD-CPU | 16-192 | 96-1152 | ab $1.82 | ab $1.82 |
Laut Erfassung vom 5. Oktober 2026 zeigt die Preisseite von AI Cloud beide Spalten mit GPU-Stundenpreisen nebeneinander, beschriftet mit „Nach Bedarf“ und „Gültig ab 1. Oktober 2026“. Die Preisdokumentation von Compute nennt für die H100 NVLink $4.50 pro GPU-Stunde ab dem 1. Oktober 2026 und $3.85 vor diesem Datum. Laut derselben Dokumentation betrifft die Aktualisierung VMs mit B300-, B200-, H200- und H100-GPUs.
Token Factory gewährt bei der ersten Registrierung $1 Testguthaben, gültig für 30 Tage. Die Karte wird automatisch belastet, wenn zu Beginn eines Monats ein negativer Saldo besteht oder die Abrechnungsschwelle erreicht ist; schlägt die Kartenbelastung fehl, wird das Konto gesperrt.
Ein unabhängiger Bewertungsbericht zu GPU-Clouds vom September 2026 stellte fest, dass Nebius bei vielen technischen Aspekten und bei den Beziehungen zu NVIDIA und Spitzenlaboren noch hinter CoreWeave liegt.
Ein im September 2026 veröffentlichter unabhängiger Bewertungsbericht nannte Nebius einen Branchenführer mit starken Angeboten in jeder Kategorie und der Fähigkeit, einen deutlichen Preisaufschlag durchzusetzen. Er beschrieb außerdem, als Anekdote, harte Verhandlungen mit hohen Preisen und Vorauszahlungen, die bei einjährigen Verpflichtungen 100 % erreichen. In den eigenen Tests des Berichts funktionierte die automatische Rückführung eines ausgefallenen GB300-Knotens in den Betrieb, dauerte aber 8 Std. 40 Min. Die Tester sahen zudem zunächst langsame 4-KiB-Schreibvorgänge und EEXIST-Fehler auf einem Cluster-Datendateisystem, bis Nebius es nach ihrer Rückmeldung neu abstimmte.
Ja. Für GPUs auf laufenden VMs ist die Abrechnungseinheit eine Sekunde und die Preiseinheit eine Stunde.
Nein. Solche Rabatte setzen ein als Unternehmen registriertes Konto voraus; Privatkonten bleiben bei nutzungsbasierter Abrechnung.
Nebius gibt an, dass Kundeninhalte von Token Factory für das Training keines Modells verwendet werden. Ohne Null-Datenaufbewahrung werden Prompts und Ausgaben dennoch gespeichert und für spekulatives Decoding genutzt.
Token Factory schreibt $1 Testguthaben gut, gültig für 30 Tage. Bei AI Cloud gibt es kostenloses Guthaben über Promo-Codes oder, für Startups, über Risikokapitalfonds von Partnern.