Toolso.AI
Toolso.AI
Alle ToolsKategorienIm TrendNeueste ToolsPreiseBlog
Toolso.AI
Toolso.AI

💌Abonnieren Sie AI Tools Weekly

Wöchentlich kuratierte Auswahl der neuesten und angesagtesten KI-Tools und Trends, direkt in Ihrem Posteingang Abonnieren

Toolso.AI
Toolso.AI

Entdecken Sie die besten KI-Tools, um Ihre Produktivität zu steigern

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Beliebte Kategorien

  • KI-Schreiben
  • KI-Bild
  • KI-Video
  • KI-Programmierung
  • Weitere Kategorien

Entdecken

  • Neueste Tools
  • Beliebte Tools
  • Mehr Tools
  • Tool einreichen
  • Preise

Über

  • Über uns
  • Kontakt
  • Blog
  • Änderungsprotokoll

Rechtliches

  • Cookie-Richtlinie
  • Datenschutzrichtlinie
  • Nutzungsbedingungen
  • Rückerstattungsrichtlinie
© 2026 Toolso.AI Alle Rechte vorbehalten
BefristetZeitlich begrenztHervorgehobener EintragPrüfung in 24 Std. · Kein Backlink · 30 Tage hervorgehoben$29.90danach $59.90Nach dem 31. Okt. steigt der Preis auf $59.90Endet in--:--:--Jetzt einreichen
  1. Startseite
  2. Alle Tools
  3. Entwicklertools
  4. Nebius
Oberflächenvorschau von Nebius
Logo von Nebius

Nebius

Nebius vermietet VMs und Cluster mit NVIDIA-GPUs samt verwaltetem Kubernetes und Slurm und stellt offene Modelle über die OpenAI-kompatible API von Token Factory bereit.

EntwicklertoolsKI-EntwicklungKI-Trainingsplattform#Maschinelles Lernen#LLM#OpenAI kompatible API
Preise ansehen
Gespeichert
Besuche
Aufrufe
Preis
Kostenpflichtig
Veröffentlicht
6. Okt. 2026
Domain
nebius.com
Nutzerbewertung

Hast du dieses Tool genutzt? Bewerte es

Dieses Tool bewerten

Nebius Produktinformationen

Preise ansehen
Tool-Informationen
Gespeichert
Besuche
Aufrufe
Preis
Kostenpflichtig
Veröffentlicht
6. Okt. 2026
Domain
nebius.com
Nutzerbewertung

Hast du dieses Tool genutzt? Bewerte es

Dieses Tool bewerten

Empfohlene Tools

Verwandte Tools

Preise ansehen

Was ist Nebius?

Nebius ist ein KI-Cloud-Anbieter, der virtuelle Maschinen mit NVIDIA-GPUs und Multi-Node-Cluster vermietet, zusammen mit verwaltetem Kubernetes, verwaltetem Slurm, Speicher und einem gehosteten Inferenzdienst für offene Modelle. Nebius beschreibt sich selbst als KI-Cloud-Unternehmen, dessen Plattform Daten, Modelltraining und -tuning, Produktionslaufzeit und Bereitstellung abdeckt.

Nebius ist an der Nasdaq unter dem Kürzel NBIS notiert und hat seinen Hauptsitz in Amsterdam. Das Angebot teilt sich in zwei Produkte, die unterschiedlich abgerechnet werden. Nebius AI Cloud ist Infrastruktur: Sie erstellen VMs, Cluster, Datenträger und Buckets und zahlen für die Zeit und Kapazität, die diese belegen. Nebius Token Factory ist eine Modell-API: Sie senden Prompts an gehostete offene Modelle und zahlen für Tokens statt für Server.

Vor der Wahl sind drei Punkte wichtig: Die GPU-Listenpreise haben sich am 1. Oktober 2026 geändert, Kapazität nach Bedarf ist vertraglich nicht garantiert, und Token Factory speichert Prompts für spekulatives Decoding, sofern die Null-Datenaufbewahrung nicht aktiviert ist.

Kernfunktionen

GPU-Rechenleistung

  • Nicht virtualisierte GPUs: Die virtuellen Instanzen von Nebius virtualisieren weder GPUs noch Netzwerkschnittstellen, was laut Unternehmen eine Leistung auf dem Niveau der besten Branchen-Benchmarks liefert.
  • Clustergröße: Die Rechenleistung von Nebius skaliert von Instanzen mit einem Knoten bis zu Clustern mit tausend GPUs auf einem nicht blockierenden NVIDIA Quantum-2 InfiniBand-Netz.
  • GPU-Angebot: GB300 NVL72- und GB200 NVL72-Systeme im Rack-Maßstab, HGX B300-, B200-, H200- und H100-Server, RTX PRO 6000- und L40S-Instanzen sowie reine CPU-VMs mit AMD EPYC Genoa und Intel Ice Lake. Die HGX H200 bietet 141 GB Speicher pro GPU.
  • VMs nach Bedarf und unterbrechbare VMs: Unterbrechbare VMs laufen auf allen GPU-VM-Plattformen; sie sind günstiger, können aber zurückgefordert werden.

Orchestrierung

  • Verwaltetes Kubernetes: eine vollständig verwaltete Container-Orchestrierungsschicht, die Nebius als für KI-Workloads vorab optimiert beschreibt.
  • Soperator (verwaltetes Slurm): Laut Nebius ist ein Slurm-Cluster in Produktionsgröße 20–30 Minuten nach einer Konfiguration in der Konsole einsatzbereit; Knoten, Abhängigkeiten und NVIDIA-Treiber werden automatisch erledigt.
  • Quelloffener Code: Soperator wurde intern entwickelt, ist auf GitHub als Open Source veröffentlicht und lässt sich auch selbst in jeder Cloud bereitstellen.
  • SkyPilot: Nebius hostet einen SkyPilot-API-Server, sodass Teamkonfigurationen und Jobverlauf in der Cloud-Umgebung statt auf einem lokalen Server bleiben.

Serverlose KI

Serverlose KI umfasst drei Dienste. Devlabs bietet interaktive Umgebungen mit Jupyter und VS Code, der Job-Dienst führt containerisierte Workloads aus, die starten, laufen und enden, und der Endpunkt-Dienst stellt eigene Modelle über HTTP bereit. Serverlose KI wird nur abgerechnet, solange Workloads laufen, ohne Kosten für ungenutzte GPUs.

Speicher

Der Speicher von Nebius umfasst ein gemeinsames Dateisystem, ein WEKA-Dateisystem, Block-Volumes, lokale SSD-Datenträger und Objektspeicher mit den Stufen Standard, Intelligent und Erweitert. Der Objektspeicher ist mit der Amazon S3 API kompatibel, sodass vorhandene S3-Tools weiterverwendet werden können.

Nebius Token Factory

  • API-Zugang: Nebius Token Factory bietet eine interaktive Testoberfläche und eine OpenAI-kompatible API für Inferenz und Feinabstimmung. Unterstützt werden Text-zu-Text-, Einbettungs- und Bildverarbeitungsmodelle.
  • Zwei Bereitstellungsmodi: serverlose Inferenz für Evaluierung und schwankenden Datenverkehr oder dedizierte Endpunkte auf isolierter Kapazität für Kontrolle über Leistung, Skalierung, Modellkonfiguration oder Region.
  • Basis- und Schnellvariante: Beide liefern identische Ausgaben, unterscheiden sich aber im Tokenpreis und in der Latenz; die Schnellvariante wählen Sie, indem Sie -fast an den Modellnamen anhängen.
  • Nachtraining: Sie können offene Modelle mit eigenen Daten anpassen und das resultierende Modell anschließend auf Token Factory bereitstellen.

Anleitung

Erste Schritte mit Nebius AI Cloud

  1. Öffnen Sie die Webkonsole und melden Sie sich mit einem Google-, GitHub- oder Microsoft-Konto an.
  2. Geben Sie Namen und E-Mail-Adresse ein und akzeptieren Sie die Nutzungsbedingungen; Nebius legt dann automatisch ein Projekt und einen Mandanten an.
  3. Wählen Sie unter Abrechnung, ob Sie Ressourcen als Unternehmen oder als Privatperson bezahlen. Das Hinzufügen einer Bankkarte löst eine Belastung von $25 aus, die Ihrem Kontoguthaben gutgeschrieben wird.
  4. Erstellen Sie eine VM unter Rechenleistung → Virtuelle Maschinen: Wählen Sie im Schritt Rechenleistung „Mit GPUs“, setzen Sie den VM-Typ auf „Unterbrechbar“, wenn Sie Spot-Kapazität möchten, und wählen Sie eine Plattform und eine Voreinstellung.
  5. Wählen Sie für eine unterbrechbare VM entweder eine Preisrichtlinie, die den stündlichen Spot-Preis deckelt, oder „Spot-Preis folgen“.
  6. Löschen Sie nach Abschluss der Arbeit die VM und ihre Volumes, denn eine gestoppte VM verursacht weiterhin Speicherkosten.

Erste Schritte mit Token Factory

  1. Registrieren Sie sich bei Token Factory und legen Sie bei der Ersteinrichtung ein Abrechnungskonto an; dieser Schritt lässt sich nicht überspringen und erfordert eine Bankkarte.
  2. Erstellen Sie einen API-Schlüssel und richten Sie einen beliebigen OpenAI-kompatiblen Client auf die Basis-URL von Token Factory aus.
  3. Wählen Sie ein Modell; hängen Sie -fast an den Namen an, wenn Ihnen die Latenz wichtiger ist als die Tokenkosten.
  4. Um die Speicherung von Prompts zu beenden, aktivieren Sie die Null-Datenaufbewahrung auf der Profilseite Ihres Kontos.

Nebius-Anwendungsfälle und Kundenbeispiele

Die folgenden Beispiele stammen aus Kundengeschichten, die Nebius auf der eigenen Website veröffentlicht; es sind vom Anbieter ausgewählte Ergebnisse, keine unabhängigen Prüfungen.

  • Betrugserkennung und Support-Automatisierung: Revolut betreibt FinCrime-Agenten, Chat-Orchestrierung und PRAGMA, sein ereignisbasiertes Transaktionsmodell, auf mehr als 200 NVIDIA H100 GPUs sowie auf Token Factory.
  • Physische KI und Robotik: RoboForce betreibt seinen Workflow für physische KI auf Nebius AI Cloud mit NVIDIA-Blackwell-Infrastruktur; die Geschichte schreibt der Plattform eine um 70 % kürzere Zeit für die KI-Einrichtungspipeline zu.
  • Training im großen Maßstab mit Slurm: Photoroom nutzte Slurm-Cluster bei Nebius, und seine Geschichte berichtet von mehrmonatigen Trainingsläufen ohne Unterbrechung.
  • Bereitstellung offener Modelle in hohem Volumen: Prosus betreibt Workloads mit offenen Modellen in hohem Volumen über dedizierte Endpunkte von Token Factory.

Für wen ist es

  • KI-Entwickler und Unternehmen: Nebius gibt an, Kunden aus Gesundheitswesen und Biowissenschaften, Robotik und physischer KI, Finanzdienstleistungen, Medien und Unterhaltung, Einzelhandel und weiteren Branchen zu bedienen.
  • Unternehmen mit langen, stabilen Workloads: Rabatte für Abnahmeverpflichtungen gibt es nur für Konten, die als Unternehmen registriert sind; Privatpersonen bleiben daher bei nutzungsbasierter Abrechnung.
  • ML-Teams ohne eigenes DevOps-Personal: Die Orchestrierungswerkzeuge stellen Cluster bereit und konfigurieren sie, sodass ML-Ingenieure Jobs ohne DevOps-Fachwissen planen können.
  • Unterbrechungstolerante Jobs: Unterbrechbare VMs eignen sich für Workloads, die ein Anhalten verkraften, da sie keine Verfügbarkeit garantieren.
  • Entwickler, die eine API statt Servern wollen: Mit der serverlosen Inferenz von Token Factory starten Sie über eine vertraute API, ohne die Infrastruktur vorab zu planen; sie richtet sich an Evaluierung, Prototyping und schwankende Workloads.
  • Startups: Guthabenangebote gibt es derzeit nur über die Risikokapitalpartner von Nebius.

Weniger geeignet ist Nebius für Käufer, die garantierte Kapazität nach Bedarf ohne Abnahmeverpflichtung brauchen, oder für Nutzer, die Speicher nicht nach jedem Experiment nachverfolgen und löschen wollen.

Plattformen

  • Schnittstellen: eine Webkonsole, eine CLI, ein Terraform-Provider und eine API. Der Objektspeicher ist mit der Amazon S3 API kompatibel, während Nebius API, CLI und Terraform-Provider den vollständigsten Funktionsumfang bieten.
  • Öffentliche Regionen: eu-north1 (Finnland), eu-south1 (Madrid, Spanien), eu-west1 und eu-west2 (Frankreich), me-west1 (Israel), us-central1 (Kansas City, Missouri), us-north1 (Woodbury, Minnesota) sowie uk-south1 und uk-south2 (Vereinigtes Königreich).
  • Private Region: eu-north2 in Island steht nur Nutzern offen, die dort bereits Bereitstellungen haben.
  • GPU-Standorte: B300-VMs gibt es nur in uk-south1, eu-west2 und us-north1, H200-VMs in eu-north1, eu-north2, eu-west1 und us-central1 und H100-VMs nur in eu-north1; die gewünschte GPU bestimmt also die Region.
  • Dienstabdeckung: Die Verfügbarkeit von Diensten hängt von der Projektregion ab, und Sie können den Support bitten, einen fehlenden Dienst in einer Region hinzuzufügen.
  • Token-Factory-Regionen: Bei dedizierten Endpunkten ist die Rechenzentrumsregion in der Endpunktkonfiguration festgelegt, öffentliche Endpunkte zeigen dagegen die Region „Global“.
  • Support: Nebius AI Cloud bietet kostenlosen technischen Support mit einem Zielwert von 30 Minuten für die erste Antwort auf kritische Tickets.

Preise

Die GPU-Cloud-Preise von Nebius werden standardmäßig nutzungsbasiert abgerechnet. GPUs auf laufenden VMs werden sekundengenau abgerechnet und pro Stunde bepreist, 30 Minuten kosten also den halben Stundensatz. Die Preise gelten in USD für alle Kunden außer Unternehmen aus Israel, die in ILS abgerechnet werden. Die Listenpreise enthalten keine anfallenden Steuern, auch keine Mehrwertsteuer.

GPU-Instanzpreise

InstanzvCPUsRAM, GBNach Bedarf, GPU-StundeGPU-Stunde (gültig ab 1. Oktober 2026)
NVIDIA GB300 NVL72112800Kontakt aufnehmenKontakt aufnehmen
NVIDIA HGX B30024346$7.85$9.50
NVIDIA GB200 NVL72112800Kontakt aufnehmenKontakt aufnehmen
NVIDIA HGX B20020224$7.15$8.50
NVIDIA HGX H20016200$4.50$5.40
NVIDIA HGX H10016200$3.85$4.50
NVIDIA RTX PRO 600024218$1.80$1.80
NVIDIA L40S mit Intel-CPU8-4032-160ab $1.55ab $1.55
NVIDIA L40S mit AMD-CPU16-19296-1152ab $1.82ab $1.82

Laut Erfassung vom 5. Oktober 2026 zeigt die Preisseite von AI Cloud beide Spalten mit GPU-Stundenpreisen nebeneinander, beschriftet mit „Nach Bedarf“ und „Gültig ab 1. Oktober 2026“. Die Preisdokumentation von Compute nennt für die H100 NVLink $4.50 pro GPU-Stunde ab dem 1. Oktober 2026 und $3.85 vor diesem Datum. Laut derselben Dokumentation betrifft die Aktualisierung VMs mit B300-, B200-, H200- und H100-GPUs.

Spot, Abnahmeverpflichtungen und weitere Kosten

  • Spot-Preise weichen zwischen den Seiten ab: Die Preisseite nennt unterbrechbare HGX H100-Kapazität ab $0.79 pro GPU-Stunde und bezeichnet Spot-Preise als dynamisch. Die Preisdokumentation von Compute nennt für eine unterbrechbare H100 NVLink einen Preis von $2.15 pro GPU-Stunde.
  • Spot-Schwankungen: Der Spot-Preis kann sich bis zu alle 15 Minuten ändern, und seine Obergrenze bleibt unter dem regulären nutzungsbasierten Preis derselben Plattform.
  • Abnahmeverpflichtungen: Wer große Cluster für mehrere Monate reserviert, kann bis zu 35 % weniger zahlen als zu den Preisen nach Bedarf. Rabatte für Abnahmeverpflichtungen werden in der Regel im Voraus bezahlt.
  • Kostenlose Posten: Verwaltetes Kubernetes, verwalteter Soperator (kostenlose Software mit verbrauchsbasierter Preisgestaltung), ausgehender und eingehender Datenverkehr sowie öffentliche IP-Adressen sind als kostenlos aufgeführt.
  • Speicher: Das gemeinsame Dateisystem kostet $0.0800 pro GiB und Monat, Standard-Objektspeicher $0.0147 pro GiB und Monat.
  • Guthaben: Promo-Codes aus Sonderangeboten von Nebius fügen kostenloses Guthaben für Ressourcen in AI Cloud hinzu.

Abrechnung bei Token Factory

Token Factory gewährt bei der ersten Registrierung $1 Testguthaben, gültig für 30 Tage. Die Karte wird automatisch belastet, wenn zu Beginn eines Monats ein negativer Saldo besteht oder die Abrechnungsschwelle erreicht ist; schlägt die Kartenbelastung fehl, wird das Konto gesperrt.

Alternativen zu Nebius

  • CoreWeave: verkauft Bare-Metal-Rechenleistung mit direktem Hardwarezugriff und ohne Virtualisierungsaufwand, ein Kontrast zu den VMs von Nebius mit nicht virtualisierten GPUs. CoreWeave betreibt außerdem ein Migrationsprogramm ohne Ausgangsgebühren, über das sich Daten ohne Gebühren für ausgehenden Datenverkehr übertragen lassen.
  • Lambda: bietet 1-Click-Cluster mit HGX B200- und H100-GPUs für verteiltes Training sowie Instanzen, die für Prototyping in wenigen Minuten starten.
  • AWS und andere große Cloud-Anbieter: Nebius wirbt mit 43 % besseren Gesamtbetriebskosten (TCO) bei der Feinabstimmung und 112 % besseren TCO bei der Inferenz gegenüber AWS, beide mit Sternchen versehen; es handelt sich um eigene Zahlen des Anbieters.

Ein unabhängiger Bewertungsbericht zu GPU-Clouds vom September 2026 stellte fest, dass Nebius bei vielen technischen Aspekten und bei den Beziehungen zu NVIDIA und Spitzenlaboren noch hinter CoreWeave liegt.

Einschränkungen

Kapazität und Unterbrechungen

  • Keine Kapazitätsgarantie nach Bedarf: Der Dienstleistungsvertrag erlaubt Nebius, Dienste nach Bedarf und unterbrechbare Dienste aufgrund verfügbarer Kapazität, Preis, Clusterauslastung oder anderer betrieblicher Erwägungen abzulehnen.
  • Stopps unterbrechbarer VMs: Unterbrechbare VMs können jederzeit gestoppt werden; Compute sendet 60 Sekunden vor dem Stoppen der VM ein SIGTERM-Signal.
  • Fester VM-Typ: Eine bestehende VM lässt sich nicht zwischen regulär und unterbrechbar umstellen; Sie müssen eine neue erstellen.
  • Kontingente: Kontingente beginnen mit Standardwerten und werden für jede Region separat festgelegt. Nebius kann außerdem Kontingente, die lange deutlich unter ihrem Limit bleiben, nach einer Kulanzfrist von üblicherweise zwei Tagen reduzieren.

Abrechnungsrisiken

  • Speicher wird weiter berechnet: Für gestoppte VMs fallen keine Rechenkosten an, ihre Speicher-Volumes werden aber bis zur Löschung weiter berechnet.
  • Belastungen an der Schwelle: Kann eine Karte die Belastung bei Erreichen der Abrechnungsschwelle nicht decken, können das Konto und der Zugriff auf Ressourcen gesperrt werden.
  • Ausstieg aus Abnahmeverpflichtungen: Eine Abnahmeverpflichtung lässt sich nur verkürzen oder kündigen, wenn der Nachtrag dies erlaubt, und Nebius kann die Anfrage ablehnen.

Grenzen von Token Factory

  • Ratenlimits: Die Limits steigen bei anhaltender Nutzung automatisch, enden aber beim 20-Fachen der Basiszuteilung; darüber hinaus verlangt Nebius einen Unternehmenstarif.
  • Optimierte Modelle: Token Factory setzt Techniken wie Quantisierung ein und gibt an, dass optimierte Modelle etwa 99 % der Qualität des Originalmodells behalten.
  • Öffentliche Endpunkte: Sie bieten keine Regionszusage und sind nicht für Produktionsszenarien gedacht, die eine stabile, vorhersehbare Region erfordern.

Unabhängige Tests

Ein im September 2026 veröffentlichter unabhängiger Bewertungsbericht nannte Nebius einen Branchenführer mit starken Angeboten in jeder Kategorie und der Fähigkeit, einen deutlichen Preisaufschlag durchzusetzen. Er beschrieb außerdem, als Anekdote, harte Verhandlungen mit hohen Preisen und Vorauszahlungen, die bei einjährigen Verpflichtungen 100 % erreichen. In den eigenen Tests des Berichts funktionierte die automatische Rückführung eines ausgefallenen GB300-Knotens in den Betrieb, dauerte aber 8 Std. 40 Min. Die Tester sahen zudem zunächst langsame 4-KiB-Schreibvorgänge und EEXIST-Fehler auf einem Cluster-Datendateisystem, bis Nebius es nach ihrer Rückmeldung neu abstimmte.

Datenschutz, Daten und Rechte

  • Aufbewahrung bei Token Factory: Sofern die Null-Datenaufbewahrung nicht aktiviert ist, werden Eingaben und Ausgaben für spekulatives Decoding gespeichert; Nebius gibt an, dass Inhalte in keinem der beiden Modi zum Trainieren von Modellen verwendet werden.
  • Null-Datenaufbewahrung: Mit aktivierter ZDR werden Prompts und Antworten nach jeder Anfrage nicht gespeichert, die Aktivierung kann aber das Serviceniveau senken, etwa die Inferenzgeschwindigkeit.
  • Speicherort: Aufbewahrte Ein- und Ausgaben von Token Factory werden in Finnland gespeichert. Alle Datensätze, Artefakte und Modellausgaben aus der Feinabstimmung werden in Rechenzentren in der EU gespeichert.
  • Eigentum: Eingaben, Ausgaben und feinabgestimmte Modelle bleiben Ihr Eigentum, allerdings sind Ausgaben möglicherweise nicht einzigartig, und andere Nutzer können ähnliche erhalten.
  • Daten in AI Cloud: Laut Dienstleistungsvertrag verwendet Nebius hochgeladene Kundendaten ausschließlich zur Erfüllung des Vertrags und der zugehörigen Bedingungen. Nach Vertragsende werden Kundendaten markiert und zusammen mit den Plattformressourcen innerhalb von 72 Stunden gelöscht, sofern das Gesetz keine andere Frist vorschreibt.
  • Sensible Daten: Kunden dürfen keine sensiblen personenbezogenen Daten hochladen, es sei denn, der Dienst unterstützt dies ausdrücklich und zusätzliche Bedingungen sind vereinbart.
  • Zertifizierungen: Nebius nennt SOC 2 Type II mit HIPAA, ISO 27001, ISO 42001 und weitere Standards und gibt an, DSGVO- und CCPA-konforme Richtlinien umzusetzen.

FAQ

Q1. Rechnet Nebius GPUs sekundengenau ab?

Ja. Für GPUs auf laufenden VMs ist die Abrechnungseinheit eine Sekunde und die Preiseinheit eine Stunde.

Q2. Können Privatpersonen Rabatte für Abnahmeverpflichtungen erhalten?

Nein. Solche Rabatte setzen ein als Unternehmen registriertes Konto voraus; Privatkonten bleiben bei nutzungsbasierter Abrechnung.

Q3. Trainiert Token Factory Modelle mit meinen Prompts?

Nebius gibt an, dass Kundeninhalte von Token Factory für das Training keines Modells verwendet werden. Ohne Null-Datenaufbewahrung werden Prompts und Ausgaben dennoch gespeichert und für spekulatives Decoding genutzt.

Q4. Gibt es eine kostenlose Testphase?

Token Factory schreibt $1 Testguthaben gut, gültig für 30 Tage. Bei AI Cloud gibt es kostenloses Guthaben über Promo-Codes oder, für Startups, über Risikokapitalfonds von Partnern.

Kennen Sie ein ähnliches Tool?
Wenn Sie andere großartige KI-Tools kennen, können Sie sie uns gerne einreichen