Vous avez utilisé cet outil ? Notez-le
Vous avez utilisé cet outil ? Notez-le
Nebius est un fournisseur de cloud IA qui loue des machines virtuelles à GPU NVIDIA et des clusters multinœuds, avec Kubernetes managé, Slurm managé, du stockage et un service d’inférence hébergé pour les modèles ouverts. Nebius se présente comme une entreprise de cloud IA dont la plateforme couvre les données, l’entraînement et l’ajustement des modèles, l’exécution en production et le déploiement.
Nebius est cotée au Nasdaq sous le symbole NBIS et a son siège à Amsterdam. L’offre se divise en deux produits facturés différemment. Nebius AI Cloud est une infrastructure : vous créez des VM, des clusters, des disques et des buckets, et payez le temps et la capacité qu’ils utilisent. Nebius Token Factory est une API de modèles : vous envoyez des prompts à des modèles ouverts hébergés et payez des tokens plutôt que des serveurs.
Trois points comptent avant de choisir : les prix catalogue des GPU ont changé le 1er octobre 2026, la capacité à la demande n’est pas garantie contractuellement, et Token Factory conserve les prompts pour le décodage spéculatif sauf si la rétention zéro des données est activée.
L’IA sans serveur comprend trois services. Devlabs fournit des environnements interactifs avec Jupyter et VS Code, le service de tâches exécute des charges conteneurisées qui démarrent, tournent puis se terminent, et le service de points de terminaison sert des modèles personnalisés via HTTP. L’IA sans serveur n’est facturée que pendant l’exécution des charges de travail, sans coût pour des GPU inactifs.
Le stockage Nebius comprend un système de fichiers partagé, un système de fichiers WEKA, des volumes en mode bloc, des disques SSD locaux et un stockage objet avec les niveaux standard, intelligent et amélioré. Le stockage objet est compatible avec l’API Amazon S3, de sorte que les outils S3 existants peuvent être réutilisés.
Les exemples ci-dessous proviennent de témoignages clients que Nebius publie sur son propre site ; il s’agit de résultats choisis par le fournisseur, pas d’audits indépendants.
Nebius convient moins aux acheteurs qui ont besoin d’une capacité à la demande garantie sans signer d’engagement, ou aux utilisateurs qui ne veulent pas suivre et supprimer le stockage après chaque expérience.
Les tarifs cloud GPU de Nebius sont à l’usage par défaut. Les GPU des VM en cours d’exécution sont facturés à la seconde et tarifés à l’heure : 30 minutes coûtent donc la moitié du tarif horaire. Les prix sont en USD pour tous les clients, sauf les entreprises israéliennes, facturées en ILS. Les prix affichés n’incluent pas les taxes applicables, dont la TVA.
| Instance | vCPU | RAM, GB | À la demande, GPU-heure | GPU-heure (en vigueur au 1er octobre 2026) |
|---|---|---|---|---|
| NVIDIA GB300 NVL72 | 112 | 800 | Nous contacter | Nous contacter |
| NVIDIA HGX B300 | 24 | 346 | $7.85 | $9.50 |
| NVIDIA GB200 NVL72 | 112 | 800 | Nous contacter | Nous contacter |
| NVIDIA HGX B200 | 20 | 224 | $7.15 | $8.50 |
| NVIDIA HGX H200 | 16 | 200 | $4.50 | $5.40 |
| NVIDIA HGX H100 | 16 | 200 | $3.85 | $4.50 |
| NVIDIA RTX PRO 6000 | 24 | 218 | $1.80 | $1.80 |
| NVIDIA L40S avec CPU Intel | 8-40 | 32-160 | à partir de $1.55 | à partir de $1.55 |
| NVIDIA L40S avec CPU AMD | 16-192 | 96-1152 | à partir de $1.82 | à partir de $1.82 |
D’après la capture du 5 octobre 2026, la page de prix d’AI Cloud affiche côte à côte les deux colonnes de prix par GPU-heure, intitulées « À la demande » et « En vigueur au 1er octobre 2026 ». La documentation tarifaire de Compute indique pour le H100 NVLink $4.50 par heure GPU à partir du 1er octobre 2026, et $3.85 avant cette date. La même documentation précise que la mise à jour concerne les VM équipées de GPU B300, B200, H200 et H100.
Token Factory offre $1 de crédit d’essai lors de la première inscription, valable 30 jours. La carte est débitée automatiquement au début d’un mois dont le solde est négatif ou lorsque le seuil de facturation est atteint, et un échec de débit de la carte suspend le compte.
Un rapport indépendant de notation des clouds GPU publié en septembre 2026 indique que Nebius reste derrière CoreWeave sur de nombreux aspects techniques et dans ses relations avec NVIDIA et les laboratoires de pointe.
Un rapport de notation indépendant publié en septembre 2026 a qualifié Nebius de leader du secteur, avec des offres solides dans chaque catégorie et la capacité d’imposer une prime de prix importante. Il décrit aussi, à titre anecdotique, des négociations agressives avec des prix élevés et des prépaiements atteignant 100 % sur les engagements d’un an. Lors des propres tests du rapport, la remise en service automatique d’un nœud GB300 défaillant a fonctionné mais a pris 8 h 40 min. Les testeurs ont aussi d’abord constaté des écritures lentes de 4 KiB et des erreurs EEXIST sur un système de fichiers de données du cluster, jusqu’à ce que Nebius le réajuste après leurs retours.
Oui. Pour les GPU des VM en cours d’exécution, l’unité de facturation est une seconde et l’unité de tarification une heure.
Non. Les remises d’engagement exigent un compte enregistré en tant qu’entreprise ; les comptes de particuliers restent facturés à l’usage.
Nebius affirme que le contenu client de Token Factory n’est utilisé pour entraîner aucun modèle. Sans la rétention zéro des données, les prompts et les sorties sont tout de même stockés et utilisés pour le décodage spéculatif.
Token Factory ajoute $1 de crédit d’essai valable 30 jours. Sur AI Cloud, les crédits gratuits passent par des codes promo ou, pour les startups, par des fonds de capital-risque partenaires.