Aller au contenu
English
Cloud medium

GPU Instances et Elastic Metal Scaleway : IA, calcul et bare metal

35 min de lecture

logo Scaleway

Toutes les charges de travail ne tiennent pas sur une Instance CPU classique. L'IA, le rendu ou le calcul intensif réclament des GPU ; certaines applications exigent une machine physique dédiée, sans voisins ni couche de virtualisation. Scaleway répond à ces besoins avec les GPU Instances et Elastic Metal. Cette leçon vous apprend à décider entre les trois familles de calcul sur des critères vérifiables, vous fait lister les offres, leurs zones, leurs quotas et leurs prix avec scw, et vous montre les pièges qui coûtent cher. Aucune ressource n'est provisionnée ici : tout se fait en lecture seule, sans dépense.

Niveau : débutant à intermédiaire. Prérequis : la CLI scw configurée.

À la fin de cette page, vous saurez :

  • Situer les cinq familles de GPU Instances et ce que chacune fait bien
  • Ce qu'apporte Elastic Metal, et ce qu'il vous retire (snapshots, Block Storage, BIOS)
  • Lister les offres GPU et Elastic Metal avec leur disponibilité et leur prix
  • Décider entre Instance CPU, GPU et Elastic Metal, et dans quelle zone
  • Connaître les quotas de départ et le modèle de facturation de chaque famille

Voici comment se positionnent ces trois familles de calcul.

Positionnement Scaleway : Instances CPU pour l'usage général, GPU Instances pour l'IA et le rendu, Elastic Metal pour le bare metal dédié

GPU Instance, Elastic Metal : deux réponses à deux problèmes différents

Section intitulée « GPU Instance, Elastic Metal : deux réponses à deux problèmes différents »

Une GPU Instance est une machine virtuelle à laquelle Scaleway attache un ou plusieurs GPU NVIDIA dédiés ; un serveur Elastic Metal est une machine physique entière, louée à l'heure ou au mois, sans hyperviseur. La première résout un problème de calcul parallèle : entraînement et inférence de modèles, rendu 3D, encodage vidéo. Le second résout un problème d'isolation et de contrôle : performance constante sans voisin, accès au matériel, licences ou hyperviseurs qui exigent une machine dédiée.

Les deux se pilotent comme le reste du catalogue, depuis la console, l'API et scw, et les deux se facturent à l'usage. La ressemblance s'arrête là. Une GPU Instance reste une Instance : elle se snapshotte, boote sur un volume Block, et se détruit en une commande. Un serveur Elastic Metal est livré vide ou avec un système installé par Scaleway, et à partir de là vous êtes seul à bord : pas de snapshot, pas de Block Storage, et un support qui n'a aucun accès à la machine une fois installée.

Scaleway propose cinq familles de GPU, et la documentation officielle dit pour chacune ce qu'elle fait bien et ce qu'elle ne fait pas. Le tableau ci-dessous reprend cette grille (page « Choosing the right GPU Instance type », validée le 2025-10-28). Il se lit par la colonne « faite pour » : c'est elle qui décide, pas le nombre de GPU.

FamilleGPU et mémoireScratchMIGRéseauFaite pourPas faite pour
L4 (L4-1-24G à L4-8-24G)1 à 8 × L4, 24 Go GDDR6nonnon2,5 à 20 Gbit/sencodage image et vidéo 8K, inférence de modèles 7B à 70Bentraînement de LLM
L40S (L40S-1-48G à L40S-8-48G)1 à 8 × L40S, 48 Go GDDR61,6 à 12,8 Tonon2,5 à 20 Gbit/sIA générative image et vidéo, fine-tuning de modèles texte-imageentraînement de gros LLM
H100 PCIe (H100-1-80G, H100-2-80G)1 à 2 × H100, 80 Go HBM2e3 à 6 Tooui, 7 partitions10 à 20 Gbit/sfine-tuning et inférence 7B (1 GPU) et 70B (2 GPU)rendu graphique, encodage
H100-SXM (H100-SXM-2-80G à -8-80G)2 à 8 × H100, 80 Go HBM3, NVLink 900 Go/s3,2 à 12,8 Tooui20 Gbit/sfine-tuning, inférence avec faible quantification, inférence Llama 4 ou DeepSeek R1 (8 GPU)entraînement de LLM sur un seul nœud, graphisme
B300-SXM (B300-SXM-8-288G)8 × B300, 288 Go HBM3e, NVLink 1 800 Go/s~24 Tooui20 Gbit/sentraînement et inférence à grande échelle, multimodal, HPC lourdtemps réel graphique, montage vidéo

Deux critères pèsent plus que le nombre de GPU : la mémoire par carte et la bande passante mémoire. La documentation Scaleway cite la règle de Tim Dettmers : les Tensor Cores d'abord, la bande passante mémoire ensuite, les FLOPS en dernier. Un modèle 70B en inférence tient dans 4 L4 (96 Go) comme dans 2 H100 (160 Go), mais la HBM3 de la H100 le sert bien plus vite. Choisissez la famille sur le type de travail, puis le nombre de cartes sur la mémoire nécessaire.

Le vieux type RENDER-S existe encore au catalogue et se facture à l'heure ; il n'apparaît plus dans la grille de choix officielle. Il n'a plus de raison d'être retenu pour un projet neuf.

Où trouve-t-on des GPU, et sont-ils disponibles ?

Section intitulée « Où trouve-t-on des GPU, et sont-ils disponibles ? »

Les GPU n'existent que dans trois zones, et rarement en stock. Relevé le 2026-09-08 avec scw instance server-type list zone=… -o json (scw 2.56.3) :

ZoneFamilles présentesDisponibilité relevée
fr-par-1L4, RENDER-SL4 en scarce ou shortage
fr-par-2B300, H100-SXM, H100, L40S, L4, RENDER-S1 seul type available sur 15 (H100-SXM-2-80G), tout le reste scarce ou shortage
pl-waw-2H100, L40S, L4les quatre L4 available, H100 et L40S en shortage
toutes les autres zonesaucune

Refaites ce relevé avant de promettre une machine à qui que ce soit : la valeur du champ availability change d'une heure à l'autre, et shortage signifie qu'une création échouera. Une leçon pratique en découle : un projet GPU commence par la zone, pas par la région. Si votre application vit en fr-par-1, ses GPU seront en fr-par-2, et le trafic entre les deux passera par un Private Network régional, ce qui fonctionne mais se décide avant.

Fenêtre de terminal
scw instance server-type list zone=fr-par-2 -o json \
| python3 -c 'import sys,json; [print(t["name"], t["gpu"], t["availability"]) for t in json.load(sys.stdin) if t["gpu"]]'

La sortie doit lister les types GPU de la zone avec leur nombre de cartes et leur disponibilité. Si la liste est vide, la zone n'héberge aucun GPU.

Les GPU Instances se facturent à la minute d'exécution, sauf RENDER-S facturé à l'heure (FAQ Instances, validée le 2025-12-19). La facturation démarre au premier démarrage, et sur Kapsule elle démarre dès la création du nœud, avant même que l'opérateur NVIDIA soit prêt. Les savings plans (jusqu'à 25 % de remise contre engagement) ne s'appliquent pas aux H100, L40S, L4, RENDER et POP-WIN : le prix catalogue est le prix payé.

Mesuré le 2026-09-08 avec scw 2.56.3 : pour L4-1-24G, le champ hourly_price renvoyé par scw instance server-type list vaut 0,013125 €. Ce nombre n'a de sens que comme prix à la minute, cohérent avec la facturation à la minute de la FAQ : multiplié par 60, il donne un ordre de grandeur d'environ 0,79 € par heure, soit environ 19 € par jour pour la plus petite GPU. Le même calcul donne environ 2,9 € par heure pour H100-1-80G (0,047775 €/min) et 60 € par heure pour B300-SXM-8-288G (1,00 €/min). Retenez la méthode plus que les valeurs : la grille tarifaire officielle fait foi, et le champ de l'API ne dit pas lui-même son unité.

Scaleway publie des images Docker d'IA dans son registre, et des images système GPU dans le marketplace. Les images système portent le label ubuntu_noble_gpu_os_12, ubuntu_noble_gpu_os_13_nvidia ou ubuntu_jammy_gpu_os_12 dans scw marketplace image list (33 images relevées le 2026-09-08) ; elles embarquent les pilotes NVIDIA, nvidia-docker et le CLI NGC. Les images Docker se tirent depuis rg.fr-par.scw.cloud/scw-ai/ : pytorch, tensorflow, jax, rapids et une image all, toutes bâties sur CUDA 12.2 et cuDNN 8, avec JupyterLab, Code Server et les bibliothèques usuelles.

Leurs tags suivent le motif YYMM-py3 (2204-py3 pour avril 2022, YYMM-tf2-py3 pour TensorFlow). La documentation publie aussi un tag latest : ne l'utilisez pas. Sur ce site, une image se réfère par un tag daté et son digest image:tag@sha256:…, seule forme qui garantit de relancer demain exactement ce qui a tourné aujourd'hui. Relevez le digest avec docker pull puis docker inspect --format '{{index .RepoDigests 0}}.

Elastic Metal : le bare metal dédié, et ce qu'il vous retire

Section intitulée « Elastic Metal : le bare metal dédié, et ce qu'il vous retire »

Elastic Metal fournit des serveurs physiques dédiés, livrés en quelques minutes, sans hyperviseur : vous avez la machine entière. On y gagne des performances constantes (aucun voisin), le contrôle du matériel et la possibilité d'y installer ce qu'une machine virtuelle interdit : votre propre hyperviseur (Proxmox, ESXi n'est plus supporté), une base de données sur NVMe local, une application licenciée au socket.

Cinq gammes existent, et leur objectif de disponibilité (SLO, page « Shared Responsibility Model », validée le 2025-07-28) dit leur rang :

GammePositionnement officielSLO alimentation et réseau
Aluminiumdédié au meilleur prix, intégration cloud native99,9 %
Berylliuméquilibré, fiable, production99,95 %
Lithiumgros stockage local : sauvegarde, archivage99,95 %
Iridiumfortes charges, haut de gamme99,99 %
Titaniumserveurs GPU dédiés (EM-T220E-L40S, EM-T620E-H100)99,99 %

La contrepartie du contrôle, c'est la responsabilité. La FAQ et le modèle de responsabilité partagée sont sans détour : pas de snapshot, pas de Block Storage (annoncé, pas disponible), pas d'accès au BIOS, firmware géré par Scaleway et appliqué au reboot. Les sauvegardes sont à votre charge, par export vers Object Storage, RAID ou réplication applicative ; en cas de panne disque, Scaleway ne garantit pas que vous récupériez vos données. À la suppression, les disques sont effacés par algorithme sécurisé, sans retour possible.

Elastic Metal n'existe que dans six zones : fr-par-1, fr-par-2, nl-ams-1, nl-ams-2, pl-waw-2, pl-waw-3 (FAQ, confirmée par l'aide de scw baremetal offer list -h). Listez les offres d'une zone avec leur prix, leur stock et leur empreinte environnementale :

Fenêtre de terminal
scw baremetal offer list zone=fr-par-2 -o json \
| python3 -c 'import sys,json; [print(o["name"], o["commercial_range"], o["stock"], o["price_per_hour"]["nanos"]/1e9, "EUR/h", o["kg_co2_equivalent"], "kgCO2e") for o in json.load(sys.stdin)]'

La sortie doit afficher une ligne par offre. Mesuré le 2026-09-08 en fr-par-2 : 41 offres, dont EM-A116X-SSD (Aluminium, 500 Mbit/s) à 0,077 € par heure en stock available, EM-L101X-SATA (Lithium) à 0,122 € par heure, et une offre EM-RV1-C4M16S128-A de la gamme labs, un serveur RISC-V à 0,042 € par heure. Chaque offre expose aussi m3_water_usage, cloud_init_supported, bandwidth et max_bandwidth : Scaleway est l'un des rares fournisseurs à publier l'empreinte carbone et hydrique de chaque machine dans son API, et c'est un critère de choix à part entière.

Lancée sur une zone sans Elastic Metal, la même commande répond :

Unknown service

C'est le cas de it-mil-1 : Milan n'a pas de bare metal, et l'erreur ne dit pas pourquoi.

Un serveur Elastic Metal se facture à l'heure ou au mois, et le passage de l'un à l'autre n'est possible qu'une fois, dans un seul sens. Vous pouvez basculer un serveur horaire en mensuel ; pour revenir à l'horaire, il faut créer et réinstaller un nouveau serveur. Le mensuel demande des frais d'engagement égaux à un mois d'abonnement. Le bon de fidélité qui remboursait ces frais après douze mois n'existe plus pour les souscriptions postérieures au 1er avril 2026.

Autre différence avec une Instance, lourde de conséquences sur la facture : un serveur Elastic Metal éteint reste facturé. La FAQ facturation est explicite : la machine physique reste allouée à votre compte du moment de la création à celui de la suppression. Éteindre n'économise rien ; seule la suppression arrête le compteur.

Ces valeurs décident de ce que vous pouvez créer avant même de choisir une offre. Elles viennent de la page officielle des quotas d'Organisation (validée le 2025-10-29), de la FAQ Elastic Metal et de la FAQ Instances ; toutes se relèvent aussi dans la console, tableau de bord de l'Organisation.

PlafondValeurSource
Quota L4-1-24G, L40S-1-48G, RENDER-S1 après vérification d'identité, 0 avantquotas d'Organisation
Quota des autres types GPU (L4 multi-cartes, H100, H100-SXM, B300)sur ticket au support, même identité vérifiéequotas d'Organisation
Quota Elastic Metal gamme A (A115X, A215R, A310X, A315X)1 avant vérification, 3 aprèsquotas d'Organisation
Volume système minimal d'une image GPU OS125 Go (10 Go pour une image classique)FAQ Instances
Objectif de disponibilité GPU Instances99,5 %doc GPU, SLA Instances
Flexible IP par serveur Elastic Metal64 au maximum, IPv4 ou blocs IPv6 /64FAQ Elastic Metal
Bande passante Elastic Metalajustable jusqu'à 25 Gbit/s, trafic illimitéFAQ Elastic Metal
Installation d'un Elastic Metallivraison en minutes, installation jusqu'à 1 hFAQ Elastic Metal
Scratch storage1,6 To (L40S-1) à ~24 To (B300-SXM-8), effacé au stop/startdoc scratch storage

Le quota GPU est le plafond qui surprend le plus. Un compte neuf, même avec identité vérifiée, ne peut créer qu'une seule petite GPU par type ; tout ce qui dépasse, y compris une simple L4-2-24G, passe par un ticket. Ouvrez-le avant le jour du besoin, pas le jour même.

Le bon choix dépend de la charge, et la plupart des charges tiennent sur une Instance CPU. Ce tableau se lit par la colonne Besoin : trouvez la ligne qui décrit votre charge, la colonne Choix donne la famille, et la colonne Pourquoi dit ce qui a tranché. Si aucune ligne ne correspond, partez d'une Instance CPU et mesurez.

BesoinChoixPourquoi
Web, API, production généraleInstance CPUsouple, économique, création en secondes, snapshots et Block Storage
Inférence d'un modèle 7B, encodage vidéoGPU L4 (L4-1-24G ou L4-4-24G)24 Go par carte, la moins chère, available en pl-waw-2 lors du relevé
Fine-tuning d'un modèle 7B à 70BGPU H100 (H100-1-80G, H100-2-80G)80 Go HBM2e par carte, MIG, scratch 3 à 6 To
Inférence de très gros modèles, multi-GPUH100-SXM ou B300-SXMNVLink 900 à 1 800 Go/s entre cartes
IA générative image et vidéoGPU L40S48 Go GDDR6 par carte, scratch NVMe
Hyperviseur maison, base NVMe locale, licence au socketElastic Metalmachine entière, pas de couche de virtualisation
Latence constante, sans voisin, SLO 99,99 %Elastic Metal Iridiumgamme au SLO le plus élevé
Sauvegardes volumineuses sur disques locauxElastic Metal Lithiumgros stockage local, bande passante 1 Gbit/s et plus
Charge GPU permanente, pilotes et noyau à votre mainElastic Metal TitaniumGPU sans hyperviseur, facturation mensuelle possible

Trois questions départagent les cas ambigus. Avez-vous besoin de snapshots ? Alors Instance, jamais Elastic Metal. La charge est-elle intermittente ? Alors GPU Instance à la minute, jamais un serveur mensuel. Avez-vous besoin d'un hyperviseur ou du matériel ? Alors Elastic Metal, et prévoyez la sauvegarde avant la première installation.

Ces six erreurs ont un point commun : elles ne produisent aucun message d'erreur. La commande réussit, la machine tourne, et la facture ou la perte de données arrive plus tard. C'est exactement ce qu'un lecteur de cette leçon doit savoir reconnaître avant de cliquer.

AntipatternConséquenceDiscipline
Choisir une GPU « par sécurité » pour une charge CPU10 à 100 fois le prix, sans gainMesurer sur une Instance CPU d'abord, ne passer au GPU que sur une mesure
Stocker un jeu de données ou un modèle sur le scratch storageeffacé au premier stop/startScratch pour le travail en cours, Block Storage ou Object Storage pour ce qui doit rester
Éteindre un Elastic Metal pour économiserfacturé à l'identique, machine toujours allouéeSupprimer, ou basculer en mensuel si l'usage est permanent
Installer un Elastic Metal sans plan de sauvegardeperte totale possible sur panne disque, sans recoursExport vers Object Storage ou RAID avant la première donnée utile
Passer en mensuel avant d'avoir validé l'offre en horaireretour à l'horaire impossible sans recréer le serveurUne semaine en horaire, puis bascule mensuelle
Découvrir le quota GPU le jour du besointicket au support, délai non maîtriséOuvrir le ticket dès que le projet est décidé

GPU et Elastic Metal sous l'angle Well-Architected

Section intitulée « GPU et Elastic Metal sous l'angle Well-Architected »

Que se passe-t-il si le modèle ne tient pas dans la mémoire de la carte ? Il ne tourne pas, quel que soit le nombre de FLOPS. La discipline est de dimensionner sur la mémoire par GPU et sa bande passante (24 Go GDDR6 pour une L4, 80 Go HBM3 à 3,35 To/s pour une H100-SXM), puis de vérifier que le CPU et la RAM système ne bridant pas le prétraitement. Sur Elastic Metal, la question devient : le disque local suit-il ? Un Lithium sur SATA et un Beryllium sur NVMe n'ont pas le même profil, et le choix se lit dans le champ disks de scw baremetal offer list.

Cost Optimization : payer la minute, pas la journée

Section intitulée « Cost Optimization : payer la minute, pas la journée »

Qui paie une GPU qui attend ? Vous, à la minute. La discipline est d'automatiser le cycle créer, calculer, détruire : une GPU Instance se crée en quelques minutes, ce qui rend absurde de la laisser tourner entre deux entraînements. Sur Elastic Metal, la question est inverse : la machine tourne-t-elle plus de 24 heures sur 24 ? Alors le mensuel, malgré ses frais d'engagement, coûte moins que l'horaire. Dans les deux cas, l'alerte de budget posée au Volet Fondations est le filet qui rattrape l'oubli.

Que reste-t-il si la machine disparaît ? Pour une GPU Instance, le volume Block et ses snapshots ; le scratch, lui, est perdu. Pour un Elastic Metal, rien que vous n'ayez copié ailleurs : le SLO de 99,9 à 99,99 % porte sur l'alimentation et le réseau, pas sur vos disques. La discipline est la règle 3-2-1 appliquée dès l'installation, et un test de restauration avant la mise en production. Le modèle de responsabilité partagée le dit sans ambiguïté : « we cannot be held responsible for the loss of your data ».

Le tableau se lit par la colonne Symptôme : c'est ce que vous voyez à l'écran, message exact compris quand il y en a un ; la colonne Cause dit ce qui se passe réellement, et la colonne Solution la commande ou le geste qui débloque.

SymptômeCauseSolution
Unknown service sur scw baremetal offer listla zone visée n'a pas d'Elastic Metal (cas de it-mil-1)utiliser une des six zones : fr-par-1, fr-par-2, nl-ams-1, nl-ams-2, pl-waw-2, pl-waw-3
Not Found sur scw instance server-type list zone=…la zone n'existe pas (faute de frappe, fr-par-4)vérifier la liste des zones dans scw instance server-type list -h
Aucun type GPU dans la listela zone n'héberge pas de GPUviser fr-par-2, fr-par-1 (L4) ou pl-waw-2
La création GPU échoue alors que le type est listéavailability à shortage, ou quota GPU à 0 ou 1relire availability, ouvrir un ticket de quota, changer de zone
Le prix affiché par l'API paraît 60 fois trop bashourly_price d'un type GPU est un prix à la minutemultiplier par 60, et se référer à la grille officielle
Les données du scratch ont disparucycle stop/start completne rien y stocker qui doive survivre ; reboot et stop in place sont sans effet
Un Elastic Metal éteint apparaît toujours sur la facturemachine allouée jusqu'à la suppressionsupprimer le serveur, ou assumer le mensuel

Vérifiez que l'essentiel de ce guide est acquis. Les questions portent uniquement sur ce qui vient d'être expliqué ici.

Contrôle de connaissances

Validez vos connaissances avec ce quiz interactif

6 questions
6 min.
70% requis

Informations

  • Le chronomètre démarre au clic sur Démarrer
  • Questions à choix multiples, vrai/faux et réponses courtes
  • Vous pouvez naviguer entre les questions
  • Les résultats détaillés sont affichés à la fin

Lance le quiz et démarre le chronomètre

  • Une GPU Instance ajoute 1 à 8 GPU NVIDIA (L4 24 Go, L40S 48 Go, H100 80 Go, B300 288 Go) à une Instance ; elle se facture à la minute, hors RENDER-S.
  • Les GPU n'existent qu'en fr-par-1 (L4), fr-par-2 (toutes familles) et pl-waw-2 ; le 2026-09-08, 14 types sur 15 étaient scarce ou shortage en fr-par-2.
  • Le quota GPU vaut 1 pour L4-1-24G, L40S-1-48G et RENDER-S après vérification d'identité ; tout le reste passe par un ticket.
  • Le scratch storage (H100, L40S, B300) est effacé au stop/start ; les L4 n'en ont pas.
  • Elastic Metal = machine entière, six zones, SLO de 99,9 % (Aluminium) à 99,99 % (Iridium, Titanium), pas de snapshot, pas de Block Storage, facturé même éteint.
  • Le passage horaire vers mensuel ne se fait qu'une fois ; le retour impose de recréer le serveur ; le bon de fidélité a disparu pour les souscriptions depuis le 1er avril 2026.
  • scw baremetal offer list zone=fr-par-2 -o json expose prix, stock, kg_co2_equivalent et m3_water_usage de chaque offre.
  • Le champ hourly_price d'un type GPU vaut un prix à la minute : 0,013125 € pour L4-1-24G, soit environ 0,79 € par heure.

Les pages officielles sur lesquelles cette leçon s'appuie, avec ce qu'on y cherche ; leur champ de validation date chaque fait cité.

Ce site vous est utile ?

Sachez que moins de 1% des lecteurs soutiennent ce site.

Je maintiens +700 guides gratuits, sans pub ni tracking. Un soutien, même symbolique, m'aide à couvrir l'hébergement et à garder ces ressources gratuites. Merci pour votre appui.

Le formulaire ne s'affiche pas ? Ouvrir Ko-fi dans un onglet.

Abonnez-vous et suivez mon actualité DevSecOps sur LinkedIn