Toutes les charges de travail ne tiennent pas sur une Instance CPU classique. L'IA, le rendu ou le calcul intensif réclament des GPU ; certaines applications exigent une machine physique dédiée, sans voisins ni couche de virtualisation. Scaleway répond à ces besoins avec les GPU Instances et Elastic Metal. Cette leçon vous apprend à décider entre les trois familles de calcul sur des critères vérifiables, vous fait lister les offres, leurs zones, leurs quotas et leurs prix avec scw, et vous montre les pièges qui coûtent cher. Aucune ressource n'est provisionnée ici : tout se fait en lecture seule, sans dépense.
Ce que vous allez apprendre
Section intitulée « Ce que vous allez apprendre »Niveau : débutant à intermédiaire. Prérequis : la CLI scw configurée.
À la fin de cette page, vous saurez :
- Situer les cinq familles de GPU Instances et ce que chacune fait bien
- Ce qu'apporte Elastic Metal, et ce qu'il vous retire (snapshots, Block Storage, BIOS)
- Lister les offres GPU et Elastic Metal avec leur disponibilité et leur prix
- Décider entre Instance CPU, GPU et Elastic Metal, et dans quelle zone
- Connaître les quotas de départ et le modèle de facturation de chaque famille
Voici comment se positionnent ces trois familles de calcul.
GPU Instance, Elastic Metal : deux réponses à deux problèmes différents
Section intitulée « GPU Instance, Elastic Metal : deux réponses à deux problèmes différents »Une GPU Instance est une machine virtuelle à laquelle Scaleway attache un ou plusieurs GPU NVIDIA dédiés ; un serveur Elastic Metal est une machine physique entière, louée à l'heure ou au mois, sans hyperviseur. La première résout un problème de calcul parallèle : entraînement et inférence de modèles, rendu 3D, encodage vidéo. Le second résout un problème d'isolation et de contrôle : performance constante sans voisin, accès au matériel, licences ou hyperviseurs qui exigent une machine dédiée.
Les deux se pilotent comme le reste du catalogue, depuis la console, l'API et scw, et les deux se facturent à l'usage. La ressemblance s'arrête là. Une GPU Instance reste une Instance : elle se snapshotte, boote sur un volume Block, et se détruit en une commande. Un serveur Elastic Metal est livré vide ou avec un système installé par Scaleway, et à partir de là vous êtes seul à bord : pas de snapshot, pas de Block Storage, et un support qui n'a aucun accès à la machine une fois installée.
Quelle GPU Instance pour quel usage ?
Section intitulée « Quelle GPU Instance pour quel usage ? »Scaleway propose cinq familles de GPU, et la documentation officielle dit pour chacune ce qu'elle fait bien et ce qu'elle ne fait pas. Le tableau ci-dessous reprend cette grille (page « Choosing the right GPU Instance type », validée le 2025-10-28). Il se lit par la colonne « faite pour » : c'est elle qui décide, pas le nombre de GPU.
| Famille | GPU et mémoire | Scratch | MIG | Réseau | Faite pour | Pas faite pour |
|---|---|---|---|---|---|---|
L4 (L4-1-24G à L4-8-24G) | 1 à 8 × L4, 24 Go GDDR6 | non | non | 2,5 à 20 Gbit/s | encodage image et vidéo 8K, inférence de modèles 7B à 70B | entraînement de LLM |
L40S (L40S-1-48G à L40S-8-48G) | 1 à 8 × L40S, 48 Go GDDR6 | 1,6 à 12,8 To | non | 2,5 à 20 Gbit/s | IA générative image et vidéo, fine-tuning de modèles texte-image | entraînement de gros LLM |
H100 PCIe (H100-1-80G, H100-2-80G) | 1 à 2 × H100, 80 Go HBM2e | 3 à 6 To | oui, 7 partitions | 10 à 20 Gbit/s | fine-tuning et inférence 7B (1 GPU) et 70B (2 GPU) | rendu graphique, encodage |
H100-SXM (H100-SXM-2-80G à -8-80G) | 2 à 8 × H100, 80 Go HBM3, NVLink 900 Go/s | 3,2 à 12,8 To | oui | 20 Gbit/s | fine-tuning, inférence avec faible quantification, inférence Llama 4 ou DeepSeek R1 (8 GPU) | entraînement de LLM sur un seul nœud, graphisme |
B300-SXM (B300-SXM-8-288G) | 8 × B300, 288 Go HBM3e, NVLink 1 800 Go/s | ~24 To | oui | 20 Gbit/s | entraînement et inférence à grande échelle, multimodal, HPC lourd | temps réel graphique, montage vidéo |
Deux critères pèsent plus que le nombre de GPU : la mémoire par carte et la bande passante mémoire. La documentation Scaleway cite la règle de Tim Dettmers : les Tensor Cores d'abord, la bande passante mémoire ensuite, les FLOPS en dernier. Un modèle 70B en inférence tient dans 4 L4 (96 Go) comme dans 2 H100 (160 Go), mais la HBM3 de la H100 le sert bien plus vite. Choisissez la famille sur le type de travail, puis le nombre de cartes sur la mémoire nécessaire.
Le vieux type RENDER-S existe encore au catalogue et se facture à l'heure ; il n'apparaît plus dans la grille de choix officielle. Il n'a plus de raison d'être retenu pour un projet neuf.
Où trouve-t-on des GPU, et sont-ils disponibles ?
Section intitulée « Où trouve-t-on des GPU, et sont-ils disponibles ? »Les GPU n'existent que dans trois zones, et rarement en stock. Relevé le 2026-09-08 avec scw instance server-type list zone=… -o json (scw 2.56.3) :
| Zone | Familles présentes | Disponibilité relevée |
|---|---|---|
fr-par-1 | L4, RENDER-S | L4 en scarce ou shortage |
fr-par-2 | B300, H100-SXM, H100, L40S, L4, RENDER-S | 1 seul type available sur 15 (H100-SXM-2-80G), tout le reste scarce ou shortage |
pl-waw-2 | H100, L40S, L4 | les quatre L4 available, H100 et L40S en shortage |
| toutes les autres zones | aucune |
Refaites ce relevé avant de promettre une machine à qui que ce soit : la valeur du champ availability change d'une heure à l'autre, et shortage signifie qu'une création échouera. Une leçon pratique en découle : un projet GPU commence par la zone, pas par la région. Si votre application vit en fr-par-1, ses GPU seront en fr-par-2, et le trafic entre les deux passera par un Private Network régional, ce qui fonctionne mais se décide avant.
scw instance server-type list zone=fr-par-2 -o json \ | python3 -c 'import sys,json; [print(t["name"], t["gpu"], t["availability"]) for t in json.load(sys.stdin) if t["gpu"]]'La sortie doit lister les types GPU de la zone avec leur nombre de cartes et leur disponibilité. Si la liste est vide, la zone n'héberge aucun GPU.
Combien coûte une GPU Instance ?
Section intitulée « Combien coûte une GPU Instance ? »Les GPU Instances se facturent à la minute d'exécution, sauf RENDER-S facturé à l'heure (FAQ Instances, validée le 2025-12-19). La facturation démarre au premier démarrage, et sur Kapsule elle démarre dès la création du nœud, avant même que l'opérateur NVIDIA soit prêt. Les savings plans (jusqu'à 25 % de remise contre engagement) ne s'appliquent pas aux H100, L40S, L4, RENDER et POP-WIN : le prix catalogue est le prix payé.
Mesuré le 2026-09-08 avec scw 2.56.3 : pour L4-1-24G, le champ hourly_price renvoyé par scw instance server-type list vaut 0,013125 €. Ce nombre n'a de sens que comme prix à la minute, cohérent avec la facturation à la minute de la FAQ : multiplié par 60, il donne un ordre de grandeur d'environ 0,79 € par heure, soit environ 19 € par jour pour la plus petite GPU. Le même calcul donne environ 2,9 € par heure pour H100-1-80G (0,047775 €/min) et 60 € par heure pour B300-SXM-8-288G (1,00 €/min). Retenez la méthode plus que les valeurs : la grille tarifaire officielle fait foi, et le champ de l'API ne dit pas lui-même son unité.
Des images prêtes pour l'IA
Section intitulée « Des images prêtes pour l'IA »Scaleway publie des images Docker d'IA dans son registre, et des images système GPU dans le marketplace. Les images système portent le label ubuntu_noble_gpu_os_12, ubuntu_noble_gpu_os_13_nvidia ou ubuntu_jammy_gpu_os_12 dans scw marketplace image list (33 images relevées le 2026-09-08) ; elles embarquent les pilotes NVIDIA, nvidia-docker et le CLI NGC. Les images Docker se tirent depuis rg.fr-par.scw.cloud/scw-ai/ : pytorch, tensorflow, jax, rapids et une image all, toutes bâties sur CUDA 12.2 et cuDNN 8, avec JupyterLab, Code Server et les bibliothèques usuelles.
Leurs tags suivent le motif YYMM-py3 (2204-py3 pour avril 2022, YYMM-tf2-py3 pour TensorFlow). La documentation publie aussi un tag latest : ne l'utilisez pas. Sur ce site, une image se réfère par un tag daté et son digest image:tag@sha256:…, seule forme qui garantit de relancer demain exactement ce qui a tourné aujourd'hui. Relevez le digest avec docker pull puis docker inspect --format '{{index .RepoDigests 0}}.
Elastic Metal : le bare metal dédié, et ce qu'il vous retire
Section intitulée « Elastic Metal : le bare metal dédié, et ce qu'il vous retire »Elastic Metal fournit des serveurs physiques dédiés, livrés en quelques minutes, sans hyperviseur : vous avez la machine entière. On y gagne des performances constantes (aucun voisin), le contrôle du matériel et la possibilité d'y installer ce qu'une machine virtuelle interdit : votre propre hyperviseur (Proxmox, ESXi n'est plus supporté), une base de données sur NVMe local, une application licenciée au socket.
Cinq gammes existent, et leur objectif de disponibilité (SLO, page « Shared Responsibility Model », validée le 2025-07-28) dit leur rang :
| Gamme | Positionnement officiel | SLO alimentation et réseau |
|---|---|---|
| Aluminium | dédié au meilleur prix, intégration cloud native | 99,9 % |
| Beryllium | équilibré, fiable, production | 99,95 % |
| Lithium | gros stockage local : sauvegarde, archivage | 99,95 % |
| Iridium | fortes charges, haut de gamme | 99,99 % |
| Titanium | serveurs GPU dédiés (EM-T220E-L40S, EM-T620E-H100) | 99,99 % |
La contrepartie du contrôle, c'est la responsabilité. La FAQ et le modèle de responsabilité partagée sont sans détour : pas de snapshot, pas de Block Storage (annoncé, pas disponible), pas d'accès au BIOS, firmware géré par Scaleway et appliqué au reboot. Les sauvegardes sont à votre charge, par export vers Object Storage, RAID ou réplication applicative ; en cas de panne disque, Scaleway ne garantit pas que vous récupériez vos données. À la suppression, les disques sont effacés par algorithme sécurisé, sans retour possible.
Lister les offres, leur stock et leur empreinte
Section intitulée « Lister les offres, leur stock et leur empreinte »Elastic Metal n'existe que dans six zones : fr-par-1, fr-par-2, nl-ams-1, nl-ams-2, pl-waw-2, pl-waw-3 (FAQ, confirmée par l'aide de scw baremetal offer list -h). Listez les offres d'une zone avec leur prix, leur stock et leur empreinte environnementale :
scw baremetal offer list zone=fr-par-2 -o json \ | python3 -c 'import sys,json; [print(o["name"], o["commercial_range"], o["stock"], o["price_per_hour"]["nanos"]/1e9, "EUR/h", o["kg_co2_equivalent"], "kgCO2e") for o in json.load(sys.stdin)]'La sortie doit afficher une ligne par offre. Mesuré le 2026-09-08 en fr-par-2 : 41 offres, dont EM-A116X-SSD (Aluminium, 500 Mbit/s) à 0,077 € par heure en stock available, EM-L101X-SATA (Lithium) à 0,122 € par heure, et une offre EM-RV1-C4M16S128-A de la gamme labs, un serveur RISC-V à 0,042 € par heure. Chaque offre expose aussi m3_water_usage, cloud_init_supported, bandwidth et max_bandwidth : Scaleway est l'un des rares fournisseurs à publier l'empreinte carbone et hydrique de chaque machine dans son API, et c'est un critère de choix à part entière.
Lancée sur une zone sans Elastic Metal, la même commande répond :
Unknown serviceC'est le cas de it-mil-1 : Milan n'a pas de bare metal, et l'erreur ne dit pas pourquoi.
Horaire ou mensuel : une décision à sens unique
Section intitulée « Horaire ou mensuel : une décision à sens unique »Un serveur Elastic Metal se facture à l'heure ou au mois, et le passage de l'un à l'autre n'est possible qu'une fois, dans un seul sens. Vous pouvez basculer un serveur horaire en mensuel ; pour revenir à l'horaire, il faut créer et réinstaller un nouveau serveur. Le mensuel demande des frais d'engagement égaux à un mois d'abonnement. Le bon de fidélité qui remboursait ces frais après douze mois n'existe plus pour les souscriptions postérieures au 1er avril 2026.
Autre différence avec une Instance, lourde de conséquences sur la facture : un serveur Elastic Metal éteint reste facturé. La FAQ facturation est explicite : la machine physique reste allouée à votre compte du moment de la création à celui de la suppression. Éteindre n'économise rien ; seule la suppression arrête le compteur.
Limites, quotas et plafonds
Section intitulée « Limites, quotas et plafonds »Ces valeurs décident de ce que vous pouvez créer avant même de choisir une offre. Elles viennent de la page officielle des quotas d'Organisation (validée le 2025-10-29), de la FAQ Elastic Metal et de la FAQ Instances ; toutes se relèvent aussi dans la console, tableau de bord de l'Organisation.
| Plafond | Valeur | Source |
|---|---|---|
Quota L4-1-24G, L40S-1-48G, RENDER-S | 1 après vérification d'identité, 0 avant | quotas d'Organisation |
| Quota des autres types GPU (L4 multi-cartes, H100, H100-SXM, B300) | sur ticket au support, même identité vérifiée | quotas d'Organisation |
Quota Elastic Metal gamme A (A115X, A215R, A310X, A315X) | 1 avant vérification, 3 après | quotas d'Organisation |
| Volume système minimal d'une image GPU OS | 125 Go (10 Go pour une image classique) | FAQ Instances |
| Objectif de disponibilité GPU Instances | 99,5 % | doc GPU, SLA Instances |
| Flexible IP par serveur Elastic Metal | 64 au maximum, IPv4 ou blocs IPv6 /64 | FAQ Elastic Metal |
| Bande passante Elastic Metal | ajustable jusqu'à 25 Gbit/s, trafic illimité | FAQ Elastic Metal |
| Installation d'un Elastic Metal | livraison en minutes, installation jusqu'à 1 h | FAQ Elastic Metal |
| Scratch storage | 1,6 To (L40S-1) à ~24 To (B300-SXM-8), effacé au stop/start | doc scratch storage |
Le quota GPU est le plafond qui surprend le plus. Un compte neuf, même avec identité vérifiée, ne peut créer qu'une seule petite GPU par type ; tout ce qui dépasse, y compris une simple L4-2-24G, passe par un ticket. Ouvrez-le avant le jour du besoin, pas le jour même.
Choisir : CPU, GPU ou Elastic Metal ?
Section intitulée « Choisir : CPU, GPU ou Elastic Metal ? »Le bon choix dépend de la charge, et la plupart des charges tiennent sur une Instance CPU. Ce tableau se lit par la colonne Besoin : trouvez la ligne qui décrit votre charge, la colonne Choix donne la famille, et la colonne Pourquoi dit ce qui a tranché. Si aucune ligne ne correspond, partez d'une Instance CPU et mesurez.
| Besoin | Choix | Pourquoi |
|---|---|---|
| Web, API, production générale | Instance CPU | souple, économique, création en secondes, snapshots et Block Storage |
| Inférence d'un modèle 7B, encodage vidéo | GPU L4 (L4-1-24G ou L4-4-24G) | 24 Go par carte, la moins chère, available en pl-waw-2 lors du relevé |
| Fine-tuning d'un modèle 7B à 70B | GPU H100 (H100-1-80G, H100-2-80G) | 80 Go HBM2e par carte, MIG, scratch 3 à 6 To |
| Inférence de très gros modèles, multi-GPU | H100-SXM ou B300-SXM | NVLink 900 à 1 800 Go/s entre cartes |
| IA générative image et vidéo | GPU L40S | 48 Go GDDR6 par carte, scratch NVMe |
| Hyperviseur maison, base NVMe locale, licence au socket | Elastic Metal | machine entière, pas de couche de virtualisation |
| Latence constante, sans voisin, SLO 99,99 % | Elastic Metal Iridium | gamme au SLO le plus élevé |
| Sauvegardes volumineuses sur disques locaux | Elastic Metal Lithium | gros stockage local, bande passante 1 Gbit/s et plus |
| Charge GPU permanente, pilotes et noyau à votre main | Elastic Metal Titanium | GPU sans hyperviseur, facturation mensuelle possible |
Trois questions départagent les cas ambigus. Avez-vous besoin de snapshots ? Alors Instance, jamais Elastic Metal. La charge est-elle intermittente ? Alors GPU Instance à la minute, jamais un serveur mensuel. Avez-vous besoin d'un hyperviseur ou du matériel ? Alors Elastic Metal, et prévoyez la sauvegarde avant la première installation.
Antipatterns à éviter
Section intitulée « Antipatterns à éviter »Ces six erreurs ont un point commun : elles ne produisent aucun message d'erreur. La commande réussit, la machine tourne, et la facture ou la perte de données arrive plus tard. C'est exactement ce qu'un lecteur de cette leçon doit savoir reconnaître avant de cliquer.
| Antipattern | Conséquence | Discipline |
|---|---|---|
| Choisir une GPU « par sécurité » pour une charge CPU | 10 à 100 fois le prix, sans gain | Mesurer sur une Instance CPU d'abord, ne passer au GPU que sur une mesure |
| Stocker un jeu de données ou un modèle sur le scratch storage | effacé au premier stop/start | Scratch pour le travail en cours, Block Storage ou Object Storage pour ce qui doit rester |
| Éteindre un Elastic Metal pour économiser | facturé à l'identique, machine toujours allouée | Supprimer, ou basculer en mensuel si l'usage est permanent |
| Installer un Elastic Metal sans plan de sauvegarde | perte totale possible sur panne disque, sans recours | Export vers Object Storage ou RAID avant la première donnée utile |
| Passer en mensuel avant d'avoir validé l'offre en horaire | retour à l'horaire impossible sans recréer le serveur | Une semaine en horaire, puis bascule mensuelle |
| Découvrir le quota GPU le jour du besoin | ticket au support, délai non maîtrisé | Ouvrir le ticket dès que le projet est décidé |
GPU et Elastic Metal sous l'angle Well-Architected
Section intitulée « GPU et Elastic Metal sous l'angle Well-Architected »Performance : la mémoire avant les FLOPS
Section intitulée « Performance : la mémoire avant les FLOPS »Que se passe-t-il si le modèle ne tient pas dans la mémoire de la carte ? Il ne tourne pas, quel que soit le nombre de FLOPS. La discipline est de dimensionner sur la mémoire par GPU et sa bande passante (24 Go GDDR6 pour une L4, 80 Go HBM3 à 3,35 To/s pour une H100-SXM), puis de vérifier que le CPU et la RAM système ne bridant pas le prétraitement. Sur Elastic Metal, la question devient : le disque local suit-il ? Un Lithium sur SATA et un Beryllium sur NVMe n'ont pas le même profil, et le choix se lit dans le champ disks de scw baremetal offer list.
Cost Optimization : payer la minute, pas la journée
Section intitulée « Cost Optimization : payer la minute, pas la journée »Qui paie une GPU qui attend ? Vous, à la minute. La discipline est d'automatiser le cycle créer, calculer, détruire : une GPU Instance se crée en quelques minutes, ce qui rend absurde de la laisser tourner entre deux entraînements. Sur Elastic Metal, la question est inverse : la machine tourne-t-elle plus de 24 heures sur 24 ? Alors le mensuel, malgré ses frais d'engagement, coûte moins que l'horaire. Dans les deux cas, l'alerte de budget posée au Volet Fondations est le filet qui rattrape l'oubli.
Reliability : un SLO n'est pas une sauvegarde
Section intitulée « Reliability : un SLO n'est pas une sauvegarde »Que reste-t-il si la machine disparaît ? Pour une GPU Instance, le volume Block et ses snapshots ; le scratch, lui, est perdu. Pour un Elastic Metal, rien que vous n'ayez copié ailleurs : le SLO de 99,9 à 99,99 % porte sur l'alimentation et le réseau, pas sur vos disques. La discipline est la règle 3-2-1 appliquée dès l'installation, et un test de restauration avant la mise en production. Le modèle de responsabilité partagée le dit sans ambiguïté : « we cannot be held responsible for the loss of your data ».
Pièges courants
Section intitulée « Pièges courants »Le tableau se lit par la colonne Symptôme : c'est ce que vous voyez à l'écran, message exact compris quand il y en a un ; la colonne Cause dit ce qui se passe réellement, et la colonne Solution la commande ou le geste qui débloque.
| Symptôme | Cause | Solution |
|---|---|---|
Unknown service sur scw baremetal offer list | la zone visée n'a pas d'Elastic Metal (cas de it-mil-1) | utiliser une des six zones : fr-par-1, fr-par-2, nl-ams-1, nl-ams-2, pl-waw-2, pl-waw-3 |
Not Found sur scw instance server-type list zone=… | la zone n'existe pas (faute de frappe, fr-par-4) | vérifier la liste des zones dans scw instance server-type list -h |
| Aucun type GPU dans la liste | la zone n'héberge pas de GPU | viser fr-par-2, fr-par-1 (L4) ou pl-waw-2 |
| La création GPU échoue alors que le type est listé | availability à shortage, ou quota GPU à 0 ou 1 | relire availability, ouvrir un ticket de quota, changer de zone |
| Le prix affiché par l'API paraît 60 fois trop bas | hourly_price d'un type GPU est un prix à la minute | multiplier par 60, et se référer à la grille officielle |
| Les données du scratch ont disparu | cycle stop/start complet | ne rien y stocker qui doive survivre ; reboot et stop in place sont sans effet |
| Un Elastic Metal éteint apparaît toujours sur la facture | machine allouée jusqu'à la suppression | supprimer le serveur, ou assumer le mensuel |
Contrôle de connaissances
Section intitulée « Contrôle de connaissances »Vérifiez que l'essentiel de ce guide est acquis. Les questions portent uniquement sur ce qui vient d'être expliqué ici.
Contrôle de connaissances
Validez vos connaissances avec ce quiz interactif
Informations
- Le chronomètre démarre au clic sur Démarrer
- Questions à choix multiples, vrai/faux et réponses courtes
- Vous pouvez naviguer entre les questions
- Les résultats détaillés sont affichés à la fin
Lance le quiz et démarre le chronomètre
Vérification
(0/0)Profil de compétences
Quoi faire maintenant
Ressources pour progresser
Des indices pour retenter votre chance ?
Nouveau quiz complet avec des questions aléatoires
Retravailler uniquement les questions ratées
Retour à la liste des certifications
À retenir
Section intitulée « À retenir »- Une GPU Instance ajoute 1 à 8 GPU NVIDIA (L4 24 Go, L40S 48 Go, H100 80 Go, B300 288 Go) à une Instance ; elle se facture à la minute, hors
RENDER-S. - Les GPU n'existent qu'en
fr-par-1(L4),fr-par-2(toutes familles) etpl-waw-2; le 2026-09-08, 14 types sur 15 étaientscarceoushortageenfr-par-2. - Le quota GPU vaut 1 pour
L4-1-24G,L40S-1-48GetRENDER-Saprès vérification d'identité ; tout le reste passe par un ticket. - Le scratch storage (H100, L40S, B300) est effacé au stop/start ; les L4 n'en ont pas.
- Elastic Metal = machine entière, six zones, SLO de 99,9 % (Aluminium) à 99,99 % (Iridium, Titanium), pas de snapshot, pas de Block Storage, facturé même éteint.
- Le passage horaire vers mensuel ne se fait qu'une fois ; le retour impose de recréer le serveur ; le bon de fidélité a disparu pour les souscriptions depuis le 1er avril 2026.
scw baremetal offer list zone=fr-par-2 -o jsonexpose prix, stock,kg_co2_equivalentetm3_water_usagede chaque offre.- Le champ
hourly_priced'un type GPU vaut un prix à la minute : 0,013125 € pourL4-1-24G, soit environ 0,79 € par heure.
Pour aller plus loin
Section intitulée « Pour aller plus loin »- Réseau Scaleway : la carte avant de construire : Pourquoi une GPU en
fr-par-2et une application enfr-par-1se parlent par un Private Network régional, et ce que ça coûte. - IPAM et Flexible IP : Les Flexible IP d'un serveur Elastic Metal forment un pool séparé de celui des Instances, à comprendre avant une bascule.
- IAM : donner le droit minimal à une CI : Les jeux
InstancesFullAccesset les permissions Elastic Metal se cadrent par Project, ce qui évite qu'un script de test crée une H100 en production.
Ressources externes
Section intitulée « Ressources externes »Les pages officielles sur lesquelles cette leçon s'appuie, avec ce qu'on y cherche ; leur champ de validation date chaque fait cité.
- Choosing the right GPU Instance type : la grille officielle « better used for / not made for » de chaque famille, avec mémoire, NVLink et scratch.
- Scaleway Docker AI images : le registre
rg.fr-par.scw.cloud/scw-ai/et le motif de tagsYYMM-py3. - Elastic Metal FAQ : zones, facturation horaire ou mensuelle, sauvegardes, limites de 64 Flexible IP.
- Bare Metal Shared Responsibility Model : les SLO par gamme et ce que Scaleway ne garantit pas.
- Organization quotas : les quotas GPU et Elastic Metal avant et après vérification d'identité.