Accélérateurs AMD Instinct

AMD Instinct sur une machine que personne d'autre n'utilise

Nos serveurs dédiés intègrent deux accélérateurs AMD : l’Instinct MI210 et l’Instinct MI50. La carte est directement intégrée à votre système d’exploitation : votre configuration ROCm, votre noyau, vos processus, sans hyperviseur intermédiaire.

MI210 : 104 unités de calcul CDNA 2, 64 Go HBM2e. MI50 : 60 unités de calcul GCN 5.1, 16 Go. Un seul utilisateur par machine. Pas de partage de temps, pas de location à la carte.

Chaque carte que nous installons — AMD et NVIDIA, actuelles et anciennes — est répertoriée avec son propre prix mensuel dans le catalogue GPU .

Transformez vos GPU en revenus passifs mensuels

Vous avez des serveurs ou des configurations GPU de bureau inutilisées ? Proposez-les dès aujourd’hui sur la plateforme Primcast et percevez des loyers mensuels réguliers auprès d’équipes d’IA, de développeurs et d’entreprises ayant besoin de puissance de calcul professionnelle.

Accédez à Marketplace

Qu'est-ce qu'un serveur AMD Instinct ici ?

Un serveur physique loué à un seul compte, équipé d'une carte graphique AMD installée dans un port PCIe et hébergeant le système d'exploitation. La carte figure sur la facture à titre d'élément distinct et non comme un produit à part entière ; le coût du serveur sous-jacent reste donc inchangé.

La carte est à vous.

Pas de partition, pas de vGPU, pas de planificateur pour gérer votre tour. L'accélérateur est directement intégré à votre noyau ; vous pouvez donc choisir votre version de ROCm et charger vos propres modules sans nous consulter.

ROCm, HIP et les cadres habituels

Les deux composants sont des cibles ROCm compatibles (gfx90a pour le MI210 et gfx906 pour le MI50), utilisées par PyTorch, TensorFlow, JAX et ONNX Runtime sur les architectures AMD. HIP assure la compatibilité avec le code source CUDA sans nécessiter de réécriture.

Prix ​​hors machine

L'accélérateur et le serveur ont chacun leur propre tarif mensuel ; il faut donc additionner les deux. Vous pouvez changer de carte sans changer de serveur. Ces tarifs, pour chaque carte du catalogue, sont indiqués sur la page GPU .

Les deux accélérateurs AMD Instinct que nous avons installés

Les deux modèles sont disponibles dès aujourd'hui via le même configurateur, sur des gammes de serveurs différentes. Les chiffres ci-dessous sont ceux publiés par AMD.

Accélérateur AMD Instinct MI210

AMD Instinct MI210

La génération CDNA 2 sur une carte PCIe standard double emplacement pleine hauteur et pleine longueur : 104 unités de calcul, 64 Go de mémoire HBM2e jusqu’à 1,6 To/s et jusqu’à trois liaisons Infinity Fabric pour le trafic direct entre cartes. Refroidissement passif de 300 W via une liaison hôte PCIe Gen 4. C’est le modèle à privilégier si la seule question est de savoir s’il tient dans la mémoire.

AMD Instinct MI50

Le composant Vega plus ancien : puce GCN 5.1, 60 unités de calcul et 16 Go de mémoire intégrée. Cette carte n’est plus disponible à la location, ce qui la rend introuvable ailleurs, et pas seulement bon marché ici. Elle reste compatible avec ROCm et exécute donc le même code HIP et PyTorch que la MI210 pour un prix mensuel bien inférieur. C’est la solution idéale pour mettre en place une chaîne d’outils ROCm avant d’investir dans la carte haut de gamme.

Débit matriciel sur le MI210

AMD annonce des performances matricielles de pointe de 181,0 TFLOPS en FP16 et BF16 pour le MI210 à sa fréquence d'horloge boost maximale de 1 700 MHz, ainsi que des performances vectorielles de pointe de 22,6 TFLOPS en FP64 et FP32.

La mémoire est la contrainte

64 Go contiennent les poids d'un modèle à 30 milliards de paramètres sur 8 bits, ou d'un modèle à 13 milliards de paramètres sur 16 bits, avec de l'espace disponible pour le cache KV. La page GPU effectue ces calculs pour chaque taille de modèle.

Ce que l'hôte donne à la carte

La génération de voies hôtes est une information que presque personne ne publie et qui détermine si une carte fonctionne à sa bande passante nominale. Nous publions la nôtre à côté de chaque carte, sur la page du GPU .

Rien ne compte les octets

Poids en entrée, points de contrôle en sortie, jeux de données en entrée. Le port n'est pas limité en bande passante, donc une session d'entraînement qui diffuse un corpus ne se traduit pas par une facture de bande passante en fin de mois.

Serveurs dédiés HPE de qualité professionnelle, équipés de la technologie AMD Instinct™

Entreprise HPE

Votre serveur dédié AMD INSTINCT™ GPU est alimenté par des serveurs HPE Enterprise, garantissant des performances stables pour les charges de travail les plus exigeantes.

mises à niveau matérielles

Ajoutez facilement des ressources ou des serveurs supplémentaires à votre infrastructure. La plupart des mises à niveau sont traitées en 24 heures.

Assistance 24h/24 et 7j/7

Des experts en serveurs dédiés sont disponibles 24h/24 et 7j/7 pour vous assister par chat en direct et par e-mail.

Le MI210 est également compatible avec les cartes NVIDIA.

Quatre accélérateurs issus du même catalogue de commande ; ce tableau compare donc des pièces compatibles entre elles. Les chiffres mensuels de la dernière ligne sont extraits du catalogue correspondant au chargement de la page.

MI210L40SA100H100
Architecture GPUCDNA 2Ada LovelaceNVIDIA AmpereTrémie
Mémoire GPU64 Go HBM2e48 Go de mémoire GDDR6 avec ECC80 Go HBM2e80 Go HBM3
Bande passante de la mémoire GPUJusqu'à 1,6 To/s864 Go/s1935 GB/s3352 Go/s
FP3222,6 TFLOPS91,6 TFLOPS19,5 TFLOPS51 TFLOPS
Noyau Tensor TF32366 TFLOPS312 TFLOPS756 TFLOPS
Matrice FP16/BF16181 TFLOPS733 TFLOPS624 TFLOPS1513 TFLOPS
PouvoirJusqu'à 300 WJusqu'à 350 WJusqu'à 400 WJusqu'à 350 W
Chargement...Chargement...Chargement...Chargement...

Le TF32 est un format de cœur tenseur NVIDIA. CDNA 2 ne l'implémente pas et AMD ne publie aucune donnée à son sujet ; la colonne MI210 est donc vide et affiche une valeur provenant d'un autre fabricant. Les lignes relatives aux cœurs tenseurs NVIDIA correspondent aux valeurs publiées, avec une certaine dispersion. Toutes les autres cartes que nous installons, y compris la MI50, sont tarifées selon le catalogue GPU .

FAQ sur les serveurs GPU AMD Instinct

Questions fréquentes concernant le déploiement et la gestion des accélérateurs AMD Instinct sur serveur physique pour les charges de travail d'IA, de HPC et d'apprentissage automatique.

Quels accélérateurs AMD Instinct puis-je commander ?

Deux modèles : l’Instinct MI210 et l’Instinct MI50. Ce sont les accélérateurs AMD disponibles dans notre catalogue, et le configurateur ne vous proposera aucun autre produit de la gamme Instinct. Le MI210 est compatible avec trois de nos serveurs et le MI50 avec deux. Nous ne proposons pas, et n’avons jamais proposé, les modèles MI250, MI250X et MI300A.

Quelle est la différence entre le MI210 et le MI50 ?

Génération et mémoire. La MI210 est basée sur l'architecture CDNA 2 d'AMD et intègre 104 unités de calcul et 64 Go de mémoire HBM2e cadencée jusqu'à 1,6 To/s. Il s'agit d'une carte PCIe double emplacement consommant jusqu'à 300 W via une liaison hôte PCIe Gen 4, avec jusqu'à trois liaisons Infinity Fabric pour le trafic entre cartes. La MI50, quant à elle, est basée sur la génération GCN 5.1 et dispose de 60 unités de calcul et de 16 Go de mémoire. Les deux cartes sont compatibles avec ROCm ; le même code HIP et PyTorch fonctionne donc sur l'une comme sur l'autre. La MI210 offre simplement une capacité de calcul quatre fois supérieure.

De quelle capacité de mémoire carte le modèle que je souhaite utiliser a-t-il besoin ?

Les poids seuls correspondent au produit des paramètres par leur taille en octets : environ 16 Go pour un modèle de 7 à 8 milliards de paramètres sur 16 bits, 28 Go pour 13 à 14 milliards et 68 Go pour 30 à 34 milliards. Le cache KV et l’environnement d’exécution s’ajoutent à cela, ce qui explique pourquoi une carte de 16 Go ne suffit pas pour un modèle dont les poids occupent 16 Go. Les 64 Go du MI210 permettent de gérer un modèle de 30 milliards quantifié sur 8 bits, avec une marge confortable. Le tableau complet est disponible sur la page dédiée aux GPU .

Combien de temps faut-il pour déployer un serveur GPU AMD Instinct ?

Si la machine est déjà installée en rack, elle est généralement activée environ 30 minutes après la validation du paiement. Dans le cas contraire, elle est fabriquée sur commande et le délai de livraison dépend des composants. Renseignez-vous avant de payer si la date est importante ; la page « Serveurs instantanés » présente les serveurs disponibles immédiatement en rack. Chaque serveur inclut une réinstallation instantanée du système d'exploitation, vous permettant ainsi de procéder à des essais sans avoir à rouvrir un ticket.

Quels logiciels et frameworks fonctionnent sur ces cartes ?

ROCm, la plateforme de calcul GPU open source d'AMD. Les deux composants sont des cibles ROCm compatibles (gfx90a sur le MI210 et gfx906 sur le MI50), prenant en charge PyTorch, TensorFlow, JAX et ONNX Runtime, ainsi que les bibliothèques BLAS, FFT, RNG et de primitives d'apprentissage profond. HIP utilise le code source CUDA existant, évitant ainsi toute réécriture. Grâce à l'accès root sur le matériel nu, vous choisissez vous-même les versions de ROCm et du noyau, et pouvez exécuter l'ensemble dans un conteneur Docker ou sous Kubernetes.