AMD Instinct hızlandırıcıları

AMD Instinct, başka kimsenin kullanmadığı bir makinede

Sunucularımıza iki adet AMD hızlandırıcı entegre ediyoruz: Instinct MI210 ve Instinct MI50. Kart, kendi işletim sisteminize (ROCm derlemenize, çekirdeğinize, işlemlerinize) doğrudan aktarılıyor; araya hiçbir hipervizör girmiyor.

MI210: 104 CDNA 2 işlem birimi, 64 GB HBM2e. MI50: 60 adet GCN 5.1 işlem birimi, 16 GB. Makine başına bir kiracı. Bölünmüş değil, zaman paylaşımlı değil.

Taktığımız her ekran kartı (AMD ve NVIDIA, güncel ve üretimi durdurulmuş modeller) GPU kataloğunda kendi aylık fiyatıyla listelenmiştir.

GPU'larınızı aylık pasif gelir kaynağına dönüştürün.

Kullanılmayan sunucu veya masaüstü GPU kurulumlarınız mı var? Bunları bugün Primcast pazar yerinde listeleyin ve üretim kalitesinde işlem gücüne ihtiyaç duyan yapay zeka ekiplerinden, geliştiricilerden ve işletmelerden düzenli aylık kira geliri elde edin.

Pazaryerine Git

AMD Instinct sunucusunun tam olarak ne olduğunu gösteren bir örnek.

Bir hesaba kiralanmış fiziksel bir sunucu, PCIe yuvasında bir AMD hızlandırıcı ve bunun üzerinde kurulu işletim sistemiyle birlikte. Kart, fatura üzerinde bir ürün kademesi değil, bir kalem olarak yer alıyor; bu nedenle, alttaki makinenin fiyatı, içine ne takılı olduğuna bağlı olarak artmıyor.

Kart sizin.

Bölümleme yok, sanal GPU yok, sıranızın ne zaman geleceğine karar veren bir zamanlayıcı yok. Hızlandırıcı doğrudan çekirdeğinize veriliyor, böylece kendi ROCm sürümünüzü sabitleyebilir ve bizden izin almadan kendi modüllerinizi yükleyebilirsiniz.

ROCm, HIP ve olağan çerçeveler

Her iki parça da ROCm hedeflerini destekliyor — MI210 için gfx90a, MI50 için gfx906 — bu da AMD'de PyTorch, TensorFlow, JAX ve ONNX Runtime'ın derlendiği platformdur. HIP, yeniden yazma gerektirmek yerine CUDA kaynak kodunu doğrudan aktarıyor.

Makine hariç fiyatlandırılmıştır.

Hızlandırıcı kendi aylık rakamına sahip, sunucu da ayrı bir rakama sahip ve ikisini topluyorsunuz. Sunucuyu değiştirmeden kartı değiştirebilirsiniz. Katalogdaki her kart için her iki rakam da GPU sayfasında yer almaktadır.

Takmış olduğumuz iki adet AMD Instinct hızlandırıcı.

İkisi de bugün aynı yapılandırma aracından, farklı sunucu serilerinde sipariş edilebilir. Aşağıdaki rakamlar AMD'nin kendi yayınladığı rakamlardır.

AMD Instinct MI210 hızlandırıcı

AMD Instinct MI210

Standart tam boy, tam uzunlukta, çift yuvalı PCIe kartta CDNA 2 nesli — 104 işlem birimi, 1,6 TB/sn'ye kadar hızda 64 GB HBM2e ve doğrudan karttan karta trafik için üç adede kadar Infinity Fabric bağlantısı. PCIe Gen 4 ana bilgisayar bağlantısı üzerinden 300 W'ta pasif soğutma. Modelin belleğe sığıp sığmadığı sorusunun asıl gündemde olduğu durumlarda sorulması gereken model budur.

AMD Instinct MI50

Eski Vega nesli parçası: GCN 5.1 silikon, 60 işlem birimi ve 16 GB dahili bellek. Artık kimse bu kartı kiralamıyor, bu da onu sadece burada ucuz olmakla kalmayıp başka yerlerde de elde edilemez hale getiriyor - ve hala desteklenen bir ROCm hedefi olduğundan, MI210 ile aynı HIP ve PyTorch kodunu aylık maliyetin çok daha düşük bir kısmına çalıştırıyor. Büyük karta geçmeden önce ROCm araç zincirini çalıştırmanın mantıklı yolu bu.

MI210'daki matris verimi

AMD, MI210 işlemcisinin 1.700 MHz tepe artırma motor saat hızında 181,0 TFLOPS tepe FP16 ve BF16 matris performansı ile birlikte 22,6 TFLOPS tepe FP64 ve FP32 vektör performansı sergilediğini açıkladı.

Bellek bir kısıtlama unsurudur.

64 GB, 8 bitlik 30 milyar parametreli bir modelin ağırlıklarını veya 16 bitlik 13 milyar parametreli bir modelin ağırlıklarını saklar ve KV önbelleği için de yer kalır. GPU sayfası, her model boyutu için bu aritmetiği gerçekleştirir.

Ev sahibinin kartta verdiği şey

Ana işlemci şeridi oluşturma bilgisi, neredeyse hiç kimsenin yayınlamadığı ve bir kartın tasarım bant genişliğinde çalışıp çalışmayacağına karar veren bir gerçektir. Biz bu bilgiyi her kartın yanında, GPU sayfasında yayınlıyoruz.

Hiçbir şey baytları saymaz.

Ağırlıklar girildi, kontrol noktaları gönderildi, veri kümeleri alındı. Bağlantı noktası sınırsız olduğundan, bir veri kümesini aktaran bir eğitim çalışması ay sonunda bant genişliği faturası olarak gelmez.

AMD Instinct™ işlemcili HPE kurumsal sınıf özel sunucuları

HPE kurumsal

AMD INSTINCT™ GPU'lu özel sunucunuz, HPE Enterprise sunucuları tarafından desteklenmekte olup, en zorlu iş yükleri için istikrarlı performans sağlar.

Donanım yükseltmeleri

Sunucu altyapınıza kolayca kaynak veya ek sunucu ekleyin. Çoğu yükseltme işlemi 24 saat içinde tamamlanır.

7/24 destek

Alanında uzman sunucu ekibimiz, canlı sohbet ve e-posta yoluyla 7/24 destek sağlamak için hazır bulunmaktadır.

MI210'u NVIDIA kartlarıyla da karşılaştırdık.

Aynı sipariş kataloğundan dört hızlandırıcı, yani aslında aynı sepete koyabileceğiniz parçaları karşılaştırıyor. Son satırdaki aylık rakamlar, sayfa yüklendiğinde o katalogdan okunuyor.

MI210L40SA100H100
GPU MimarisiCDNA 2Ada LovelaceNVIDIA AmpereHazne
GPU Belleği64GB HBM2e48 GB GDDR6 ECC80 GB HBM2e80 GB HBM3
GPU Bellek Bant Genişliği1,6 TB/s'ye kadar864 GB/s1935 GB/s3352 GB/s
FP3222,6 TFLOPS91,6 TFLOPS19,5 TFLOPS51 TFLOPS
TF32 Tensor Çekirdeği366 TFLOPS312 TFLOPS756 TFLOPS
FP16/BF16 Matrisi181 TFLOPS733 TFLOPS624 TFLOPS1513 TFLOPS
Güç300W'a kadar350W'a kadar400W'a kadar350W'a kadar
Yükleniyor...Yükleniyor...Yükleniyor...Yükleniyor...

TF32, NVIDIA'nın tensor-core formatıdır. CDNA 2 bunu uygulamamaktadır ve AMD bununla ilgili herhangi bir rakam yayınlamamaktadır, bu nedenle MI210 sütununda başka bir satıcıdan alınmış bir rakam yerine hiçbir şey gösterilmemektedir. NVIDIA tensor-core satırları, seyrek verilerle birlikte yayınlanmış rakamlardır. Takmış olduğumuz diğer tüm kartlar, MI50 dahil, GPU kataloğunda fiyatlandırılmıştır.

AMD Instinct GPU sunucuları hakkında SSS

Yapay zeka, yüksek performanslı bilgi işlem ve makine öğrenimi iş yükleri için AMD Instinct hızlandırıcılarını donanım üzerinde dağıtma ve yönetmeyle ilgili sık sorulan sorular.

Hangi AMD Instinct hızlandırıcılarını sipariş edebilirim?

İki tane: Instinct MI210 ve Instinct MI50. Bunlar sipariş kataloğumuzdaki AMD hızlandırıcılarıdır ve yapılandırma aracı size Instinct serisinden başka bir şey sunmayacaktır. MI210, sunucu serilerimizin üçünde, MI50 ise ikisinde kullanılmaktadır. MI250, MI250X veya MI300A'yı kullanmıyoruz ve hiçbir zaman kullanmadık.

MI210 ile MI50 arasındaki fark nedir?

Nesil ve bellek. MI210, AMD'nin 104 işlem birimi ve 1,6 TB/s'ye kadar hızda 64 GB HBM2e belleğe sahip, çift yuvalı bir PCIe kartında bulunan ve PCIe Gen 4 ana bilgisayar bağlantısı üzerinden 300 W'a kadar güç çeken, karttan karta trafik için üç adede kadar Infinity Fabric bağlantısına sahip CDNA 2 mimarisidir. MI50 ise 60 işlem birimi ve 16 GB belleğe sahip daha önceki GCN 5.1 neslidir. Her ikisi de desteklenen ROCm hedefleridir, bu nedenle aynı HIP ve PyTorch kodu her ikisinde de çalışır; MI210, modelin dört kat daha fazlasını barındırır.

Çalıştırmak istediğim model ne kadar hafıza kartına ihtiyaç duyuyor?

Ağırlıklar tek başına, parametre başına bayt sayısı ile çarpılan parametrelerdir: 16 bitlik 7-8 milyar parametreli bir model için yaklaşık 16 GB, 13-14 milyar için 28 GB, 30-34 milyar için 68 GB. KV önbelleği ve çalışma zamanı bunun üzerine eklenir; bu nedenle 16 GB'lık bir kart, ağırlıkları 16 GB olan bir modeli rahatlıkla karşılayamaz. MI210'un 64 GB'ı, 8 bit'e nicelleştirilmiş 30 milyar parametreli bir modeli, çalışmak için yeterli alanla birlikte kapsar. GPU sayfasında tüm tablo bulunmaktadır.

Bir AMD Instinct GPU sunucusunun kurulumu ne kadar sürer?

Makine zaten rafa monte edilmişse, ödeme onaylandıktan yaklaşık 30 dakika sonra etkinleştirilir. Rafa monte edilmemişse, sipariş üzerine üretilir ve teslim süresi parçalara bağlıdır. Tarih önemliyse ödeme yapmadan önce sorun — anlık sunucular sayfası, şu anda rafta bulunan makineleri gösterir. Her sunucu anlık işletim sistemi yeniden yükleme özelliğine sahiptir, böylece yeniden bilet açmadan yineleme yapabilirsiniz.

Bu kartlarda hangi yazılımlar ve çerçeveler çalışıyor?

ROCm, AMD'nin açık kaynaklı GPU hesaplama platformudur. Her iki parça da ROCm hedeflerini destekler — MI210'da gfx90a, MI50'de gfx906 — bu da PyTorch, TensorFlow, JAX ve ONNX Runtime'ın yanı sıra BLAS, FFT, RNG ve derin öğrenme temel kütüphanelerini kapsar. HIP, yeniden yazma gerektirmek yerine mevcut CUDA kaynak kodunu aktarır. Doğrudan donanım üzerinde root erişimine sahip olduğunuz için ROCm ve çekirdek sürümlerini kendiniz seçebilir ve tümünü Docker veya Kubernetes altında çalıştırabilirsiniz.