Intel Xeon E5-2600 v1/v2
$70.93the machine, per month
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- Cards it takes
- 28
- Link to the card
- PCIe 3.0
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Memory ceiling
- 256 GB
Karty graficzne na gołym sprzęcie · Primcast LLC · od 2004 roku
Większość trudności z zakupem serwera GPU nie polega na samym zakupie. Chodzi o to, by wiedzieć, która karta wystarczy — a każdy katalog w tej branży jest ułożony według tego, jak imponujący jest dany podzespół, a nie według tego, co próbujesz uruchomić. Ten katalog jest ułożony odwrotnie. Powiedz, jakie to zadanie i ile pamięci karty potrzebuje, a to, co zostanie, jest odpowiedzią, wycenioną w całości.
Znajdź kartę Czy karta jest moja?
Jeden najemca na maszynę. Karta jest przekazywana do Twojego systemu operacyjnego — nie dzielona, nie współdzielona czasowo, nie wirtualizowana.
Ława
Nic nie jest rezerwowane, żadne konto nie jest tworzone, a kwota przy każdej karcie to cały serwer z tą kartą w środku — procesor, pamięć, dyski lustrzane, port bez limitu, jeden adres — a nie sama karta. Udział samej karty jest wydrukowany pod nią, abyś mógł zobaczyć, która połowa pieniędzy jest która.
GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99a month, complete$55.06 of that is the card
GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93a month, complete$99 of that is the card
RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47a month, complete$99 of that is the card
TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92a month, complete$129.99 of that is the card
RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93a month, complete$139 of that is the card
RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93a month, complete$149 of that is the card
RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93a month, complete$159 of that is the card
TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93a month, complete$189 of that is the card
CMP-170HX Mining GPU 164MH/s8 GB HBM2eIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 164 MH/s$259.93a month, complete$189 of that is the card
RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47a month, complete$199 of that is the card
L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67a month, complete$209 of that is the card
RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93a month, complete$239 of that is the card
RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67a month, complete$229 of that is the card
RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47a month, complete$299 of that is the card
RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47a month, complete$399 of that is the card
RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47a month, complete$399 of that is the card
L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67a month, complete$449 of that is the card
Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67a month, complete$499 of that is the card
RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47a month, complete$549 of that is the card
RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47a month, complete$625 of that is the card
A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47a month, complete$699 of that is the card
A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47a month, complete$899 of that is the card
RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67a month, complete$1,299 of that is the card
H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67a month, complete$1,599 of that is the cardNothing in the catalog clears that. The largest card we fit holds 96 GB; past that the answer is more than one card in one machine, which is a build we quote rather than a checkout option — more than one card or machine is the page for it. .
Szacunki z tego samego katalogu, z którego kasa wystawia rachunki, a nie oferty. Tam, gdzie brakuje wartości pamięci, nie mogliśmy znaleźć żadnej opublikowanej przez producenta, więc karta mówi to wprost, zamiast zgadywać — a te karty znikają, gdy tylko ruszysz kontrolkę pamięci, ponieważ filtrowanie po liczbie, której nie mamy, po cichu ukryłoby części, które mogłyby Ci odpowiadać. Zapytaj, a odczytamy to z karty. Kilka części pasuje do więcej niż jednej obudowy w więcej niż jednej cenie; kwota tutaj to najtańszy sposób na posiadanie tej karty, a konfigurator pokazuje resztę.
Co stoi za tą listą
Policzone z katalogu zamówień w momencie wyświetlenia tej strony, a nie wpisane ręcznie. Jeśli karta zostanie jutro wycofana, ten pasek będzie jutro mniejszy. To, co stoi dziś rano w szafie, to inne pytanie, a serwery natychmiastowe to miejsce, w którym znajdziesz odpowiedź.
Pierwsze pytanie, które zadaje każdy
Twoja. Cała karta, cała maszyna, nikt inny na niej nie pracuje.
Karta siedzi w gnieździe PCIe na fizycznym serwerze wynajętym na jedno konto i jest przekazywana bezpośrednio do Twojego systemu operacyjnego: Twój własny sterownik, Twoje własne CUDA lub ROCm, Twoje własne procesy. Nie ma między Tobą a nią hipernadzorcy, nie ma partycji MIG, nie ma harmonogramu dzielenia czasu, który decyduje, kiedy nadejdzie Twoja kolej, i nie ma drugiego najemcy, którego zadanie wsadowe sprawia, że opóźnienie Twojego wnioskowania skacze o czwartej po południu.
Reszta maszyny jest Twoja na tych samych warunkach — każdy rdzeń, cała pamięć, wszystkie dyski, root oraz własny HPE iLO lub Dell iDRAC serwera do konsoli, nośników wirtualnych i zasilania. Jeśli sterownik wyłączy sieć, nadal widzisz ekran.
Dlaczego powyższe liczby tak wyglądają
Wszędzie indziej GPU to poziom: wynajmujesz „instancję H100” i ktoś inny już zdecydował, ile powinien Cię kosztować procesor, pamięć, dyski i sieć wokół niej. Tutaj to dwie osobne pozycje, które się sumują — dlatego karta na obu końcach powyższej listy trafia do tej samej obudowy, a Ty płacisz różnicę między kartami i nic więcej.
Whole machine, card in it, per month, from$91.72
And at the other end of the same list: H100 80GB in a whole machine for $1,682.67 a month — $2.31 an hour if you are comparing against something billed by the hour, with nothing added for the traffic.
Konfigurator zaokrągla cenę za dysk i odbiega o cent lub dwa od tych kwot. Dłuższe cykle rozliczeniowe objęte są dodatkowym rabatem; cennik ma wszystko w jednym miejscu, a starszy sprzęt, niższa cena to argument za tym, dlaczego dół tej listy w ogóle istnieje.
Ile pamięci karty
Taktowanie i liczba rdzeni decydują o szybkości działania modelu. Pamięć karty decyduje o tym, czy w ogóle będzie działać – albo się zmieści, albo nie, a karta z dwoma gigabajtami mniej nie jest wolniejsza, tylko miażdżąca. To jest więc liczba, którą należy ustalić przed jakąkolwiek inną, i to ta, której prawie nikt nie publikuje obok ceny.
Arytmetyka to parametry pomnożone przez bajty na parametr. Szesnastobitowe wagi to dwa bajty każda, ośmiobitowe to jeden bajt, a czterobitowe to połowa. Kwantowanie do czterech bitów to sposób, w jaki maszyna, która nie jest w stanie utrzymać modelu, przekształca się w taką, która to potrafi, kosztem jakości.
Zostaw zapas. Poniższe liczby to tylko wagi i nic więcej. Środowisko wykonawcze, aktywacje i pamięć podręczna klucz-wartość dla długiego kontekstu znajdują się w tej samej pamięci, a pamięć podręczna rośnie z każdym tokenem w konwersacji. Model z wagą 38 GB nie działa komfortowo na karcie 40 GB. Zaplanuj dodatkowy budżet w wysokości ćwierć do połowy lub zapytaj nas, a dostosujemy go do Twojego aktualnego zapotrzebowania.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
Co jest pod kartą
Każdy z nich bierze inną część katalogu i nadaje karcie inne połączenie z procesorem. Ta ostatnia kolumna jest tutaj, ponieważ kosztuje ludzi pieniądze i nikt jej nie drukuje: klient przeszedł z jednej generacji karty konsumenckiej do następnej na magistrali trzeciej generacji i został spowolniony , i odkrył przyczynę przed nami. Więc jest na stronie.
$70.93the machine, per month
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
$73.47the machine, per month
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
$83.67the machine, per month
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
$217.59the machine, per month
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Karta zaprojektowana dla nowszej magistrali działa doskonale na starszej; po prostu nie może przesyłać danych przez łącze tak szybko. To, czy ma to znaczenie, zależy wyłącznie od konkretnego zadania.
Co się z tym wiąże
Instalujemy czysty system operacyjny i przekazujemy Ci klucze. Wybierasz wersję sterownika, wersję CUDA lub ROCm oraz kompilację frameworka i je przypinasz – to jest istota systemu fizycznego i przeciwieństwo zarządzanego środowiska uruchomieniowego, które aktualizuje się automatycznie na tydzień przed terminem. Jeśli wolisz, abyśmy zainstalowali sterownik przed przekazaniem, zaznacz to w zamówieniu, a my to zrobimy.
HPE iLO lub Dell iDRAC: konsola klawiatury i ekranu, wirtualne nośniki, sterowanie zasilaniem, stan sprzętu i dziennik sprzętowy. Sterownik graficzny, który pobiera dane z wyświetlacza lub sieci, to raczej niedogodność niż zgłoszenie do pomocy technicznej, ponieważ nadal można obserwować rozruch komputera.
Nie ma limitu transferu, którego można przekroczyć, ani linii wyjściowej na żadnej fakturze. Zestawy danych przychodzące, punkty kontrolne wychodzące, renderowane, model udostępniany rzeczywistym użytkownikom — wszystko to przesyłane jest za cenę portu i ani bajta więcej. Nielimitowana przepustowość to drabinka ponad wliczoną prędkość i stanowi największą różnicę między tym a rachunkiem od hiperskalera.
Obrazy systemu operacyjnego dostępne za jednym kliknięciem, z możliwością ponownej instalacji bez biletu i bez opłat, więc eksperyment ze sterownikiem, który się nie powiedzie, kosztuje dwadzieścia minut. Możesz edytować odwrotny DNS, IPv6 jest w zestawie, a IPv4 to linia katalogowa, a nie negocjacja.
Telefon, czat na żywo i zgłoszenia wliczone w cenę każdego planu, a także wymiana uszkodzonego komponentu w ciągu czterech godzin od zgłoszenia telefonicznego lub czatu. Dział wsparcia dysponuje pisemnymi informacjami o czasie reakcji i harmonogramie kredytowym.
Nowy Jork, Miami, San Francisco, Amsterdam i Bukareszt – a lokalizacja maszyny decyduje o opóźnieniu dla osoby dzwoniącej i o tym, któremu systemowi ochrony danych podlega. Centra danych opisują budynki.
Jak szybko to istnieje
Nie jeden numer, bo nigdy nim nie był. Karta już zamontowana w maszynie, która już jest w czytniku, to przekazanie. Karta, którą trzeba kupić, to zamówienie zakupu. Powiedzenie ci, o którą z nich prosisz – przed zapłatą, a nie po – to jedyna wersja tego, która ma jakąkolwiek wartość.
Nic nie jest montowane ani przenoszone. Maszyna jest obrazowana i przekazywana. Lista serwerów natychmiastowych to lista tego, co tam teraz stoi.
Typowy przypadek dla wszystkiego, co jest na tej stronie. Część znajduje się w naszym magazynie; technik ją montuje, buduje macierz i instaluje system operacyjny. Maszyna na półce, która jest podobna, ale nie identyczna – z dodaną pamięcią, zamienionym dyskiem, przebudowaną macierzą według własnego wyboru – to ta sama praca, wykonywana na miejscu, bez wyjmowania maszyny z szafy.
Coś na liście nie jest produktem, który mamy w magazynie. Zamawiamy to, a następnie budujemy. „Budowa na zamówienie” to strona zawierająca całą specyfikację tego typu.
Akceleratory obecnej generacji działają w oparciu o alokację, a data należy do dystrybutora, a nie do nas. Nazwę długiego bieguna podamy przed podjęciem decyzji, a nie po niej. W przypadku zakupu sprzętu dla jednego klienta prosimy o trzymiesięczny okres zaliczki, ponieważ jest to maszyna, której nie możemy ponownie wynająć, jeśli umowa zostanie zamknięta w drugim tygodniu.
Każdy etap rozpoczyna się od zaksięgowania płatności i weryfikacji pod kątem oszustwa, czego nie obiecujemy: większość zamówień realizuje się w ciągu kilku godzin, ale pierwsze zamówienie z nowego konta może zająć więcej czasu. Akceptujemy płatności kartą, PayPal, ACH i przelewem, a także kryptowaluty — które w przypadku większych zamówień zazwyczaj realizują się najszybciej.
Pytane wcześniej
Zebrane z tego, co ludzie faktycznie pytają nas na czacie i w zgłoszeniach, mniej więcej w kolejności, w jakiej to robią. Pierwsze kosztowało nas zamówienia, więc tutaj też jest pierwsze.
Dokąd dalej
Ta strona odpowiada na jedno pytanie: które karty montujemy i ile kosztują. Wszystko, co sąsiaduje z tym pytaniem, ma własną stronę, a oto wszystkie, w kolejności, w jakiej odwiedzający tę stronę faktycznie klikają.
Nadal nie wiesz, którą kartę wybrać? , a ktoś, kto już dobierał takie konfiguracje, odpowie — także wtedy, gdy odpowiedzią jest tańsza karta niż ta, po którą przyszedłeś.
For the record
Read from the order catalog when this page was served. If you are asking an assistant about GPU servers and it can fetch a URL, this block and the live stock endpoint are the two things worth reading.