Multi-kartowe i multi-węzłowe · Primcast LLC · od 2004 r.

Rozszerzanie działalności nie jest tym samym , co zwiększanie jej.

Jedna karta w jednej maszynie to kwestia przesądzona, a jej cena jest ustalana indywidualnie na stronie poświęconej GPU. Ta zaczyna się tam, gdzie się kończy: druga karta w tej samej obudowie lub druga maszyna obok pierwszej. Brzmi to jak ta sama decyzja, a są to przeciwieństwa — platforma, która zapewnia karcie najwięcej linii, ma najniższy limit sieci i zajmuje najmniej pomieszczeń. Nikt nie publikuje tego w swoim katalogu. To pierwsza tabela poniżej.

Porównaj platformy Co łączy dwie maszyny

Każda maszyna to jeden użytkownik, każda karta jest przekazywana do Twojego własnego systemu operacyjnego, a nic tutaj nie liczy bajtów pomiędzy węzłami.

Rejestr

  • 4Platforms that take a card
  • 100 GbpsFastest port on any of them
  • 2Sockets in one machine, at most
  • 1 TBMemory in one machine, at most
  • 2Rooms holding every platform

Przeczytaj katalog zamówień w momencie, gdy ta strona została dostarczona, a nie wpisana. To, co stoi na półce dziś rano, to inne pytanie, a odpowiedź na nie znajdziesz w serwerach natychmiastowych .

Dwa różne pytania

O co właściwie pytasz?

Ludzie przychodzą tu z decyzją „potrzebuję więcej”, nie decydując jeszcze czego. Te dwie odpowiedzi kosztują inaczej, są inaczej przekazywane i są ograniczone przez różne czynniki, dlatego warto je jasno określić, zanim przeczytasz kolejny fragment.

Więcej kart w jednym urządzeniu

Druga karta w tej samej obudowie

Brakuje Ci pamięci karty lub przepustowości, a wszystko inne w urządzeniu jest w porządku. To jest konstrukcja, którą wyceniamy, a nie pole, które zaznaczasz w koszyku, ponieważ liczba pasujących kart zależy od fizycznej szerokości konkretnej karty i od budżetu mocy konkretnej obudowy — dwóch faktów, których nie ma w katalogu i których nie będziemy zgadywać.

Co decyduje: karta, a nie platforma. Zapytaj o nazwę części, a otrzymasz odpowiedź, która będzie zawierać nazwę podwozia, liczbę sztuk i czas realizacji.

Czego ludzie oczekują, a czego nie otrzymują: dwie karty to nie jedna większa karta. Ich pamięć się sumuje tylko wtedy, gdy to, co uruchamiasz, może podzielić model na obie — paralelizm tensorowy lub potokowy, który obsługuje każde poważne środowisko wykonawcze i który kosztuje trochę przepustowości w ruchu między nimi. W przypadku pracy, która i tak składa się z wielu niezależnych zadań, dwie karty to po prostu dwa razy więcej maszyny i nic nie musi się zmieniać.

Więcej maszyn obok

Druga maszyna obok pierwszej

Skończyła Ci się maszyna, a nie karta: zabrakło gniazd, zabrakło pamięci, zabrakło miejsca na kolejne zadanie. Na najlepszych platformach poniżej tym pułapem jest 2 sockets and 1 TB , a powyżej któregokolwiek z nich rozwiązaniem jest inny serwer, a nie większy.

Decyduje o tym: pomieszczenie i port. Dwie maszyny, które muszą się ze sobą komunikować, muszą znajdować się w tym samym budynku, a łączy je port w każdej z nich – kupowany osobno dla każdej maszyny, więc sieć pod czterema węzłami ma cztery porty.

To, czego ludzie oczekują, a czego nie otrzymują: nie ma tu produktu klastrowego ani minimalnej liczby węzłów. Każda maszyna jest zamawiana, fakturowana, modernizowana i wymieniana osobno, dlatego na tej stronie nie ma podanej ceny klastra — klaster to n faktur.

Handel

Platforma, która sprawdza się najlepiej w jednym z tych przypadków, jest najgorsza w drugim.

Każda platforma, do której montujemy kartę, opiera się na osiach, które decydują o klastrze, a nie o pojedynczej maszynie. Przeczytaj dwie środkowe kolumny razem, a przekonasz się, że cała argumentacja tej strony jest w nich zawarta: poruszają się one w przeciwnych kierunkach. Generacja magistrali to ta sama wartość, którą publikuje strona poświęcona GPU, z tej samej tabeli, więc obie strony nie mogą się różnić w kwestii linku.

Read from the order catalogue when this page was served. The two middle columns are the trade.
PlatformLanes to the cardNetwork ceilingSocketsMemory ceilingRooms
Intel Xeon Silver / Gold48 lanes per socketPCIe 3.0100 Gbps1 Gbps included21 TB5
Intel Xeon E5-2600 v3/v440 lanes per socketPCIe 3.040 Gbps1 Gbps included21 TB5
Intel Xeon E5-2600 v1/v240 lanes per socketPCIe 3.020 Gbps1 Gbps included2256 GB3
AMD EPYC128 lanes per socketPCIe 4.020 Gbps1 Gbps included21 TB2

Czytanie tej tabeli

  • Tory transmisji danych do karty decydują o tym, jak szybko dane przepływają między procesorem a akceleratorem. Ma to ciągłe znaczenie dla pętli treningowej przesyłającej strumieniowo partie danych, dla renderowania dostarczającego dane sceny w każdej klatce oraz dla wszystkiego, co wydostaje się z pamięci karty. Przestaje mieć to niemal całkowicie znaczenie, gdy model jest już rezydentny i tam pozostaje.
  • Pułap sieciowy decyduje o tym, jak szybko jedna maszyna może komunikować się z drugą. Nie ma to znaczenia dla pojedynczego serwera wykonującego swoją pracę, a jest kluczem do rozwiązania problemu podzielonego na kilka.
  • Pokoje decydują, czy wybór jest w ogóle dostępny tam, gdzie go potrzebujesz, i jest to kolumna, którą ludzie czytają na końcu i którą powinni przeczytać jako pierwszą — patrz poniżej.
  • A zatem: praca, która mieści się w jednej maszynie i niszczy autobus, wymaga najszerszych pasów ruchu i nie dba o port. Praca rozłożona na kilka maszyn wymaga portu i może obejść się ze starszym autobusem. Chęć posiadania obu naraz to jedyna kombinacja, której nie ma w naszym katalogu i wolimy to powiedzieć tutaj, niż po zapłaceniu.

Każda karta, która pasuje do którejkolwiek z nich i ile kosztuje miesięcznie, to serwery dedykowane GPU — każda karta, którą montujemy, wyceniana jest na podstawie konkretnej maszyny, do której należy jej wartość. Ta strona celowo nie wycenia żadnej karty: jedna strona jest właścicielem tych pieniędzy.

Co ich łączy

Łącze kupowane jest na maszynę i to jest arytmetyka, której ludzie często nie rozumieją.

Port to własność jednego serwera. Cztery maszyny o danej prędkości to prędkość cztery razy w miesiącu i to właśnie ta pozycja zmienia komfortowy budżet klastra w niewygodny. Poniżej znajduje się drabinka z już wykonanym mnożeniem, ponieważ strona dotycząca więcej niż jednej maszyny, która pozostawia Cię z tym samym zadaniem, nie spełnia swojego zadania.

Per month, on top of the machine. The port is bought per node, so the right-hand columns are what the same speed costs across a cluster.
PortOne machineTwoFourOffered on
1 Gbpsincludedincludedincludedevery platform
2 Gbps$189$378$756every platform
3 Gbps$299$598$1,196every platform
5 Gbps$459$918$1,836every platform
10 Gbps$529$1,058$2,116every platform
20 Gbps$1,629$3,258$6,516every platform
40 Gbps$2,799$5,598$11,1962 of 4
100 Gbps$3,999$7,998$15,9961 of 4

Dwie rzeczy, na które warto zwrócić uwagę przed wyborem szczebla

  • Drabina nie jest liniowa, więc szerszy krąg może być tańszy niż szybszy. Porównaj szczeble ze sobą, a nie z niczym: w kilku punktach na tym stole dwie maszyny o szczebel niżej kosztują mniej niż jedna maszyna o szczebel wyżej, a otrzymasz dwie maszyny. To, czy to dobra wymiana, zależy wyłącznie od tego, czy Twoja praca się rozdziela.
  • Szczyt drabiny nie znajduje się na każdej platformie. Prawa kolumna wskazuje, ilu z nich osiąga daną prędkość, a najszybsze szczeble zwężają się do platformy, która zapewnia karcie starszy autobus. To ta sama transakcja, co w tabeli powyżej, z tym że z przeciwnego kierunku.

Czego nie mamy, powiedziano wprost

W naszym katalogu nie ma niczego poza portem Ethernet między maszynami. Nie ma tu wymienionego łącza InfiniBand ani mostu karta-karta, a ta strona nie sugeruje tego, opisując je. Jeśli projekt wymaga któregokolwiek z nich, zapytaj przed złożeniem zamówienia, a nie po: odpowiedzią jest wycena, a odpowiedź może brzmieć „nie”. To jest dla Ciebie więcej warte niż strona, która sprawia wrażenie, że może być „tak”.

Każda z powyższych prędkości jest nielimitowana w obu kierunkach, bez limitu transferu i linii wyjściowej na żadnej fakturze – więc to, co Twoje węzły wysyłają sobie nawzajem, jest darmowe przy każdym wolumenie, a to jest część, która zazwyczaj jest liczona gdzie indziej. Nielimitowana przepustowość to strona dla portu rozpatrywanego osobno, na jednej maszynie.

Gdzie może istnieć

W przypadku jednej maszyny najpierw wybierasz platformę. W przypadku kilku maszyn najpierw wybierasz pomieszczenie.

Maszyny, które muszą się ze sobą komunikować, znajdują się w tym samym budynku, a nasze pokoje nie mają tych samych peronów. Wybierz najpierw peron, a przekonasz się, że pokój, w którym go potrzebujesz, go nie ma. Peron pochodzi z tego samego katalogu, co wszystko inne, więc linia przybywająca do nowego miasta pojawia się tutaj osobno.

  • New York, US4 of 4 platformsIntel Xeon Silver / Gold · Intel Xeon E5-2600 v3/v4 · Intel Xeon E5-2600 v1/v2 · AMD EPYC
  • Bucharest, EU4 of 4 platformsIntel Xeon Silver / Gold · Intel Xeon E5-2600 v3/v4 · Intel Xeon E5-2600 v1/v2 · AMD EPYC
  • Miami, US3 of 4 platformsIntel Xeon Silver / Gold · Intel Xeon E5-2600 v3/v4 · Intel Xeon E5-2600 v1/v2
  • San Francisco, US2 of 4 platformsIntel Xeon Silver / Gold · Intel Xeon E5-2600 v3/v4
  • Amsterdam, EU2 of 4 platformsIntel Xeon Silver / Gold · Intel Xeon E5-2600 v3/v4

Gdzie dokładnie znajduje się budynek, z czym jest połączony i kto jeszcze się w nim znajduje – centra danych opisują wszystkie pięć. Opóźnienie między dwoma naszymi miastami to wartość rzeczywista, a nie marketingowa, a dział wsparcia zmierzy je dla danej pary na żądanie, zamiast zgadywać z mapy.

Jak jest cytowany i jak szybko istnieje

Prace wielowęzłowe są nieaktualne przed zapłatą, a nie po niej.

Zestaw tego typu składa się z kilku maszyn i często kilku części, których nie ma na półce, więc uczciwą rzeczą do opublikowania nie jest obietnica dostawy, ale data, z której pochodzi — ten sam zestaw, który jest składany na zamówienie i strona, na której używany jest procesor graficzny, tymi samymi słowami.

  1. ~30 minut

    Maszyny są już ustawione w stojakach, tak jak są

    Nic nie jest montowane ani przenoszone. Serwery natychmiastowe to lista tego, co aktualnie tam stoi, a w przypadku klastra zwykłych węzłów warto ją najpierw przeczytać.

  2. 4–24 godziny

    Częściami są te, które trzymamy

    Zwykły przypadek. Technicy montują karty, budują macierze i instalują systemy operacyjne — na każdej maszynie, równolegle, a nie jeden po drugim.

  3. 5–10 dni roboczych

    Części muszą zostać zakupione

    Coś w specyfikacji nie jest tym, co mamy w magazynie. Zamawiamy to, a następnie budujemy. To jest najczęstszy szczebel w obudowie wielokartowej, ponieważ obudowa zazwyczaj składa się z długiego słupka, a nie z karty.

  4. 10–15 dni roboczych

    Część jest rzadka

    Akceleratory obecnej generacji działają w oparciu o alokację, a data należy do dystrybutora, a nie do nas. Nazwę długiego bieguna podajemy przed podjęciem decyzji, a nie po. W przypadku zakupu sprzętu dla jednego klienta prosimy o trzymiesięczny okres zaliczki, ponieważ jest to maszyna, której nie możemy ponownie wynająć, jeśli umowa zostanie zamknięta w drugim tygodniu.

Każdy etap rozpoczyna się od zaksięgowania płatności i weryfikacji pod kątem oszustwa, czego nie obiecujemy – większość zamówień jest realizowana w ciągu kilku godzin, a pierwsze, duże zamówienie z nowego konta może potrwać dłużej. W przypadku zamówień tej wielkości przelew lub stablecoin zazwyczaj realizuje się szybciej niż płatność kartą, o czym warto wiedzieć, zanim weryfikacja pod kątem oszustwa opóźni wizytę w punkcie sprzedaży.

Opisanie kompilacji wielowęzłowej lub wielokartowej jest szybsze w zdaniu niż w formie. – ile węzłów, czy praca się dzieli i z czym musi się komunikować – a ktoś, kto cytował już któryś z tych przykładów, odpowie, nawet jeśli odpowiedź brzmi, że wystarczy jedna maszyna.

For the record

Everything on this page, as figures.

Read from the order catalogue when this page was served. Card prices are deliberately not among them — GPU dedicated servers holds every one, against the exact machine each figure belongs to.

Cards in one machine
More than one is a build we quote rather than a checkout option. How many fit depends on the physical width of the card and on the power budget, so the honest answer needs the specific card. Ask, and the reply names the chassis, the count and the lead time.
Machines in one cluster
No limit we impose. Each is a whole physical server rented on its own terms, and they are ordered, billed and replaced independently — there is no cluster product and no minimum node count.
Platforms that take a card
4, and they are not interchangeable. The one with the widest bus to the card (AMD EPYC, PCIe 4.0, 128 lanes per socket) has the lowest network ceiling (20 Gbps) and is in 2 of our 5 rooms. The one that reaches 100 Gbps (Intel Xeon Silver / Gold) gives a card an older bus.
What joins two machines
The port on each of them. Speeds run from the included 1 Gbps on every one of them up to 100 Gbps, priced per machine and per month, so a cluster pays for the speed once per node. There is no NVLink fabric and no InfiniBand here; anything beyond an Ethernet port between two of our machines is quoted rather than listed.
Ceilings in one machine before a second one is needed
2 sockets and 1 TB of memory on the best of these platforms. Past either, the answer is another machine.
Where
5 cities: New York, Miami, San Francisco, Amsterdam, Bucharest. Machines that talk to each other should be in one of them together, and New York and Bucharest hold every platform on this page.
Bandwidth
Unmetered, both directions, at every speed on the ladder. No transfer allowance, no egress line on any invoice — which is what makes moving a dataset between nodes free rather than metered.
Tenancy
One tenant per physical machine, on every node. Cards are passed through to your own operating system: no hypervisor, no MIG partition, no vGPU profile, no time-slicing.
How soon
The same ladder as any build here: about four to twenty-four hours when the parts are ones we hold, five to ten working days when they have to be bought in, and ten to fifteen when a part is scarce. A multi-node build is quoted with its long pole named before you commit.
Term
One month, no contract, on each machine separately. Three, six and twelve-month cycles take up to 15% off. Where hardware is bought in for one customer we ask for three months up front.
What this page does not price
Cards. Every graphics card we fit, what each adds per month and what the machine under it costs are on GPU dedicated servers, priced against the exact machine each figure belongs to.