H100 80 GB · A100 80 GB · A100 40 GB

Οι επιταχυντές — και τι δεν θα κάνουν

Τρεις κάρτες φτιαγμένες για μία δουλειά: να κρατούν ένα μοντέλο και να κάνουν αριθμητικές πράξεις πάνω του, πιο γρήγορα από οτιδήποτε άλλο εδώ. Έχουν στοιβαγμένη μνήμη, διόρθωση σφαλμάτων και τη δυνατότητα να συνδυάζονται μεταξύ τους. Δεν έχουν έξοδο οθόνης και δεν έχουν κωδικοποιητή βίντεο — όχι αργό, κανέναν — και το να το ξέρεις αυτό πριν παραγγείλεις αξίζει περισσότερο από οποιοδήποτε benchmark σε αυτή τη σελίδα.

40 και 80 GB Στοιβαγμένη μνήμη, ECC Χωρίς κωδικοποιητή βίντεο

Μετατρέψτε τις GPU σας σε παθητικό μηνιαίο εισόδημα

Έχετε αδρανείς διατάξεις GPU σε server ή desktop; Καταχωρίστε τις σήμερα στην αγορά Primcast και κερδίστε σταθερά μηνιαία ενοίκια από ομάδες τεχνητής νοημοσύνης, προγραμματιστές και επιχειρήσεις που χρειάζονται υπολογιστική ισχύ επιπέδου παραγωγής.

Μετάβαση στην Αγορά

Δύο πράγματα που εκπλήσσουν τους ανθρώπους

Δεν μπορούν να κωδικοποιήσουν βίντεο. Καθόλου.

Ο ίδιος ο πίνακας υποστήριξης κωδικοποίησης και αποκωδικοποίησης της NVIDIA καταγράφει μηδέν μηχανές NVENC στην A100 και μηδέν στην H100. Αποκωδικοποιούν — πέντε μηχανές στην A100, επτά στην H100 — αλλά δεν υπάρχει κωδικοποιητής στην κάρτα, οπότε κάθε καρέ που παράγουν αυτές οι κάρτες πρέπει να κωδικοποιηθεί από τον επεξεργαστή. Αν η ροή εργασίας σας παράγει βίντεο, αυτό είναι το λάθος ράφι, και η L40S με τους τρεις κωδικοποιητές AV1 είναι το σωστό. Αυτό είναι μία σελίδα πιο πέρα στο /l40s.

Αυτές οι κάρτες επίσης δεν έχουν εξόδους οθόνης. Είναι εξαρτήματα υπολογισμού χωρίς κεφαλή. Οτιδήποτε περιμένει framebuffer — μια εικονική επιφάνεια εργασίας, ένας απομακρυσμένος σταθμός εργασίας, ένας διακομιστής παιχνιδιών — δεν ανήκει σε αυτές.

Η A100 δεν είναι ξεπερασμένη, και η κάρτα των 40 GB δεν είναι λάθος

Η A100 είναι η προηγούμενη γενιά, και διαβάζει τα βάρη της με 1.555 GB/s με 40 GB και 1.935 GB/s με 80 GB. Για ένα μοντέλο που χωράει, αυτός ο ρυθμός ανάγνωσης είναι που καθορίζει πόσα tokens το δευτερόλεπτο παίρνετε, και παραμένει πολύ μπροστά από κάθε μη στοιβαγμένη κάρτα στον κατάλογο. Η κάρτα των 40 GB χωράει ένα μοντέλο τριάντα δισεκατομμυρίων παραμέτρων σε ακρίβεια οκτώ bit άνετα, που είναι το μεγαλύτερο μέρος αυτού που πραγματικά εξυπηρετούν οι άνθρωποι, σε ένα κλάσμα του κόστους της H100 κάθε μήνα.

Αγοράστε την H100 όταν το μοντέλο χρειάζεται πραγματικά Hopper — τη μηχανή transformer, το FP8, τις νεότερες μονάδες tensor — ή όταν η εκτέλεση πρέπει να τελειώσει νωρίτερα αντί απλώς να τελειώσει. Αγοράστε μια A100 όταν το ερώτημα είναι αν χωράει και πόσο γρήγορα διαβάζει, που είναι το πιο συνηθισμένο ερώτημα.

Οι προδιαγραφές, όπως δημοσιεύονται

Στοιχεία από τα φύλλα δεδομένων της ίδιας της NVIDIA και τους πίνακες προδιαγραφών Tesla, που αναφέρονται στον πηγαίο κώδικα αυτής της σελίδας. Όπου ένα στοιχείο δεν μπορούσε να επιβεβαιωθεί για το ακριβές εξάρτημα που τοποθετούμε, αυτή η σελίδα δεν τυπώνει τίποτα αντί για εικασία.

H100 80GB

Architecture

Hopper

Card memory

80 GB HBM2e

Board power

350 W

Card interface

PCIe Gen 5 x16

Hardware video encoders

None. Decode only (7 engines)

Error-correcting memory

Yes

A100 80GB

Architecture

Ampere

Card memory

80 GB HBM2e

CUDA cores

6,912

Memory bandwidth

1,935 GB/s

Board power

300 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

None. Decode only (5 engines)

Error-correcting memory

Yes

A100 40GB

Architecture

Ampere

Card memory

40 GB HBM2

CUDA cores

6,912

Memory bandwidth

1,555 GB/s

Board power

250 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

None. Decode only (5 engines)

Error-correcting memory

Yes

Η H100 δεν εμφανίζει αριθμό πυρήνων και εύρος ζώνης παραπάνω, και αυτό είναι σκόπιμο. Το εξάρτημά μας είναι καταγεγραμμένο στο κατάστημα με αριθμό πυρήνων που ανήκει στη μονάδα SXM, η οποία είναι μια κάρτα που βιδώνεται σε μια βασική πλακέτα αντί να μπαίνει σε υποδοχή· η μνήμη HBM2e 80 GB που επίσης καταγράφει ανήκει στην κάρτα PCIe, που είναι αυτή που πραγματικά μπαίνει σε αυτά τα μηχανήματα. Αντί να διαλέξουμε ένα και να το τυπώσουμε με σιγουριά, η σελίδα τυπώνει τη μνήμη στην οποία συμφωνούν και οι δύο πηγές και παραλείπει τα υπόλοιπα. Ρωτήστε μας και θα σας πούμε ακριβώς ποια πλακέτα θα μπει στο δικό σας.

Σε τι είναι καλές

Μία δουλειά, καλύτερα από οτιδήποτε άλλο σε αυτόν τον ιστότοπο.

Γρήγορη ανάγνωση βαρών

Η στοιβαγμένη μνήμη είναι η διαφορά ανάμεσα σε αυτό το ράφι και όλα τα άλλα. Μόλις ένα μοντέλο είναι μόνιμο, η ταχύτητα παραγωγής καθορίζεται από το πόσο γρήγορα μπορεί η κάρτα να διαβάσει τα δικά της βάρη, και αυτές διαβάζουν μιάμιση έως δύο φορές πιο γρήγορα από την ταχύτερη μη στοιβαγμένη κάρτα που τοποθετούμε.

Συνδυασμός σε έναν ενιαίο χώρο διευθύνσεων

Αυτά τα εξαρτήματα διαθέτουν NVLink, οπότε δύο από αυτά σε ένα μηχάνημα μπορούν να συμπεριφερθούν ως μία μεγαλύτερη δεξαμενή αντί για δύο ξεχωριστές. Οι κάρτες σταθμών εργασίας και καταναλωτικές στον κατάλογο δεν μπορούν να το κάνουν καθόλου. Είναι μια κατασκευή που κοστολογούμε αντί για επιλογή στο ταμείο.

Λειτουργία για εβδομάδες χωρίς επίβλεψη

Διόρθωση σφαλμάτων παντού, και υλικό φτιαγμένο για συνεχές φορτίο αντί για εκρήξεις. Για μια εκπαίδευση που μετριέται σε εβδομάδες με πραγματικά χρήματα πίσω της, αυτό δεν είναι χαρακτηριστικό πολυτελείας.

Να είναι αποκλειστικά δικές σας

Ένας ενοικιαστής ανά φυσικό μηχάνημα και η κάρτα περνάει κατευθείαν — χωρίς διαμέρισμα MIG, χωρίς προφίλ vGPU, χωρίς χρονοπρογραμματιστή κατανομής χρόνου και χωρίς τη δουλειά κανενός άλλου πάνω της. Αλλού ένα “στιγμιότυπο A100” είναι συχνά ένα κομμάτι μιας.

Οι τρεις τους δίπλα δίπλα, και τι βρίσκεται από πάνω

Από τα δικά μας ράφια. Όλες αυτές είναι παραγγέλσιμες σήμερα, στο ίδιο πλαίσιο, οπότε το ερώτημα είναι ποια αξίζει τη διαφορά.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
A100 40GB40 GB HBM2$699$772.47
A100 80GB80 GB HBM2e$899$972.47
RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECC$1,299$1,382.67
H100 80GB80 GB HBM2e$1,599$1,682.67

Η τελευταία σειρά είναι εκεί επειδή είναι η έντιμη σύγκριση και οι περισσότερες καταχωρίσεις την κρύβουν: η RTX PRO 6000 Blackwell έχει 96 GB, περισσότερα από οποιονδήποτε επιταχυντή σε αυτή τη σελίδα. Διαβάστε τη μνήμη της και τα χρήματά της σε σχέση με της H100 στον παραπάνω πίνακα αντί να δεχτείτε τον λόγο μας για κανένα από τα δύο. Αυτό που θυσιάζει είναι ο ρυθμός ανάγνωσης και το NVLink· αυτό που κερδίζει είναι τέσσερις κωδικοποιητές βίντεο και ray tracing. Αν το ερώτημά σας είναι θα χωρέσει, διαβάστε το /rtx60 πριν δεσμευτείτε σε αυτό το ράφι.

Σε ποιο μηχάνημα μπαίνουν, και τι σύνδεση παίρνουν εκεί

Η A100 είναι κάρτα PCIe Gen 4 και η H100 είναι Gen 5, ενώ οι πλατφόρμες μας είναι Gen 3 και Gen 4. Η H100 επομένως δεν παίρνει ποτέ τον πλήρη δίαυλο για τον οποίο σχεδιάστηκε σε κανένα μηχάνημα που λειτουργούμε, και αυτή η σελίδα το λέει αντί να σας αφήσει να το ανακαλύψετε.

Intel Xeon Silver / Gold

H100 80GB

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 5.

A quarter or less of the bus the card was designed for. Worth avoiding when the work crosses the slot every step, and irrelevant once the weights are resident.

AMD EPYC

H100 80GB

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 5.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon E5-2600 v3/v4

A100 80GB, A100 40GB

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

A100 80GB, A100 40GB

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

A100 80GB, A100 40GB

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

Το αν αυτό σας κοστίζει κάτι εξαρτάται εξ ολοκλήρου από τη μορφή της εργασίας. Ένα τελικό σημείο συμπερασμού του οποίου τα βάρη είναι μόνιμα barely αγγίζει την υποδοχή και δεν θα το παρατηρήσει. Ένας βρόχος εκπαίδευσης που στέλνει μια φρέσκια παρτίδα από τη μνήμη του κεντρικού υπολογιστή σε κάθε βήμα θα το παρατηρήσει σε κάθε βήμα. Αν δεν είστε σίγουροι ποιο από τα δύο είστε, πείτε μας ποια είναι η εργασία πριν παραγγείλετε — αυτό καθορίζει το μηχάνημα, όχι την κάρτα.

Τι πραγματικά χωράει στα 80 GB

Weights only, rounded up. Fits means the card’s 80 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — fits14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — fits19 GB — fits
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — fits

Η A100 των 40 GB κρατά τον ίδιο πίνακα ένα σκαλοπάτι πιο κάτω: ένα μοντέλο τριάντα έως τριάντα τεσσάρων δισεκατομμυρίων παραμέτρων χωράει με περιθώριο μόνο στα τέσσερα bit, και στα οκτώ bit τα 34 GB βαρών του δεν περνούν ούτε τον στενό πήχη. Ένα μοντέλο εβδομήντα δισεκατομμυρίων στα δεκαέξι bit δεν χωράει σε καμία μεμονωμένη κάρτα που πουλάμε — αυτό είναι κατασκευή δύο καρτών, και ο λόγος που η γραμμή NVLink παραπάνω έχει σημασία.

Αυτός ο πίνακας απαντά στο “τι χωράει σε αυτή την κάρτα”. Το ερώτημα αντίστροφα — πόση μνήμη χρειάζεται ένα μοντέλο, και ποια κάρτα το περνάει — είναι μια σελίδα από μόνο του.

Πόσο κοστίζουν, με τα μηχανήματα στα οποία μπαίνουν

Η κάρτα είναι μία γραμμή στο τιμολόγιο και το μηχάνημα είναι άλλη. Και τα δύο μισά παρακάτω προέρχονται από μία ανάγνωση του καταλόγου παραγγελιών, οπότε η τιμή και η προδιαγραφή δίπλα της ανήκουν πάντα η μία στην άλλη.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
A100 40GBIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$699$772.47
Configure this build →
A100 40GBIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$699$782.67
Configure this build →
A100 40GBAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$699$916.59
Configure this build →
A100 80GBIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$899$972.47
Configure this build →
A100 80GBIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$899$982.67
Configure this build →
A100 80GBAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$899$1,116.59
Configure this build →
H100 80GBIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$1,599$1,682.67
Configure this build →
H100 80GBAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$1,599$1,816.59
Configure this build →

Το εύρος ζώνης είναι αμέτρητο και προς τις δύο κατευθύνσεις χωρίς χρέωση εξερχόμενης κίνησης, που σε αυτό το ράφι είναι συνήθως το μεγαλύτερο κρυφό κόστος αλλού — μια εκπαίδευση που τραβάει ένα σύνολο δεδομένων και στέλνει σημεία ελέγχου μετακινεί πάρα πολλά byte, και η εξερχόμενη κίνηση ανά gigabyte χρεώνεται σε καθένα από αυτά. Μία διεύθυνση IPv4 περιλαμβάνεται, δεν υπάρχει συμβόλαιο και ο ένας μήνας είναι ο προεπιλεγμένος όρος. Για κάθε άλλη κάρτα που τοποθετούμε, κοστολογημένη με τον ίδιο τρόπο, διαβάστε ολόκληρο τον κατάλογο, με τιμές. Για μηχανήματα σε rack και έτοιμα σήμερα, /instant.

Ερωτήσεις που πραγματικά κάνουν οι άνθρωποι για αυτές τις κάρτες

Μπορώ να κάνω transcoding βίντεο σε μια A100 ή μια H100;

Όχι σε υλικό. Καμία από τις δύο κάρτες δεν έχει κωδικοποιητή — ο πίνακας υποστήριξης της NVIDIA καταγράφει μηδέν μηχανές NVENC και στις δύο — οπότε η κωδικοποίηση πέφτει στον επεξεργαστή και τρέχει με ταχύτητα επεξεργαστή. Αποκωδικοποιούν, οπότε μια ροή εργασίας που διαβάζει βίντεο και παράγει κάτι άλλο από βίντεο είναι εντάξει. Αν χρειάζεστε καρέ προς τα έξω, η L40S έχει τρεις κωδικοποιητές AV1 και είναι πολύ φθηνότερη: /l40s. Πόσα ζωντανά κανάλια σηκώνει μια κάρτα, και το μηχάνημα στο οποίο μπαίνει: /transcoding.

Η κάρτα τεμαχίζεται σε στιγμιότυπα MIG;

Όχι από εμάς. Παίρνετε ολόκληρη τη φυσική κάρτα περασμένη στο δικό σας λειτουργικό σύστημα, σε ένα μηχάνημα χωρίς κανέναν άλλο πάνω του. Αυτά τα εξαρτήματα υποστηρίζουν MIG, οπότε μπορείτε να διαμερίσετε τη δική σας κάρτα αν θέλετε· αυτή είναι δική σας απόφαση στο δικό σας μηχάνημα, όχι κάτι που γίνεται σε αυτήν πριν φτάσει σε εσάς. Αυτό αξίζει να το ελέγξετε όπου αλλού ψωνίζετε — πάρα πολλές προσφορές “A100” είναι ένα κομμάτι μιας.

A100 40 GB ή 80 GB;

Πρώτα χωρητικότητα, μετά ρυθμός ανάγνωσης. Αν το μοντέλο και τα συμφραζόμενά του χωράνε σε σαράντα gigabytes με ένα πέμπτο να περισσεύει, η μικρότερη κάρτα είναι η καλύτερη αγορά και η σκάλα παραπάνω δείχνει το κενό. Η κάρτα των 80 GB διαβάζει επίσης πιο γρήγορα — 1.935 GB/s έναντι 1.555 — οπότε αν είστε κοντά στο όριο είτε σε χωρητικότητα είτε σε ρυθμό μετάδοσης, πάρτε τη μεγαλύτερη.

Ποια έκδοση driver και CUDA παίρνω;

Όποια εγκαταστήσετε. Το μηχάνημα φτάνει με καθαρό λειτουργικό σύστημα και root, και καρφιτσώνετε τον driver, την έκδοση CUDA και το build του framework σε ό,τι είχε δοκιμαστεί ο κώδικάς σας. Τίποτα δεν αναβαθμίζεται κάτω από τα πόδια σας. Αν προτιμάτε να έχει εγκατασταθεί ο driver πριν την παράδοση, πείτε το στην παραγγελία και ονομάστε την έκδοση.

Πόσο σύντομα μπορώ να έχω μία;

Αυτά είναι τα εξαρτήματα που είναι πιο πιθανό να αγοραστούν κατόπιν παραγγελίας αντί να τοποθετηθούν από απόθεμα, και σας λέμε ποιο πριν πληρώσετε αντί μετά. Ένας επιταχυντής τρέχουσας γενιάς σε κατανομή είναι ο μεγαλύτερος χρόνος παράδοσης που αναφέρουμε. Το /instant παραθέτει μηχανήματα σε rack και έτοιμα αυτή τη στιγμή.