RTX 3090 · 3080 Ti · 3080 · 3070 Ti · 3070

Serie RTX 30 — cinque schede, da 8 GB a 24 GB

Silicio consumer Ampere del 2020, ancora montato su rack e ancora noleggiato, perché nulla ha sostituito ciò in cui è davvero bravo: la maggior potenza di calcolo per sterlina del catalogo. L'unica domanda che merita una pagina è quale delle cinque, e la risposta onesta di solito dipende da un solo numero — quanta memoria ti serve.

8, 10, 12 e 24 GB Nessuna ECC Un encoder, nessun AV1

Trasforma le tue GPU in entrate mensili passive

Hai configurazioni GPU server o desktop inattive? Pubblicarle oggi sul marketplace Primcast e guadagna affitti mensili costanti da team AI, sviluppatori e aziende che necessitano di calcolo di livello produttivo.

Vai al Marketplace

Quale delle cinque

Prima le più economiche. Leggi verso il basso finché la colonna della memoria non contiene ciò che ti serve, poi fermati — le schede sopra sono più veloci nello stesso lavoro, non capaci di uno diverso.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 30708 GB GDDR6$139$209.93
RTX 3070 Ti8 GB GDDR6X$149$222.47
RTX 308010 GB GDDR6X$159$229.93
RTX 3080 Ti12 GB GDDR6X$199$272.47
RTX 309024 GB GDDR6X$239$309.93

La trappola al centro di quella tabella

La nostra RTX 3080 è la scheda originale da 10 GB, quella con 8.704 core CUDA. NVIDIA ha poi distribuito una revisione da 12 GB con 8.960 core, e moltissimi annunci altrove riportano la cifra di 12 GB accanto alla scheda più economica. Dieci gigabyte non sono dodici: è la differenza tra contenere un modello da tredici miliardi di parametri a precisione a otto bit e non contenerlo. Se stai dimensionando in base a un numero letto da qualche altra parte, dimensiona rispetto al nostro.

L'altro passaggio da tenere d'occhio è quello dalla 3080 Ti alla 3090. È il salto di capacità più grande della scala — da dodici gigabyte a ventiquattro — ed è l'unica delle cinque che supera i 24 GB. Se ti serve quello, niente di più economico in questa pagina andrà bene, e le alternative sono su l'intero catalogo, con prezzi.

Le specifiche, come le pubblica NVIDIA

Core ray-tracing di seconda generazione, core tensor di terza generazione, PCIe Gen 4 ovunque. Dati dalle pagine di confronto GeForce di NVIDIA, citati nel sorgente di questa pagina.

RTX 3090

Architecture

Ampere

Card memory

24 GB GDDR6X

CUDA cores

10,496

Memory bandwidth

936 GB/s

Board power

350 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3080 Ti

Architecture

Ampere

Card memory

12 GB GDDR6X

CUDA cores

10,240

Memory bandwidth

912 GB/s

Board power

350 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3080

Architecture

Ampere

Card memory

10 GB GDDR6X

CUDA cores

8,704

Memory bandwidth

760 GB/s

Board power

320 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3070 Ti

Architecture

Ampere

Card memory

8 GB GDDR6X

CUDA cores

6,144

Memory bandwidth

608 GB/s

Board power

290 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3070

Architecture

Ampere

Card memory

8 GB GDDR6

CUDA cores

5,888

Memory bandwidth

448 GB/s

Board power

220 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

In cosa sono brave, e in cosa no

Queste schede hanno sei anni e non le abbiamo ritirate, perché per una larga parte del lavoro reale restano l'acquisto corretto piuttosto che il compromesso.

Brave in: capacità economica

La RTX 3090 monta gli stessi 24 GB della RTX 4090 D di due generazioni dopo, per meno soldi ogni mese. Quando ciò che compri è capacità e la velocità a orologio non è il vincolo stringente, la scheda più vecchia è semplicemente l'acquisto migliore.

Brave in: server di gioco e lavoro batch

Il silicio consumer è ciò su cui il software consumer viene scritto e testato. Server di gioco, rendering batch, fine-tuning amatoriale, inferenza che puoi rieseguire — qualsiasi cosa in cui un bit sbagliato è un nuovo tentativo piuttosto che un disastro — gira qui per una frazione del prezzo dello scaffale professionale.

Scarse in: pipeline video moderne

Un encoder e un decoder per scheda, e nessuna codifica AV1 su nessuna delle cinque — la codifica AV1 arriva con la serie RTX 40. Se la tua pipeline è AV1, questa generazione non può farlo in hardware e la risposta è una RTX 4090 D o una L40S.

Scarse in: lunghe esecuzioni senza supervisione

Nessuna memoria con correzione degli errori su nessuna di esse, e nessun driver professionale certificato. Per un'esecuzione misurata in settimane senza checkpointing, o per software concesso in licenza solo a schede professionali, prendi invece una scheda dallo scaffale workstation.

In quale macchina vanno, e quale collegamento ricevono lì

Ogni scheda RTX 30 è un componente PCIe Gen 4. Tre delle quattro piattaforme che le ospitano sono Gen 3, e una è Gen 4.

Intel Xeon E5-2600 v1/v2

RTX 3090, RTX 3080, RTX 3070

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon E5-2600 v3/v4

RTX 3090, RTX 3080 Ti, RTX 3080, RTX 3070 Ti, RTX 3070

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 3090, RTX 3080 Ti, RTX 3080, RTX 3070 Ti, RTX 3070

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 3080

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

Per questa generazione lo slot raramente decide qualcosa: una scheda che contiene la propria scena o i propri pesi tocca appena il bus una volta caricata, e queste non sono schede a cui qualcuno invia enormi batch di addestramento in streaming. È registrato qui perché è vero e perché lo pubblichiamo per ogni scheda, non perché dovrebbe farti cambiare idea.

Cosa ci sta davvero: la scheda da 24 GB in cima alla scala

Weights only, rounded up. Fits means the card’s 24 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — tight
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

Leggi quella tabella scendendo di un gradino per ogni passo giù dalla scala. La 3080 Ti contiene dodici gigabyte, la 3080 dieci, la 3070 Ti e la 3070 otto ciascuna — quindi un modello da sette a otto miliardi di parametri a precisione a otto bit è più o meno dove atterra il fondo di questa pagina, e tutto ciò che è più grande richiede la 3090 o uno scaffale del tutto diverso.

Quella tabella risponde a “cosa sta in questa scheda”. La domanda al contrario — quanta memoria serve a un modello, e quale scheda la supera — è una pagina a sé.

Quanto costano, con le macchine in cui vanno

La scheda è una riga della fattura e la macchina un'altra. Entrambe le metà qui sotto provengono da un'unica lettura del catalogo ordini, quindi il prezzo e la specifica accanto appartengono sempre l'uno all'altra.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 3070Intel Xeon E5-2600 v1/v2
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · PCIe 3.0
$139$209.93
Configure this build →
RTX 3070Intel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$139$212.47
Configure this build →
RTX 3070 TiIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$149$222.47
Configure this build →
RTX 3070Intel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$139$222.67
Configure this build →
RTX 3080Intel Xeon E5-2600 v1/v2
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · PCIe 3.0
$159$229.93
Configure this build →
RTX 3080Intel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$159$232.47
Configure this build →
RTX 3070 TiIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$149$232.67
Configure this build →
RTX 3080Intel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$159$242.67
Configure this build →
RTX 3080 TiIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$199$272.47
Configure this build →
RTX 3080 TiIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$199$282.67
Configure this build →
RTX 3090Intel Xeon E5-2600 v1/v2
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · PCIe 3.0
$239$309.93
Configure this build →
RTX 3090Intel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$239$312.47
Configure this build →
RTX 3090Intel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$239$322.67
Configure this build →
RTX 3080AMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$159$376.59
Configure this build →

La larghezza di banda non è misurata in entrambe le direzioni senza costi di uscita, un indirizzo IPv4 è incluso, non c'è contratto e un mese è la durata predefinita. Per ogni altra scheda che montiamo, con prezzi allo stesso modo, leggi l'intero catalogo, con prezzi. Per macchine su rack e pronte oggi, /instant. Per il motivo per cui noleggiamo ancora hardware che tutti gli altri hanno ritirato, /value.

Domande che le persone fanno davvero su questa generazione

La vostra RTX 3080 è la scheda da 10 GB o quella da 12 GB?

La scheda da 10 GB, con 8.704 core CUDA — il componente originale di lancio. La revisione da 12 GB ha 8.960 core e noi non la montiamo. Questo conta più di quanto suggeriscano i due gigabyte, perché un modello da tredici miliardi di parametri a precisione a otto bit richiede circa quattordici gigabyte e non sta in nessuna delle due, mentre un modello più piccolo sta comodamente in entrambe.

Perché noleggiare una scheda del 2020?

Perché la maggior parte del lavoro GPU non è addestrare un modello di frontiera. È servire qualcosa che già ci sta, codificare video, renderizzare fotogrammi o far girare un server di gioco, e per tutto questo la scheda giusta è spesso di due generazioni indietro a una frazione del costo. La RTX 3090 contiene gli stessi ventiquattro gigabyte di una scheda di due generazioni più nuova. Questo è l'intero argomento, e /value ne fa la versione più lunga.

Posso metterne due in una macchina?

È una configurazione che quotiamo piuttosto che una casella da spuntare, perché il numero dipende dal telaio, dalla larghezza fisica della scheda e dal budget di potenza. Chiedi, e la risposta indica telaio, numero e tempi di consegna. Nota che due schede sono due pool di memoria separati: un modello che non sta in una 3090 non sta in due senza essere diviso deliberatamente tra di esse.

La scheda è condivisa con qualcun altro?

No. Un solo locatario per macchina fisica, e la scheda viene passata direttamente al tuo sistema operativo — nessun hypervisor, nessuna partizione, nessuna suddivisione del tempo. Installi e blocchi il tuo driver e la tua release CUDA, e nulla si aggiorna sotto di te.

Quanto presto posso averne una?

Dipende se la scheda è già montata, già sul nostro scaffale o deve essere acquistata — e ti viene detto quale prima di pagare. /instant elenca le macchine su rack e pronte adesso.