RTX 3090 · 3080 Ti · 3080 · 3070 Ti · 3070

Série RTX 30 — cinco placas, de 8 GB a 24 GB

Silício de consumo Ampere de 2020, ainda em rack e ainda alugado, porque nada substituiu aquilo em que ele é realmente bom: a maior quantidade de aritmética por libra do catálogo. A única pergunta que merece uma página é qual das cinco, e a resposta honesta geralmente se resume a um número — quanta memória você precisa.

8, 10, 12 e 24 GB Sem ECC Um codificador, sem AV1

Transforme suas GPUs em receita mensal passiva

Tem configurações de GPU de servidor ou desktop paradas? Anuncie-as hoje no marketplace da Primcast e receba aluguéis mensais constantes de equipes de IA, desenvolvedores e empresas que precisam de computação de nível de produção.

Ir para o Marketplace

Qual das cinco

Da mais barata para a mais cara. Leia para baixo até a coluna de memória comportar o que você precisa, então pare — as placas acima dela são mais rápidas no mesmo trabalho, não capazes de um trabalho diferente.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 30708 GB GDDR6$139$209.93
RTX 3070 Ti8 GB GDDR6X$149$222.47
RTX 308010 GB GDDR6X$159$229.93
RTX 3080 Ti12 GB GDDR6X$199$272.47
RTX 309024 GB GDDR6X$239$309.93

A armadilha no meio daquela tabela

Nossa RTX 3080 é a placa original de 10 GB, aquela com 8.704 núcleos CUDA. A NVIDIA lançou depois uma revisão de 12 GB com 8.960, e muitas listagens em outros lugares citam o número de 12 GB ao lado da placa mais barata. Dez gigabytes não são doze: é a diferença entre comportar um modelo de treze bilhões de parâmetros em precisão de oito bits e não comportá-lo. Se você está dimensionando contra um número que leu em outro lugar, dimensione contra o nosso.

O outro ponto a observar é o degrau da 3080 Ti para a 3090. É o maior salto de capacidade da escada — de doze gigabytes para vinte e quatro — e é a única das cinco que ultrapassa 24 GB. Se você precisa disso, nada mais barato nesta página servirá, e as alternativas estão em todo o catálogo, com preços.

As especificações, como a NVIDIA as publica

Núcleos de ray tracing de segunda geração, núcleos tensor de terceira geração, PCIe Gen 4 em todas. Números das próprias páginas de comparação GeForce da NVIDIA, citados no código-fonte desta página.

RTX 3090

Architecture

Ampere

Card memory

24 GB GDDR6X

CUDA cores

10,496

Memory bandwidth

936 GB/s

Board power

350 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3080 Ti

Architecture

Ampere

Card memory

12 GB GDDR6X

CUDA cores

10,240

Memory bandwidth

912 GB/s

Board power

350 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3080

Architecture

Ampere

Card memory

10 GB GDDR6X

CUDA cores

8,704

Memory bandwidth

760 GB/s

Board power

320 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3070 Ti

Architecture

Ampere

Card memory

8 GB GDDR6X

CUDA cores

6,144

Memory bandwidth

608 GB/s

Board power

290 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

RTX 3070

Architecture

Ampere

Card memory

8 GB GDDR6

CUDA cores

5,888

Memory bandwidth

448 GB/s

Board power

220 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

1 NVENC, 1 NVDEC, no AV1 encode

Error-correcting memory

No

No que elas são boas, e no que não são

Essas placas têm seis anos e não as aposentamos, porque para uma grande parcela do trabalho real elas continuam sendo a compra correta, e não o meio-termo.

Boas em: capacidade barata

A RTX 3090 carrega os mesmos 24 GB da RTX 4090 D duas gerações depois, por menos dinheiro todo mês. Quando capacidade é o que você está comprando e a velocidade de relógio não é a restrição determinante, a placa mais antiga é simplesmente a melhor compra.

Boas em: servidores de jogos e trabalho em lote

Silício de consumo é contra o que o software de consumo é escrito e testado. Servidores de jogos, renderização em lote, ajuste fino por hobby, inferência que você pode rodar de novo — qualquer coisa em que um bit errado é uma nova tentativa, e não um desastre — roda aqui por uma fração do preço da prateleira profissional.

Ruins em: pipelines de vídeo modernos

Um codificador e um decodificador por placa, e nenhuma codificação AV1 em nenhuma das cinco — a codificação AV1 chega com a série RTX 40. Se o seu pipeline é AV1, esta geração não consegue fazê-lo em hardware e a resposta é uma RTX 4090 D ou uma L40S.

Ruins em: execuções longas sem supervisão

Nenhuma memória com correção de erros em nenhuma delas, e nenhum driver profissional certificado. Para uma execução medida em semanas sem checkpointing, ou para software licenciado apenas para placas profissionais, escolha uma placa da prateleira de estações de trabalho.

Em qual máquina elas entram, e qual link recebem lá

Toda placa RTX 30 é uma peça PCIe Gen 4. Três das quatro plataformas que as aceitam são Gen 3, e uma é Gen 4.

Intel Xeon E5-2600 v1/v2

RTX 3090, RTX 3080, RTX 3070

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon E5-2600 v3/v4

RTX 3090, RTX 3080 Ti, RTX 3080, RTX 3070 Ti, RTX 3070

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 3090, RTX 3080 Ti, RTX 3080, RTX 3070 Ti, RTX 3070

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 3080

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

Para esta geração o slot raramente decide algo: uma placa que mantém sua própria cena ou seus próprios pesos mal toca o barramento depois de carregada, e essas não são placas para as quais alguém transmite lotes enormes de treinamento. Isso está registrado aqui porque é verdade e porque publicamos para cada placa, não porque deva mudar sua opinião.

O que realmente cabe: a placa de 24 GB no topo da escada

Weights only, rounded up. Fits means the card’s 24 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — tight
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

Leia aquela tabela descendo um degrau para cada passo abaixo na escada. A 3080 Ti comporta doze gigabytes, a 3080 dez, a 3070 Ti e a 3070 oito cada — então um modelo de sete a oito bilhões de parâmetros em precisão de oito bits é aproximadamente onde a base desta página chega, e tudo maior exige a 3090 ou uma prateleira totalmente diferente.

Aquela tabela responde “o que cabe nesta placa”. A pergunta no sentido inverso — quanta memória um modelo precisa, e qual placa a comporta — está em uma página própria.

Quanto custam, com as máquinas em que entram

A placa é uma linha na fatura e a máquina é outra. As duas metades abaixo vêm de uma única leitura do catálogo de pedidos, então o preço e a especificação ao lado sempre pertencem um ao outro.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 3070Intel Xeon E5-2600 v1/v2
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · PCIe 3.0
$139$209.93
Configure this build →
RTX 3070Intel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$139$212.47
Configure this build →
RTX 3070 TiIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$149$222.47
Configure this build →
RTX 3070Intel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$139$222.67
Configure this build →
RTX 3080Intel Xeon E5-2600 v1/v2
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · PCIe 3.0
$159$229.93
Configure this build →
RTX 3080Intel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$159$232.47
Configure this build →
RTX 3070 TiIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$149$232.67
Configure this build →
RTX 3080Intel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$159$242.67
Configure this build →
RTX 3080 TiIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$199$272.47
Configure this build →
RTX 3080 TiIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$199$282.67
Configure this build →
RTX 3090Intel Xeon E5-2600 v1/v2
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · PCIe 3.0
$239$309.93
Configure this build →
RTX 3090Intel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$239$312.47
Configure this build →
RTX 3090Intel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$239$322.67
Configure this build →
RTX 3080AMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$159$376.59
Configure this build →

A largura de banda é ilimitada em ambas as direções, sem cobrança de saída, um endereço IPv4 está incluído, não há contrato e um mês é o prazo padrão. Para todas as outras placas que instalamos, com preços da mesma forma, leia todo o catálogo, com preços. Para máquinas em rack e prontas hoje, /instant. Para saber por que ainda alugamos hardware que todos os outros aposentaram, /value.

Perguntas que as pessoas realmente fazem sobre esta geração

Sua RTX 3080 é a placa de 10 GB ou a de 12 GB?

A placa de 10 GB, com 8.704 núcleos CUDA — a peça original de lançamento. A revisão de 12 GB tem 8.960 núcleos e não a instalamos. Isso importa mais do que os dois gigabytes sugerem, porque um modelo de treze bilhões de parâmetros em precisão de oito bits precisa de cerca de catorze gigabytes e não cabe em nenhuma das duas, enquanto um modelo menor cabe confortavelmente em ambas.

Por que alugar uma placa de 2020 afinal?

Porque a maior parte do trabalho com GPU não é treinar um modelo de fronteira. É servir algo que já cabe, codificar vídeo, renderizar quadros ou rodar um servidor de jogos, e para tudo isso a placa certa muitas vezes está duas gerações atrás por uma fração do dinheiro. A RTX 3090 comporta os mesmos vinte e quatro gigabytes de uma placa duas gerações mais nova. Esse é todo o argumento, e /value faz a versão mais longa dele.

Posso colocar duas delas em uma máquina?

É uma configuração que orçamos em vez de uma caixa que você marca, porque a quantidade depende do chassi, da largura física da placa e do orçamento de energia. Pergunte, e a resposta informa o chassi, a quantidade e o prazo de entrega. Note que duas placas são dois pools de memória separados: um modelo que não cabe em uma 3090 não cabe em duas sem ser dividido deliberadamente entre elas.

A placa é compartilhada com mais alguém?

Não. Um locatário por máquina física, e a placa é passada diretamente para o seu próprio sistema operacional — sem hipervisor, sem partição, sem divisão de tempo. Você instala e fixa seu próprio driver e versão do CUDA, e nada é atualizado por baixo de você.

Em quanto tempo posso ter uma?

Depende de a placa já estar instalada, já estar na nossa prateleira ou precisar ser comprada — e você é informado de qual caso antes de pagar. /instant lista máquinas em rack e prontas agora.