GeForce RTX 4090 D · 24 GB GDDR6X

RTX 4090D — e por que não é uma RTX 4090

A placa que instalamos é a 4090 D, a edição de conformidade com exportação que a NVIDIA criou para o mercado chinês. Não é um rebadge nem uma falsificação: é uma placa AD102 genuína com menos shaders e os mesmos 24 GB de memória. Se você chegou aqui procurando um servidor com 4090, esta página existe para mostrar a diferença antes de você pagar por ela.

24 GB GDDR6X Dois codificadores, AV1 Sem ECC

Transforme suas GPUs em receita mensal passiva

Tem servidores ou desktops com GPU parados? Anuncie-os hoje no marketplace da Primcast e ganhe aluguéis mensais constantes de equipes de IA, desenvolvedores e empresas que precisam de computação em nível de produção.

Ir para o Marketplace

O que significa o D

Em dezembro de 2023, o Departamento de Comércio dos Estados Unidos definiu um limite de exportação que a RTX 4090 ultrapassava. A NVIDIA cortou uma versão para ficar abaixo dele e vendeu essa versão na China: a RTX 4090 D. Ela foi lançada em 28 de dezembro de 2023 e tem 14.592 núcleos CUDA contra os 16.384 da placa completa — cerca de onze por cento menos shaders.

Todo o resto é a mesma placa. Vinte e quatro gigabytes de GDDR6X em um barramento de 384 bits, a mesma largura de banda de memória de 1.008 GB/s, o mesmo clock de boost de 2,52 GHz, os mesmos núcleos de ray tracing de terceira geração e núcleos tensor de quarta geração, os mesmos dois codificadores AV1. Nada que dependa de capacidade ou velocidade de memória muda, o que cobre a maior parte do que se pede a uma placa alugada: os modelos que cabem em 24 GB continuam cabendo, e os frames que são transmitidos continuam sendo transmitidos.

Onde ela custa caro é em throughput aritmético bruto em trabalhos que saturam os shaders — um render longo, uma execução de treinamento em lote. Calcule cerca de um décimo a menos que uma 4090 completa e você não será pego de surpresa. Dizemos isso aqui em vez de imprimir “RTX 4090” na página e deixar você descobrir, que é o que a maioria dos anúncios faz.

Across the 57 cards in the catalogue: RTX 4090D holds 24 GB, 13 cards we fit hold more, and 11 cost more per month. Read the whole ladder on the whole catalogue, priced.

A especificação, como publicada

Ada Lovelace. Números da própria documentação da série RTX 40 da NVIDIA, citados no código-fonte desta página.

RTX 4090D

Architecture

Ada Lovelace

Card memory

24 GB GDDR6X

CUDA cores

14,592

Memory bandwidth

1,008 GB/s

Board power

425 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

2 NVENC, 1 NVDEC, AV1

Error-correcting memory

No

No que ela é boa, e no que não é

Esta é uma placa de consumo em um rack. Essa é toda a sua vantagem e toda a sua limitação, e vale a pena dizer ambas com clareza.

Boa em: aritmética por libra

O silício GeForce é a forma mais barata de comprar essa quantidade de computação. Não há licença de driver profissional no preço nem margem de datacenter, então para trabalhos em que um bit errado significa repetir em vez de um desastre — renderização em lote, servidores de jogos, treinamento amador, inferência que você pode executar de novo — é muito difícil de superar.

Boa em: vídeo, diferente dos aceleradores

Dois codificadores de hardware com AV1 e um decodificador. Uma 4090 D transcodifica o dia inteiro. A A100 e a H100 mais acima no catálogo não conseguem codificar um único frame em hardware — elas não têm codificador algum — então, para qualquer coisa com vídeo, esta placa não é o meio-termo, é a resposta correta.

Ruim em: qualquer coisa que precise de mais de 24 GB

Vinte e quatro gigabytes são o muro, e ele chega mais cedo do que as pessoas esperam: um modelo de treze bilhões de parâmetros em precisão de oito bits cabe, o mesmo modelo em dezesseis bits não cabe, e um modelo de setenta bilhões não cabe em precisão alguma. A tabela abaixo é exata sobre isso.

Ruim em: trabalho que não tolera um bit invertido

Sem memória com correção de erros e sem driver profissional certificado. Para uma execução de várias semanas sem checkpointing, ou para uma carga sob licença que exija uma placa profissional, a resposta é uma placa da prateleira de workstations. Elas estão em todo o catálogo, com preços.

O que ela substituiu, e o que a substitui

Das nossas próprias prateleiras, não de um roadmap de fabricante. As três são encomendáveis hoje, no mesmo chassi, então a questão não é qual é a mais nova, mas qual vale a diferença.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 309024 GB GDDR6X$239$309.93
RTX 4090D24 GB GDDR6X$299$372.47
RTX 509032 GB GDDR7$399$472.47

A RTX 3090 tem os mesmos 24 GB e é o jeito mais antigo, mais lento e mais barato de obtê-los — se o que você está comprando é capacidade e não velocidade, leia a página da série RTX 30 antes de gastar a diferença. A RTX 5090 sobe para 32 GB e é uma placa PCIe Gen 5 em plataformas que são Gen 3 e Gen 4, então leia a seção abaixo antes de presumir que mais nova é mais rápida aqui.

Em qual máquina ela entra, e qual link ela recebe lá

A 4090 D é uma placa PCIe Gen 4. Duas das nossas três plataformas que a aceitam são Gen 3, e uma é Gen 4.

Intel Xeon E5-2600 v3/v4

RTX 4090D

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 4090D

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 4090D

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

Este é o fato por trás do ticket de suporte #3347, em que um cliente mudou para uma placa mais nova em uma plataforma mais antiga e renderizou mais devagar do que antes. Uma vez que a cena ou os pesos estão residentes na placa, o slot fica ocioso e a geração dele deixa de importar. Ela importa quando o trabalho cruza o slot a cada passo.

O que realmente cabe em 24 GB

Weights only, rounded up. Fits means the card’s 24 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — tight
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

O outro teto é a energia: esta placa consome até 425 W sozinha, o que faz com que mais de uma delas em um chassi seja uma configuração que cotamos em vez de uma caixa que você marca.

Essa tabela responde “o que cabe nesta placa”. A pergunta no sentido inverso — quanta memória um modelo precisa, e qual placa atende — está em uma página própria.

Quanto custa, com a máquina em que ela entra

A placa é uma linha na fatura e a máquina é outra. As duas metades abaixo vêm de uma única leitura do catálogo de pedidos, então o preço e a especificação ao lado sempre pertencem um ao outro.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 4090DIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$372.47
Configure this build →
RTX 4090DIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$382.67
Configure this build →
RTX 4090DAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$299$516.59
Configure this build →

A largura de banda é ilimitada nas duas direções, sem cobrança de egresso, um endereço IPv4 está incluído, não há contrato e um mês é o prazo padrão. Para todas as outras placas que instalamos, com preços da mesma forma, leia todo o catálogo, com preços. Para máquinas já montadas em rack e prontas hoje, /instant.

Perguntas que as pessoas realmente fazem sobre esta placa

Vou receber uma RTX 4090 completa se eu pedir?

Não nesta página. O que instalamos é a 4090 D, e a página diz isso em vez de imprimir “RTX 4090” e torcer. Se o seu trabalho realmente precisa dos onze por cento extras de shaders, diga-nos qual é e diremos se conseguimos obter a peça e qual seria o prazo, em vez de enviar a D e chamá-la de 4090.

O D afeta CUDA, drivers ou compatibilidade de software?

Não. Ela se identifica como uma placa GeForce Ada Lovelace, usa o driver GeForce comum, e toda versão de CUDA, build de framework e renderizador que roda em uma 4090 roda nela. A diferença é a contagem de shaders, não a arquitetura.

A placa é compartilhada com mais alguém?

Não. Um locatário por máquina física, e a placa é passada diretamente para o seu próprio sistema operacional — sem hypervisor, sem partição, sem divisão de tempo. Você instala e fixa seu próprio driver e versão de CUDA, e nada é atualizado por baixo de você.

4090 D ou RTX 3090, se eu só me importo com os 24 GB?

Então a 3090 é muito provavelmente a melhor compra, e a escada acima mostra a diferença. A 4090 D é significativamente mais rápida e tem codificação AV1 que a 3090 não tem; a 3090 tem a mesma capacidade por menos dinheiro todo mês. Se o modelo cabe de qualquer forma e as execuções não são consecutivas, a placa mais antiga vence na aritmética.

Em quanto tempo posso ter uma?

Depende de a placa já estar instalada, já estar na nossa prateleira ou precisar ser comprada — e você é informado disso antes de pagar. /instant lista máquinas montadas em rack e prontas agora.