GeForce RTX 4090 D · 24 GB GDDR6X

RTX 4090D — e por que ela não é uma RTX 4090

A placa que instalamos é a 4090 D, a edição para exportação que a NVIDIA fabricou para o mercado chinês. Não é uma versão renomeada nem falsificada: é uma placa AD102 genuína com menos shaders e os mesmos 24 GB de memória. Se você veio aqui procurando por uma 4090 para servidor, esta página existe para lhe mostrar a diferença antes de você comprar.

24 GB GDDR6X Dois codificadores, AV1 Sem ECC

O que significa o D

Em dezembro de 2023, o Departamento de Comércio dos Estados Unidos estabeleceu um limite de exportação que a RTX 4090 ultrapassou. A NVIDIA reduziu as especificações de uma versão para atender a esse limite e vendeu essa versão na China: a RTX 4090 D. Ela foi lançada em 28 de dezembro de 2023 e possui 14.592 núcleos CUDA, contra 16.384 da placa completa — cerca de 11% menos shaders.

Todo o resto é a mesma placa. Vinte e quatro gigabytes de GDDR6X em um barramento de 384 bits, a mesma largura de banda de memória de 1.008 GB/s, o mesmo clock boost de 2,52 GHz, os mesmos núcleos de ray tracing de terceira geração e núcleos tensores de quarta geração, os mesmos dois codificadores AV1. Nada que dependa da capacidade ou velocidade da memória muda, o que cobre a maior parte do que se espera de uma placa alugada: os modelos que cabem em 24 GB ainda cabem, e os frames que são transmitidos continuam sendo transmitidos.

Onde você realmente gasta dinheiro é na capacidade de processamento aritmético bruto em tarefas que saturam os shaders — uma renderização longa, um treinamento em lote. Reserve cerca de um décimo a menos do que o necessário para uma RTX 4090 completa e você não se surpreenderá. Dizemos isso aqui em vez de simplesmente imprimir "RTX 4090" na página e deixar você descobrir, que é o que a maioria das listas faz.

Across the 56 cards in the catalogue: RTX 4090D holds 24 GB, 13 cards we fit hold more, and 11 cost more per month. Read the whole ladder on the whole catalogue, priced.

A especificação, conforme publicada

Ada Lovelace. Dados da própria documentação da série RTX 40 da NVIDIA, citada na fonte desta página.

RTX 4090D

Architecture

Ada Lovelace

Card memory

24 GB GDDR6X

CUDA cores

14,592

Memory bandwidth

1,008 GB/s

Board power

425 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

2 NVENC, 1 NVDEC, AV1

Error-correcting memory

No

O que faz bem e o que não faz.

Este é um cartão de crédito para consumidor em um expositor. Essa é sua única vantagem e sua única limitação, e ambas merecem ser ditas claramente.

Bom em: aritmética por libra

O silício GeForce é a maneira mais barata de obter essa capacidade de processamento. Não há custo adicional por carteira de habilitação profissional nem margem de lucro de data center, então, para trabalhos em que um bit errado significa apenas uma nova tentativa em vez de um desastre — renderização em lote, servidores de jogos, treinamento para entusiastas, inferência que pode ser executada novamente — é muito difícil encontrar algo melhor.

Bom em: vídeo, ao contrário dos aceleradores

Dois codificadores de hardware com AV1 e um decodificador. Uma 4090 D transcodifica o dia todo. As placas A100 e H100, mais acima no catálogo, não conseguem codificar um único quadro por hardware — elas não têm codificador algum — então, para qualquer coisa que envolva vídeo, esta placa não é uma solução de compromisso, é a resposta certa.

Ruim em: qualquer coisa que precise de mais de 24 GB

Vinte e quatro gigabytes é o limite, e ele chega mais cedo do que se espera: um modelo com treze bilhões de parâmetros e precisão de oito bits cabe, o mesmo modelo com dezesseis bits não cabe, e um modelo com setenta bilhões de parâmetros não cabe em nenhuma precisão. A tabela abaixo é precisa quanto a isso.

Ruim em: trabalhos que não toleram bits invertidos

Sem memória de correção de erros e sem driver profissional certificado. Para uma execução de várias semanas sem pontos de verificação, ou para uma carga de trabalho sob uma licença que exige uma placa profissional, a solução é uma placa de vídeo para estações de trabalho. Elas estão disponíveis em todo o catálogo, com preços variados .

O que substituiu e o que o substitui.

Dos nossos próprios estoques, e não de um cronograma de fornecedores. Os três modelos estão disponíveis para encomenda hoje, no mesmo chassi, então a questão não é qual é o mais recente, mas sim qual vale a diferença.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 309024 GB GDDR6X$239$309.93
RTX 4090D24 GB GDDR6X$299$372.47
RTX 509032 GB GDDR7$399$472.47

A RTX 3090 também possui 24 GB de memória e é a opção mais antiga, lenta e barata — se o que você prioriza é a capacidade, e não a velocidade, leia a página da série RTX 30 antes de gastar a diferença. A RTX 5090 oferece 32 GB de memória e é uma placa PCIe Gen 5 em plataformas Gen 3 e Gen 4, então leia a seção abaixo antes de presumir que a mais recente é necessariamente mais rápida.

Em qual máquina ele será inserido e qual link ele receberá?

A 4090 D é uma placa PCIe Gen 4. Duas das nossas três plataformas compatíveis com ela são Gen 3, e uma é Gen 4.

Intel Xeon E5-2600 v3/v4

RTX 4090D

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 4090D

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 4090D

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

Este é o fato por trás do ticket de suporte nº 3347, onde um cliente migrou para uma placa de vídeo mais recente em uma plataforma mais antiga e a renderização ficou mais lenta do que antes. Assim que a cena ou os pesos estão residentes na placa, o slot fica ocioso e sua geração deixa de ser relevante. A relevância surge quando o processamento atravessa o slot a cada etapa.

O que realmente cabe em 24 GB?

Weights only, rounded up. A row counts as fitting when it leaves a fifth of the card’s 24 GB free for the KV cache, the activations and the runtime — which is head-room, not luxury.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — fits
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

O outro limite é a potência: esta placa consome até 425 W sozinha, o que faz com que a instalação de mais de uma delas em um chassi seja um item que orçamos, em vez de uma simples opção a ser marcada.

Quanto custa, incluindo a máquina em que é instalado?

O cartão é uma linha na fatura e a máquina é outra. Ambas as metades abaixo provêm de uma única leitura do catálogo de pedidos, portanto o preço e a especificação ao lado sempre pertencem um ao outro.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 4090DIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$372.47
Configure this build →
RTX 4090DIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$382.67
Configure this build →
RTX 4090DAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$299$516.59
Configure this build →

A largura de banda é ilimitada em ambas as direções, sem cobrança de saída, um endereço IPv4 está incluído, não há contrato e o prazo padrão é de um mês. Para todas as outras placas que instalamos, o preço é o mesmo, consulte o catálogo completo . Para máquinas instaladas e prontas para uso hoje, /instant .

Perguntas que as pessoas realmente fazem sobre este cartão.

Se eu pedir, consigo uma RTX 4090 completa?

Não nesta página. O que recomendamos é a 4090 D, e isso está indicado na página, em vez de imprimir "RTX 4090" e torcer para dar certo. Se o seu projeto realmente precisa desses 11% extras de shaders, diga-nos qual é a peça e nós informaremos se podemos obtê-la e qual seria o prazo de entrega, em vez de enviar a D e chamá-la de 4090.

O "D" afeta a compatibilidade do CUDA, dos drivers ou do software?

Não. Ela é reconhecida como uma placa GeForce Ada Lovelace, utiliza o driver GeForce padrão e todas as versões do CUDA, builds de framework e renderizadores que rodam em uma 4090 também rodam nela. A diferença está na quantidade de shaders, não na arquitetura.

O cartão é compartilhado com mais alguém?

Não. Um único usuário por máquina física, e a placa é repassada diretamente para o seu próprio sistema operacional — sem hipervisor, sem particionamento, sem fatiamento de tempo. Você instala e fixa seu próprio driver e versão do CUDA, e nada é atualizado sem a sua permissão.

RTX 4090D ou RTX 3090, se eu só me importar com os 24 GB?

Nesse caso, a 3090 provavelmente é a melhor compra, e a tabela acima mostra a diferença. A 4090 D é significativamente mais rápida e possui codificação AV1, que a 3090 não tem; a 3090 tem a mesma capacidade por um preço mensal menor. Se o modelo atender às suas necessidades e os testes não forem consecutivos, a placa mais antiga leva vantagem em termos de custo-benefício.

Em quanto tempo posso receber um?

Depende se o cartão já está instalado, se já está em estoque ou se precisa ser comprado — e você será informado disso antes de pagar. /instant lista as máquinas instaladas e prontas para uso no momento.