GeForce RTX 4090 D · 24 Go GDDR6X

RTX 4090D — et pourquoi ce n’est pas une RTX 4090

La carte que nous installons est la 4090 D, l’édition conforme aux règles d’exportation que NVIDIA a conçue pour le marché chinois. Ce n’est pas un simple changement d’étiquette ni une contrefaçon : c’est une véritable carte AD102 avec moins de shaders et les mêmes 24 Go de mémoire. Si vous êtes arrivé ici en cherchant un serveur 4090, cette page existe pour vous expliquer la différence avant que vous ne payiez.

24 Go GDDR6X Deux encodeurs, AV1 Pas d’ECC

Transformez vos GPU en revenus mensuels passifs

Vous avez des configurations GPU serveur ou de bureau inutilisées ? Mettez-les en ligne dès aujourd’hui sur la place de marché Primcast et percevez des loyers mensuels réguliers de la part d’équipes d’IA, de développeurs et d’entreprises qui ont besoin de puissance de calcul de qualité production.

Aller à la place de marché

Ce que signifie le D

En décembre 2023, le ministère du Commerce des États-Unis a fixé un seuil d’exportation que la RTX 4090 dépassait. NVIDIA a réduit une version pour passer sous ce seuil et l’a vendue en Chine : la RTX 4090 D. Elle est sortie le 28 décembre 2023 et compte 14 592 cœurs CUDA contre 16 384 pour la carte complète, soit environ onze pour cent de shaders en moins.

Tout le reste est la même carte. Vingt-quatre gigaoctets de GDDR6X sur un bus de 384 bits, la même bande passante mémoire de 1 008 Go/s, la même horloge boost de 2,52 GHz, les mêmes cœurs de ray tracing de troisième génération et cœurs tensoriels de quatrième génération, les mêmes deux encodeurs AV1. Rien de ce qui dépend de la capacité ou de la vitesse mémoire ne change, ce qui couvre l’essentiel de ce qu’on demande à une carte louée : les modèles qui tiennent dans 24 Go tiennent toujours, et les images qui sont diffusées le sont toujours.

Là où elle vous coûte, c’est en débit arithmétique brut sur les charges qui saturent les shaders — un long rendu, un entraînement par lots. Prévoyez environ un dixième de moins qu’une 4090 complète et vous ne serez pas surpris. Nous le disons ici plutôt que d’imprimer “RTX 4090” sur la page et de vous laisser le découvrir, ce que font la plupart des annonces.

Across the 57 cards in the catalogue: RTX 4090D holds 24 GB, 13 cards we fit hold more, and 11 cost more per month. Read the whole ladder on the whole catalogue, priced.

La fiche technique, telle que publiée

Ada Lovelace. Chiffres tirés de la documentation RTX série 40 de NVIDIA, cités dans la source de cette page.

RTX 4090D

Architecture

Ada Lovelace

Card memory

24 GB GDDR6X

CUDA cores

14,592

Memory bandwidth

1,008 GB/s

Board power

425 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

2 NVENC, 1 NVDEC, AV1

Error-correcting memory

No

Ce pour quoi elle est bonne, et ce pour quoi elle ne l’est pas

C’est une carte grand public dans un rack. C’est tout son avantage et toute sa limite, et les deux méritent d’être dits clairement.

Bonne pour : l’arithmétique par livre

Le silicium GeForce est le moyen le moins cher d’acheter autant de calcul. Il n’y a pas de licence de pilote professionnel dans le prix ni de marge datacenter, donc pour un travail où un bit erroné signifie une nouvelle tentative plutôt qu’une catastrophe — rendu par lots, serveurs de jeux, entraînement amateur, inférence que vous pouvez relancer — elle est très difficile à battre.

Bonne pour : la vidéo, contrairement aux accélérateurs

Deux encodeurs matériels avec AV1 et un décodeur. Une 4090 D transcodera toute la journée. Les A100 et H100 plus haut dans le catalogue ne peuvent pas encoder une seule image en matériel — elles n’ont aucun encodeur — donc pour tout ce qui contient de la vidéo, cette carte n’est pas le compromis, c’est la bonne réponse.

Mauvaise pour : tout ce qui nécessite plus de 24 Go

Vingt-quatre gigaoctets, c’est le mur, et il arrive plus tôt qu’on ne le pense : un modèle de treize milliards de paramètres en précision huit bits tient, le même modèle en seize bits ne tient pas, et un modèle de soixante-dix milliards ne tient à aucune précision. Le tableau ci-dessous est précis à ce sujet.

Mauvaise pour : le travail qui ne tolère pas un bit inversé

Pas de mémoire à correction d’erreurs, et pas de pilote professionnel certifié. Pour une exécution de plusieurs semaines sans point de reprise, ou pour une charge soumise à une licence exigeant une carte professionnelle, la réponse est plutôt une carte du rayon workstation. Celles-ci figurent dans tout le catalogue, avec les prix.

Ce qu’elle a remplacé, et ce qui la remplace

De nos propres étagères plutôt que d’une feuille de route de fournisseur. Ces trois cartes sont commandables aujourd’hui, dans le même châssis, donc la question n’est pas laquelle est la plus récente mais laquelle vaut la différence.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 309024 GB GDDR6X$239$309.93
RTX 4090D24 GB GDDR6X$299$372.47
RTX 509032 GB GDDR7$399$472.47

La RTX 3090 a les mêmes 24 Go et c’est le moyen plus ancien, plus lent et moins cher de les obtenir — si c’est la capacité que vous achetez et non la vitesse, lisez la page de la série RTX 30 avant de dépenser la différence. La RTX 5090 passe à 32 Go, et c’est une carte PCIe Gen 5 sur des plateformes qui sont Gen 3 et Gen 4, alors lisez la section ci-dessous avant de supposer que plus récent est plus rapide ici.

Dans quelle machine elle va, et quelle liaison elle y obtient

La 4090 D est une carte PCIe Gen 4. Deux de nos trois plateformes qui l’acceptent sont Gen 3, et une est Gen 4.

Intel Xeon E5-2600 v3/v4

RTX 4090D

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 4090D

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 4090D

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

C’est le fait derrière le ticket de support n°3347, où un client est passé à une carte plus récente sur une plateforme plus ancienne et a rendu plus lentement qu’avant. Une fois que la scène ou les poids sont résidents sur la carte, le slot est inactif et sa génération cesse d’importer. Cela importe quand le travail traverse le slot à chaque étape.

Ce qui tient réellement dans 24 Go

Weights only, rounded up. Fits means the card’s 24 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — tight
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

L’autre plafond, c’est la puissance : cette carte consomme jusqu’à 425 W à elle seule, ce qui fait que plus d’une dans un châssis est une configuration que nous chiffrons plutôt qu’une case à cocher.

Ce tableau répond à “ce qui tient dans cette carte”. La question dans l’autre sens — combien de mémoire un modèle nécessite, et quelle carte la dépasse — a sa propre page.

Ce qu’elle coûte, avec la machine dans laquelle elle va

La carte est une ligne sur la facture et la machine en est une autre. Les deux moitiés ci-dessous proviennent d’une seule lecture du catalogue de commandes, donc le prix et la spécification à côté appartiennent toujours l’un à l’autre.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 4090DIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$372.47
Configure this build →
RTX 4090DIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$382.67
Configure this build →
RTX 4090DAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$299$516.59
Configure this build →

La bande passante est non mesurée dans les deux sens sans frais de sortie, une adresse IPv4 est incluse, il n’y a pas de contrat et un mois est la durée par défaut. Pour toutes les autres cartes que nous installons, au même prix, lisez tout le catalogue, avec les prix. Pour les machines en rack prêtes aujourd’hui, /instant.

Les questions que les gens posent vraiment sur cette carte

Vais-je recevoir une RTX 4090 complète si je le demande ?

Pas depuis cette page. Ce que nous installons, c’est la 4090 D, et la page le dit plutôt que d’imprimer “RTX 4090” en espérant. Si votre travail a réellement besoin des onze pour cent de shaders supplémentaires, dites-nous de quoi il s’agit et nous vous dirons si nous pouvons nous procurer la pièce et quel serait le délai, plutôt que d’expédier la D en l’appelant 4090.

Le D affecte-t-il CUDA, les pilotes ou la compatibilité logicielle ?

Non. Elle se présente comme une carte GeForce Ada Lovelace, prend le pilote GeForce ordinaire, et chaque version de CUDA, build de framework et moteur de rendu qui fonctionne sur une 4090 fonctionne dessus. La différence est un nombre de shaders, pas une architecture.

La carte est-elle partagée avec quelqu’un d’autre ?

Non. Un locataire par machine physique, et la carte est transmise directement à votre propre système d’exploitation — pas d’hyperviseur, pas de partition, pas de découpage temporel. Vous installez et épinglez votre propre pilote et votre version de CUDA, et rien ne se met à jour sous vos pieds.

4090 D ou RTX 3090, si je ne m’intéresse qu’aux 24 Go ?

Alors la 3090 est très probablement le meilleur achat, et l’échelle ci-dessus montre l’écart. La 4090 D est nettement plus rapide et possède l’encodage AV1 que la 3090 n’a pas ; la 3090 a la même capacité pour moins d’argent chaque mois. Si le modèle tient dans les deux cas et que les exécutions ne sont pas consécutives, la carte plus ancienne gagne sur l’arithmétique.

Dans combien de temps puis-je en avoir une ?

Cela dépend si la carte est déjà installée, déjà sur notre étagère, ou doit être achetée — et on vous le dit avant de payer. /instant liste les machines en rack prêtes immédiatement.