GeForce RTX 4090 D · 24 GB GDDR6X

RTX 4090D — und warum sie keine RTX 4090 ist

Die Karte, die wir verbauen, ist die 4090 D, die Export-Compliance-Version, die NVIDIA für den chinesischen Markt gebaut hat. Sie ist kein Rebranding und keine Fälschung: Sie ist eine echte AD102-Karte mit weniger Shadern und denselben 24 GB Speicher. Wenn Sie auf der Suche nach einem 4090-Server hierhergekommen sind, existiert diese Seite, um Ihnen den Unterschied zu erklären, bevor Sie dafür bezahlen.

24 GB GDDR6X Zwei Encoder, AV1 Kein ECC

Verwandeln Sie Ihre GPUs in passives monatliches Einkommen

Haben Sie ungenutzte Server- oder Desktop-GPU-Setups? Listen Sie sie noch heute auf dem Primcast-Marktplatz und erzielen Sie stabile monatliche Mieteinnahmen von KI-Teams, Entwicklern und Unternehmen, die produktionsreife Rechenleistung benötigen.

Zum Marktplatz

Was das D bedeutet

Im Dezember 2023 setzte das Handelsministerium der Vereinigten Staaten eine Exportschwelle fest, die die RTX 4090 überschritt. NVIDIA kürzte eine Version herunter, um sie zu unterschreiten, und verkaufte diese Version in China: die RTX 4090 D. Sie kam am 28. Dezember 2023 auf den Markt und hat 14.592 CUDA-Kerne gegenüber den 16.384 der vollen Karte — etwa elf Prozent weniger Shader.

Alles andere ist dieselbe Karte. Vierundzwanzig Gigabyte GDDR6X auf einem 384-Bit-Bus, dieselben 1.008 GB/s Speicherbandbreite, derselbe Boost-Takt von 2,52 GHz, dieselben Raytracing-Kerne der dritten Generation und Tensor-Kerne der vierten Generation, dieselben zwei AV1-Encoder. Nichts, was von der Speicherkapazität oder Speichergeschwindigkeit abhängt, ändert sich überhaupt, und das deckt das meiste ab, wofür eine gemietete Karte angefragt wird: Die Modelle, die in 24 GB passen, passen weiterhin, und die Frames, die streamen, streamen weiterhin.

Wo sie Sie etwas kostet, ist der reine arithmetische Durchsatz bei Arbeit, die die Shader auslastet — ein langer Render, ein Batch-Trainingslauf. Kalkulieren Sie grob ein Zehntel weniger als bei einer vollen 4090, und Sie werden nicht überrascht sein. Wir sagen das hier, statt „RTX 4090“ auf die Seite zu drucken und Sie es selbst herausfinden zu lassen, wie es die meisten Angebote tun.

Across the 57 cards in the catalogue: RTX 4090D holds 24 GB, 13 cards we fit hold more, and 11 cost more per month. Read the whole ladder on the whole catalogue, priced.

Die Spezifikation, wie veröffentlicht

Ada Lovelace. Zahlen aus NVIDIAs eigener RTX-40-Serien-Dokumentation, zitiert im Quelltext dieser Seite.

RTX 4090D

Architecture

Ada Lovelace

Card memory

24 GB GDDR6X

CUDA cores

14,592

Memory bandwidth

1,008 GB/s

Board power

425 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

2 NVENC, 1 NVDEC, AV1

Error-correcting memory

No

Worin sie gut ist und worin nicht

Dies ist eine Consumer-Karte im Rack. Das ist ihr ganzer Vorteil und ihre ganze Einschränkung, und beides ist es wert, klar ausgesprochen zu werden.

Gut in: Rechenleistung pro Pfund

GeForce-Silizium ist der günstigste Weg, so viel Rechenleistung zu kaufen. Es steckt keine professionelle Treiberlizenz im Preis und keine Rechenzentrumsmarge, daher ist sie für Arbeiten, bei denen ein falsches Bit einen neuen Versuch statt einer Katastrophe bedeutet — Batch-Rendering, Gameserver, Hobby-Training, Inferenz, die Sie erneut ausführen können — nur sehr schwer zu schlagen.

Gut in: Video, anders als die Beschleuniger

Zwei Hardware-Encoder mit AV1 und ein Decoder. Eine 4090 D transcodiert den ganzen Tag. Die A100 und H100 weiter oben im Katalog können in Hardware keinen einzigen Frame encodieren — sie haben überhaupt keinen Encoder — daher ist diese Karte für alles mit Videoanteil nicht der Kompromiss, sondern die richtige Antwort.

Schlecht in: allem, was mehr als 24 GB benötigt

Vierundzwanzig Gigabyte sind die Wand, und sie kommt früher, als die Leute erwarten: Ein Modell mit dreizehn Milliarden Parametern passt bei Acht-Bit-Präzision, dasselbe Modell bei Sechzehn-Bit nicht, und ein Modell mit siebzig Milliarden passt bei keiner Präzision. Die Tabelle unten ist diesbezüglich exakt.

Schlecht in: Arbeit, die kein gekipptes Bit tolerieren kann

Kein fehlerkorrigierender Speicher und kein zertifizierter professioneller Treiber. Für einen mehrwöchigen Lauf ohne Checkpointing oder für eine Workload unter einer Lizenz, die eine professionelle Karte verlangt, ist die Antwort stattdessen eine Karte aus dem Workstation-Regal. Diese finden Sie im gesamten Katalog, mit Preisen.

Was sie ersetzt hat und was sie ersetzt

Aus unseren eigenen Regalen statt aus einer Hersteller-Roadmap. Alle drei sind heute bestellbar, im selben Chassis, daher lautet die Frage nicht, welche die neueste ist, sondern welche den Unterschied wert ist.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 309024 GB GDDR6X$239$309.93
RTX 4090D24 GB GDDR6X$299$372.47
RTX 509032 GB GDDR7$399$472.47

Die RTX 3090 hat dieselben 24 GB und ist der ältere, langsamere, günstigere Weg, sie zu bekommen — wenn Sie Kapazität kaufen und Geschwindigkeit nicht entscheidend ist, lesen Sie die Seite zur RTX-30-Serie, bevor Sie die Differenz ausgeben. Die RTX 5090 steigt auf 32 GB und ist eine PCIe-Gen-5-Karte auf Plattformen, die Gen 3 und Gen 4 sind; lesen Sie daher den Abschnitt unten, bevor Sie annehmen, dass neuer hier schneller ist.

In welche Maschine sie passt und welche Anbindung sie dort bekommt

Die 4090 D ist eine PCIe-Gen-4-Karte. Zwei unserer drei Plattformen, die sie aufnehmen, sind Gen 3, und eine ist Gen 4.

Intel Xeon E5-2600 v3/v4

RTX 4090D

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 4090D

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 4090D

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

Das ist der Sachverhalt hinter Support-Ticket #3347, bei dem ein Kunde auf einer älteren Plattform auf eine neuere Karte wechselte und langsamer renderte als zuvor. Sobald die Szene oder die Gewichte auf der Karte resident sind, ist der Slot im Leerlauf, und seine Generation spielt keine Rolle mehr. Sie spielt eine Rolle, wenn die Arbeit bei jedem Schritt über den Slot läuft.

Was tatsächlich in 24 GB passt

Weights only, rounded up. Fits means the card’s 24 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — tight
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

Die andere Obergrenze ist die Leistung: Diese Karte zieht allein bis zu 425 W, und genau das macht mehr als eine davon in einem Chassis zu einem Build, den wir individuell anbieten, statt zu einem Kästchen, das Sie ankreuzen.

Diese Tabelle beantwortet „Was passt in diese Karte“. Die umgekehrte Frage — wie viel Speicher ein Modell benötigt und welche Karte das schafft — hat eine eigene Seite.

Was sie kostet, mit der Maschine, in die sie passt

Die Karte ist eine Zeile auf der Rechnung und die Maschine eine andere. Beide Hälften unten stammen aus einer einzigen Abfrage des Bestellkatalogs, daher gehören der Preis und die danebenstehende Spezifikation immer zusammen.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 4090DIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$372.47
Configure this build →
RTX 4090DIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$382.67
Configure this build →
RTX 4090DAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$299$516.59
Configure this build →

Die Bandbreite ist in beide Richtungen ungedrosselt ohne Egress-Gebühr, eine IPv4-Adresse ist enthalten, es gibt keinen Vertrag und ein Monat ist die Standardlaufzeit. Für jede andere Karte, die wir verbauen, auf dieselbe Weise bepreist, lesen Sie den gesamten Katalog, mit Preisen. Für Maschinen, die heute gerackt und bereit sind, /instant.

Fragen, die Leute zu dieser Karte tatsächlich stellen

Bekomme ich eine volle RTX 4090, wenn ich danach frage?

Nicht über diese Seite. Was wir verbauen, ist die 4090 D, und die Seite sagt das, statt „RTX 4090“ zu drucken und zu hoffen. Wenn Ihre Arbeit wirklich die zusätzlichen elf Prozent Shader benötigt, sagen Sie uns, worum es sich handelt, und wir werden Ihnen mitteilen, ob wir das Bauteil beschaffen können und wie die Lieferzeit wäre, statt die D zu versenden und sie eine 4090 zu nennen.

Beeinflusst die D CUDA, Treiber oder Softwarekompatibilität?

Nein. Sie meldet sich als Ada-Lovelace-GeForce-Karte, verwendet den normalen GeForce-Treiber, und jede CUDA-Version, jeder Framework-Build und jeder Renderer, der auf einer 4090 läuft, läuft auch auf ihr. Der Unterschied ist eine Shader-Anzahl, keine Architektur.

Wird die Karte mit jemand anderem geteilt?

Nein. Ein Mandant pro physischer Maschine, und die Karte wird direkt an Ihr eigenes Betriebssystem durchgereicht — kein Hypervisor, keine Partition, kein Time-Slicing. Sie installieren und pinnen Ihren eigenen Treiber und Ihre eigene CUDA-Version, und nichts wird unter Ihnen aktualisiert.

4090 D oder RTX 3090, wenn mir nur die 24 GB wichtig sind?

Dann ist die 3090 sehr wahrscheinlich der bessere Kauf, und die Leiter oben zeigt den Abstand. Die 4090 D ist deutlich schneller und hat AV1-Encoding, das die 3090 nicht hat; die 3090 hat dieselbe Kapazität für jeden Monat weniger Geld. Wenn das Modell so oder so passt und die Läufe nicht nahtlos aufeinander folgen, gewinnt die ältere Karte bei der Rechenleistung.

Wie schnell kann ich eine haben?

Das hängt davon ab, ob die Karte bereits verbaut ist, bereits in unserem Regal liegt oder erst beschafft werden muss — und das erfahren Sie, bevor Sie bezahlen. /instant listet Maschinen, die jetzt gerackt und bereit sind.