GeForce RTX 4090 D · 24 GB GDDR6X

RTX 4090D — i dlaczego to nie jest RTX 4090

Karta, którą montujemy, to 4090 D, wersja zgodna z ograniczeniami eksportowymi, którą NVIDIA zbudowała na rynek chiński. To nie jest przebrandowanie ani podróbka: to prawdziwa karta AD102 z mniejszą liczbą jednostek cieniujących i tymi samymi 24 GB pamięci. Jeśli trafiłeś tu, szukając serwera z 4090, ta strona istnieje po to, by pokazać Ci różnicę, zanim za nią zapłacisz.

24 GB GDDR6X Dwa enkodery, AV1 Bez ECC

Zamień swoje GPU w pasywny miesięczny przychód

Masz nieużywane konfiguracje GPU w serwerze lub desktopie? Wystaw je już dziś na marketplace Primcast i zarabiaj stały miesięczny czynsz od zespołów AI, deweloperów i firm potrzebujących mocy obliczeniowej klasy produkcyjnej.

Przejdź do Marketplace

Co oznacza litera D

W grudniu 2023 roku Departament Handlu Stanów Zjednoczonych ustalił próg eksportowy, który RTX 4090 przekraczał. NVIDIA przygotowała okrojoną wersję, aby go nie przekraczać, i sprzedawała ją w Chinach: RTX 4090 D. Zadebiutowała 28 grudnia 2023 roku i ma 14 592 rdzenie CUDA wobec 16 384 w pełnej karcie — czyli około jedenastu procent mniej jednostek cieniujących.

Cała reszta to ta sama karta. Dwadzieścia cztery gigabajty GDDR6X na magistrali 384-bitowej, ta sama przepustowość pamięci 1 008 GB/s, ten sam zegar boost 2,52 GHz, te same rdzenie ray tracingu trzeciej generacji i rdzenie tensorowe czwartej generacji, te same dwa enkodery AV1. Nic, co zależy od pojemności lub szybkości pamięci, w ogóle się nie zmienia, a to obejmuje większość zadań, do których wynajmowana karta jest wykorzystywana: modele mieszczące się w 24 GB nadal się mieszczą, a klatki, które są streamowane, nadal są streamowane.

Tam, gdzie tracisz, to surowa przepustowość arytmetyczna przy pracy obciążającej jednostki cieniujące — długi render, wsadowe uczenie. Załóż budżet o około jedną dziesiątą mniejszy niż przy pełnym 4090 i nie będziesz zaskoczony. Mówimy to wprost, zamiast wypisywać na stronie „RTX 4090” i pozwolić Ci się o tym przekonać, co robi większość ogłoszeń.

Across the 57 cards in the catalogue: RTX 4090D holds 24 GB, 13 cards we fit hold more, and 11 cost more per month. Read the whole ladder on the whole catalogue, priced.

Specyfikacja, zgodnie z publikacją

Ada Lovelace. Dane z dokumentacji serii RTX 40 firmy NVIDIA, cytowane w źródle tej strony.

RTX 4090D

Architecture

Ada Lovelace

Card memory

24 GB GDDR6X

CUDA cores

14,592

Memory bandwidth

1,008 GB/s

Board power

425 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

2 NVENC, 1 NVDEC, AV1

Error-correcting memory

No

W czym jest dobra, a w czym nie

To karta konsumencka w szafie rack. To cała jej zaleta i całe ograniczenie, a o obu warto powiedzieć wprost.

Dobra w: arytmetyce za funta

Układy GeForce to najtańszy sposób na zakup takiej mocy obliczeniowej. W cenie nie ma licencji na sterownik profesjonalny ani marży datacenter, więc przy pracy, w której błędny bit oznacza ponowienie, a nie katastrofę — renderowanie wsadowe, serwery gier, uczenie hobbystyczne, inferencja, którą można uruchomić ponownie — bardzo trudno ją przebić.

Dobra w: wideo, w przeciwieństwie do akceleratorów

Dwa sprzętowe enkodery z AV1 i dekoder. 4090 D będzie transkodować cały dzień. A100 i H100 z wyższej półki katalogu nie potrafią sprzętowo zakodować ani jednej klatki — w ogóle nie mają enkodera — więc do wszystkiego, co zawiera wideo, ta karta nie jest kompromisem, lecz właściwą odpowiedzią.

Słaba w: wszystkim, co potrzebuje więcej niż 24 GB

Dwadzieścia cztery gigabajty to ściana, która pojawia się szybciej, niż ludzie się spodziewają: model o trzynastu miliardach parametrów w precyzji ośmiobitowej się mieści, ten sam model w szesnastobitowej już nie, a model o siedemdziesięciu miliardach nie mieści się w żadnej precyzji. Tabela poniżej podaje to dokładnie.

Słaba w: pracy, która nie toleruje przekłamanego bitu

Brak pamięci z korekcją błędów i brak certyfikowanego sterownika profesjonalnego. Przy wielotygodniowym zadaniu bez checkpointów lub obciążeniu objętym licencją wymagającą karty profesjonalnej odpowiedzią jest karta z półki stacji roboczych. Znajdziesz je w całym katalogu, z cenami.

Co zastąpiła i co zastępuje ją

Z naszych własnych półek, a nie z roadmapy producenta. Wszystkie trzy można zamówić już dziś, w tej samej obudowie, więc pytanie nie brzmi, która jest najnowsza, lecz która jest warta różnicy w cenie.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 309024 GB GDDR6X$239$309.93
RTX 4090D24 GB GDDR6X$299$372.47
RTX 509032 GB GDDR7$399$472.47

RTX 3090 ma te same 24 GB i jest starszym, wolniejszym, tańszym sposobem na ich zdobycie — jeśli kupujesz pojemność, a nie szybkość, przeczytaj stronę serii RTX 30, zanim wydasz różnicę. RTX 5090 robi krok w górę do 32 GB i jest kartą PCIe Gen 5 na platformach Gen 3 i Gen 4, więc przeczytaj sekcję poniżej, zanim założysz, że nowsza znaczy tu szybsza.

Do jakiej maszyny trafia i jakie łącze tam dostaje

4090 D to karta PCIe Gen 4. Dwie z naszych trzech platform, które ją przyjmują, to Gen 3, a jedna to Gen 4.

Intel Xeon E5-2600 v3/v4

RTX 4090D

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 4090D

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 4090D

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

To jest fakt stojący za zgłoszeniem #3347, w którym klient przeszedł na nowszą kartę na starszej platformie i renderował wolniej niż wcześniej. Gdy scena lub wagi są już załadowane na kartę, slot jest bezczynny i jego generacja przestaje mieć znaczenie. Ma znaczenie, gdy praca przechodzi przez slot przy każdym kroku.

Co naprawdę mieści się w 24 GB

Weights only, rounded up. Fits means the card’s 24 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — tight
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

Drugim sufitem jest zasilanie: ta karta pobiera sama do 425 W, przez co więcej niż jedna w obudowie to konfiguracja, którą wyceniamy, a nie pole, które po prostu zaznaczasz.

Ta tabela odpowiada na pytanie „co mieści się w tej karcie”. Pytanie postawione odwrotnie — ile pamięci potrzebuje model i która karta je zapewnia — ma własną stronę.

Ile to kosztuje, razem z maszyną, do której trafia

Karta to jedna pozycja na fakturze, a maszyna druga. Obie poniższe części pochodzą z jednego odczytu katalogu zamówień, więc cena i specyfikacja obok niej zawsze do siebie pasują.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 4090DIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$372.47
Configure this build →
RTX 4090DIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$382.67
Configure this build →
RTX 4090DAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$299$516.59
Configure this build →

Transfer jest nielimitowany w obu kierunkach bez opłat za ruch wychodzący, jeden adres IPv4 jest w cenie, nie ma umowy, a domyślny okres to jeden miesiąc. O każdej innej montowanej przez nas karcie, wycenionej w ten sam sposób, przeczytasz w całym katalogu, z cenami. Maszyny już w szafie i gotowe od ręki znajdziesz na /instant.

Pytania, które ludzie naprawdę zadają o tę kartę

Czy dostanę pełnego RTX 4090, jeśli poproszę?

Nie z tej strony. Montujemy 4090 D i strona mówi to wprost, zamiast wypisywać „RTX 4090” i liczyć na cud. Jeśli Twoja praca naprawdę potrzebuje dodatkowych jedenastu procent jednostek cieniujących, powiedz nam, na czym polega, a odpowiemy, czy możemy zdobyć taki komponent i jaki byłby czas oczekiwania, zamiast wysyłać D i nazywać go 4090.

Czy D wpływa na CUDA, sterowniki lub kompatybilność oprogramowania?

Nie. Zgłasza się jako karta GeForce Ada Lovelace, przyjmuje zwykły sterownik GeForce, a każde wydanie CUDA, build frameworka i renderer działające na 4090 działają na niej. Różnica to liczba jednostek cieniujących, nie architektura.

Czy karta jest z kimś współdzielona?

Nie. Jeden najemca na maszynę fizyczną, a karta jest przekazywana bezpośrednio do Twojego systemu operacyjnego — bez hipernadzorcy, bez partycji, bez dzielenia czasu. Instalujesz i przypinasz własny sterownik oraz wydanie CUDA, a nic nie aktualizuje się pod Tobą.

4090 D czy RTX 3090, jeśli zależy mi tylko na 24 GB?

Wtedy 3090 jest najprawdopodobniej lepszym zakupem, a powyższa drabinka pokazuje różnicę. 4090 D jest znacząco szybsza i ma kodowanie AV1, którego 3090 nie ma; 3090 ma tę samą pojemność za mniejsze pieniądze co miesiąc. Jeśli model mieści się w obu przypadkach, a zadania nie są wykonywane jedno po drugim, starsza karta wygrywa pod względem arytmetyki.

Jak szybko mogę ją mieć?

To zależy od tego, czy karta jest już zamontowana, czy jest na naszej półce, czy trzeba ją dokupić — a dowiesz się tego, zanim zapłacisz. /instant pokazuje maszyny w szafie gotowe od ręki.