GeForce RTX 4090 D · 24 GB GDDR6X

RTX 4090D — i dlaczego nie jest to RTX 4090

Karta, którą montujemy, to 4090 D, zgodna z normami eksportowymi wersja NVIDIA stworzona na rynek chiński. To nie jest rebranding ani podróbka: to oryginalna karta AD102 z mniejszą liczbą shaderów i taką samą pamięcią 24 GB. Jeśli trafiłeś tutaj w poszukiwaniu serwera 4090, ta strona pomoże Ci poznać różnicę, zanim za niego zapłacisz.

24 GB pamięci GDDR6X Dwa enkodery, AV1 Brak ECC

Co oznacza D

W grudniu 2023 roku Departament Handlu Stanów Zjednoczonych ustalił próg eksportowy, który przekroczyła karta RTX 4090. NVIDIA ograniczyła wersję, aby spełnić wymagania, i sprzedawała ją w Chinach: RTX 4090 D. Karta trafiła na rynek 28 grudnia 2023 roku i ma 14 592 rdzenie CUDA w porównaniu z 16 384 rdzeniami standardowej karty — o około jedenaście procent mniej shaderów.

Cała reszta to ta sama karta. Dwadzieścia cztery gigabajty pamięci GDDR6X na 384-bitowej magistrali, ta sama przepustowość pamięci 1008 GB/s, to samo taktowanie w trybie boost 2,52 GHz, te same rdzenie ray tracingu trzeciej generacji i rdzenie tensorowe czwartej generacji, te same dwa enkodery AV1. Nic, co zależy od pojemności lub szybkości pamięci, nie ulega zmianie, co pokrywa większość zadań, jakie musi spełniać wypożyczona karta: modele mieszczące się w 24 GB nadal się mieszczą, a przesyłane strumieniowo klatki nadal się przesyłają.

Kosztuje Cię to jednak surową arytmetyczną przepustowość, która nasyca shadery — długie renderowanie, wsadowe szkolenie. Zabudżetuj mniej więcej o jedną dziesiątą mniej niż pełne 4090, a nie będziesz zaskoczony. Piszemy o tym tutaj, zamiast wyświetlać „RTX 4090” na stronie i pozwolić Ci się przekonać, jak to robi większość ofert.

Across the 56 cards in the catalogue: RTX 4090D holds 24 GB, 13 cards we fit hold more, and 11 cost more per month. Read the whole ladder on the whole catalogue, priced.

Specyfikacja w formie opublikowanej

Ada Lovelace. Dane pochodzą z dokumentacji kart graficznych serii RTX 40 firmy NVIDIA, podanej w źródle tej strony.

RTX 4090D

Architecture

Ada Lovelace

Card memory

24 GB GDDR6X

CUDA cores

14,592

Memory bandwidth

1,008 GB/s

Board power

425 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

2 NVENC, 1 NVDEC, AV1

Error-correcting memory

No

W czym jest dobry, a w czym nie

To karta konsumencka w stojaku. To jej cała zaleta i zarazem cała wada, i obie warto powiedzieć wprost.

Dobry w: arytmetyce na funt

Karta graficzna GeForce to najtańszy sposób na zakup takiej mocy obliczeniowej. Cena nie obejmuje licencji kierowcy zawodowego ani marży centrum danych, więc w zastosowaniach, gdzie błąd w elemencie oznacza konieczność ponownej próby, a nie katastrofę – takich jak renderowanie wsadowe, serwery gier, szkolenia hobbystyczne, wnioskowanie, które można ponownie uruchomić – jest ona bardzo trudna do pobicia.

Dobry w: wideo, w przeciwieństwie do akceleratorów

Dwa enkodery sprzętowe z AV1 i dekoderem. Karta 4090 D będzie transkodować cały dzień. Karty A100 i H100, znajdujące się wyżej w katalogu, nie potrafią zakodować ani jednej klatki sprzętowo – nie mają w ogóle enkodera – więc w przypadku wszystkiego, co zawiera wideo, ta karta nie jest kompromisem, lecz właściwym rozwiązaniem.

Słaby w: czymkolwiek, co wymaga więcej niż 24 GB

Dwadzieścia cztery gigabajty to granica, która nadchodzi szybciej, niż się spodziewają: model trzynastomiliardowy z ośmiobitową precyzją pasuje, ten sam model szesnastobitowy nie, a model siedemdziesięciomiliardowy nie pasuje z żadną precyzją. Poniższa tabela dokładnie to wyjaśnia.

Słaby w: pracy, w której nie można tolerować odwróconego bitu

Brak pamięci z korekcją błędów i brak certyfikowanego kierowcy zawodowego. W przypadku wielotygodniowej pracy bez punktów kontrolnych lub obciążenia pracą na licencji wymagającej karty zawodowej, rozwiązaniem jest karta z półki na stacji roboczej. Są one dostępne w całym katalogu, w cenie

Co zastąpiło i co je zastępuje

Z naszych własnych półek, a nie z planu rozwoju dostawcy. Wszystkie trzy można zamówić już dziś, w tej samej obudowie, więc pytanie nie brzmi, który jest najnowszy, ale który jest wart swojej ceny.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 309024 GB GDDR6X$239$309.93
RTX 4090D24 GB GDDR6X$299$372.47
RTX 509032 GB GDDR7$399$472.47

Karta RTX 3090 ma te same 24 GB i jest starszą, wolniejszą i tańszą opcją – jeśli zależy Ci na pojemności, a nie na szybkości, przeczytaj stronę o serii RTX 30 , zanim wydasz różnicę. Karta RTX 5090 ma do 32 GB i jest kartą PCIe Gen 5 na platformach Gen 3 i Gen 4, więc przeczytaj poniższą sekcję, zanim założysz, że nowsza karta jest szybsza.

Do której maszyny trafi i jakim łączem tam dotrze

Karta 4090 D jest kartą PCIe Gen 4. Dwie z trzech naszych platform, które ją obsługują, to Gen 3, a jedna to Gen 4.

Intel Xeon E5-2600 v3/v4

RTX 4090D

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 4090D

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 4090D

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

To właśnie leży u podstaw zgłoszenia pomocy technicznej nr 3347, w którym klient przeniósł się na nowszą kartę na starszej platformie, co spowodowało wolniejsze renderowanie. Gdy scena lub obciążenia są już na karcie, slot jest nieaktywny, a jego generowanie przestaje mieć znaczenie. Ma znaczenie, gdy praca przekracza slot na każdym kroku.

Co tak naprawdę mieści się w 24 GB

Weights only, rounded up. A row counts as fitting when it leaves a fifth of the card’s 24 GB free for the KV cache, the activations and the runtime — which is head-room, not luxury.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — fits
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

Drugim limitem jest moc: karta ta pobiera do 425 W, co sprawia, że ​​obudowa, w której jest ich więcej, jest przez nas wyceniana, a nie czymś, co trzeba zaznaczyć.

Ile to kosztuje, z maszyną wchodzi w to

Karta to jedna linia na fakturze, a maszyna to druga. Obie połówki poniżej pochodzą z jednego odczytu katalogu zamówień, więc cena i specyfikacja obok zawsze są ze sobą powiązane.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 4090DIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$372.47
Configure this build →
RTX 4090DIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$382.67
Configure this build →
RTX 4090DAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$299$516.59
Configure this build →

Przepustowość jest nielimitowana w obu kierunkach, bez opłat za wyjście, w cenie jest jeden adres IPv4, nie ma umowy, a domyślny okres wynosi jeden miesiąc. Za każdą inną kartę, którą montujemy, obowiązuje ta sama cena, zapoznaj się z całym katalogiem, ceny . Dla maszyn gotowych do użycia już dziś, /instant .

Pytania, które ludzie faktycznie zadają na temat tej karty

Czy dostanę pełną kartę RTX 4090, jeśli poproszę?

Nie z tej strony. Montujemy 4090 D, a strona o tym informuje, zamiast pisać „RTX 4090” i mieć nadzieję. Jeśli Twoja praca naprawdę wymaga dodatkowych jedenastu procent shaderów, powiedz nam, czego to wymaga, a my powiemy, czy możemy znaleźć tę część i jaki byłby czas realizacji, zamiast wysyłać D i nazywać go 4090.

Czy litera D ma wpływ na CUDA, sterowniki lub zgodność oprogramowania?

Nie. Zgłasza się jako karta Ada Lovelace GeForce, korzysta ze zwykłego sterownika GeForce i działa na niej każda wersja CUDA, kompilacja frameworka i renderer działający na procesorze 4090. Różnica polega na liczbie shaderów, a nie architekturze.

Czy karta jest udostępniana komuś innemu?

Nie. Jeden użytkownik na maszynę fizyczną, a karta jest przekazywana bezpośrednio do Twojego systemu operacyjnego — bez hiperwizora, partycji i ograniczeń czasowych. Instalujesz i przypinasz własne sterowniki i wersję CUDA, a nic nie aktualizuje się automatycznie.

4090 D czy RTX 3090, jeśli zależy mi tylko na 24 GB?

W takim razie karta 3090 jest prawdopodobnie lepszym zakupem, a powyższy diagram pokazuje różnicę. Karta 4090 D jest znacznie szybsza i ma kodowanie AV1, którego 3090 nie ma; karta 3090 ma tę samą pojemność za mniejsze pieniądze miesięcznie. Jeśli model spełnia oba kryteria i przebiegi nie następują jeden po drugim, starsza karta wygrywa arytmetycznie.

Jak szybko mogę go otrzymać?

Zależy to od tego, czy karta jest już zamontowana, czy znajduje się na naszej półce, czy trzeba ją kupić — o czym dowiesz się przed dokonaniem płatności. /instant wyświetla listę maszyn ustawionych w stojakach i gotowych do użycia od zaraz.