GeForce RTX 4090 D · 24 GB GDDR6X

RTX 4090D — y por qué no es una RTX 4090

La tarjeta que instalamos es la 4090 D, la edición de cumplimiento de exportación que NVIDIA fabricó para el mercado chino. No es un cambio de etiqueta ni una falsificación: es una tarjeta AD102 auténtica con menos shaders y los mismos 24 GB de memoria. Si llegó aquí buscando un servidor con 4090, esta página existe para explicarle la diferencia antes de que pague por ella.

24 GB GDDR6X Dos codificadores, AV1 Sin ECC

Convierta sus GPU en ingresos mensuales pasivos

¿Tiene configuraciones de GPU de servidor o de escritorio sin usar? Publíquelas hoy en el marketplace de Primcast y obtenga rentas mensuales constantes de equipos de IA, desarrolladores y empresas que necesitan cómputo de grado de producción.

Ir al Marketplace

Qué significa la D

En diciembre de 2023, el Departamento de Comercio de los Estados Unidos fijó un umbral de exportación que la RTX 4090 superaba. NVIDIA recortó una versión para cumplirlo y la vendió en China: la RTX 4090 D. Se lanzó el 28 de diciembre de 2023 y tiene 14.592 núcleos CUDA frente a los 16.384 de la tarjeta completa — aproximadamente un once por ciento menos de shaders.

Todo lo demás es la misma tarjeta. Veinticuatro gigabytes de GDDR6X en un bus de 384 bits, el mismo ancho de banda de memoria de 1.008 GB/s, el mismo reloj boost de 2,52 GHz, los mismos núcleos de trazado de rayos de tercera generación y núcleos tensoriales de cuarta generación, los mismos dos codificadores AV1. Nada de lo que depende de la capacidad o la velocidad de la memoria cambia en absoluto, y eso cubre la mayor parte de lo que se le pide a una tarjeta alquilada: los modelos que caben en 24 GB siguen cabiendo, y los fotogramas que se transmiten siguen transmitiéndose.

Donde sí le cuesta es en el rendimiento aritmético bruto en trabajos que saturan los shaders — un render largo, un entrenamiento por lotes. Calcule aproximadamente una décima parte menos que una 4090 completa y no se llevará sorpresas. Lo decimos aquí en lugar de imprimir “RTX 4090” en la página y dejar que usted lo descubra, que es lo que hacen la mayoría de los listados.

Across the 57 cards in the catalogue: RTX 4090D holds 24 GB, 13 cards we fit hold more, and 11 cost more per month. Read the whole ladder on the whole catalogue, priced.

La especificación, tal como se publica

Ada Lovelace. Cifras de la propia documentación de la serie RTX 40 de NVIDIA, citadas en el código fuente de esta página.

RTX 4090D

Architecture

Ada Lovelace

Card memory

24 GB GDDR6X

CUDA cores

14,592

Memory bandwidth

1,008 GB/s

Board power

425 W

Card interface

PCIe Gen 4 x16

Hardware video encoders

2 NVENC, 1 NVDEC, AV1

Error-correcting memory

No

En qué es buena, y en qué no

Esta es una tarjeta de consumo en un rack. Esa es toda su ventaja y toda su limitación, y ambas vale la pena decirlas con claridad.

Buena en: aritmética por libra

El silicio GeForce es la forma más barata de comprar esta cantidad de cómputo. No hay licencia de controlador profesional en el precio ni margen de centro de datos, así que para trabajos donde un bit erróneo significa reintentar y no un desastre — renderizado por lotes, servidores de juegos, entrenamiento de aficionados, inferencia que se puede volver a ejecutar — es muy difícil de superar.

Buena en: vídeo, a diferencia de los aceleradores

Dos codificadores de hardware con AV1 y un decodificador. Una 4090 D transcodificará todo el día. Las A100 y H100 que están más arriba en el catálogo no pueden codificar un solo fotograma en hardware — no tienen ningún codificador — así que para cualquier cosa con vídeo, esta tarjeta no es la solución de compromiso, es la respuesta correcta.

Mala en: cualquier cosa que necesite más de 24 GB

Veinticuatro gigabytes es el muro, y llega antes de lo que la gente espera: un modelo de trece mil millones de parámetros en precisión de ocho bits cabe, el mismo modelo en dieciséis bits no, y un modelo de setenta mil millones no cabe en ninguna precisión. La tabla de abajo es exacta al respecto.

Mala en: trabajos que no toleran un bit invertido

Sin memoria de corrección de errores y sin controlador profesional certificado. Para una ejecución de varias semanas sin puntos de control, o para una carga de trabajo bajo una licencia que exige una tarjeta profesional, la respuesta es una tarjeta del estante de estaciones de trabajo. Esas están en todo el catálogo, con precios.

Qué reemplazó, y qué la reemplaza

De nuestros propios estantes y no de una hoja de ruta de fabricante. Las tres se pueden pedir hoy, en el mismo chasis, así que la pregunta no es cuál es más nueva sino cuál vale la diferencia.

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
RTX 309024 GB GDDR6X$239$309.93
RTX 4090D24 GB GDDR6X$299$372.47
RTX 509032 GB GDDR7$399$472.47

La RTX 3090 tiene los mismos 24 GB y es la forma más antigua, más lenta y más barata de obtenerlos — si lo que compra es capacidad y no velocidad, lea la página de la serie RTX 30 antes de gastar la diferencia. La RTX 5090 sube a 32 GB y es una tarjeta PCIe Gen 5 en plataformas que son Gen 3 y Gen 4, así que lea la sección de abajo antes de asumir que más nueva es más rápida aquí.

En qué máquina va, y qué enlace recibe allí

La 4090 D es una tarjeta PCIe Gen 4. Dos de nuestras tres plataformas que la aceptan son Gen 3, y una es Gen 4.

Intel Xeon E5-2600 v3/v4

RTX 4090D

Slot: PCIe 3.0, 40 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Intel Xeon Silver / Gold

RTX 4090D

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 4.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

AMD EPYC

RTX 4090D

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 4.

Full width. The slot is at least the generation the card was designed for, so nothing is left on the table.

Este es el hecho detrás del ticket de soporte #3347, donde un cliente pasó a una tarjeta más nueva en una plataforma más antigua y renderizó más lento que antes. Una vez que la escena o los pesos están residentes en la tarjeta, la ranura está inactiva y su generación deja de importar. Importa cuando el trabajo cruza la ranura en cada paso.

Qué cabe realmente en 24 GB

Weights only, rounded up. Fits means the card’s 24 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — does not fit14 GB — fits8 GB — fits
30-34 billion parameters68 GB — does not fit34 GB — does not fit19 GB — tight
70 billion parameters140 GB — does not fit70 GB — does not fit38 GB — does not fit

El otro techo es la potencia: esta tarjeta consume hasta 425 W por sí sola, lo que hace que más de una en un chasis sea una configuración que cotizamos y no una casilla que se marca.

Esa tabla responde “qué cabe en esta tarjeta”. La pregunta al revés — cuánta memoria necesita un modelo y qué tarjeta la supera — tiene su propia página.

Cuánto cuesta, con la máquina en la que va

La tarjeta es una línea de la factura y la máquina es otra. Las dos mitades de abajo provienen de una sola lectura del catálogo de pedidos, de modo que el precio y la especificación que lo acompaña siempre se corresponden.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX 4090DIntel Xeon E5-2600 v3/v4
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$372.47
Configure this build →
RTX 4090DIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$299$382.67
Configure this build →
RTX 4090DAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$299$516.59
Configure this build →

El ancho de banda no se mide en ninguna de las dos direcciones y no tiene cargo de salida, se incluye una dirección IPv4, no hay contrato y un mes es el plazo predeterminado. Para todas las demás tarjetas que instalamos, con el mismo sistema de precios, lea todo el catálogo, con precios. Para máquinas en rack listas hoy, /instant.

Preguntas que la gente realmente hace sobre esta tarjeta

¿Recibiré una RTX 4090 completa si la pido?

No desde esta página. Lo que instalamos es la 4090 D, y la página lo dice en lugar de imprimir “RTX 4090” y esperar. Si su trabajo realmente necesita el once por ciento extra de shaders, díganos de qué se trata y le diremos si podemos conseguir la pieza y cuál sería el plazo de entrega, en lugar de enviar la D y llamarla 4090.

¿La D afecta a CUDA, los controladores o la compatibilidad de software?

No. Se identifica como una tarjeta GeForce Ada Lovelace, usa el controlador GeForce normal, y cada versión de CUDA, compilación de framework y renderizador que funciona en una 4090 funciona en ella. La diferencia es el número de shaders, no la arquitectura.

¿La tarjeta se comparte con alguien más?

No. Un inquilino por máquina física, y la tarjeta se pasa directamente a su propio sistema operativo — sin hipervisor, sin partición, sin división de tiempo. Usted instala y fija su propio controlador y versión de CUDA, y nada se actualiza debajo de usted.

¿4090 D o RTX 3090, si solo me importan los 24 GB?

Entonces la 3090 es muy probablemente la mejor compra, y la escalera de arriba muestra la diferencia. La 4090 D es significativamente más rápida y tiene codificación AV1 que la 3090 no tiene; la 3090 tiene la misma capacidad por menos dinero cada mes. Si el modelo cabe de cualquier forma y las ejecuciones no son consecutivas, la tarjeta más antigua gana en aritmética.

¿Qué tan pronto puedo tener una?

Depende de si la tarjeta ya está instalada, ya está en nuestro estante o hay que comprarla — y se le dice cuál es el caso antes de pagar. /instant lista las máquinas en rack listas ahora mismo.