RTX PRO 6000 Blackwell · 96 GB GDDR7 con ECC

RTX PRO 6000 en un servidor que alquilas por mes

Noventa y seis gigabytes de GDDR7 con corrección de errores en una sola tarjeta de expansión, dentro de una máquina física completa sin nadie más. Ninguna tarjeta que instalamos tiene más — ni siquiera los aceleradores. Lo que cedes para obtener esa capacidad es velocidad de lectura de memoria y NVLink, y esta página lo dice antes que cualquier otra cosa.

96 GB, ECC Cuatro codificadores, AV1 Pasada directamente, no troceada

Convierte tus GPUs en ingresos mensuales pasivos

¿Tienes configuraciones de GPU de servidor o de escritorio sin usar? Anúncialas hoy en el marketplace de Primcast y obtén rentas mensuales estables de equipos de IA, desarrolladores y empresas que necesitan cómputo de grado de producción.

Ir al Marketplace

La tarjeta más grande de aquí, y dónde queda en la factura

Across the 57 cards in the catalogue: RTX PRO 6000 Blackwell 96GB holds 96 GB, no card we fit holds more, and one costs more per month. Read the whole ladder on the whole catalogue, priced.

Una H100 es un acelerador: existe para alojar un modelo y hacer aritmética con él, y NVIDIA le pone precio en consecuencia. La RTX PRO 6000 es una tarjeta de estación de trabajo a la que, por casualidad, le han dado más memoria que al acelerador. Si toda tu pregunta es ¿cabe?, lee la columna de memoria y la columna de dinero de la tabla de abajo una contra la otra — en este estante no van en la misma dirección, y esa es la razón de que esta página exista.

Dónde queda frente a las otras tarjetas de gran memoria que instalamos

Cheapest complete machine first. Every figure read from the order catalogue when this page was served.
CardCard memoryThe cardCheapest complete machine
A4048 GB GDDR6$499$572.47
RTX 6000 ADA48 GB GDDR6 ECC$625$698.47
A100 80GB80 GB HBM2e$899$972.47
RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECC$1,299$1,382.67
H100 80GB80 GB HBM2e$1,599$1,682.67

Cada cifra de arriba se lee del catálogo de pedidos con el que factura el checkout, en el momento en que se sirvió esta página. Nada de esta página está escrito a mano.

La especificación, tal como la publica NVIDIA

Blackwell, núcleos Tensor de quinta generación, núcleos RT de cuarta generación. Cifras de la propia página de producto de NVIDIA para la Workstation Edition, citadas en el código fuente de esta página.

RTX PRO 6000 Blackwell 96GB

Architecture

Blackwell

Card memory

96 GB GDDR7 ECC

CUDA cores

24,064

Memory bandwidth

1,792 GB/s

Board power

600 W

Card interface

PCIe Gen 5 x16

Hardware video encoders

4 NVENC, 4 NVDEC, AV1

Error-correcting memory

Yes

Para qué es buena, y para qué no

La versión honesta. Una tarjeta tan cara es la tarjeta equivocada más a menudo de lo que es la correcta, y los cuatro párrafos de abajo son los que lo deciden.

Buena para: sostener algo grande, entero

Noventa y seis gigabytes bastan para un modelo de setenta mil millones de parámetros en precisión de ocho bits con margen de sobra para la ventana de contexto, y bastan para un modelo de treinta mil millones en dieciséis bits completos. Una tarjeta, un espacio de direcciones, sin fragmentación y sin una segunda máquina que mantener sincronizada.

Buena para: trabajo que es gráficos Y aritmética

Cuatro codificadores y cuatro decodificadores por hardware con AV1, más núcleos de trazado de rayos de cuarta generación. Renderiza, transcodifica e infiere en la misma placa. Los aceleradores de este estante no hacen nada de las dos primeras — no tienen codificador de vídeo en absoluto.

Mala para: trabajo limitado por memoria a escala

GDDR7 es rápida, pero no es memoria apilada. La A100 y la H100 leen sus pesos más rápido por segundo que esta tarjeta, y para la generación de tokens en lotes grandes esa velocidad de lectura es el techo, no la aritmética. Si tu cuello de botella es el ancho de banda y no la capacidad, el acelerador más pequeño gana.

Mala para: agruparse con una segunda tarjeta

No hay NVLink en esta pieza. Dos de ellas en una máquina son dos grupos separados de 96 GB que hablan por la ranura, no un grupo de 192 GB. Cuando de verdad necesitas más de 96 GB en un solo espacio de direcciones, esta no es la tarjeta que te lleva hasta ahí.

En qué máquina va, y qué enlace recibe allí

Esta tarjeta es una pieza PCIe Gen 5 y toda plataforma que ejecutamos es Gen 3 o Gen 4, así que nunca recibe el bus completo para el que fue diseñada. Eso importa para algunos trabajos y para otros no importa en absoluto, y la diferencia vale más que el silencio.

Intel Xeon Silver / Gold

RTX PRO 6000 Blackwell 96GB

Slot: PCIe 3.0, 48 lanes per socket. Card: PCIe Gen 5.

A quarter or less of the bus the card was designed for. Worth avoiding when the work crosses the slot every step, and irrelevant once the weights are resident.

AMD EPYC

RTX PRO 6000 Blackwell 96GB

Slot: PCIe 4.0, 128 lanes per socket. Card: PCIe Gen 5.

About half the bus the card was designed for. That costs a training loop streaming batches off the host; it costs an inference server or a transcoder nothing, because the weights are already on the card.

Una vez que los pesos residen en la tarjeta, la ranura queda ociosa y la generación deja de importar — lo cual es la mayoría de la inferencia, la mayoría del renderizado y toda la transcodificación. Importa para un bucle de entrenamiento que transmite un lote nuevo por la ranura en cada paso. Pregunta si no estás seguro de cuál de los dos eres; la respuesta decide la máquina, no la tarjeta.

Qué cabe realmente en 96 GB

Weights only, rounded up. Fits means the card’s 96 GB holds the weights 1.5× over — room for the KV cache, the activations and the runtime, and the only verdict the LLM sizing page recommends a card on. Tight clears 1.25× only: the model loads, and a long context or a second user runs the card out.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB — fits8 GB — fits5 GB — fits
13-14 billion parameters28 GB — fits14 GB — fits8 GB — fits
30-34 billion parameters68 GB — tight34 GB — fits19 GB — fits
70 billion parameters140 GB — does not fit70 GB — tight38 GB — fits

La potencia de la placa es el otro techo y es real: la Workstation Edition de esta tarjeta consume hasta 600 W por sí sola, y la edición Max-Q es el mismo silicio y los mismos 96 GB a 300 W. Cuál de las dos admite un chasis dado depende del chasis, así que pregunta antes de pedir y no después.

Esa tabla responde “qué cabe en esta tarjeta”. La pregunta al revés — cuánta memoria necesita un modelo, y qué tarjeta la cubre — es una página propia.

Cuánto cuesta, con la máquina en la que va

La tarjeta es una línea separada en la factura y la máquina es otra. Las dos mitades de abajo provienen de una sola lectura del catálogo de pedidos, de modo que el precio y la especificación que lo acompaña siempre se corresponden.

Read from the order catalogue when this page was served. The card is a separate line; the machine does not get dearer because of what is plugged into it.
CardThe machine it goes inThe cardComplete, per month
RTX PRO 6000 Blackwell 96GBIntel Xeon Silver / Gold
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · PCIe 3.0
$1,299$1,382.67
Configure this build →
RTX PRO 6000 Blackwell 96GBAMD EPYC
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps · PCIe 4.0
$1,299$1,516.59
Configure this build →

El ancho de banda no está medido en ninguna de las dos direcciones y no hay cargo por salida, se incluye una dirección IPv4, no hay contrato y un mes es el plazo por defecto. Para todas las demás tarjetas que instalamos, y las mismas cifras para todas ellas, lee el catálogo completo, con precios. Para máquinas ya montadas en rack y listas hoy en lugar de hechas por encargo, /instant.

Preguntas que la gente hace de verdad sobre esta tarjeta

¿Es la misma tarjeta que la RTX 6000 Ada?

No, y los nombres invitan al error. La RTX 6000 Ada Generation es el buque insignia profesional anterior: 48 GB de GDDR6 con ECC sobre la arquitectura Ada Lovelace. La RTX PRO 6000 Blackwell tiene 96 GB de GDDR7 con ECC, el doble de memoria, en silicio más nuevo. Instalamos ambas, y aparecen una al lado de la otra en la escalera de arriba para que el paso entre ellas sea una cifra y no una afirmación.

96 GB frente a los 80 GB de la H100 — entonces, ¿para qué sirve la H100?

Estás pagando por cosas distintas. El dinero de la H100 está en la memoria apilada y en la velocidad de lectura que la acompaña, más NVLink para agrupar varias tarjetas en un solo espacio de direcciones. El dinero de la RTX PRO 6000 está en la capacidad, el trazado de rayos y cuatro codificadores de vídeo. Si la pregunta es ¿cabe el modelo?, esta tarjeta la responde con más margen de sobra. Si la pregunta es ¿cuántos tokens por segundo con un tamaño de lote grande?, el acelerador la responde mejor y la escalera de arriba muestra cuánto cuesta eso.

¿La tarjeta se comparte con alguien más?

No. Un inquilino por máquina física, y la tarjeta se pasa directamente a tu propio sistema operativo — sin hipervisor, sin partición MIG, sin perfil vGPU, sin división de tiempo. Instalas y fijas tu propio controlador y tu versión de CUDA, y nada se actualiza debajo de ti. Lo que mides la primera tarde es lo que conservas.

¿Puedo tener dos de ellas en una máquina?

Es una configuración que cotizamos, no una casilla que marcas, porque la respuesta depende del chasis, del ancho físico de la tarjeta y del presupuesto de potencia — y con hasta 600 W cada una, el presupuesto de potencia suele ser lo que lo decide. Pregunta, y la respuesta indica el chasis, la cantidad y el plazo de entrega. Ten en cuenta que dos tarjetas son aquí dos grupos de memoria separados: esta pieza no tiene NVLink.

¿Cuándo puedo tener una?

Depende de si la tarjeta ya está instalada, ya está en nuestro estante o hay que comprarla — y se te dice cuál es antes de pagar, no después. /instant lista máquinas montadas en rack y listas ahora mismo. Cualquier otra cosa se cotiza con su plazo de entrega real.