Intel Xeon E5-2600 v1/v2
$70.93the machine, per month
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- Cards it takes
- 28
- Link to the card
- PCIe 3.0
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Memory ceiling
- 256 GB
Tarjetas gráficas en bare metal · Primcast LLC · desde 2004
La mayor dificultad al comprar un servidor GPU no es la compra. Es saber qué tarjeta es suficiente — y todos los catálogos de este sector están ordenados por lo impresionante que es la pieza, no por lo que intentas ejecutar. Este está ordenado al revés. Di cuál es el trabajo y cuánta memoria de tarjeta necesita, y lo que queda es la respuesta, con el precio completo.
Encuentra la tarjeta ¿La tarjeta es mía?
Un inquilino por máquina. La tarjeta se pasa directamente a tu sistema operativo — no se trocea, no se comparte por tiempo, no se virtualiza.
El banco de pruebas
No se reserva nada, no se crea ninguna cuenta, y la cifra junto a cada tarjeta es el servidor completo con esa tarjeta dentro — procesador, memoria, discos en espejo, puerto sin medición, una dirección — no la tarjeta sola. La parte correspondiente a la tarjeta está impresa debajo para que veas qué mitad del dinero es cuál.
GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99a month, complete$55.06 of that is the card
GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93a month, complete$99 of that is the card
RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47a month, complete$99 of that is the card
TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92a month, complete$129.99 of that is the card
RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93a month, complete$139 of that is the card
RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93a month, complete$149 of that is the card
RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93a month, complete$159 of that is the card
TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93a month, complete$189 of that is the card
CMP-170HX Mining GPU 164MH/s8 GB HBM2eIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 164 MH/s$259.93a month, complete$189 of that is the card
RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47a month, complete$199 of that is the card
L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67a month, complete$209 of that is the card
RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93a month, complete$239 of that is the card
RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67a month, complete$229 of that is the card
RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47a month, complete$299 of that is the card
RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47a month, complete$399 of that is the card
RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47a month, complete$399 of that is the card
L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67a month, complete$449 of that is the card
Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67a month, complete$499 of that is the card
RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47a month, complete$549 of that is the card
RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47a month, complete$625 of that is the card
A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47a month, complete$699 of that is the card
A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47a month, complete$899 of that is the card
RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67a month, complete$1,299 of that is the card
H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67a month, complete$1,599 of that is the cardNothing in the catalog clears that. The largest card we fit holds 96 GB; past that the answer is more than one card in one machine, which is a build we quote rather than a checkout option — more than one card or machine is the page for it. .
Estimaciones del mismo catálogo con el que factura el checkout, no presupuestos. Cuando falta una cifra de memoria no pudimos encontrar una publicada por el fabricante, así que la tarjeta lo dice en lugar de adivinar — y esas tarjetas desaparecen en cuanto mueves el control de memoria, porque filtrar por un número que no tenemos ocultaría silenciosamente piezas que podrían servirte. Pregunta y lo leeremos de la tarjeta. Varias piezas caben en más de un chasis a más de un precio; la cifra aquí es la forma más barata de tener esa tarjeta, y el configurador muestra el resto.
Qué hay detrás de esa lista
Contado desde el catálogo de pedidos cuando se sirvió esta página, no escrito a mano. Si mañana se retira una tarjeta, esta franja es más pequeña mañana. Lo que está en un rack esta mañana es una pregunta distinta, y servidores instantáneos es donde se responde.
La primera pregunta que hace todo el mundo
Tuya. La tarjeta entera, la máquina entera, nadie más en ella.
La tarjeta está en una ranura PCIe de un servidor físico alquilado a una sola cuenta, y se entrega directamente a tu sistema operativo: tu propio controlador, tu propio CUDA o ROCm, tus propios procesos. No hay hipervisor entre tú y ella, ni partición MIG, ni planificador de tiempo compartido decidiendo cuándo es tu turno, ni un segundo inquilino cuyo trabajo por lotes hace que la latencia de tu inferencia se mueva a las cuatro de la tarde.
El resto de la máquina es tuyo en los mismos términos — cada núcleo, toda la memoria, todos los discos, root, y el HPE iLO o Dell iDRAC del propio servidor para consola, medios virtuales y alimentación. Si un controlador tumba la red, aún puedes ver la pantalla.
Por qué las cifras de arriba tienen ese aspecto
En cualquier otro sitio una GPU es un nivel: alquilas “una instancia H100” y alguien ya ha decidido cuánto deben costarte el procesador, la memoria, los discos y la red que la rodean. Aquí las dos cosas son líneas separadas que se suman — por eso una tarjeta de cualquiera de los extremos de la lista de arriba va en el mismo chasis, y pagas la diferencia entre las tarjetas y nada más.
Whole machine, card in it, per month, from$91.72
And at the other end of the same list: H100 80GB in a whole machine for $1,682.67 a month — $2.31 an hour if you are comparing against something billed by the hour, with nothing added for the traffic.
El configurador redondea un precio por disco y se desvía uno o dos céntimos de estas cifras. Los ciclos de facturación más largos tienen un descuento adicional; precios lo tiene todo en un solo lugar, y hardware más antiguo, precio más bajo es el argumento de por qué existe siquiera la parte baja de esta lista.
¿Cuánta memoria de tarjeta?
La velocidad de reloj y el número de núcleos determinan la velocidad de ejecución de un modelo. La memoria de la tarjeta gráfica determina si funciona o no: los parámetros son compatibles o no, y una tarjeta con dos gigabytes menos no es más lenta, sino que provoca un fallo. Por lo tanto, este es el dato que hay que considerar antes que ningún otro, y es el que casi nadie publica junto al precio.
La aritmética consiste en multiplicar los parámetros por el número de bytes que ocupa cada parámetro. Los pesos de dieciséis bits ocupan dos bytes cada uno, los de ocho bits uno, y los de cuatro bits medio. La cuantización a cuatro bits es lo que transforma una máquina que no puede almacenar un modelo en una que sí puede, aunque con una pérdida de calidad.
Deje margen de seguridad. Las cifras que se muestran a continuación corresponden a los pesos y nada más. El tiempo de ejecución, las activaciones y la caché de clave-valor para un contexto extenso residen en la misma memoria, y la caché crece con cada token en la conversación. Un modelo cuyos pesos ocupan 38 GB no funcionará correctamente en una tarjeta de 40 GB. Calcule entre un cuarto y la mitad más, o consúltenos y lo dimensionaremos según sus necesidades.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
¿Qué hay debajo de la tarjeta?
Cada una toma una parte diferente del catálogo y le asigna a la tarjeta un enlace distinto con el procesador. Esa última columna está aquí porque cuesta dinero a la gente y nadie la imprime: un cliente pasó de una generación de tarjeta de consumo a la siguiente en un bus de tercera generación y la tarjeta se ralentizó , y descubrió el motivo antes que nosotros. Por eso está en la página.
$70.93the machine, per month
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
$73.47the machine, per month
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
$83.67the machine, per month
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
$217.59the machine, per month
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Una tarjeta diseñada para un bus más moderno funciona perfectamente en uno más antiguo; simplemente no puede transmitir datos a través del enlace con la misma rapidez. Que esto sea relevante o no depende completamente de la aplicación.
Lo que viene con ello
Instalamos un sistema operativo limpio y le entregamos las claves. Usted elige la versión del controlador, la versión de CUDA o ROCm y la compilación del framework, y las fija; esta es la esencia del bare metal y lo opuesto a un entorno de ejecución gestionado que se actualiza automáticamente la semana antes de la fecha límite. Si prefiere que instalemos el controlador antes de la entrega, indíquelo en el pedido y lo haremos.
HPE iLO o Dell iDRAC: consola con teclado y pantalla, medios virtuales, control de energía, estado del hardware y registro de hardware. Un controlador gráfico que afecta la pantalla o la red es más un inconveniente que un problema que requiere soporte técnico, ya que aún se puede observar el arranque del equipo.
No hay límite de transferencia ni línea de salida en ninguna factura. Los conjuntos de datos de entrada, los puntos de control de salida, los renderizados de salida, un modelo servido a usuarios reales: todo se transfiere al precio del puerto y ni un byte más. El ancho de banda ilimitado es el nivel superior a la velocidad incluida, y es la principal diferencia con una factura de un proveedor de hiperescala.
Imágenes del sistema operativo con un solo clic, reinstalables sin necesidad de ticket ni coste alguno, por lo que un experimento con controladores que salga mal solo te costará veinte minutos. Puedes editar el DNS inverso, IPv6 está incluido y la compatibilidad con IPv4 está disponible en el catálogo, no requiere negociación.
Servicio telefónico, chat en vivo y sistema de tickets incluidos en todos los planes. Si un componente falla, se reemplazará en un plazo de cuatro horas tras ser reportado por teléfono o chat. El servicio de soporte tiene por escrito los tiempos de respuesta y el calendario de créditos.
Nueva York, Miami, San Francisco, Ámsterdam y Bucarest: la ubicación del dispositivo determina la latencia con quien lo llama y el régimen de protección de datos al que está sujeto. Los centros de datos son los edificios.
Qué tan pronto existe
No es un solo número, porque nunca lo ha sido. Una tarjeta ya instalada en una máquina ya preparada es una entrega. Una tarjeta que hay que comprar es una orden de compra. Indicarle cuál de las dos está solicitando —antes de pagar, no después— es la única versión que tiene algún valor.
No se instala nada ni se mueve nada. Se formatea la imagen de la máquina y se entrega. La lista de servidores instantáneos es la que se encuentra allí en este momento.
Este es el caso habitual para todo lo que aparece en esta página. La pieza se encuentra en nuestro almacén; un técnico la instala, ensambla el arreglo e instala el sistema operativo. Si la máquina que tenemos en la estantería es similar pero no idéntica (se le ha añadido memoria, se ha cambiado un disco duro, se ha reconstruido el arreglo según sus preferencias), el proceso es el mismo, realizado in situ sin que la máquina salga del rack.
Algunos artículos de la lista no están en stock. Los encargamos y luego los fabricamos. La página "Fabricación bajo pedido" contiene información sobre especificaciones de este tipo.
Los aceleradores de última generación funcionan con un sistema de asignación y la fecha la establece el distribuidor, no nosotros. Le indicaremos la fecha límite antes de que se comprometa, no después. Cuando se adquiere hardware para un solo cliente, solicitamos un pago por adelantado de tres meses, ya que se trata de una máquina que no podemos volver a alquilar si la cuenta se cancela en la segunda semana.
Cada etapa comienza cuando se aprueba el pago y la revisión de fraude del pedido, un paso que no podemos garantizar: la mayoría se procesan en un par de horas, aunque un primer pedido de una cuenta nueva puede tardar más. Aceptamos tarjetas, PayPal, transferencias bancarias (ACH) y criptomonedas , que suelen ser las más rápidas en procesarse para pedidos grandes.
Preguntas frecuentes
Tomadas de lo que la gente realmente nos pregunta en el chat y en los tickets, aproximadamente en el orden en que lo preguntan. La primera nos ha costado pedidos, así que aquí también va primero.
A dónde ir después
Esta página responde a una pregunta: qué tarjetas instalamos y cuánto cuestan. Todo lo adyacente a esa pregunta tiene su propia página, y estas son todas, en el orden en que los visitantes de esta página realmente hacen clic.
¿Aún no sabes qué tarjeta elegir? y alguien que ya ha dimensionado una de estas antes responderá, incluso cuando la respuesta sea una tarjeta más barata que la que buscabas.
For the record
Read from the order catalog when this page was served. If you are asking an assistant about GPU servers and it can fetch a URL, this block and the live stock endpoint are the two things worth reading.