NVIDIA CMP 170HX · desbloqueada cuando la instalamos

Servidores dedicados CMP desbloqueados.

NVIDIA construyó la CMP 170HX para minería y bloqueó todo lo demás: la tarjeta mostraba 8 GB de memoria y ejecutaba cálculos de coma flotante a paso de tortuga. El bloqueo resultó ser por software. Instalamos un controlador que lo elimina, de modo que su servidor llega con una tarjeta que tiene 64 GB de memoria muy rápida y ejecuta modelos de IA tal como su chip fue diseñado para hacerlo.

Misma tarjeta, mismo chip. La parte gris es lo que NVIDIA dejó activado; el resto es lo que el controlador enciende.

Para qué sirve ahora

Se vendió para minería. Desbloqueada, es una tarjeta de IA.

Un chatbot solo tuyo

Ejecuta un modelo abierto como Llama, Qwen o Mistral en un servidor que nadie más usa. Las instrucciones, los documentos y las respuestas se quedan en tu máquina en lugar de ir a la API de otro.

Modelos grandes en una sola tarjeta

Un modelo de 70 mil millones de parámetros cabe en una tarjeta desbloqueada a 4 bits. En una tarjeta que no ha sido desbloqueada, el límite es un modelo de unos 8 mil millones.

Espacio para conversaciones largas

Lo que el modelo no usa va a su contexto, así que los documentos largos y los chats extensos siguen adelante en lugar de quedarse sin espacio a mitad de camino.

Varios modelos a la vez

Un modelo de chat, un modelo de embeddings para búsqueda y un modelo pequeño que enruta las solicitudes pueden permanecer cargados juntos, en lugar de turnarse.

Trabajos que preferirías no cronometrar

Un precio mensual fijo y sin medidor, ni en la tarjeta ni en el ancho de banda. Deja un lote ejecutándose durante el fin de semana y la factura no se mueve.

El modelo más grande que cabe, según la regla que usa nuestra página de LLM

8 GB64 GB
4-bit7-8 billion parameters70 billion parameters
8-bit30-34 billion parameters
16-bit13-14 billion parameters

Solo pesos, con entre un cuarto y la mitad de nuevo reservado para la conversación en sí. La guía completa de dimensionamiento está en nuestra página de LLM.

La misma tarjeta, antes y después

Cuánto más rápida, medido por terceros.

LTT Labs desbloqueó una CMP 170HX en septiembre de 2026 y ejecutó los mismos modelos en ella de ambas formas. Estos son sus resultados, no los nuestros. Las velocidades cambian según el modelo y el software, así que tómalos como la magnitud del salto y no como una cifra que debamos cumplir.

Tal como la envió NVIDIADesbloqueada

8B model at 4-bit, generating

30 tokens/s
113 tokens/s

LTT Labs, llama.cpp, Granite 4.1 8B Q4_K_M

8B model at 4-bit, reading a prompt

351 tokens/s
2,994 tokens/s

LTT Labs, llama.cpp, pp512

27B model at 4-bit (~16 GB)

does not fit
38 tokens/s

LTT Labs, llama.cpp, Qwen 3.6 27B Q4_K_M

27B model at 8-bit (~29 GB)

does not fit
33 tokens/s

LTT Labs, llama.cpp, Qwen 3.8 27B Q8_0

Estas cifras proceden del artículo de LTT Labs de septiembre de 2026, que ejecutó llama.cpp en su propio equipo de pruebas. El desbloqueo en sí es cmpunlocker, un proyecto de código abierto de Amogh Munikote.

Qué ocurre después de hacer el pedido

No tienes que instalar nada. Esa es la ventaja de alquilarlo con nosotros.

  1. 1

    Eliges Ubuntu

    Elige Ubuntu 22.04, 24.04 o 26.04 en el configurador. El desbloqueo es un controlador de Linux, así que esta es la única elección que importa.

  2. 2

    Instalamos la tarjeta y el sistema

    Se coloca la tarjeta, se instala Ubuntu y el controlador desbloqueado se integra para el kernel exacto que ejecutará tu servidor.

  3. 3

    Arranca desbloqueado

    El servidor se apaga por completo y se vuelve a encender, que es lo que necesita el desbloqueo, y se comprueba la memoria completa de cada tarjeta antes de entregar el servidor.

  4. 4

    Las actualizaciones lo mantienen desbloqueado

    Cuando Ubuntu instala un kernel nuevo, el controlador se recompila solo para adaptarse. Escribe cmp-unlock status cuando quieras ver cómo está funcionando cada tarjeta.

Conviene saberlo antes de comprar

Las letras pequeñas, sin rodeos.

Cuánto cuesta

La tarjeta, el servidor que la aloja y nada más encima.

La tarjeta tiene su propia línea en la factura y el servidor otra, para que veas cuánto cuesta cada uno. La cifra mostrada corresponde a una tarjeta en el servidor más pequeño que la admite. Añade memoria, discos más grandes o más tarjetas en el configurador y verás el nuevo total al momento.

Hay una cuota única de configuración porque la tarjeta se instala según tu pedido. El ancho de banda es ilimitado, el impuesto de ventas de EE. UU. se añade al finalizar la compra cuando corresponde, y el precio mensual es el mismo al renovar.

Configurar mi servidor

$272.67/month

  • The card$189
  • The server$83.67
  • Setup$29 once

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

1–4 cards · New York, Bucharest, San Francisco and Miami · 15% off yearly

Preguntas

Lo que la gente pregunta sobre la CMP desbloqueada

¿Qué significa “desbloqueada” en una CMP 170HX?

NVIDIA vendió la CMP 170HX como tarjeta de minería y desactivó la mayor parte por software: mostraba 8 GB de memoria y hacía cálculos de coma flotante muy lentamente. Un controlador comunitario llamado cmpunlocker vuelve a activar esas partes. Una tarjeta desbloqueada tiene 64 GB de memoria y funciona a la velocidad del chip que lleva dentro, que es el mismo chip que una A100.

¿Cuánta memoria tendrá mi tarjeta?

64 GB en la versión de 8 GB de la tarjeta, que es lo que verá en nvidia-smi. La versión de 10 GB se desbloquea a 40 GB, porque más que eso no es fiable en ella. Sin el controlador desbloqueado, ambas muestran la memoria con la que se enviaron.

¿Tengo que desbloquearla yo mismo?

No. Pida el servidor con Ubuntu 22.04, 24.04 o 26.04 y llega desbloqueado. Instalamos el controlador, compilamos el desbloqueo para su kernel y comprobamos cada tarjeta antes de entregarle el servidor.

¿Seguirá desbloqueada después de actualizaciones y reinicios?

Sí. El controlador desbloqueado se carga cada vez que el servidor arranca, y cuando Ubuntu instala un kernel nuevo el desbloqueo se recompila solo para él. Si alguna tarjeta muestra 8 GB, apague y encienda el servidor desde el panel de control, y avísenos si eso no lo soluciona.

¿Qué software de IA funciona en ella?

Cualquier cosa hecha para tarjetas NVIDIA: PyTorch, llama.cpp, Ollama, vLLM y el resto. Instale el kit de herramientas CUDA con apt install cuda-toolkit. Evite los paquetes llamados cuda y cuda-drivers, que añadirían un segundo controlador; configuramos el servidor para rechazarlos.

¿Puedo ejecutar Windows en ella?

Puede, pero el desbloqueo solo existe para Linux, así que en Windows la tarjeta se queda en 8 GB con sus límites originales. Para cualquier cosa que necesite la memoria, elija Ubuntu.

¿Cuántas tarjetas puede tener un servidor?

Hasta cuatro. Dos tarjetas desbloqueadas suman 128 GB entre ambas, suficiente para un modelo de 70 mil millones de parámetros a 8 bits.

¿Puedo seguir minando con ella?

Sí, el desbloqueo no quita nada. Aunque si la minería es el plan principal, nuestra página de minería cubre las tarjetas y los costes para ello.

¿Por qué hay una tarifa de configuración?

La tarjeta se instala según su pedido, lo que convierte el servidor en una configuración personalizada, y las configuraciones personalizadas conllevan una tarifa única de configuración. Se cobra una sola vez, y el precio mensual no sube al renovar.

¿Ya tienes una CMP 170HX?

Anúnciala en el marketplace de Primcast y deja que equipos de IA y desarrolladores la alquilen por meses, al precio que tú fijes.

Ir al Marketplace