NVIDIA CMP 170HX · sbloccata quando la installiamo noi

Server dedicati CMP sbloccati.

NVIDIA ha costruito la CMP 170HX per il mining e ha bloccato tutto il resto: la scheda mostrava 8 GB di memoria ed eseguiva i calcoli in virgola mobile a passo di lumaca. Il blocco si è rivelato software. Installiamo un driver che lo rimuove, così il tuo server arriva con una scheda dotata di 64 GB di memoria molto veloce ed esegue i modelli di intelligenza artificiale nel modo per cui il suo chip è stato progettato.

Stessa scheda, stesso chip. La parte grigia è ciò che NVIDIA ha lasciato attivo; il resto è ciò che il driver accende.

In cosa è brava adesso

È stata venduta per il mining. Sbloccata, è una scheda per l'IA.

Un chatbot solo tuo

Esegui un modello aperto come Llama, Qwen o Mistral su un server che nessun altro usa. Prompt, documenti e risposte restano sulla tua macchina invece di passare dall'API di qualcun altro.

Modelli grandi su una sola scheda

Un modello da 70 miliardi di parametri sta su una scheda sbloccata a 4 bit. Su una scheda non sbloccata, il tetto è un modello di circa 8 miliardi.

Spazio per conversazioni lunghe

Quello che il modello non usa va al suo contesto, così documenti lunghi e chat prolungate continuano invece di esaurire lo spazio a metà.

Più modelli contemporaneamente

Un modello di chat, un modello di embedding per la ricerca e un piccolo modello che smista le richieste possono restare tutti caricati insieme, invece di darsi il turno.

Lavori che preferiresti non cronometrare

Un unico prezzo mensile fisso e nessun contatore, sulla scheda o sulla banda. Lascia un batch in esecuzione per il weekend e il conto non si muove.

Il modello più grande che ci sta, secondo la regola usata nella nostra pagina LLM

8 GB64 GB
4-bit7-8 billion parameters70 billion parameters
8-bit30-34 billion parameters
16-bit13-14 billion parameters

Solo pesi, con un quarto o metà in più tenuto libero per la conversazione stessa. La guida completa al dimensionamento è sulla nostra pagina LLM.

La stessa scheda, prima e dopo

Quanto più veloce, misurato da qualcun altro.

LTT Labs ha sbloccato una CMP 170HX a settembre 2026 e ha eseguito gli stessi modelli su di essa in entrambe le modalità. Questi sono i loro risultati, non i nostri. Le velocità cambiano con il modello e il software, quindi considerateli come l'entità del salto piuttosto che un numero a cui vincolarci.

Come l'ha spedita NVIDIASbloccata

8B model at 4-bit, generating

30 tokens/s
113 tokens/s

LTT Labs, llama.cpp, Granite 4.1 8B Q4_K_M

8B model at 4-bit, reading a prompt

351 tokens/s
2,994 tokens/s

LTT Labs, llama.cpp, pp512

27B model at 4-bit (~16 GB)

does not fit
38 tokens/s

LTT Labs, llama.cpp, Qwen 3.6 27B Q4_K_M

27B model at 8-bit (~29 GB)

does not fit
33 tokens/s

LTT Labs, llama.cpp, Qwen 3.8 27B Q8_0

Questi numeri provengono dall'articolo di LTT Labs di settembre 2026, che ha eseguito llama.cpp sulla propria macchina di test. Lo sblocco in sé è cmpunlocker, un progetto open-source di Amogh Munikote.

Cosa succede dopo l'ordine

Niente da installare per te. È proprio questo il senso di noleggiarla da noi.

  1. 1

    Scegli Ubuntu

    Scegli Ubuntu 22.04, 24.04 o 26.04 nel configuratore. Lo sblocco è un driver Linux, quindi questa è l'unica scelta che conta.

  2. 2

    Montiamo la scheda e installiamo

    La scheda viene inserita, Ubuntu viene installato e il driver sbloccato viene integrato per l'esatto kernel che il tuo server eseguirà.

  3. 3

    Si avvia già sbloccata

    Il server viene spento completamente e riacceso, che è ciò che richiede lo sblocco, e ogni scheda viene verificata per la sua memoria completa prima che il server venga consegnato.

  4. 4

    Gli aggiornamenti la lasciano sbloccata

    Quando Ubuntu installa un nuovo kernel, il driver si ricompila da solo per adattarsi. Digita cmp-unlock status ogni volta che vuoi vedere come sta andando ogni scheda.

Da sapere prima di acquistare

I limiti, senza giri di parole.

Quanto costa

La scheda, il server che la ospita e nient’altro sopra.

La scheda ha una propria riga in fattura e il server un’altra, così puoi vedere quanto costa ciascuno. La cifra mostrata si riferisce a una scheda nel server più piccolo che la supporta. Aggiungi memoria, dischi più grandi o altre schede nel configuratore e il totale si aggiorna man mano.

È previsto un costo di attivazione una tantum perché la scheda viene installata in base al tuo ordine. La banda non è misurata, l’imposta sulle vendite statunitense viene aggiunta al pagamento dove applicabile e il prezzo mensile resta lo stesso al rinnovo.

Configura il mio server

$272.67/month

  • The card$189
  • The server$83.67
  • Setup$29 once

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

1–4 cards · New York, Bucharest, San Francisco and Miami · 15% off yearly

Domande

Cosa chiedono le persone sulla CMP sbloccata

Cosa significa “sbloccata” per una CMP 170HX?

NVIDIA ha venduto la CMP 170HX come scheda per il mining e ne ha disattivato la maggior parte via software: mostrava 8 GB di memoria ed eseguiva i calcoli in virgola mobile molto lentamente. Un driver della community chiamato cmpunlocker riattiva quelle parti. Una scheda sbloccata ha 64 GB di memoria e gira alla velocità del chip al suo interno, che è lo stesso chip di una A100.

Quanta memoria avrà la mia scheda?

64 GB sulla versione da 8 GB della scheda, che è ciò che vedrai in nvidia-smi. La versione da 10 GB si sblocca a 40 GB, perché oltre quella quantità non è affidabile. Senza il driver sbloccato, entrambe mostrano la memoria con cui sono state vendute.

Devo sbloccarla da solo?

No. Ordina il server con Ubuntu 22.04, 24.04 o 26.04 e arriva già sbloccato. Installiamo il driver, compiliamo lo sblocco per il tuo kernel e controlliamo ogni scheda prima di consegnarti il server.

Resterà sbloccata dopo aggiornamenti e riavvii?

Sì. Il driver sbloccato si carica a ogni avvio del server e, quando Ubuntu installa un nuovo kernel, lo sblocco si ricompila da solo per quel kernel. Se una scheda dovesse mostrare 8 GB, spegni e riaccendi il server dal pannello di controllo e contattaci se il problema persiste.

Quale software AI gira su di essa?

Qualsiasi cosa creata per le schede NVIDIA: PyTorch, llama.cpp, Ollama, vLLM e gli altri. Installa il toolkit CUDA con apt install cuda-toolkit. Evita i pacchetti chiamati cuda e cuda-drivers, che aggiungerebbero un secondo driver; abbiamo configurato il server per rifiutarli.

Posso eseguire Windows su di essa?

Puoi, ma lo sblocco esiste solo per Linux, quindi su Windows la scheda resta a 8 GB con i suoi limiti originali. Per tutto ciò che richiede la memoria, scegli Ubuntu.

Quante schede può avere un server?

Fino a quattro. Due schede sbloccate offrono 128 GB complessivi, sufficienti per un modello da 70 miliardi di parametri a 8 bit.

Posso ancora minare con essa?

Sì, lo sblocco non toglie nulla. Se però il mining è il piano principale, la nostra pagina sul mining illustra le schede e i costi per quell'uso.

Perché c'è una tariffa di configurazione?

La scheda viene montata in base al tuo ordine, il che rende il server una build personalizzata, e le build personalizzate comportano una tariffa di configurazione una tantum. Viene addebitata una sola volta e il prezzo mensile non aumenta al rinnovo.

Possiedi già una CMP 170HX?

Mettila in vendita sul marketplace Primcast e lascia che team di IA e sviluppatori la noleggino da te con canone mensile, al prezzo che stabilisci tu.

Vai al Marketplace