Un chatbot solo tuo
Esegui un modello aperto come Llama, Qwen o Mistral su un server che nessun altro usa. Prompt, documenti e risposte restano sulla tua macchina invece di passare dall'API di qualcun altro.
NVIDIA CMP 170HX · sbloccata quando la installiamo noi
NVIDIA ha costruito la CMP 170HX per il mining e ha bloccato tutto il resto: la scheda mostrava 8 GB di memoria ed eseguiva i calcoli in virgola mobile a passo di lumaca. Il blocco si è rivelato software. Installiamo un driver che lo rimuove, così il tuo server arriva con una scheda dotata di 64 GB di memoria molto veloce ed esegue i modelli di intelligenza artificiale nel modo per cui il suo chip è stato progettato.
Stessa scheda, stesso chip. La parte grigia è ciò che NVIDIA ha lasciato attivo; il resto è ciò che il driver accende.
In cosa è brava adesso
Esegui un modello aperto come Llama, Qwen o Mistral su un server che nessun altro usa. Prompt, documenti e risposte restano sulla tua macchina invece di passare dall'API di qualcun altro.
Un modello da 70 miliardi di parametri sta su una scheda sbloccata a 4 bit. Su una scheda non sbloccata, il tetto è un modello di circa 8 miliardi.
Quello che il modello non usa va al suo contesto, così documenti lunghi e chat prolungate continuano invece di esaurire lo spazio a metà.
Un modello di chat, un modello di embedding per la ricerca e un piccolo modello che smista le richieste possono restare tutti caricati insieme, invece di darsi il turno.
Un unico prezzo mensile fisso e nessun contatore, sulla scheda o sulla banda. Lascia un batch in esecuzione per il weekend e il conto non si muove.
Solo pesi, con un quarto o metà in più tenuto libero per la conversazione stessa. La guida completa al dimensionamento è sulla nostra pagina LLM.
La stessa scheda, prima e dopo
LTT Labs ha sbloccato una CMP 170HX a settembre 2026 e ha eseguito gli stessi modelli su di essa in entrambe le modalità. Questi sono i loro risultati, non i nostri. Le velocità cambiano con il modello e il software, quindi considerateli come l'entità del salto piuttosto che un numero a cui vincolarci.
Questi numeri provengono dall'articolo di LTT Labs di settembre 2026, che ha eseguito llama.cpp sulla propria macchina di test. Lo sblocco in sé è cmpunlocker, un progetto open-source di Amogh Munikote.
Cosa succede dopo l'ordine
Scegli Ubuntu 22.04, 24.04 o 26.04 nel configuratore. Lo sblocco è un driver Linux, quindi questa è l'unica scelta che conta.
La scheda viene inserita, Ubuntu viene installato e il driver sbloccato viene integrato per l'esatto kernel che il tuo server eseguirà.
Il server viene spento completamente e riacceso, che è ciò che richiede lo sblocco, e ogni scheda viene verificata per la sua memoria completa prima che il server venga consegnato.
Quando Ubuntu installa un nuovo kernel, il driver si ricompila da solo per adattarsi. Digita cmp-unlock status ogni volta che vuoi vedere come sta andando ogni scheda.
Da sapere prima di acquistare
Quanto costa
La scheda ha una propria riga in fattura e il server un’altra, così puoi vedere quanto costa ciascuno. La cifra mostrata si riferisce a una scheda nel server più piccolo che la supporta. Aggiungi memoria, dischi più grandi o altre schede nel configuratore e il totale si aggiorna man mano.
È previsto un costo di attivazione una tantum perché la scheda viene installata in base al tuo ordine. La banda non è misurata, l’imposta sulle vendite statunitense viene aggiunta al pagamento dove applicabile e il prezzo mensile resta lo stesso al rinnovo.
$272.67/month
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
Domande
NVIDIA ha venduto la CMP 170HX come scheda per il mining e ne ha disattivato la maggior parte via software: mostrava 8 GB di memoria ed eseguiva i calcoli in virgola mobile molto lentamente. Un driver della community chiamato cmpunlocker riattiva quelle parti. Una scheda sbloccata ha 64 GB di memoria e gira alla velocità del chip al suo interno, che è lo stesso chip di una A100.
64 GB sulla versione da 8 GB della scheda, che è ciò che vedrai in nvidia-smi. La versione da 10 GB si sblocca a 40 GB, perché oltre quella quantità non è affidabile. Senza il driver sbloccato, entrambe mostrano la memoria con cui sono state vendute.
No. Ordina il server con Ubuntu 22.04, 24.04 o 26.04 e arriva già sbloccato. Installiamo il driver, compiliamo lo sblocco per il tuo kernel e controlliamo ogni scheda prima di consegnarti il server.
Sì. Il driver sbloccato si carica a ogni avvio del server e, quando Ubuntu installa un nuovo kernel, lo sblocco si ricompila da solo per quel kernel. Se una scheda dovesse mostrare 8 GB, spegni e riaccendi il server dal pannello di controllo e contattaci se il problema persiste.
Qualsiasi cosa creata per le schede NVIDIA: PyTorch, llama.cpp, Ollama, vLLM e gli altri. Installa il toolkit CUDA con apt install cuda-toolkit. Evita i pacchetti chiamati cuda e cuda-drivers, che aggiungerebbero un secondo driver; abbiamo configurato il server per rifiutarli.
Puoi, ma lo sblocco esiste solo per Linux, quindi su Windows la scheda resta a 8 GB con i suoi limiti originali. Per tutto ciò che richiede la memoria, scegli Ubuntu.
Fino a quattro. Due schede sbloccate offrono 128 GB complessivi, sufficienti per un modello da 70 miliardi di parametri a 8 bit.
Sì, lo sblocco non toglie nulla. Se però il mining è il piano principale, la nostra pagina sul mining illustra le schede e i costi per quell'uso.
La scheda viene montata in base al tuo ordine, il che rende il server una build personalizzata, e le build personalizzate comportano una tariffa di configurazione una tantum. Viene addebitata una sola volta e il prezzo mensile non aumenta al rinnovo.