NVIDIA CMP 170HX · déverrouillée dès que nous l’installons

Serveurs dédiés CMP déverrouillés.

NVIDIA a conçu la CMP 170HX pour le minage et a verrouillé tout le reste : la carte n’affichait que 8 Go de mémoire et exécutait les calculs en virgule flottante au ralenti. Le verrou s’est révélé être logiciel. Nous installons un pilote qui le lève, afin que votre serveur arrive avec une carte dotée de 64 Go de mémoire très rapide et exécute les modèles d’IA comme sa puce a été conçue pour le faire.

Même carte, même puce. La partie grise correspond à ce que NVIDIA a laissé actif ; le reste est ce que le pilote active.

Ce qu’il sait bien faire maintenant

Il a été vendu pour le minage. Déverrouillé, c’est une carte IA.

Un chatbot rien qu’à vous

Faites tourner un modèle ouvert comme Llama, Qwen ou Mistral sur un serveur que personne d’autre n’utilise. Les invites, les documents et les réponses restent sur votre machine au lieu de passer par l’API de quelqu’un d’autre.

De grands modèles sur une seule carte

Un modèle de 70 milliards de paramètres tient sur une carte déverrouillée en 4 bits. Sur une carte non déverrouillée, le plafond est d’environ 8 milliards.

De la place pour de longues conversations

Tout ce que le modèle n’utilise pas va dans son contexte, si bien que les longs documents et les longues discussions continuent au lieu de manquer de place à mi-chemin.

Plusieurs modèles à la fois

Un modèle de chat, un modèle d’intégration pour la recherche et un petit modèle qui aiguille les requêtes peuvent rester chargés ensemble, plutôt que de se relayer.

Des tâches que vous préférez ne pas chronométrer

Un prix mensuel fixe et pas de compteur, sur la carte comme sur la bande passante. Laissez un lot tourner tout le week-end et la facture ne bouge pas.

Le plus grand modèle qui tient, selon la règle utilisée sur notre page LLM

8 GB64 GB
4-bit7-8 billion parameters70 billion parameters
8-bit30-34 billion parameters
16-bit13-14 billion parameters

Poids uniquement, avec un quart à la moitié gardé libre pour la conversation elle-même. Le guide complet de dimensionnement se trouve sur notre page LLM.

La même carte, avant et après

Combien plus rapide, mesuré par quelqu’un d’autre.

LTT Labs a déverrouillé une CMP 170HX en septembre 2026 et a exécuté les mêmes modèles dessus dans les deux configurations. Voici leurs résultats, pas les nôtres. Les vitesses varient selon le modèle et le logiciel, alors considérez-les comme l’ampleur du gain plutôt que comme un chiffre à nous opposer.

Telle que livrée par NVIDIADéverrouillée

8B model at 4-bit, generating

30 tokens/s
113 tokens/s

LTT Labs, llama.cpp, Granite 4.1 8B Q4_K_M

8B model at 4-bit, reading a prompt

351 tokens/s
2,994 tokens/s

LTT Labs, llama.cpp, pp512

27B model at 4-bit (~16 GB)

does not fit
38 tokens/s

LTT Labs, llama.cpp, Qwen 3.6 27B Q4_K_M

27B model at 8-bit (~29 GB)

does not fit
33 tokens/s

LTT Labs, llama.cpp, Qwen 3.8 27B Q8_0

Ces chiffres proviennent de l’article de LTT Labs de septembre 2026, qui a exécuté llama.cpp sur leur propre machine de test. Le déverrouillage lui-même est cmpunlocker, un projet open source d’Amogh Munikote.

Ce qui se passe après votre commande

Rien à installer de votre côté. C’est justement l’intérêt de la location chez nous.

  1. 1

    Vous choisissez Ubuntu

    Choisissez Ubuntu 22.04, 24.04 ou 26.04 dans le configurateur. Le déverrouillage est un pilote Linux : c’est donc le seul choix qui compte vraiment.

  2. 2

    Nous installons la carte et le système

    La carte est montée, Ubuntu est installé, et le pilote déverrouillé y est intégré pour le noyau exact que votre serveur exécutera.

  3. 3

    Il démarre directement déverrouillé

    Le serveur est complètement éteint puis rallumé, comme l’exige le déverrouillage, et chaque carte est vérifiée pour sa mémoire complète avant la remise du serveur.

  4. 4

    Les mises à jour conservent le déverrouillage

    Quand Ubuntu installe un nouveau noyau, le pilote se reconstruit automatiquement pour correspondre. Tapez cmp-unlock status quand vous voulez voir l’état de chaque carte.

À savoir avant d’acheter

Les limites, en toute transparence.

Combien ça coûte

La carte, le serveur en dessous, et rien par-dessus.

La carte occupe sa propre ligne sur la facture et le serveur une autre, pour que vous puissiez voir ce que chacun coûte. Le montant affiché correspond à une carte dans le plus petit serveur qui l’accepte. Ajoutez de la mémoire, des disques plus grands ou d’autres cartes dans le configurateur et le nouveau total s’affiche au fur et à mesure.

Des frais d’installation uniques s’appliquent, car la carte est montée selon votre commande. La bande passante est illimitée, la taxe de vente américaine est ajoutée au moment du paiement lorsqu’elle s’applique, et le prix mensuel reste le même au renouvellement.

Configurer mon serveur

$272.67/month

  • The card$189
  • The server$83.67
  • Setup$29 once

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

1–4 cards · New York, Bucharest, San Francisco and Miami · 15% off yearly

Questions

Ce que les gens demandent à propos du CMP déverrouillé

Que signifie “déverrouillé” pour un CMP 170HX ?

NVIDIA a vendu le CMP 170HX comme carte de minage et a désactivé la plupart de ses fonctions par logiciel : elle affichait 8 Go de mémoire et effectuait les calculs en virgule flottante très lentement. Un pilote communautaire appelé cmpunlocker réactive ces fonctions. Une carte déverrouillée dispose de 64 Go de mémoire et fonctionne à la vitesse de la puce qu’elle contient, la même puce qu’une A100.

Quelle quantité de mémoire aura ma carte ?

64 Go sur la version 8 Go de la carte, ce que vous verrez dans nvidia-smi. La version 10 Go se déverrouille à 40 Go, car au-delà, la fiabilité n’est pas assurée. Sans le pilote déverrouillé, les deux affichent la mémoire avec laquelle elles ont été livrées.

Dois-je la déverrouiller moi-même ?

Non. Commandez le serveur avec Ubuntu 22.04, 24.04 ou 26.04 et il arrive déverrouillé. Nous installons le pilote, compilons le déverrouillage pour votre noyau et vérifions chaque carte avant de vous remettre le serveur.

Restera-t-il déverrouillé après les mises à jour et les redémarrages ?

Oui. Le pilote déverrouillé se charge à chaque démarrage du serveur, et lorsqu’Ubuntu installe un nouveau noyau, le déverrouillage se reconstruit automatiquement pour celui-ci. Si une carte affiche un jour 8 Go, éteignez puis rallumez le serveur depuis le panneau de contrôle, et prévenez-nous si cela ne résout pas le problème.

Quels logiciels d’IA fonctionnent dessus ?

Tout ce qui est conçu pour les cartes NVIDIA : PyTorch, llama.cpp, Ollama, vLLM et les autres. Installez le kit d’outils CUDA avec apt install cuda-toolkit. Évitez les paquets nommés cuda et cuda-drivers, qui ajouteraient un second pilote ; nous configurons le serveur pour les refuser.

Puis-je exécuter Windows dessus ?

Vous le pouvez, mais le déverrouillage n’existe que pour Linux ; sous Windows, la carte reste donc à 8 Go avec ses limites d’origine. Pour tout ce qui nécessite la mémoire, choisissez Ubuntu.

Combien de cartes un serveur peut-il avoir ?

Jusqu’à quatre. Deux cartes déverrouillées totalisent 128 Go, de quoi faire tourner un modèle de 70 milliards de paramètres en 8 bits.

Puis-je encore miner avec ?

Oui, le déverrouillage n’enlève rien. Si le minage est toutefois votre projet principal, notre page dédiée au minage présente les cartes et les coûts associés.

Pourquoi y a-t-il des frais d’installation ?

La carte est montée selon votre commande, ce qui fait du serveur une configuration personnalisée, et les configurations personnalisées impliquent des frais d’installation uniques. Ils sont facturés une seule fois, et le prix mensuel n’augmente pas lors du renouvellement.

Vous possédez déjà une CMP 170HX ?

Mettez-la en ligne sur la place de marché Primcast et laissez les équipes d’IA et les développeurs la louer auprès de vous au mois, au prix que vous fixez.

Accéder à la place de marché