NVIDIA CMP 170HX · 我们安装后即解锁

解锁版 CMP 独立服务器。

NVIDIA 为挖矿打造了 CMP 170HX,却把其余能力锁了起来:这张卡只显示 8 GB 显存,浮点运算慢如爬行。后来发现这把锁只是软件层面的。我们安装一个解除限制的驱动,让您到手的服务器拥有一张 64 GB 高速显存的显卡,并按照其芯片原本的设计运行 AI 模型。

同一张卡,同一颗芯片。灰色部分是 NVIDIA 保留开启的;其余部分由驱动开启。

它现在擅长什么

它曾为挖矿而生。解锁之后,它是一张 AI 卡。

只属于你的聊天机器人

在无人共用的服务器上运行 Llama、Qwen 或 Mistral 等开放模型。提示词、文档和回答都留在你的机器上,而不是发往别人的 API。

一张卡跑大模型

700 亿参数的模型以 4-bit 精度就能装进一张解锁卡。在未解锁的卡上,上限大约是 80 亿参数的模型。

长对话有足够空间

模型用不完的显存都会留给上下文,因此长文档和长对话可以持续进行,不会中途耗尽空间。

多个模型同时运行

聊天模型、用于搜索的嵌入模型,以及负责路由请求的小模型可以同时加载,而不必轮流占用。

你不想计时的任务

按月一口价,卡和带宽都不按量计费。让一批任务跑整个周末,账单也不会变动。

按我们 LLM 页面所用的规则,能装下的最大模型

8 GB64 GB
4-bit7-8 billion parameters70 billion parameters
8-bit30-34 billion parameters
16-bit13-14 billion parameters

仅计算权重,并额外留出四分之一到一半的空间给对话本身。完整的选型指南见我们的 LLM 页面

同一张卡,解锁前后

快了多少,由别人来测量。

LTT Labs 在 2026 年 9 月解锁了一块 CMP 170HX,并用两种方式在上面运行了相同的模型。这些是他们的结果,不是我们的。速度会因模型和软件而异,所以请把它们看作提升的幅度,而不是我们要你死守的数字。

NVIDIA 出厂状态解锁后

8B model at 4-bit, generating

30 tokens/s
113 tokens/s

LTT Labs, llama.cpp, Granite 4.1 8B Q4_K_M

8B model at 4-bit, reading a prompt

351 tokens/s
2,994 tokens/s

LTT Labs, llama.cpp, pp512

27B model at 4-bit (~16 GB)

does not fit
38 tokens/s

LTT Labs, llama.cpp, Qwen 3.6 27B Q4_K_M

27B model at 8-bit (~29 GB)

does not fit
33 tokens/s

LTT Labs, llama.cpp, Qwen 3.8 27B Q8_0

这些数字来自 LTT Labs 2026 年 9 月的评测文章,他们在自己的测试机上运行了 llama.cpp。解锁工具本身是 cmpunlocker,一个由 Amogh Munikote 开发的开源项目。

下单之后会发生什么

您无需安装任何东西。这正是向我们租用的意义所在。

  1. 1

    您选择 Ubuntu

    在配置器中选择 Ubuntu 22.04、24.04 或 26.04。解锁功能是一个 Linux 驱动程序,因此这是唯一重要的选择。

  2. 2

    我们安装显卡并完成部署

    显卡装入服务器,安装 Ubuntu,并将解锁驱动程序内置到系统中,精确匹配您服务器将要运行的内核。

  3. 3

    启动即为解锁状态

    服务器会完全关机再重新启动,这正是解锁所需的过程,并且每块显卡都会在交付前检查其全部显存。

  4. 4

    更新后仍保持解锁

    当 Ubuntu 安装新内核时,驱动程序会自动重新构建以匹配。随时输入 cmp-unlock status 即可查看每块显卡的运行状态。

购买前值得了解

先说清楚这些限制。

费用说明

显卡、承载它的服务器,仅此而已。

显卡在账单上单独列一行,服务器另列一行,这样每一项的费用都一目了然。所示价格为最小规格服务器中单张显卡的费用。在配置器中增加内存、更大硬盘或更多显卡时,总价会随之实时更新。

由于显卡需按订单安装,因此收取一次性设置费。带宽不限流量,美国销售税在结账时按适用情况加收,续费时月费保持不变。

配置我的服务器

$272.67/month

  • The card$189
  • The server$83.67
  • Setup$29 once

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

1–4 cards · New York, Bucharest, San Francisco and Miami · 15% off yearly

常见问题

关于解锁版 CMP 的常见疑问

“解锁”对 CMP 170HX 意味着什么?

NVIDIA 将 CMP 170HX 作为挖矿卡出售,并在软件层面关闭了大部分功能:它只显示 8 GB 显存,浮点运算速度极慢。一个名为 cmpunlocker 的社区驱动会重新开启这些功能。解锁后的显卡拥有 64 GB 显存,并以芯片本身的性能运行,该芯片与 A100 相同。

我的显卡会有多少显存?

8 GB 版本的显卡解锁后为 64 GB,你可以在 nvidia-smi 中看到。10 GB 版本解锁后为 40 GB,因为超过这个容量在该版本上不够稳定。如果没有解锁驱动,两者都只显示出厂时的显存容量。

我需要自己解锁吗?

不需要。订购服务器时选择 Ubuntu 22.04、24.04 或 26.04,交付时即已解锁。我们会安装驱动、为你的内核构建解锁模块,并在交付前逐一检查每张显卡。

更新和重启后还会保持解锁状态吗?

会的。解锁驱动会在服务器每次启动时加载,当 Ubuntu 安装新内核时,解锁模块会自动为新内核重新构建。如果某张显卡显示 8 GB,请从控制面板关闭再开启服务器,若问题仍未解决请告知我们。

哪些 AI 软件可以在上面运行?

任何为 NVIDIA 显卡开发的软件:PyTorch、llama.cpp、Ollama、vLLM 等等。使用 apt install cuda-toolkit 安装 CUDA 工具包。请避开名为 cuda 和 cuda-drivers 的软件包,它们会添加第二个驱动;我们已将服务器设置为拒绝安装这些包。

可以在上面运行 Windows 吗?

可以,但解锁仅适用于 Linux,因此在 Windows 上显卡仍保持 8 GB 及原始限制。对于任何需要大显存的任务,请选择 Ubuntu。

一台服务器可以装多少张显卡?

最多四张。两张解锁显卡合计拥有 128 GB 显存,足以在 8-bit 精度下运行 700 亿参数的模型。

我还能用它挖矿吗?

可以,解锁不会移除任何功能。不过,如果挖矿是主要计划,我们的挖矿页面介绍了相关显卡和成本。

为什么有设置费?

显卡是根据你的订单安装的,这使得服务器成为定制配置,而定制配置会收取一次性设置费。该费用只收取一次,续费时月费不会上涨。

已经拥有 CMP 170HX?

把它挂到 Primcast 市场上,让 AI 团队和开发者按月向您租用,价格由您来定。

前往市场