Czatbot tylko dla Ciebie
Uruchom otwarty model, taki jak Llama, Qwen czy Mistral, na serwerze, z którego nie korzysta nikt inny. Podpowiedzi, dokumenty i odpowiedzi pozostają na Twoim komputerze, zamiast trafiać do cudzego API.
NVIDIA CMP 170HX · odblokowana podczas instalacji
NVIDIA zbudowała CMP 170HX z myślą o kopaniu i zablokowała całą resztę: karta pokazywała 8 GB pamięci, a obliczenia zmiennoprzecinkowe działały w ślimaczym tempie. Blokada okazała się wyłącznie programowa. Instalujemy sterownik, który ją znosi, dzięki czemu serwer dociera do Ciebie z kartą wyposażoną w 64 GB bardzo szybkiej pamięci, uruchamiającą modele AI tak, jak jej układ został do tego zaprojektowany.
Ta sama karta, ten sam układ. Szara część to to, co NVIDIA pozostawiła włączone; reszta to to, co włącza sterownik.
Do czego nadaje się teraz
Uruchom otwarty model, taki jak Llama, Qwen czy Mistral, na serwerze, z którego nie korzysta nikt inny. Podpowiedzi, dokumenty i odpowiedzi pozostają na Twoim komputerze, zamiast trafiać do cudzego API.
Model o 70 miliardach parametrów mieści się na jednej odblokowanej karcie w trybie 4-bitowym. Na karcie, która nie została odblokowana, pułapem jest model o około 8 miliardach parametrów.
To, czego model nie wykorzysta, trafia do jego kontekstu, dzięki czemu długie dokumenty i długie rozmowy trwają dalej, zamiast kończyć się w połowie z braku miejsca.
Model czatu, model osadzania do wyszukiwania i mały model kierujący zapytaniami mogą pozostać załadowane razem, zamiast zmieniać się kolejno.
Jedna stała cena miesięczna i brak licznika, na karcie czy na transferze. Zostaw zadanie wsadowe na weekend, a rachunek się nie zmieni.
Tylko wagi, z zachowaniem od ćwierci do połowy wolnego miejsca na samą rozmowę. Pełny przewodnik po doborze rozmiaru znajduje się na naszej stronie o LLM.
Ta sama karta, przed i po
LTT Labs odblokowało CMP 170HX we wrześniu 2026 roku i uruchomiło na nim te same modele na oba sposoby. To ich wyniki, nie nasze. Szybkość zmienia się w zależności od modelu i oprogramowania, więc traktuj je jako skalę przyspieszenia, a nie liczbę, której będziemy się trzymać.
Te liczby pochodzą z artykułu LTT Labs z września 2026 roku, w którym uruchomiono llama.cpp na ich własnej maszynie testowej. Samo odblokowanie to cmpunlocker, projekt open-source autorstwa Amogha Munikote.
Co się dzieje po złożeniu zamówienia
W konfiguratorze wybierz Ubuntu 22.04, 24.04 lub 26.04. Odblokowanie to sterownik linuksowy, więc to jedyny wybór, który ma znaczenie.
Karta trafia do środka, instalowane jest Ubuntu, a odblokowany sterownik jest wbudowywany pod dokładnie to jądro, na którym będzie działać Twój serwer.
Serwer jest całkowicie wyłączany i włączany ponownie, czego wymaga odblokowanie, a każda karta jest sprawdzana pod kątem pełnej pamięci, zanim serwer zostanie przekazany.
Gdy Ubuntu instaluje nowe jądro, sterownik sam się przebudowuje, aby do niego pasować. Wpisz cmp-unlock status, kiedy tylko chcesz zobaczyć, jak radzi sobie każda karta.
Warto wiedzieć przed zakupem
Ile to kosztuje
Karta ma własną pozycję na fakturze, a serwer osobną, więc widzisz, ile kosztuje każde z nich. Podana kwota dotyczy jednej karty w najmniejszym serwerze, który ją obsługuje. Dodaj pamięć, większe dyski lub kolejne karty w konfiguratorze, a nowa suma będzie się aktualizować na bieżąco.
Pobieramy jednorazową opłatę instalacyjną, ponieważ karta jest montowana pod Twoje zamówienie. Transfer jest nielimitowany, amerykański podatek od sprzedaży doliczamy przy kasie, jeśli Cię obowiązuje, a cena miesięczna pozostaje taka sama przy odnowieniu.
$272.67/month
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
Pytania
NVIDIA sprzedawała CMP 170HX jako kartę do kopania i programowo wyłączyła większość jej możliwości: pokazywała 8 GB pamięci i bardzo wolno wykonywała obliczenia zmiennoprzecinkowe. Społecznościowy sterownik o nazwie cmpunlocker włącza te części z powrotem. Odblokowana karta ma 64 GB pamięci i działa z prędkością układu, który się w niej znajduje — tego samego, co w A100.
64 GB w wersji karty z 8 GB — tyle zobaczysz w nvidia-smi. Wersja z 10 GB odblokowuje się do 40 GB, ponieważ więcej nie jest na niej niezawodne. Bez odblokowanego sterownika obie pokazują pamięć, z którą zostały sprzedane.
Nie. Zamów serwer z Ubuntu 22.04, 24.04 lub 26.04, a dotrze już odblokowany. Instalujemy sterownik, kompilujemy odblokowanie pod Twoje jądro i sprawdzamy każdą kartę przed przekazaniem serwera.
Tak. Odblokowany sterownik ładuje się przy każdym uruchomieniu serwera, a gdy Ubuntu instaluje nowe jądro, odblokowanie przebudowuje się pod nie samodzielnie. Jeśli karta kiedykolwiek pokaże 8 GB, wyłącz i włącz serwer z panelu sterowania i daj nam znać, jeśli to nie pomoże.
Wszystko stworzone dla kart NVIDIA: PyTorch, llama.cpp, Ollama, vLLM i pozostałe. Zainstaluj zestaw narzędzi CUDA poleceniem apt install cuda-toolkit. Unikaj pakietów o nazwach cuda i cuda-drivers, które dodałyby drugi sterownik; ustawiamy serwer tak, aby je odrzucał.
Możesz, ale odblokowanie istnieje tylko dla Linuksa, więc w Windows karta pozostaje przy 8 GB z pierwotnymi ograniczeniami. Do wszystkiego, co potrzebuje pamięci, wybierz Ubuntu.
Do czterech. Dwie odblokowane karty mają razem 128 GB — wystarczająco na model o 70 miliardach parametrów w trybie 8-bitowym.
Tak, odblokowanie niczego nie odbiera. Jeśli jednak kopanie jest głównym planem, nasza strona o kopaniu opisuje karty i koszty z tym związane.
Karta jest montowana pod Twoje zamówienie, co czyni serwer konstrukcją niestandardową, a konstrukcje niestandardowe wiążą się z jednorazową opłatą instalacyjną. Pobierana jest raz, a cena miesięczna nie rośnie przy przedłużeniu.