NVIDIA CMP 170HX · GA100 · kurulumda kilidi açılır

Kilidi açılmış CMP özel sunucuları. Kartın 64 GB’ının tamamı, NVIDIA’nın açık bıraktığı 8 GB değil.

CMP 170HX, bir A100 ile aynı GA100 kalıbını taşır ve fabrikadan o kalıbın büyük bölümü çitlerle kapatılmış olarak çıktı: 8 GB HBM2e görünür, FP32 bir damlaya kısılmış, bağlantı PCIe Gen 1’de tutulmuş. NVIDIA’nın açık sürücüsünün yamalı bir derlemesi çitleri indirir. Sunucunuzu kurarken onu Ubuntu’ya derliyoruz, böylece ilk kez oturum açmadan önce kartın kilidi açılmış oluyor.

64 GB HBM2e per cardUbuntu, Debian, AlmaLinux or RockyUp to 4 cards per machinefrom $272.67/mo complete
Öncesi ve sonrası, aynı kartta

Yamalı sürücü neyi değiştiriyor

LTT Labs, Eylül 2026'da bir CMP 170HX'in kilidini açtı ve aynı test düzeneğinde kartı kilitli ve kilitsiz haliyle kendi kendine karşı çalıştırdı. Bunlar onların rakamları, bizim değil ve her satır nereden geldiğini belirtiyor. Değişimin büyüklüğü için alıntılıyoruz: token hızları modele, nicemlemeye, llama.cpp derlemesine ve bayraklara göre değişir; bu yüzden bunları bir vaat olarak değil, bir oran olarak okuyun.

MeasureAs NVIDIA shipped itUnlockedSource
Card memory8 GB HBM2e64 GB HBM2ecmpunlocker; 65,536 MiB measured by LTT Labs
FP32 fused multiply-addabout 0.39 TFLOPSunthrottled170th Street (stock); cmpunlocker (full SM throughput)
PCIe linkGen 1 x4Gen 2 x4cmpunlocker
Host to card, measured0.84 GB/s1.68 GB/sLTT Labs, nvbandwidth
8B model at 4-bit, generating30 tokens/s113 tokens/sLTT Labs, llama.cpp, Granite 4.1 8B Q4_K_M
8B model at 4-bit, reading a prompt351 tokens/s2,994 tokens/sLTT Labs, llama.cpp, pp512
27B model at 4-bit (~16 GB)does not fit38 tokens/sLTT Labs, llama.cpp, Qwen 3.6 27B Q4_K_M
27B model at 8-bit (~29 GB)does not fit33 tokens/sLTT Labs, llama.cpp, Qwen 3.8 27B Q8_0

Önemli olan değişiklik bellek. 8 GB'da kart küçük bir modeli tutar ve başka pek bir şey tutmaz. 64 GB'da ise 27 milyar parametreli bir modeli 8-bit olarak tutar ve kartın büyük kısmı bağlam için boş kalır; bu da üzerinde deney yapabileceğiniz bir kart ile hizmet sunabileceğiniz bir kart arasındaki farktır.

Token üretimi bant genişliğine, istem okuma aritmetiğe dayanır. Metin üretimi, ağırlıkların bellekten ne kadar hızlı aktığıyla sınırlıdır; HBM2e bu konuda her zaman iyiydi. Uzun bir istemi okumak ise çarpma-toplama birimleriyle sınırlıdır; kısıtlamanın en çok zarar verdiği ve kilidin en büyük farkı gösterdiği yer burasıdır.

Model yüklendikten sonra bağlantı neredeyse önemsizdir. Gen 2 x4, ana bilgisayar-kart hızını ikiye katlar ve yüklemeyi kısaltır. Bundan sonra ağırlıklar kartta yaşar ve veri yolu boşta kalır.

Kaynaklar: LTT Labs, “Actually Download More RAM” (12 Eylül 2026) ölçülen her satır için; 170th Street stok FP32 rakamı için; cmpunlocker yamaların neyi geri getirdiği için.

Kurulum, adım adım

Kilit açma makineye nasıl geliyor

cmpunlocker README dosyasını herkes okuyabilir. Para vermeye değer kısım, teslimden önce yapılan ve teslimden sonra çalışır durumda tutulan, onu çevreleyen her şeydir. Sizin çalıştıracağınız hiçbir şey yok.

  1. NVIDIA’nın açık sürücüsü, tek bir sürüme sabitlenmiş

    Kurulumcu, NVIDIA’nın CUDA deposunu ekler ve açık sürücünün 610.57.04 için kullanıcı alanını, başsız ve DKMS olmadan kurar; her parçasını o sürümde tutar: Ubuntu ve Debian’da nvidia-driver-pinning-610.57.04 paketi, AlmaLinux ve Rocky’de bir dnf sürüm kilidi. Kilit açma tek bir sürücü için derlenmiştir; sıradan bir güncellemenin kütüphaneleri altından çekip almasını durduran şey bu sabitlemedir.

  2. cmpunlocker, çekirdeğiniz için derlenmiş

    Sabit bir commit’te cmpunlocker’ı alır ve yamalı nvidia.ko modülünü, kurulumcu kapanmadan önce, yeni sistemin içinde, açılış yapacağı çekirdeğe karşı derleriz. Yamalar, sürücünün kartı başlatma biçimini değiştirir. Karta hiçbir şey yazılmaz; sürücüyü kaldırmak kartı tam olarak eski haline döndürür.

  3. Soğuk bir ilk açılış

    Kilit açma yalnızca kart kapatıldıktan sonraki ilk sürücü yüklemesinde etkili olur; bu yüzden bu kurulumların her biri sunucunun kapatılıp BMC üzerinden yeniden açılmasıyla biter ve karta ilk dokunan şey yamalı sürücü olur.

  4. İlk oturum açmada kontrol edilir, ardından bellek testi yapılır

    Kurulan sistem ilk yanıt verdiğinde, kurulum her karta ne olarak geldiğini sorar — bellek, PCIe nesli ve bağlantı genişliği — ardından sürücünün verdiği her bellek baytını sabit, adres ve sözde rastgele desenlerle yazıp geri okur. Her iki yanıt da sunucunun kurulum günlüğüne gider; destek orada görebilir. cmp-unlock status ve cmp-unlock memtest aynı yanıtları bir kabuktan size verir.

  5. Çekirdek güncellemeleri onu yeniden kilitlemez

    Bir çekirdek kancası (/etc/kernel/postinst.d veya AlmaLinux ve Rocky’de /etc/kernel/install.d), makinede tutulan NVIDIA kaynak kopyasından her yeni çekirdek için yamalı modülleri yeniden derler; böylece gözetimsiz bir güncelleme kartı sessizce 8 GB’a geri göndermez. Paket yöneticisine ayrıca yanına ikinci, stok bir sürücü koyacak paketleri reddetmesi söylenir; CUDA’yı apt install cuda-toolkit veya dnf install cuda-toolkit ile kurun, asla ortaya çıkmaz.

Boyutlandırma, sitenin geri kalanının kullandığı kurala göre

64 GB'a ne sığar, 8 GB'a ne sığardı

Yalnızca ağırlıklar, yukarı yuvarlanmıştır. Bir model, kart onu KV önbelleği ve çalışma zamanı için dörtte bir ila yarım kadar daha fazla alanla tutabildiğinde sığar sayılır; bunun altında yüklenir ve bağlam büyüdüğü anda bellek tükenir. Bu, LLM sayfamızın her kartı boyutlandırdığı kuralın aynısıdır.

Model sizePrecisionWeights8 GB, locked64 GB, unlocked
7-8 billion parameters16-bit16 GB—fits
8-bit8 GB—fits
4-bit5 GBfitsfits
13-14 billion parameters16-bit28 GB—fits
8-bit14 GB—fits
4-bit8 GB—fits
30-34 billion parameters16-bit68 GB——
8-bit34 GB—fits
4-bit19 GB—fits
70 billion parameters16-bit140 GB——
8-bit70 GB——
4-bit38 GB—fits

Tek bir makinedeki iki kart, tek kartın tutamadığını tutar: 8 bit'te 70 milyar parametreli bir model yaklaşık 70 GB gerektirir ve bu bir çifte sığar. Bir modeli birden çok karta veya birden çok makineye bölmek çoklu GPU sayfasındadır. Makineye en az en büyük model dosyası kadar sistem belleği de verin; aşağıdaki en ucuz yapı 16 GB'a sahiptir ve 38 GB'lık bir dosyayı yalnızca yavaşça yükler.

Sipariş vermeden önce bunu okuyun

Kilidin açılması neleri değiştirmez

Kilidi açılmış bir CMP, fiyatına göre çok iyi bir çıkarım kartıdır. Bir A100 değildir ve farkın görüldüğü yerler şunlardır.

ECC yok
HBM2e üzerindeki hata düzeltme hâlâ kapalıdır; henüz kimsenin kilidini açamadığı özellikler listesindedir. Çıkarımda ters dönen bir bit, bir yeniden deneme maliyeti doğurur. Bir hafta süren bir eğitim çalışması ya da bit bazında birebir doğruluk gerektiren herhangi bir iş için, L40S gibi belleği korunan bir kart seçin.
PCIe Gen 2 x4
Ölçülen değerle ana makineden karta yaklaşık 1,7 GB/s; yani yalnızca veri yolu, 38 GB'lık bir modeli taşımak için yaklaşık 25 saniyeye ihtiyaç duyar. Bir model bu yoldan bir kez geçer ve ardından kart üzerinde kalır; bu yüzden sunum sırasında bu durum neredeyse hiç fark edilmez. Sistem belleğinden parti parti veri akışı yapan bir eğitim döngüsü ise her adımda bunu hisseder.
Ampere’in sayı biçimleri
Tensör çekirdeklerinde FP16, BF16, TF32 ve INT8. FP8 ve FP4 yok; her ikisi de Ampere'den sonraki nesillerle geldi. GGUF, AWQ veya GPTQ ile nicemlenmiş modeller sorunsuz çalışır; çünkü bunlar kartın sahip olduğu biçimlere açılır.
Yalnızca Linux
Kilit açma işlemi bir Linux çekirdek sürücüsüdür. Makineyi Ubuntu, Debian, AlmaLinux veya Rocky Linux ile sipariş edin; sürücü hazır gelir. Windows veya Proxmox VE üzerinde kart, NVIDIA'nın gönderdiği hâliyle 8 GB olarak çalışır.
Secure Boot kapalı
Yamalı modüller imzasızdır; bu yüzden Secure Boot'u zorunlu kılan bir çekirdek bunları reddeder ve kart tümüyle sürücüsüz kalır. Kapalı bırakın.
Topluluk kodu, NVIDIA’nın değil
cmpunlocker, Amogh Munikote tarafından geliştirilen açık kaynaklı bir projedir (GPL-2.0) ve NVIDIA bunu desteklemez. Derleyip denetlediğimiz bir commit'i kurarız ve bu sabitlemeyi bilinçli olarak, asla otomatik biçimde değiştirmeyiz.
10 GB kart 40 GB'ta durur
8 GB kartın kilidi 64 GB'a açılır. 10 GB kartın paketinde, yük altında kararlı kalandan daha fazla bellek bulunur; bu yüzden kilit açma işlemi onu, kararlı kalan boyut olan 40 GB'ta durdurur. Kurulum, makinede hangisinin olduğunu okur ve her karta doğru yapılandırmayı uygular.
Düğmenin arkasındaki makine

Tek bir kilidi açılmış CMP, onu kabul eden en ucuz makinede

Kart, faturada kendi satırıdır; makine ise başka bir satır. İkisi toplanır. Aşağıdaki rakamlar bu yapılandırmanın olabileceği en düşük maliyettir: kart, onu kabul eden en ucuz eksiksiz makinede, satış vergisi hariç. Yapılandırıcı bundan daha fazla bellekle açılabilir; orada işlemciyi, belleği veya diskleri değiştirin; her değişiklik yaptıkça fiyatlandırılır.

NVIDIA CMP 170HX, braketinde görüntü çıkışı olmayan tam boy pasif bir kart
250 W'a kadar güç çeken ve fanı olmayan pasif, tam boy bir kart. Önden arkaya hava çeken bir sunucu kasası için üretilmiştir ve bizimkiler de orada çalışır.
CardNVIDIA CMP 170HX: 64 GB HBM2e unlocked (8 GB HBM2e without the patched driver)
Card, per month$189
MachineIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
Machine, per month$83.67
Together$272.67 a month
Setup$29 once
Cards per machine1 to 4
CitiesNew York, Bucharest, San Francisco and Miami
TermMonthly; 15% off on a twelve-month cycle
DriverNVIDIA open 610.57.04, patched by cmpunlocker, on Ubuntu 22.04–26.04, Debian 12/13, AlmaLinux 9/10 or Rocky Linux 9/10
Memory testEvery byte the driver hands out, written and read back on each card before handover

Bu yapılandırmayı yapılandırıcıda aç →

Kurulum ücreti, kart siparişe göre takıldığı için vardır: kart eklenmiş bir makine özel bir yapılandırmadır. Aylık rakam yenilemede aynıdır. Taktiğimiz diğer her kart GPU sayfasında aynı şekilde fiyatlandırılır.

Bu kart hakkında sorulanlar

Kilidi açılmış CMP sunucuları, sorular ve cevaplar

Kilidi açılmış CMP 170HX nedir?
cmpunlocker projesinden, NVIDIA’nın açık çekirdek sürücüsünün yamalı bir derlemesini çalıştıran bir NVIDIA CMP 170HX. Kart bir GA100, yani A100’deki çip; NVIDIA bunu 8 GB HBM2e’si görünür, FP32 çarpma-toplama işlemi kısılmış ve bağlantısı PCIe Gen 1’de tutulmuş olarak gönderdi. Yamalı sürücü 64 GB’ı devreye alır, kısıtlamayı kaldırır ve kartı her başlattığında bağlantıyı Gen 2’ye eğitir. Kartın kendisinde hiçbir değişiklik yapılmaz.
Kilidi açılmış bir CMP 170HX’in ne kadar belleği var?
8 GB’lık kartta 64 GB HBM2e; yamalı sürücü çalışırken nvidia-smi’nin bildirdiği değer budur. Kartın 10 GB sürümü 40 GB’da tutulur; bu, üzerinde kararlı kalan boyuttur. Yamalı sürücü olmadan her iki kart da NVIDIA’nın gönderdiği değeri gösterir: 8 veya 10 GB.
Kilit açma işlemi yeniden başlatmalarda ve çekirdek güncellemelerinde kalıcı mı?
Evet. Yamalı modüller diğer tüm çekirdek modülleri gibi kurulur ve her açılışta yüklenir. Yeni bir çekirdek geldiğinde, siz o çekirdekle açılmadan önce bir kanca, makinede tutulan NVIDIA kaynağından onun için modülleri yeniden derler. Bir kart yine de 8 GB ile gelirse, çekirdek sürümünüzle cmp-unlock build komutunu çalıştırın ve sunucuyu kontrol panelinden güç döngüsüne alın.
Hangi işletim sistemleri kilidi açılmış sürücüyü alır?
Ubuntu 22.04, 24.04 ve 26.04, Debian 12 ve 13, AlmaLinux 9 ve 10 ve Rocky Linux 9 ve 10; bizim tarafımızdan, kartın bulunduğu her makineye kurulur: bu kurulumun bir parçasıdır, işaretlenecek bir seçenek değildir. Windows ve Proxmox VE kartı NVIDIA’nın gönderdiği haliyle alır: kilit açma bir Linux çekirdek sürücüsüdür ve Proxmox’ta kartlar genellikle sanal makinelere gider; ana makine sürücüsü bunlara ulaşamaz.
Üzerinde CUDA, PyTorch, vLLM ve llama.cpp kullanabilir miyim?
Evet. Sürücü, yamalar uygulanmış NVIDIA’nın kendi 610.57.04 sürümüdür; bu nedenle güncel bir sürücüye sahip bir Ampere kart için derlenmiş her şey çalışır. CUDA araç setini tek başına, apt install cuda-toolkit veya dnf install cuda-toolkit ile kurun; cuda ve cuda-drivers meta paketleri yanlarında ikinci bir stok sürücü getirir, bu yüzden paket yöneticisi bunları reddedecek şekilde ayarlanmıştır.
70 milyar parametreli bir model tek kartta çalışır mı?
4 bit’te evet: ağırlıklar yaklaşık 38 GB tutar; bu da 64 GB’lık bir kartta boyutlandırma kuralımızın istediği alanı bırakır. 8 bit’te yaklaşık 70 GB tutar ve bu iki kart gerektirir; bir makine en fazla dört kart alır.
Bir sunucuya kaç kart takabilirim?
Bu sayfanın bağlantı verdiği makinede en fazla dört. Sayıyı yapılandırıcıda seçin. Dörtten fazlası için veya makineler arasında bölünmüş bir model için çoklu GPU sayfasına bakın.
Kilidi açılmış bellek güvenilir mi?
8 GB’lık kartın 64 GB’ta çalışması, kamuya açık testlerde dayanıklılığını kanıtlamış kombinasyondur ve 10 GB’lık kart da aynı nedenle 40 GB’ta durur. Yine de bu bellek NVIDIA’nın ayırdığı bellektir ve bir kart zayıf bir bölge taşıyabilir: LTT Labs, test ettikleri kartlar arasında böyle bir tane buldu. Bu yüzden her kurulumda test edilir: ilk soğuk açılıştan sonra, her kartta sürücünün vereceği her bayt yazılır ve geri okunur; sabit, adres ve sözde rastgele desenler yerinde ters çevrilir ve sonuç sunucunun kurulum günlüğüne yazılır. Bu teslimatta yapılan bir kontroldür, yıllar için bir garanti değildir; bir kart sonradan sorun çıkarırsa cmp-unlock memtest komutunu çalıştırın ve bize ne söylediğini iletin. Arızalanan bir kart diğer tüm parçalar gibi değiştirilir.
Bu yapılandırmada neden kurulum ücreti var?
Çünkü kart siparişe göre takılır. Kart eklenmiş bir makine özel bir yapılandırmadır ve özel bir yapılandırma yukarıdaki tabloda gösterilen tek seferlik kurulum ücretini taşır. Bir kez alınır ve yenilemede aylık tutar değişmez.
Bu sunucular nerede?
Yukarıdaki tablonun listelediği her şehirde. Hat Amsterdam’da da satılır, ancak yapılandırıcı orada kart takamaz; bu nedenle kilidi açılmış bir CMP o şehirde mevcut değildir.

Bakabileceğiniz başka bir yer