NVIDIA CMP 170HX · GA100 · ξεκλείδωτη κατά την εγκατάσταση

Ξεκλείδωτοι dedicated servers με CMP. Και τα 64 GB της κάρτας, όχι μόνο τα 8 που άφησε ενεργά η NVIDIA.

Η CMP 170HX φέρει το ίδιο die GA100 με την A100 και βγήκε από το εργοστάσιο με το μεγαλύτερο μέρος του die αποκλεισμένο: 8 GB από τη μνήμη HBM2e ορατά, το FP32 περιορισμένο σε ρυθμό σταγόνας και η σύνδεση κλειδωμένη σε PCIe Gen 1. Μια patched έκδοση του ανοιχτού driver της NVIDIA’ αφαιρεί τους περιορισμούς. Τη μεταγλωττίζουμε σε Ubuntu κατά την εγκατάσταση του server σας, ώστε η κάρτα να είναι ξεκλείδωτη πριν συνδεθείτε για πρώτη φορά.

64 GB HBM2e per cardUbuntu 22.04 / 24.04 / 26.04Up to 4 cards per machinefrom $272.67/mo complete
Πριν και μετά, στην ίδια κάρτα

Τι αλλάζει ο διορθωμένος οδηγός

Τα LTT Labs ξεκλείδωσαν μια CMP 170HX τον Σεπτέμβριο του 2026 και τη δοκίμασαν με τον εαυτό της, κλειδωμένη και ξεκλείδωτη, στον ίδιο πάγκο δοκιμών. Αυτά είναι τα δικά τους νούμερα, όχι τα δικά μας, και κάθε γραμμή αναφέρει από πού προέρχεται. Τα παραθέτουμε για το μέγεθος της αλλαγής: οι ρυθμοί token μεταβάλλονται ανάλογα με το μοντέλο, την κβαντοποίηση, την έκδοση του llama.cpp και τις σημαίες, οπότε διαβάστε τα ως αναλογία και όχι ως υπόσχεση.

MeasureAs NVIDIA shipped itUnlockedSource
Card memory8 GB HBM2e64 GB HBM2ecmpunlocker; 65,536 MiB measured by LTT Labs
FP32 fused multiply-addabout 0.39 TFLOPSunthrottled170th Street (stock); cmpunlocker (full SM throughput)
PCIe linkGen 1 x4Gen 2 x4cmpunlocker
Host to card, measured0.84 GB/s1.68 GB/sLTT Labs, nvbandwidth
8B model at 4-bit, generating30 tokens/s113 tokens/sLTT Labs, llama.cpp, Granite 4.1 8B Q4_K_M
8B model at 4-bit, reading a prompt351 tokens/s2,994 tokens/sLTT Labs, llama.cpp, pp512
27B model at 4-bit (~16 GB)does not fit38 tokens/sLTT Labs, llama.cpp, Qwen 3.6 27B Q4_K_M
27B model at 8-bit (~29 GB)does not fit33 tokens/sLTT Labs, llama.cpp, Qwen 3.8 27B Q8_0

Η μνήμη είναι η αλλαγή που μετράει. Στα 8 GB η κάρτα χωράει ένα μικρό μοντέλο και ελάχιστα άλλα. Στα 64 GB χωράει ένα μοντέλο 27 δισεκατομμυρίων παραμέτρων στα 8-bit με το μεγαλύτερο μέρος της κάρτας ακόμα ελεύθερο για context, κι αυτή είναι η διαφορά ανάμεσα σε μια κάρτα για πειραματισμό και σε μια για παραγωγική εξυπηρέτηση.

Η παραγωγή token βασίζεται στο εύρος ζώνης, η ανάγνωση prompt στην αριθμητική. Η παραγωγή κειμένου περιορίζεται από το πόσο γρήγορα ρέουν τα βάρη από τη μνήμη, κάτι στο οποίο η HBM2e ήταν πάντα καλή· η ανάγνωση ενός μεγάλου prompt περιορίζεται από τις μονάδες πολλαπλασιασμού-πρόσθεσης, εκεί όπου ο περιορισμός έπληττε περισσότερο και όπου το ξεκλείδωμα φαίνεται πιο έντονα.

Η σύνδεση μετά βίας έχει σημασία μόλις φορτωθεί ένα μοντέλο. Το Gen 2 x4 διπλασιάζει τον ρυθμό host-προς-κάρτα, γεγονός που συντομεύει τη φόρτωση. Μετά από αυτό τα βάρη μένουν στην κάρτα και ο δίαυλος παραμένει αδρανής.

Πηγές: LTT Labs, “Actually Download More RAM” (12 Σεπτεμβρίου 2026) για κάθε μετρημένη γραμμή· 170th Street για το εργοστασιακό νούμερο FP32· cmpunlocker για το τι αποκαθιστούν οι διορθώσεις.

Η εγκατάσταση, βήμα προς βήμα

Πώς φτάνει το ξεκλείδωμα στο μηχάνημα

Οποιοσδήποτε μπορεί να διαβάσει το README του cmpunlocker. Το κομμάτι που αξίζει να πληρώσετε είναι όλα όσα το περιβάλλουν, που γίνονται πριν την παράδοση και συνεχίζουν να λειτουργούν μετά από αυτήν. Δεν χρειάζεται να εκτελέσετε τίποτα εσείς.

  1. Ο ανοιχτός οδηγός της NVIDIA, καρφιτσωμένος σε μία έκδοση

    Ο εγκαταστάτης προσθέτει το αποθετήριο CUDA της NVIDIA και εγκαθιστά τον ανοιχτό οδηγό πυρήνα 610.57.04, χωρίς γραφικό περιβάλλον και χωρίς DKMS, μαζί με το πακέτο nvidia-driver-pinning-610.57.04 που κρατά κάθε κομμάτι του σε αυτή την έκδοση. Το ξεκλείδωμα έχει φτιαχτεί για έναν συγκεκριμένο οδηγό· η καρφίτσα είναι αυτό που εμποδίζει ένα συνηθισμένο apt upgrade να τραβήξει τις βιβλιοθήκες κάτω από τα πόδια του.

  2. cmpunlocker, μεταγλωττισμένο για τον πυρήνα σας

    Κατεβάζουμε το cmpunlocker σε συγκεκριμένο commit και χτίζουμε το τροποποιημένο nvidia.ko μέσα στο νέο σύστημα, για τον πυρήνα με τον οποίο πρόκειται να εκκινήσει, πριν ο εγκαταστάτης κλείσει το μηχάνημα. Οι τροποποιήσεις αλλάζουν τον τρόπο με τον οποίο ο οδηγός ενεργοποιεί την κάρτα. Τίποτα δεν εγγράφεται μόνιμα στην κάρτα, οπότε αν αφαιρέσετε τον οδηγό, επιστρέφει ακριβώς στην προηγούμενη κατάστασή της.

  3. Μια ψυχρή πρώτη εκκίνηση

    Το ξεκλείδωμα ενεργοποιείται μόνο στο πρώτο φόρτωμα του οδηγού αφού η κάρτα έχει απενεργοποιηθεί πλήρως. Οι εγκαταστάσεις Ubuntu που κάνουμε τελειώνουν ήδη έτσι: ο εγκαταστάτης κλείνει τον διακομιστή και εμείς τον ενεργοποιούμε ξανά μέσω του BMC, ώστε το πρώτο πράγμα που αγγίζει την κάρτα να είναι ο τροποποιημένος οδηγός.

  4. Έλεγχος κατά την πρώτη σύνδεση

    Όταν το εγκατεστημένο σύστημα απαντήσει για πρώτη φορά, η εγκατάσταση ρωτά κάθε κάρτα τι αναγνωρίστηκε ως — μνήμη, γενιά PCIe και πλάτος διαύλου — και γράφει την απάντηση στο αρχείο καταγραφής εγκατάστασης του διακομιστή, όπου μπορεί να τη δει η υποστήριξη. Η εντολή cmp-unlock status σας δίνει την ίδια απάντηση από ένα τερματικό οποιαδήποτε στιγμή.

  5. Οι ενημερώσεις πυρήνα δεν το ξανακλειδώνουν

    Ένα hook στο /etc/kernel/postinst.d ξαναχτίζει τα τροποποιημένα modules για κάθε νέο πυρήνα, από ένα αντίγραφο του πηγαίου κώδικα της NVIDIA που διατηρείται στο μηχάνημα, ώστε μια αυτόματη αναβάθμιση να μην επαναφέρει αθόρυβα την κάρτα στα 8 GB. Το apt έχει επίσης ρυθμιστεί να αρνείται τα πακέτα που θα έβαζαν δίπλα του έναν δεύτερο, εργοστασιακό οδηγό· εγκαταστήστε το CUDA με apt install cuda-toolkit και δεν εμφανίζεται ποτέ.

Διαστασιολόγηση, με τον κανόνα που χρησιμοποιεί όλο το υπόλοιπο site

Τι χωράει σε 64 GB, και τι χωρούσε σε 8

Μόνο βάρη, στρογγυλοποιημένα προς τα πάνω. Ένα μοντέλο θεωρείται ότι χωράει όταν η κάρτα μπορεί να το κρατήσει με ένα τέταρτο έως μισό επιπλέον περιθώριο για την κρυφή μνήμη KV και το runtime· κάτω από αυτό, φορτώνει και μετά ξεμένει μόλις μεγαλώσει το context. Είναι ο ίδιος κανόνας με τον οποίο η σελίδα μας για LLM διαστασιολογεί κάθε κάρτα.

Model sizePrecisionWeights8 GB, locked64 GB, unlocked
7-8 billion parameters16-bit16 GBfits
8-bit8 GBfits
4-bit5 GBfitsfits
13-14 billion parameters16-bit28 GBfits
8-bit14 GBfits
4-bit8 GBfits
30-34 billion parameters16-bit68 GB
8-bit34 GBfits
4-bit19 GBfits
70 billion parameters16-bit140 GB
8-bit70 GB
4-bit38 GBfits

Δύο κάρτες σε ένα μηχάνημα χωράνε ό,τι δεν χωράει μία: ένα μοντέλο 70 δισεκατομμυρίων παραμέτρων στα 8-bit χρειάζεται περίπου 70 GB, που χωράνε σε ένα ζεύγος. Ο διαμοιρασμός ενός μοντέλου σε πολλές κάρτες, ή πολλά μηχανήματα, είναι η σελίδα για πολλαπλές GPU. Δώστε στο μηχάνημα τουλάχιστον τόση μνήμη συστήματος όση και το μεγαλύτερο αρχείο μοντέλου· η φθηνότερη σύνθεση παρακάτω έχει 16 GB, που φορτώνει ένα αρχείο 38 GB, απλώς αργά.

Διαβάστε το πριν παραγγείλετε

Τι δεν αλλάζει το ξεκλείδωμα

Μια ξεκλείδωτη CMP είναι μια πολύ καλή κάρτα συμπερασμού για την τιμή της. Δεν είναι A100, και αυτά είναι τα σημεία όπου φαίνεται.

Χωρίς ECC
Η διόρθωση σφαλμάτων στην HBM2e παραμένει απενεργοποιημένη· βρίσκεται στη λίστα με όσα δεν έχει ξεκλειδώσει ακόμη κανείς. Για συμπερασμό, ένα αντεστραμμένο bit κοστίζει μια επανάληψη. Για μια εβδομαδιαία εκπαίδευση, ή για οτιδήποτε πρέπει να είναι ακριβές σε επίπεδο bit, επιλέξτε μια κάρτα με προστατευμένη μνήμη, όπως η L40S.
PCIe Gen 2 x4
Περίπου 1,7 GB/s από τον υπολογιστή στην κάρτα, μετρημένα, οπότε μόνο ο δίαυλος χρειάζεται περίπου 25 δευτερόλεπτα για να μεταφέρει ένα μοντέλο 38 GB. Ένα μοντέλο τον διασχίζει μία φορά και μετά ζει στην κάρτα, γι' αυτό και η εξυπηρέτηση σχεδόν δεν το αντιλαμβάνεται. Ένας βρόχος εκπαίδευσης που στέλνει παρτίδες από τη μνήμη του συστήματος το αντιλαμβάνεται σε κάθε βήμα.
Οι αριθμητικές μορφές της Ampere’s
FP16, BF16, TF32 και INT8 στους πυρήνες τανυστών. Χωρίς FP8 και χωρίς FP4· και τα δύο ήρθαν με τις γενιές μετά την Ampere. Τα κβαντισμένα μοντέλα σε GGUF, AWQ ή GPTQ τρέχουν κανονικά, επειδή αποσυμπιέζονται σε μορφές που διαθέτει η κάρτα.
Μόνο Linux
Το ξεκλείδωμα είναι ένας οδηγός πυρήνα Linux. Παραγγείλετε το μηχάνημα με Ubuntu 22.04, 24.04 ή 26.04 και είναι ενσωματωμένο· σε Windows, ή σε άλλη διανομή, η κάρτα τρέχει όπως την έστειλε η NVIDIA, με 8 GB.
Secure Boot απενεργοποιημένο
Τα διορθωμένα modules είναι ανυπόγραφα, οπότε ένας πυρήνας με ενεργό Secure Boot τα απορρίπτει, και η κάρτα μένει χωρίς κανέναν οδηγό. Αφήστε το απενεργοποιημένο.
Κώδικας κοινότητας, όχι της NVIDIA’s
Το cmpunlocker είναι ένα έργο ανοιχτού κώδικα (GPL-2.0) του Amogh Munikote, και η NVIDIA δεν το υποστηρίζει. Εγκαθιστούμε ένα commit που έχουμε χτίσει και ελέγξει, και μετακινούμε αυτή την καρφίτσα σκόπιμα, ποτέ αυτόματα.
Η κάρτα των 10 GB σταματά στα 40 GB
Η κάρτα των 8 GB ξεκλειδώνει στα 64 GB. Η κάρτα των 10 GB έχει περισσότερη μνήμη στο πακέτο της από όση αντέχει υπό φορτίο, οπότε το ξεκλείδωμα τη σταματά στα 40 GB, το μέγεθος που παραμένει σταθερό. Η εγκατάσταση διαβάζει ποια βρίσκεται στο μηχάνημα και εφαρμόζει τη σωστή γεωμετρία σε κάθε κάρτα.
Η μηχανή πίσω από το κουμπί

Ένα ξεκλείδωτο CMP, στο φθηνότερο μηχάνημα που το δέχεται

Η κάρτα είναι ξεχωριστή γραμμή στο τιμολόγιο και το μηχάνημα άλλη· τα δύο αθροίζονται. Τα παρακάτω νούμερα είναι το ελάχιστο κόστος αυτής της σύνθεσης: η κάρτα στο φθηνότερο πλήρες μηχάνημα που τη δέχεται, πριν από κάθε φόρο πωλήσεων. Ο διαμορφωτής μπορεί να ανοίξει με περισσότερη μνήμη από αυτήν· αλλάξτε εκεί τον επεξεργαστή, τη μνήμη ή τους δίσκους και κοστολογεί κάθε αλλαγή τη στιγμή που την κάνετε.

Η NVIDIA CMP 170HX, μια παθητική κάρτα πλήρους μήκους χωρίς εξόδους οθόνης στο bracket της
Μια παθητική κάρτα πλήρους μήκους που τραβάει έως 250 W και δεν έχει ανεμιστήρα. Είναι φτιαγμένη για πλαίσιο διακομιστή που τραβάει αέρα από μπροστά προς τα πίσω, και εκεί τρέχουν οι δικές μας.
CardNVIDIA CMP 170HX: 64 GB HBM2e unlocked (8 GB HBM2e without the patched driver)
Card, per month$189
MachineIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
Machine, per month$83.67
Together$272.67 a month
Setup$29 once
Cards per machine1 to 4
CitiesNew York, Bucharest, San Francisco and Miami
TermMonthly; 15% off on a twelve-month cycle
DriverNVIDIA open 610.57.04, patched by cmpunlocker, on Ubuntu 22.04, 24.04 or 26.04

Ανοίξτε αυτή τη σύνθεση στον διαμορφωτή →

Η χρέωση εγκατάστασης υπάρχει επειδή η κάρτα τοποθετείται κατά παραγγελία: ένα μηχάνημα με προστιθέμενη κάρτα είναι custom build. Το μηνιαίο ποσό είναι το ίδιο στην ανανέωση. Κάθε άλλη κάρτα που τοποθετούμε κοστολογείται με τον ίδιο τρόπο στη σελίδα GPU.

Ερωτήσεις για αυτή την κάρτα

Ξεκλείδωτοι διακομιστές CMP, ερωτήσεις και απαντήσεις

Τι είναι μια ξεκλείδωτη CMP 170HX;
Μια NVIDIA CMP 170HX που τρέχει μια διορθωμένη έκδοση του ανοιχτού οδηγού πυρήνα της NVIDIA’, από το πρότζεκτ cmpunlocker. Η κάρτα είναι μια GA100, το τσιπ του A100, που η NVIDIA διέθεσε με 8 GB ορατής HBM2e, με περιορισμένο FP32 πολλαπλασιασμό-πρόσθεση και τη σύνδεσή της κλειδωμένη σε PCIe Gen 1. Ο διορθωμένος οδηγός ενεργοποιεί 64 GB, αφαιρεί τον περιορισμό και εκπαιδεύει τη σύνδεση σε Gen 2 κάθε φορά που εκκινεί την κάρτα. Τίποτα στην ίδια την κάρτα δεν τροποποιείται.
Πόση μνήμη έχει μια ξεκλείδωτη CMP 170HX;
64 GB HBM2e στην κάρτα των 8 GB, όπως αναφέρει το nvidia-smi μόλις τρέξει ο διορθωμένος οδηγός. Η έκδοση των 10 GB της κάρτας κρατιέται στα 40 GB, το μέγεθος που παραμένει σταθερό σε αυτήν. Χωρίς τον διορθωμένο οδηγό, κάθε κάρτα δείχνει ό,τι διέθεσε η NVIDIA: 8 ή 10 GB.
Το ξεκλείδωμα επιβιώνει από επανεκκινήσεις και ενημερώσεις πυρήνα;
Ναι. Τα διορθωμένα modules εγκαθίστανται όπως κάθε άλλο module πυρήνα και φορτώνονται σε κάθε εκκίνηση. Όταν έρχεται νέος πυρήνας, ένα hook τα ανακατασκευάζει για αυτόν από τον πηγαίο κώδικα της NVIDIA που διατηρείται στο μηχάνημα, πριν καν εκκινήσετε σε αυτόν. Αν μια κάρτα εμφανιστεί στα 8 GB παρόλα αυτά, εκτελέστε cmp-unlock build με την έκδοση του πυρήνα σας και κάντε power-cycle στον διακομιστή από τον πίνακα ελέγχου.
Ποια λειτουργικά συστήματα παίρνουν τον ξεκλείδωτο οδηγό;
Ubuntu 22.04, 24.04 και 26.04, εγκατεστημένα από εμάς, σε οποιοδήποτε μηχάνημα με την κάρτα: είναι μέρος της εγκατάστασης, όχι επιλογή για τσεκάρισμα. Τα Windows και οι άλλες διανομές Linux που εγκαθιστούμε παίρνουν την κάρτα όπως τη διέθεσε η NVIDIA, επειδή το ξεκλείδωμα είναι οδηγός Linux και τον κατασκευάζουμε μόνο εκεί που τον έχουμε δοκιμάσει.
Μπορώ να χρησιμοποιήσω CUDA, PyTorch, vLLM και llama.cpp σε αυτήν;
Ναι. Ο οδηγός είναι ο ίδιος 610.57.04 της NVIDIA’ με τις διορθώσεις εφαρμοσμένες, οπότε οτιδήποτε έχει κατασκευαστεί για κάρτα Ampere με τρέχοντα οδηγό λειτουργεί. Εγκαταστήστε το CUDA toolkit με apt install cuda-toolkit· τα meta-packages cuda και cuda-drivers θα έφερναν μαζί τους έναν δεύτερο, εργοστασιακό οδηγό, οπότε το apt έχει ρυθμιστεί να τα απορρίπτει.
Θα τρέξει ένα μοντέλο 70 δισεκατομμυρίων παραμέτρων σε μία κάρτα;
Σε 4-bit, ναι: τα βάρη φτάνουν περίπου τα 38 GB, που αφήνει τον χώρο που απαιτεί ο κανόνας διαστασιολόγησής μας σε κάρτα 64 GB. Σε 8-bit φτάνουν περίπου τα 70 GB, που χρειάζεται δύο κάρτες· ένα μηχάνημα δέχεται έως τέσσερις.
Πόσες κάρτες μπορώ να βάλω σε έναν διακομιστή;
Έως τέσσερις στο μηχάνημα στο οποίο παραπέμπει αυτή η σελίδα. Επιλέξτε τον αριθμό στον διαμορφωτή. Για περισσότερες από τέσσερις, ή για μοντέλο μοιρασμένο σε πολλά μηχανήματα, δείτε τη σελίδα multi-GPU.
Είναι αξιόπιστη η ξεκλείδωτη μνήμη;
Η κάρτα των 8 GB στα 64 GB είναι ο συνδυασμός που έχει αντέξει σε δημόσιες δοκιμές, και η κάρτα των 10 GB σταματά στα 40 GB για τον ίδιο λόγο. Είναι όμως μνήμη που η NVIDIA έχει κατατάξει, και μία κάρτα μπορεί να φέρει ένα αδύναμο σημείο: τα LTT Labs βρήκαν ένα ανάμεσα στις κάρτες που δοκίμασαν. Κάθε εγκατάσταση ελέγχει ότι κάθε κάρτα εμφανίστηκε στο πλήρες μέγεθός της, που δεν είναι το ίδιο με ένα μακρύ τεστ μνήμης. Τρέξτε ένα δικό σας πριν εμπιστευτείτε μια κάρτα με εργασία που διαρκεί μέρες, και ενημερώστε μας αν αποτύχει· η κάρτα αντικαθίσταται όπως κάθε άλλο εξάρτημα.
Γιατί υπάρχει χρέωση εγκατάστασης σε αυτή τη σύνθεση;
Επειδή η κάρτα τοποθετείται κατά παραγγελία. Ένα μηχάνημα με προστιθέμενη κάρτα είναι προσαρμοσμένη σύνθεση, και μια προσαρμοσμένη σύνθεση φέρει την εφάπαξ χρέωση εγκατάστασης που φαίνεται στον παραπάνω πίνακα. Χρεώνεται μία φορά, και το μηνιαίο ποσό δεν αλλάζει κατά την ανανέωση.
Πού βρίσκονται αυτοί οι διακομιστές;
Σε κάθε πόλη που αναφέρει ο παραπάνω πίνακας. Η σειρά πωλείται επίσης στο Άμστερνταμ, αλλά ο διαμορφωτής δεν μπορεί να τοποθετήσει κάρτα εκεί, οπότε μια ξεκλείδωτη CMP δεν είναι διαθέσιμη σε αυτή την πόλη.

Κάπου αλλού να κοιτάξετε