Υπολογίστε την TPS του Quadro K6000 SDI σε τοπικά AI μοντέλα

NVIDIA 12 GB GDDR5 288 GB/s July 2013

Κάθε μοντέλο στον κατάλογό μας αξιολογήθηκε σε σχέση με αυτή την ΚΑΡΤΑ στη διάρκεια του CONTEXT LENGTH και της ελάχιστης ποιότητας που επιλέγετε. Η ταχύτητα είναι μια εκτίμηση για ένα μόνο αίτημα, υπολογισμένη από το MEMORY BANDWIDTH αυτής της ΚΑΡΤΑΣ και το μέγεθος κάθε μοντέλου μόλις συμπιεστεί..

Υπολογίστηκε για αυτήν την κάρτα

396 μοντέλα που μπορεί να εκτελέσει

679 μοντέλα στον κατάλογό μας συνολικά

Το μεγαλύτερο μοντέλο που κρατάει

ERNIE-4.5-21B-A3B

21B · Q3_K_M · 74.1 tok/s

Ταχύτερο μοντέλο

Gemma 3 QAT 1B

104 tok/s · 1B

Ποια AI μοντέλα μπορούν να τρέξουν σε μια Quadro K6000 SDI?

Ορίστε τις εισόδους, διαβάστε την απάντηση

Περισσότερα συμφραζόμενα σημαίνει περισσότερη μνήμη για την κρυφή μνήμη της συνομιλίας. Η ταχύτητα είναι για μια νέα συνομιλία και δεν αλλάζει με αυτή τη ρύθμιση..

Κρύβει μοντέλα που θα χωρούσαν μόνο αν συμπιεστούν κάτω από αυτό το σημείο.

396 τα μοντέλα ταιριάζουν

Υπολογισμός
Ποσοτικοποίηση Καλά
104 tok/s

36–208 · χαμηλή εμπιστοσύνη

Gemma 3 1B 1B Mar 2025 1.8 GB 33k μουσικά κομμάτια Q8_0 Άνετο
104 tok/s

36–208 · χαμηλή εμπιστοσύνη

Gemma 3 QAT 1B 1B Apr 2025 1.8 GB 33k μουσικά κομμάτια Q8_0 Άνετο
104 tok/s

36–208 · χαμηλή εμπιστοσύνη

HGRN 1B (WT 103) 1B Nov 2023 1.8 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
104 tok/s

36–208 · χαμηλή εμπιστοσύνη

LLama 3..2 Typhoon 2 1B 1B Dec 2024 1.8 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
104 tok/s

36–208 · χαμηλή εμπιστοσύνη

OLMo-1B 1B Feb 2024 1.8 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
104 tok/s

36–208 · χαμηλή εμπιστοσύνη

Pythia-1b 1B Apr 2023 1.8 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
96.1 tok/s

34–192 · χαμηλή εμπιστοσύνη

OpenELM-1.1B 1.1B May 2024 1.9 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
94.4 tok/s

33–189 · χαμηλή εμπιστοσύνη

DeciCoder-1B 1.1B Aug 2023 1.9 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
94.4 tok/s

33–189 · χαμηλή εμπιστοσύνη

SantaCoder 1.1B Jan 2023 1.9 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
94.4 tok/s

33–189 · χαμηλή εμπιστοσύνη

TinyLlama-1.1B (1T token checkpoint) 1.1B Oct 2023 1.9 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
94.4 tok/s

33–189 · χαμηλή εμπιστοσύνη

TinyLlama-1.1B (3T token checkpoint) 1.1B Oct 2023 1.9 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
86.5 tok/s

30–173 · χαμηλή εμπιστοσύνη

EXAONE 4.0 (1.2B) 1.2B Jul 2025 2.0 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
86.5 tok/s

30–173 · χαμηλή εμπιστοσύνη

MinerU2.5 1.2B Sep 2025 2.0 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
86.5 tok/s

30–173 · χαμηλή εμπιστοσύνη

Pleias 1.0 1.2B 1.2B Dec 2024 2.0 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
86.5 tok/s

30–173 · χαμηλή εμπιστοσύνη

Pleias-RAG-1B 1.2B Apr 2025 2.0 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
84.4 tok/s

30–169 · χαμηλή εμπιστοσύνη

Llama 3.2 1B 1.2B Sep 2024 2.2 GB 131k μουσικά κομμάτια Q8_0 Άνετο
83.2 tok/s

29–166 · χαμηλή εμπιστοσύνη

DeepSeekMoE-16B 16B Jan 2024 10.0 GB 4k μουσικά κομμάτια Q4_K_M Στενά
83.2 tok/s

29–166 · χαμηλή εμπιστοσύνη

MiniCPM-1.2B 1.2B Jun 2024 2.0 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
79.9 tok/s

28–160 · χαμηλή εμπιστοσύνη

DeepSeek Coder 1.3B 1.3B Jan 2024 2.1 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
79.9 tok/s

28–160 · χαμηλή εμπιστοσύνη

DeepSeek-VL-1.3B 1.3B Mar 2024 2.1 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
79.9 tok/s

28–160 · χαμηλή εμπιστοσύνη

DigiRL 1.3B Jun 2024 2.1 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
79.9 tok/s

28–160 · χαμηλή εμπιστοσύνη

GLA Transformer 1.3B 1.3B Aug 2024 2.1 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
79.9 tok/s

28–160 · χαμηλή εμπιστοσύνη

Janus 1.3B 1.3B Oct 2024 2.1 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
79.9 tok/s

28–160 · χαμηλή εμπιστοσύνη

Kosmos-2.5 1.3B Aug 2024 2.1 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο
79.9 tok/s

28–160 · χαμηλή εμπιστοσύνη

Otter 1.3B May 2023 2.1 GB 131k μουσικά κομμάτια ? Q8_0 Άνετο

Οι ταχύτητες είναι εκτιμήσεις για ένα μόνο αίτημα — μία συνομιλία τη φορά — υπολογισμένες από την μνήμη, το μέγεθος του μοντέλου και την ποσοτικοποίηση. Η πραγματική διακύμανση έξοδου ποικίλλει με τον χρόνο εκτέλεσης συμπερασμάτων και την έκδοσή του. Οι αριθμοί που δημοσιεύονται από τους προμηθευτές υλικού μετρούν πολλές ταυτόχρονες αιτήσεις και είναι πολύ υψηλότεροι..

Σε καταγραφή

Quadro K6000 SDI Πλήρης προδιαγραφή

Τα πάντα σε αρχείο για αυτήν την κάρτα, ταξινομημένα κατά πόσο σχετίζονται με τη λειτουργία ενός AI μοντέλου παρά σύμφωνα με το πώς θα το κατέγραφε ένα φύλλο προδιαγραφών. Η ΜΝΗΜΗ έρχεται πρώτη γιατί αποφασίζει το αποτέλεσμα; το υπόλοιπο είναι CONTEXT..

Μνήμη

Οι δύο προδιαγραφές που αποφασίζουν ποιο μοντέλο μπορεί να τρέξει αυτή η ΚΑΡΤΑ και με ποια ταχύτητα. Η ικανότητα καθορίζει ποια μοντέλα ταιριάζουν· το bandwidth καθορίζει πόσα tokens ανά δευτερόλεπτο παράγουν μόλις ταιριάξουν.

Μέγεθος μνήμης
12 GB
Μνήμη εύρους ζώνης
288 GB/s
Τύπος μνήμης
GDDR5
Πλάτος διαύλου μνήμης
384 bit
Ρολογιά μνήμης
1.5 GHz

Το τσιπ

Ποιος επεξεργαστής είναι πάνω στην πλακέτα και πώς κατασκευάστηκε. Ένα μικρότερο μέγεθος διαδικασίας γενικά σημαίνει περισσότερη απόδοση για την ίδια ισχύ.

Γραφικός επεξεργαστής
GK110
Αρχιτεκτονική
Kepler
Γενιά
Quadro Kepler(Kx000)
Μέταλλο
TSMC
Μέγεθος διαδικασίας
28 nm
Τρανζίστορ
7.1 billion
Πυκνότητα τρανζίστορ
12,600 K/mm²
Μέγεθος τσιπ
561 mm²
Πακέτο
BGA-2152
Απελευθερώθηκε
23 July 2013

Ταχύτητες ρολογιού

Πόσο γρήγορα λειτουργεί ο επεξεργαστής. Αξίζει πολύ λιγότερο εδώ από ό,τι σε ένα gaming benchmark: η δημιουργία κειμένου περιορίζεται από το MEMORY BANDWIDTH, έτσι μια υψηλότερη συχνότητα barely moves το αποτέλεσμα.

Βασική συχνότητα
902 MHz
Ωθήσει ρολογιού
902 MHz

Μονάδες Επεξεργασίας

Τι περιέχει το τσιπ. Αυτά οδηγούν την απόδοση γραφικών και έχουν σημασία κυρίως για την επεξεργασία μιας μακράς προτροπής αντί για την παραγωγή της απάντησης.

Μονάδες σκίασης
2,880
Μονάδες Χαρτογράφησης Υφής
240
Μονάδες εξόδου απόδοσης
48
L1 κρυφή μνήμη
16 KB
L2 κρυφή μνήμη
1.5 MB

Θεωρητική Απόδοση

Οι κορυφαίοι ρυθμοί αριθμητικών υπολογισμών που δημοσιεύθηκαν για την κάρτα. Αυτές είναι ανώτατα όρια που καμία πραγματική εργασία δεν φτάνει, και η παραγωγή κειμένου φτάνει μόνο σε ένα μικρό ποσοστό αυτών επειδή περιορίζεται από τη μνήμη αντί για την αριθμητική.

Μονή ακρίβεια (FP32)
5.2 TFLOPS
Διπλή ακρίβεια (FP64)
1.7 TFLOPS
Ρυθμός εικονοστοιχείων
54 GPixel/s
Ρυθμός υφής
217 GTexel/s

Η πλακέτα

Τι απαιτείται για να εγκαταστήσετε φυσικά και να τροφοδοτήσετε την ΚΑΡΤΑ — οι πρακτικοί περιορισμοί που αποφασίζουν αν ταιριάζει στη μηχανή που ήδη έχετε.

Κατανάλωση ενέργειας (TDP)
239 W
Προτεινόμενη τροφοδοσία
550 W
Διασύνδεση λεωφορείου
PCIe 3.0 x16
Πλάτος υποδοχής
Triple-slot
Διαστάσεις
267 mm
Εμφάνιση εξόδων
3x DVI, 2x DisplayPort 1.2, 3x SDI

Υποστήριξη λογισμικού

Ποιες γραφικές και υπολογιστικές διεπαφές υποστηρίζει η κάρτα. Η δυνατότητα υπολογισμού CUDA είναι αυτή που επηρεάζει την εκτίμηση: κάτω από 7.0 δεν υπάρχουν πυρήνες tensor, και το σύγχρονο λογισμικό εκτίμησης επιστρέφει σε πιο αργούς κωδικούς.

ικανότητα υπολογισμού CUDA
3.5
DirectX
11.0
OpenGL
4.6
Βούλκαν
1.2
OpenCL
3.0
Μοντέλο Σκίασης
5.1

Καταχωρίσεις

Πού να αγοράσω ένα Quadro K6000 SDI

Κανένας προμηθευτής δεν καταχωρεί αυτήν την κάρτα αυτή τη στιγμή. Οι καταχωρίσεις προέρχονται από προμηθευτές που τις δημοσιεύουν εδώ απευθείας. — περιηγηθείτε στον κατάλογο προμηθευτών να δεις ποιος πουλάει τι.

Τι σημαίνουν οι αριθμοί

Μνήμη: η προδιαγραφή που αποφασίζει τα πάντα

Μνήμη

12 GB

Εύρος ζώνης

288 GB/s

Μεγαλύτερο μοντέλο

ERNIE-4.5-21B-A3B

Quadro K6000 SDI φερεί 12 GB του GDDR5. Αυτό φτάνει άνετα σε μικρά και μεσαία μοντέλα, αν και τα μεγαλύτερα μένουν εκτός εμβέλειας χωρίς να τα χωρίσουμε. Η υπερβολή του οδηγού αφήνει περίπου 10.8 GB.

Η μνημονική εύρος ζώνης φτάνει 288 GB/s πέρα από ένα λεωφορείο του 384 μπίτ. Η διαύγεια είναι ο πραγματικός περιορισμός αυτής της κάρτας. Κάθε τοκέν απαιτεί την ανάγνωση ολόκληρου του μοντέλου από την VRAM, οπότε ένα μεγάλο μοντέλο θα αισθάνεται αργό εδώ ακόμα και όταν χωράει.

Η τιμή είναι το πλάτος του λεωφορείου πολλαπλασιασμένο με μια ροή μνήμης του 1.5 GHz. Διεύρυνση του λεωφορείου και αύξηση του ρολογιού είναι οι δύο μοχλοί που έχει ένας κατασκευαστής, γι' αυτό και μια κάρτα με αδιάφορους πυρήνες μπορεί ακόμα να παράγει γρήγορα.

Το μεγαλύτερο πράγμα που κρατάει είναι ERNIE-4.5-21B-A3B, 21B, συμπιεσμένο σε Q3_K_M και δημιουργώντας γύρω 74.1 tokens ανά δευτερόλεπτο

Το τσιπ και πώς κατασκευάστηκε

Quadro K6000 SDI είναι κατασκευασμένο πάνω στον επεξεργαστή γραφικών GK110, χρησιμοποιώντας την αρχιτεκτονική Kepler από NVIDIA, ως μέρος της γενιάς Quadro Kepler(Kx000).

Το τσιπ κατασκευάζεται από TSMC, σε μια διαδικασία της 28 νμ, με ένα ζάρι που μετράει 561 mm², κρατώντας 7.1 billion Τρανζίστορ. Μια μικρότερη διαδικασία σημαίνει γενικά περισσότερη απόδοση για την ίδια ισχύ, αν και για τα γλωσσικά μοντέλα έχει πολύ λιγότερη σημασία από το υποσύστημα μνήμης.

Δημοσιεύτηκε το July 2013, χονδρικά 13.024351184033 χρόνια πριν. Η υποστήριξη λογισμικού INFERENCE τείνει να ακολουθεί την υλικοτεχνική υποδομή κατά ένα ή δύο χρόνια, οπότε μια κάρτα αυτής της ηλικίας γενικά διαθέτει ώριμους, καλά βελτιστοποιημένους κώδικες που της είναι διαθέσιμοι.

Διαδικασία υπολογισμού, και γιατί έχει λιγότερη σημασία απ' ότι φαίνεται

FP64

1.7 TFLOPS

Η διάβαση διπλής ακρίβειας φθάνει 1.7 TFLOPS. Δεν έχει καμία σχέση με την εκτέλεση ενός γλωσσικού ΜΟΝΤΕΛΟΥ — κανένας χρόνος εκτέλεσης συμπερασμού δεν το χρησιμοποιεί — αλλά χωρίζει τα μέρη των κέντρων δεδομένων από τα καταναλωτικά, καθώς τα τελευταία το περιορίζουν σκόπιμα.

Οι ρολόγια τρέχουν από μια βάση του 902 MHz σε μια αύξησηของ 902 MHz. Αξίζει πολύ λιγότερο εδώ από ό,τι σε ένα gaming benchmark: η αύξηση των ρολογιών επιταχύνει την αριθμητική, και η αριθμητική δεν είναι αυτό που περιμένει η γενιά.

Κρυφή μνήμη και μονάδες επεξεργασίας

Quadro K6000 SDI έχει L1 cache της 16 KB, υποστηριζόμενο από μια L2 cache του 1.5 MB. Η Cache απορροφά ένα μερίδιο της κίνησης μνήμης που αλλιώς θα έπληττε το κύριο λεωφορείο, το οποίο είναι το μόνο μέρος σε αυτή τη σελίδα όπου ένας αριθμός διαφορετικός από τη bandwidth επηρεάζει ήσυχα την ταχύτητα δημιουργίας - μια μεγάλη L2 επιτρέπει περισσότερα από το working set να παραμένουν κοντά στους πυρήνες.

Υπάρχουν 2,880 Μονάδες σκίασης, 240 Μονάδες Χαρτογράφησης Υφής, και 48 Μονάδες εξόδου απόδοσης. Αυτά οδηγούν τα γραφικά φορτία εργασίας και συμβάλλουν στην επεξεργασία εντολών, αλλά παραμένουν ανενεργά για μεγάλο μέρος του χρόνου που χρειάζεται ένα μοντέλο για να παράγει μια απάντηση.

Ικανότητα, μέγεθος και εγκατάσταση

Κατανάλωση ενέργειας

239 W

Quadro K6000 SDI βαθμολογείται σε 239 W, και η προτεινόμενη τροφοδοσία συστήματος είναι 550 W. Η εκτέλεση ενός γλωσσικού μοντέλου κρατά μια κάρτα απασχολημένη σε εκρήξεις παρά συνεχώς — απορροφά έντονα κατά τη διαδικασία παραγωγής και αδρανεί μεταξύ των αιτημάτων — έτσι η διαρκής κατανάλωση κατά τη διάρκεια μιας εργάσιμης ημέρας είναι συνήθως πολύ κάτω από την αναγραφόμενη τιμή.

Η κάρτα καταλαμβάνει triple-slot, μετρήσεις 267 μμ μήκους. Αξίζει να ελεγχθεί σε σχέση με την περίπτωση και την τροφοδοσία που είναι ήδη στη μηχανή, καθώς οι μεγαλύτερες κάρτες χρειάζονται σημαντικά περισσότερα και από τα δύο σε σύγκριση με ό,τι παρέχει ένα τυπικό επιτραπέζιο.

Συνδέεται μέσω PCIe 3.0 x16. Η διεπαφή ρυθμίζει πόσο γρήγορα ένα μοντέλο φορτώνεται από το δίσκο στην κάρτα, όχι πόσο γρήγορα εκτελείται μόλις εκεί, έτσι μια στενότερη σύνδεση κοστίζει μερικά δευτερόλεπτα στην εκκίνηση και τίποτα μετά από αυτό.

Οι ακραίοι

Οι μεγαλύτεροι AI μοντέλα που τρέχουν σε μια Quadro K6000 SDI

Τα μεγαλύτερα OPEN WEIGHT μοντέλα που ταιριάζουν σε αυτή την CARD, τα νεότερα πρώτα. Κάθε ένα εμφανίζεται με την καλύτερη συμπίεση που μπορεί να κρατήσει η CARD..

  1. 01 ERNIE-4.5-21B-A3B 21B · Q3_K_M · Jun 2025 74.1 tok/s
  2. 02 GigaChat Lite (GigaChat-20B-A3B) 20B · Q3_K_M · Dec 2024 77.8 tok/s
  3. 03 InternLM2.5 20B · Q3_K_M · Aug 2024 14.0 tok/s
  4. 04 Granite 20B 20B · Q3_K_M · May 2024 14.0 tok/s
  5. 05 InternLM2-20B 20B · Q3_K_M · Jan 2024 14.0 tok/s
  6. 06 CogAgent 18B · IQ4_XS · Dec 2023 14.2 tok/s
  7. 07 SPHINX (Llama 2 13B) 19.9B · Q3_K_M · Nov 2023 14.1 tok/s
  8. 08 CogVLM-17B 17B · IQ4_XS · Nov 2023 15.0 tok/s
  9. 09 Flan UL2 19.5B · Q3_K_M · Mar 2023 14.4 tok/s
  10. 10 Palmyra Large 20B 20B · Q3_K_M · Mar 2023 14.0 tok/s

Οι ταχύτεροι AI μοντέλα σε μια Quadro K6000 SDI

Όπου αυτή η ΚΑΡΤΑ παράγει τούβλα γρηγορότερα. Μικρότερα μοντέλα κυριαρχούν εδώ, επειδή η παραγωγή κάθε τούβλου σημαίνει να διαβάζουμε ολόκληρο το μοντέλο από τη μνήμη μία φορά..

  1. 01 Gemma 3 QAT 1B 1B · Q8_0 · 1.8 GB 104 tok/s
  2. 02 Gemma 3 1B 1B · Q8_0 · 1.8 GB 104 tok/s
  3. 03 LLama 3..2 Typhoon 2 1B 1B · Q8_0 · 1.8 GB 104 tok/s
  4. 04 OLMo-1B 1B · Q8_0 · 1.8 GB 104 tok/s
  5. 05 HGRN 1B (WT 103) 1B · Q8_0 · 1.8 GB 104 tok/s
  6. 06 Pythia-1b 1B · Q8_0 · 1.8 GB 104 tok/s
  7. 07 OpenELM-1.1B 1.1B · Q8_0 · 1.9 GB 96.1 tok/s
  8. 08 TinyLlama-1.1B (1T token checkpoint) 1.1B · Q8_0 · 1.9 GB 94.4 tok/s
  9. 09 TinyLlama-1.1B (3T token checkpoint) 1.1B · Q8_0 · 1.9 GB 94.4 tok/s
  10. 10 DeciCoder-1B 1.1B · Q8_0 · 1.9 GB 94.4 tok/s

Βήμα προς βήμα

Πώς να υπολογίσετε τους TOKENS ανά ΔΕΥΤΕΡΟΛΕΠΤΟ ενός Quadro K6000 SDI

Δεν χρειάζεται να υπολογίσετε τίποτα με το χέρι — ο υπολογιστής gputps.com σε αυτή τη σελίδα έχει ήδη υπολογίσει για κάθε μοντέλο που μπορεί να κρατήσει αυτή η κάρτα. Η ανάγνωση της απάντησης απαιτεί έξι βήματα..

  1. 01

    Βρείτε το μοντέλο στον πίνακα

    Ο πίνακας απαριθμεί 396 μοντέλα που τρέχει αυτή η κάρτα. Η αναζήτηση περιορίζει τη λίστα κατά όνομα ή κατά μέγεθος.

  2. 02

    Αποφασίστε πόσο πολύ διαρκούν οι συνομιλίες σας

    Οι μεγαλύτερες συζητήσεις κοστίζουν VRAM πάνω από τα βάρη. Εναντίον 12 GB έτσι οι ρυθμίσεις αξίζουν να γίνουν σωστά.

  3. 03

    Κλειδώστε τη σύγκριση σε ένα επίπεδο ποιότητας

    Από προεπιλογή, ο πίνακας επιλέγει την λιγότερο συμπιεσμένη αντιγραφή που χωράει. Η ρύθμιση ενός κατωφλιού αφαιρεί τα μοντέλα που πληρούν προϋποθέσεις μόνο μέσω βαριάς συμπίεσης.

  4. 04

    Κοίτα το φάσμα, όχι μόνο τον αριθμό

    Οι αριθμοί υπολογίζονται, δεν μετρώνται. Το ταχύτερο αποτέλεσμα σε αυτή την κάρτα είναι 104 τόκ/σ σε Gemma 3 QAT 1B. Η ίδια κάρτα και μοντέλο διαφέρει κατά τριάντα έως πενήντα τοις εκατό μεταξύ των χρόνων εκτέλεσης συμπερασμάτων.

  5. 05

    Έλεγξε τη στήλη μνήμης πριν δεσμεύσεις

    Η στήλη εφαρμογής χωρίζει τα μοντέλα που απλώς ταιριάζουν από αυτά που έχουν περιθώριο — αξίζει να ελεγχθεί πριν από την επιλογή ενός, σε σχέση με ένα διαθέσιμο 12 GB.

  6. 06

    Διασταύρωση με άλλες συσκευές

    Κάθε όνομα μοντέλου στον πίνακα συνδέεται με τη δική του σελίδα, η οποία εκτελεί τον ίδιο υπολογισμό σε κάθε κάρτα που διατηρούμε. Εκεί είναι που βλέπετε εάν η σωστή αγορά είναι Quadro K6000 SDI.

Απαντήσεις

Quadro K6000 SDI — κοινές ερωτήσεις

01

Quadro K6000 SDI— πόσο cache έχει;

Η μνήμη L1 είναι 16 KB, και η L2 cache είναι 1.5 MB. Η Cache απορροφά μέρος της μνήμης κυκλοφορίας που θα έφτανε αλλιώς στον κύριο διαδικτυακό κόμβο, έτσι μια μεγαλύτερη L2 δίνει μια μέτρια αύξηση στην ταχύτητα γενετικά πέρα από αυτό που προ predicts η μόνο πλά bandwidth.

02

Quadro K6000 SDI— υποστηρίζει CUDA;

Ναι. Αναφέρει την ικανότητα υπολογισμού CUDA. 3.5, το οποίο προηγείται των TENSOR CORES. Η δυνατότητα 7.0 και άνω έχει πυρήνες τανυστών, τους οποίους χρησιμοποιεί λογισμικό σύγχρονης inference. Κάτω από αυτό, επιστρέφει σε πιο αργές διαδρομές κώδικα για μοντέλα ποσοτικοποίησης.

03

Quadro K6000 SDI— ποια είναι η διεπαφή bus που χρησιμοποιεί;

Χρησιμοποιεί PCIe 3.0 x16. Αυτό διέπει πόσο γρήγορα φορτώνεται ένα μοντέλο στην κάρτα αντί για το πόσο γρήγορα τρέχει μόλις φορτωθεί, οπότε κοστίζει μερικά δευτερόλεπτα κατά την εκκίνηση και τίποτα κατά τη διάρκεια της γεννήσεως.

04

Quadro K6000 SDI— είναι καλό για να τρέξετε τοπικά AI μοντέλα;

Η μνήμη του καλύπτει μικρά και μεσαία μοντέλα, αν και τα μεγαλύτερα είναι εκτός εμβέλειας, ενώ το εύρος ζώνης του σημαίνει ότι η γενιά θα φαίνεται αργή σε μεγαλύτερα μοντέλα. Στο σύνολό της, τρέχει 396 των μοντέλων που παρακολουθούμε. Εάν αυτό είναι αρκετό εξαρτάται αποκλειστικά από το ποιο μοντέλο θέλετε — ο παραπάνω πίνακας απαντά σε αυτό απευθείας.

05

Quadro K6000 SDI— μπορεί να τρέξει ένα μοντέλο που δεν χωράει στη μνήμη του;

Μπορεί να διαχωριστεί, με την υπερχείλιση να κρατείται στη μνήμη συστήματος πέρα από την κάρτα. 12 GB τραβάει ολόκληρο το πράγμα κάτω, και κανένα από τα στοιχεία σε αυτή τη σελίδα δεν το υποθέτει.

06

Θα μπορούσαν δύο Quadro K6000 SDI οι κάρτες θα είναι δύο φορές πιο γρήγορες;

Η χωρητικότητα προστίθεται, η ροή δεν προστίθεται. Δύο από αυτά σας δίνουν 24 GB που σας επιτρέπει να κρατάτε μοντέλα που κανένα από τα δύο δεν θα μπορούσε να κρατήσει μόνο του, αλλά η γενιά δεν χωρίζει με αυτόν τον τρόπο. Αυτές οι αριθμοί περιγράφουν μια κάρτα.

07

Quadro K6000 SDI— ποια AI μοντέλα μπορεί να εκτελέσει;

396 του 679 Οι ανοιχτού τύπου γλωσσικοί μοντέλοι που παρακολουθούμε ταιριάζουν σε αυτή την κάρτα και μπορούν να εκτελούνται τοπικά. Ο πίνακας σε αυτή τη σελίδα απαριθμεί τον καθένα, με τη μνήμη που χρειάζεται, την ποσοτικοποίηση στην οποία εκτελείται και μια εκτιμώμενη ταχύτητα παραγωγής.

08

Quadro K6000 SDI— ποιο είναι το μεγαλύτερο AI μοντέλο που μπορεί να τρέξει;

Το μεγαλύτερο μοντέλο στον κατάλογό μας που χωράει είναι ERNIE-4.5-21B-A3B σε 21B παραμέτρους, συμπιεσμένο σε Q3_K_M. Παράγει περίπου 74.1 δεσμεύσεις ανά δευτερόλεπτο και χρειάζονται περίπου 10.1 GB της μνήμης της κάρτας.

09

Quadro K6000 SDI— πόσοι τόκεν ανά δευτερόλεπτο παράγει;

Εξαρτάται από το ΜΟΝΤΕΛΟ. Το πιο γρήγορο ΜΟΝΤΕΛΟ που παρακολουθούμε εδώ είναι Gemma 3 QAT 1B γύρω από 104 διακυμάνσεις ανά δευτερόλεπτο, ενώ μεγαλύτερα μοντέλα τρέχουν αναλογικά πιο αργά επειδή κάθε διακυμάνση απαιτεί την ανάγνωση ολόκληρου του μοντέλου από τη μνήμη μία φορά. Οι ταχύτητες είναι εκτιμήσεις για μία μόνο συνομιλία τη φορά.

10

Quadro K6000 SDI— μπορεί να τρέξει 7B μοντέλα;

Ναι. Για παράδειγμα τρέχει. DeepSeek Coder 6.7B σε Q6_K, χρησιμοποιώντας περίπου 9.9 GB μνήμης και δημιουργία γύρω από 22.5 tokens ανά δευτερόλεπτο

11

Quadro K6000 SDI— μπορεί να τρέξει 13B μοντέλα;

Ναι. Για παράδειγμα τρέχει. DeepSeekMoE-16B σε Q4_K_M, χρησιμοποιώντας περίπου 10.0 GB μνήμης και δημιουργία γύρω από 83.2 tokens ανά δευτερόλεπτο

12

Quadro K6000 SDI— πόση μνήμη έχει;

Αυτή η GPU έχει 12 GB του GDDR5. Γύρω από το ένα δέκατο είναι δεσμευμένο από την εκτέλεση συμπερασμού και τον οδηγό, αφήνοντας περίπου 10.8 GB διαθέσιμο για ένα μοντέλο και τη συζήτησή του.

13

Quadro K6000 SDI— ποια είναι η εύρος ζώνης μνήμης της;

Η μνημονική εύρος ζώνης φτάνει 288 GB/s πέρα από ένα λεωφορείο του 384 μπίτ. Αυτή είναι η μοναδική καλύτερη πρόβλεψη για το πόσο γρήγορα παράγει κείμενο, επειδή η παραγωγή κάθε token σημαίνει την ανάγνωση ολόκληρου του μοντέλου έξω από τη μνήμη μία φορά.

14

Quadro K6000 SDI— ποιο τύπο μνήμης χρησιμοποιεί;

Χρησιμοποιεί GDDR5 χρονισμένος σε 1.5 GHz. Οι τύποι HBM βρίσκονται σε επιταχυντές κέντρων δεδομένων και διαθέτουν πολύ περισσότερη εύρυθμη απόδοση από την GDDR που χρησιμοποιείται σε GPU καρτών επιτραπέζιου υπολογιστή, γι' αυτό και δημιουργούν tokens σημαντικά πιο γρήγορα με την ίδια χωρητικότητα.

15

Quadro K6000 SDI— ποιος το κατασκευάζει;

Αυτό είναι ένα προϊόν του NVIDIA, με το τσιπ που κατασκευάστηκε από TSMC, σε μια διαδικασία της 28 νμ.

16

Quadro K6000 SDI— πότε κυκλοφόρησε;

Δημοσιεύτηκε το July 2013.

17

Quadro K6000 SDI— πόση ισχύς χρησιμοποιεί;

Η αξιολογούμενη ισχύς της κάρτας είναι 239 W, και η προτεινόμενη τροφοδοσία συστήματος είναι 550 W. Η δημιουργία κειμένου απαιτεί ένταση σε εκρήξεις και είναι σε κατάσταση αναμονής μεταξύ των αιτημάτων, οπότε η μέση κατανάλωση κατά τη διάρκεια μιας εργάσιμης συνεδρίας είναι κανονικά πολύ κάτω από την αξιολογούμενη τιμή.

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το υλικό. Αν ήδη ξέρετε ποιο ΜΟΝΤΕΛ θέλετε και χρειάζεστε να ξέρετε τι απαιτείται για να το ΤΡΕΞΕΤΕ., Αρχίστε από το ΜΟΝΤΕΛΟ..

Όλες οι GPUs