Υπολογίστε την TPS του Jetson Orin Nano Super σε τοπικά AI μοντέλα
Κάθε μοντέλο στον κατάλογό μας αξιολογήθηκε σε σχέση με αυτή την ΚΑΡΤΑ στη διάρκεια του CONTEXT LENGTH και της ελάχιστης ποιότητας που επιλέγετε. Η ταχύτητα είναι μια εκτίμηση για ένα μόνο αίτημα, υπολογισμένη από το MEMORY BANDWIDTH αυτής της ΚΑΡΤΑΣ και το μέγεθος κάθε μοντέλου μόλις συμπιεστεί..
Υπολογίστηκε για αυτήν την κάρτα
679 μοντέλα στον κατάλογό μας συνολικά
Το μεγαλύτερο μοντέλο που κρατάει
Baichuan 1-13B
13.3B · Q3_K_M · 8.8 tok/s
Ταχύτερο μοντέλο
Gemma 3 QAT 1B
43.4 tok/s · 1B
Ποια AI μοντέλα μπορούν να τρέξουν σε μια Jetson Orin Nano Super?
Ορίστε τις εισόδους, διαβάστε την απάντηση
Περισσότερα συμφραζόμενα σημαίνει περισσότερη μνήμη για την κρυφή μνήμη της συνομιλίας. Η ταχύτητα είναι για μια νέα συνομιλία και δεν αλλάζει με αυτή τη ρύθμιση..
Κρύβει μοντέλα που θα χωρούσαν μόνο αν συμπιεστούν κάτω από αυτό το σημείο.
337 τα μοντέλα ταιριάζουν
Υπολογισμός| Ποσοτικοποίηση | Καλά | ||||||
|---|---|---|---|---|---|---|---|
|
43.4
tok/s
37–52 |
Gemma 3 1B | 1B | Mar 2025 | 1.8 GB | 33k μουσικά κομμάτια | Q8_0 | Άνετο |
|
43.4
tok/s
37–52 |
Gemma 3 QAT 1B | 1B | Apr 2025 | 1.8 GB | 33k μουσικά κομμάτια | Q8_0 | Άνετο |
|
43.4
tok/s
26–69 · χαμηλή εμπιστοσύνη |
HGRN 1B (WT 103) ≈ | 1B | Nov 2023 | 1.8 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
43.4
tok/s
26–69 · χαμηλή εμπιστοσύνη |
LLama 3..2 Typhoon 2 1B ≈ | 1B | Dec 2024 | 1.8 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
43.4
tok/s
26–69 · χαμηλή εμπιστοσύνη |
OLMo-1B ≈ | 1B | Feb 2024 | 1.8 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
43.4
tok/s
26–69 · χαμηλή εμπιστοσύνη |
Pythia-1b ≈ | 1B | Apr 2023 | 1.8 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
40.2
tok/s
24–64 · χαμηλή εμπιστοσύνη |
OpenELM-1.1B ≈ | 1.1B | May 2024 | 1.9 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
39.4
tok/s
24–63 · χαμηλή εμπιστοσύνη |
DeciCoder-1B ≈ | 1.1B | Aug 2023 | 1.9 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
39.4
tok/s
24–63 · χαμηλή εμπιστοσύνη |
SantaCoder ≈ | 1.1B | Jan 2023 | 1.9 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
39.4
tok/s
24–63 · χαμηλή εμπιστοσύνη |
TinyLlama-1.1B (1T token checkpoint) ≈ | 1.1B | Oct 2023 | 1.9 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
39.4
tok/s
24–63 · χαμηλή εμπιστοσύνη |
TinyLlama-1.1B (3T token checkpoint) ≈ | 1.1B | Oct 2023 | 1.9 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
36.1
tok/s
22–58 · χαμηλή εμπιστοσύνη |
EXAONE 4.0 (1.2B) ≈ | 1.2B | Jul 2025 | 2.0 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
36.1
tok/s
22–58 · χαμηλή εμπιστοσύνη |
MinerU2.5 ≈ | 1.2B | Sep 2025 | 2.0 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
36.1
tok/s
22–58 · χαμηλή εμπιστοσύνη |
Pleias 1.0 1.2B ≈ | 1.2B | Dec 2024 | 2.0 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
36.1
tok/s
22–58 · χαμηλή εμπιστοσύνη |
Pleias-RAG-1B ≈ | 1.2B | Apr 2025 | 2.0 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
35.3
tok/s
30–42 |
Llama 3.2 1B | 1.2B | Sep 2024 | 2.2 GB | 131k μουσικά κομμάτια | Q8_0 | Άνετο |
|
34.8
tok/s
21–56 · χαμηλή εμπιστοσύνη |
MiniCPM-1.2B ≈ | 1.2B | Jun 2024 | 2.0 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
DeepSeek Coder 1.3B ≈ | 1.3B | Jan 2024 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
DeepSeek-VL-1.3B ≈ | 1.3B | Mar 2024 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
DigiRL ≈ | 1.3B | Jun 2024 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
GLA Transformer 1.3B ≈ | 1.3B | Aug 2024 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
Janus 1.3B ≈ | 1.3B | Oct 2024 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
Kosmos-2.5 ≈ | 1.3B | Aug 2024 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
Otter ≈ | 1.3B | May 2023 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
|
33.4
tok/s
20–53 · χαμηλή εμπιστοσύνη |
Phi-1 ≈ | 1.3B | Oct 2023 | 2.1 GB | 131k μουσικά κομμάτια ? | Q8_0 | Άνετο |
Οι ταχύτητες είναι εκτιμήσεις για ένα μόνο αίτημα — μία συνομιλία τη φορά — υπολογισμένες από την μνήμη, το μέγεθος του μοντέλου και την ποσοτικοποίηση. Η πραγματική διακύμανση έξοδου ποικίλλει με τον χρόνο εκτέλεσης συμπερασμάτων και την έκδοσή του. Οι αριθμοί που δημοσιεύονται από τους προμηθευτές υλικού μετρούν πολλές ταυτόχρονες αιτήσεις και είναι πολύ υψηλότεροι..
Σε καταγραφή
Jetson Orin Nano Super Πλήρης προδιαγραφή
Τα πάντα σε αρχείο για αυτήν την κάρτα, ταξινομημένα κατά πόσο σχετίζονται με τη λειτουργία ενός AI μοντέλου παρά σύμφωνα με το πώς θα το κατέγραφε ένα φύλλο προδιαγραφών. Η ΜΝΗΜΗ έρχεται πρώτη γιατί αποφασίζει το αποτέλεσμα; το υπόλοιπο είναι CONTEXT..
Μνήμη
Οι δύο προδιαγραφές που αποφασίζουν ποιο μοντέλο μπορεί να τρέξει αυτή η ΚΑΡΤΑ και με ποια ταχύτητα. Η ικανότητα καθορίζει ποια μοντέλα ταιριάζουν· το bandwidth καθορίζει πόσα tokens ανά δευτερόλεπτο παράγουν μόλις ταιριάξουν.
- Μέγεθος μνήμης
- 8 GB
- Μνήμη εύρους ζώνης
- 102 GB/s
- Τύπος μνήμης
- LPDDR5
- Πλάτος διαύλου μνήμης
- 128 bit
- Ρολογιά μνήμης
- 800 MHz
Το τσιπ
Ποιος επεξεργαστής είναι πάνω στην πλακέτα και πώς κατασκευάστηκε. Ένα μικρότερο μέγεθος διαδικασίας γενικά σημαίνει περισσότερη απόδοση για την ίδια ισχύ.
- Γραφικός επεξεργαστής
- GA10B
- Αρχιτεκτονική
- Ampere
- Γενιά
- Tegra(Ampere)
- Μέταλλο
- Samsung
- Μέγεθος διαδικασίας
- 8 nm
- Μέγεθος τσιπ
- 200 mm²
- Απελευθερώθηκε
- 17 December 2024
Ταχύτητες ρολογιού
Πόσο γρήγορα λειτουργεί ο επεξεργαστής. Αξίζει πολύ λιγότερο εδώ από ό,τι σε ένα gaming benchmark: η δημιουργία κειμένου περιορίζεται από το MEMORY BANDWIDTH, έτσι μια υψηλότερη συχνότητα barely moves το αποτέλεσμα.
- Βασική συχνότητα
- 1.02 GHz
- Ωθήσει ρολογιού
- 1.02 GHz
Μονάδες Επεξεργασίας
Τι περιέχει το τσιπ. Αυτά οδηγούν την απόδοση γραφικών και έχουν σημασία κυρίως για την επεξεργασία μιας μακράς προτροπής αντί για την παραγωγή της απάντησης.
- Μονάδες σκίασης
- 1,024
- Μονάδες Χαρτογράφησης Υφής
- 32
- Μονάδες εξόδου απόδοσης
- 16
- Ροή πολλών επεξεργαστών
- 8
- Πυρήνες Tensor
- 32
- L1 κρυφή μνήμη
- 128 KB
- L2 κρυφή μνήμη
- 2 MB
Θεωρητική Απόδοση
Οι κορυφαίοι ρυθμοί αριθμητικών υπολογισμών που δημοσιεύθηκαν για την κάρτα. Αυτές είναι ανώτατα όρια που καμία πραγματική εργασία δεν φτάνει, και η παραγωγή κειμένου φτάνει μόνο σε ένα μικρό ποσοστό αυτών επειδή περιορίζεται από τη μνήμη αντί για την αριθμητική.
- Μισή ακρίβεια (FP16)
- 4.2 TFLOPS
- Μονή ακρίβεια (FP32)
- 2.1 TFLOPS
- Ρυθμός εικονοστοιχείων
- 16 GPixel/s
- Ρυθμός υφής
- 33 GTexel/s
Η πλακέτα
Τι απαιτείται για να εγκαταστήσετε φυσικά και να τροφοδοτήσετε την ΚΑΡΤΑ — οι πρακτικοί περιορισμοί που αποφασίζουν αν ταιριάζει στη μηχανή που ήδη έχετε.
- Κατανάλωση ενέργειας (TDP)
- 25 W
- Διασύνδεση λεωφορείου
- PCIe 4.0 x4
- Πλάτος υποδοχής
- IGP
- Διαστάσεις
- 70 mm
Υποστήριξη λογισμικού
Ποιες γραφικές και υπολογιστικές διεπαφές υποστηρίζει η κάρτα. Η δυνατότητα υπολογισμού CUDA είναι αυτή που επηρεάζει την εκτίμηση: κάτω από 7.0 δεν υπάρχουν πυρήνες tensor, και το σύγχρονο λογισμικό εκτίμησης επιστρέφει σε πιο αργούς κωδικούς.
- ικανότητα υπολογισμού CUDA
- 8.7
- DirectX
- 12.2
- OpenGL
- 4.6
- Βούλκαν
- 1.4
- OpenCL
- 3.0
- Μοντέλο Σκίασης
- 6.8
Καταχωρίσεις
Πού να αγοράσω ένα Jetson Orin Nano Super
Κανένας προμηθευτής δεν καταχωρεί αυτήν την κάρτα αυτή τη στιγμή. Οι καταχωρίσεις προέρχονται από προμηθευτές που τις δημοσιεύουν εδώ απευθείας. — περιηγηθείτε στον κατάλογο προμηθευτών να δεις ποιος πουλάει τι.
Τι σημαίνουν οι αριθμοί
Γιατί η μνήμη είναι ο αριθμός που έχει σημασία εδώ
Μνήμη
8 GB
Εύρος ζώνης
102 GB/s
Μεγαλύτερο μοντέλο
Baichuan 1-13B
Jetson Orin Nano Super κρατά μόνο 8 GB του LPDDR5. Αυτό περιορίζει το μοντέλο στο μικρότερο άκρο του καταλόγου, και ένα μοντέλο πρέπει να χωράει ολόκληρο πριν δημιουργήσει οτιδήποτε. Ένα runtime στην πραγματικότητα παίρνει περίπου 7.2 GB.
Η μνημονική εύρος ζώνης φτάνει 102 GB/s πέρα από ένα λεωφορείο του 128 μπίτ. Η διαύγεια είναι ο πραγματικός περιορισμός αυτής της κάρτας. Κάθε τοκέν απαιτεί την ανάγνωση ολόκληρου του μοντέλου από την VRAM, οπότε ένα μεγάλο μοντέλο θα αισθάνεται αργό εδώ ακόμα και όταν χωράει.
Το bandwidth είναι συχνότητα επί πλάτους του λεωφορείου, και αυτή η κάρτα ρολογίζει τη μνήμη της στο 800 MHz. Διεύρυνση του λεωφορείου και αύξηση του ρολογιού είναι οι δύο μοχλοί που έχει ένας κατασκευαστής, γι' αυτό και μια κάρτα με αδιάφορους πυρήνες μπορεί ακόμα να παράγει γρήγορα.
Η πρακτική οροφή είναι Baichuan 1-13B, 13.3B, συμπιεσμένο σε Q3_K_M και δημιουργώντας γύρω 8.8 tokens ανά δευτερόλεπτο
Το τσιπ και πώς κατασκευάστηκε
Jetson Orin Nano Super είναι κατασκευασμένο πάνω στον επεξεργαστή γραφικών GA10B, χρησιμοποιώντας την αρχιτεκτονική Ampere από NVIDIA, ως μέρος της γενιάς Tegra(Ampere).
Το τσιπ κατασκευάζεται από Samsung, σε μια διαδικασία της 8 νμ, με ένα ζάρι που μετράει 200 mm². Μια μικρότερη διαδικασία σημαίνει γενικά περισσότερη απόδοση για την ίδια ισχύ, αν και για τα γλωσσικά μοντέλα έχει πολύ λιγότερη σημασία από το υποσύστημα μνήμης.
Δημοσιεύτηκε το December 2024, χονδρικά 1.6217684160692 χρόνια πριν. Η υποστήριξη λογισμικού INFERENCE τείνει να ακολουθεί την υλικοτεχνική υποδομή κατά ένα ή δύο χρόνια, οπότε μια κάρτα αυτής της ηλικίας γενικά διαθέτει ώριμους, καλά βελτιστοποιημένους κώδικες που της είναι διαθέσιμοι.
Διαδικασία υπολογισμού, και γιατί έχει λιγότερη σημασία απ' ότι φαίνεται
FP16
4.2 TFLOPS
Πυρήνες Tensor
32
Στο χαρτί Jetson Orin Nano Super φθάνει 4.2 TFLOPS σε μισή ακρίβεια, και 2.1 TFLOPS σε απλή ακρίβεια. Αυτά είναι κορυφαία νούμερα που κανένα πραγματικό φορτίο δεν υποστηρίζει, και η γενετική κειμένων φτάνει μόνο σε ένα μικρό ποσοστό τους - η αποκωδικοποίηση περιορίζεται από τη μνήμη παρά από την αριθμητική, γι' αυτό μια κάρτα μπορεί να φαίνεται εξαιρετικά ισχυρή εδώ και να παράγει ακόμα μικρές μονάδες με έναν κανονικό ρυθμό.
Η ΚΑΡΤΑ φέρει 32 Πυρήνες Tensor διάσπαρτα 8 Ροή πολλών επεξεργαστών. Αυτά επιταχύνουν τη μητρική αριθμητική που είναι στην καρδιά ενός μετασχηματιστή, και είναι αυτά που κάνουν την επεξεργασία προτροπών — διαβάζοντας ένα μεγάλο έγγραφο πριν απαντήσουν — δραματικά ταχύτερη από ό,τι θα ήταν διαφορετικά.
Οι ρολόγια τρέχουν από μια βάση του 1.02 GHz σε μια αύξησηของ 1.02 GHz. Αξίζει πολύ λιγότερο εδώ από ό,τι σε ένα gaming benchmark: η αύξηση των ρολογιών επιταχύνει την αριθμητική, και η αριθμητική δεν είναι αυτό που περιμένει η γενιά.
Κρυφή μνήμη και μονάδες επεξεργασίας
Jetson Orin Nano Super έχει L1 cache της 128 KB, υποστηριζόμενο από μια L2 cache του 2 MB. Η Cache απορροφά ένα μερίδιο της κίνησης μνήμης που αλλιώς θα έπληττε το κύριο λεωφορείο, το οποίο είναι το μόνο μέρος σε αυτή τη σελίδα όπου ένας αριθμός διαφορετικός από τη bandwidth επηρεάζει ήσυχα την ταχύτητα δημιουργίας - μια μεγάλη L2 επιτρέπει περισσότερα από το working set να παραμένουν κοντά στους πυρήνες.
Υπάρχουν 1,024 Μονάδες σκίασης, 32 Μονάδες Χαρτογράφησης Υφής, και 16 Μονάδες εξόδου απόδοσης. Αυτά οδηγούν τα γραφικά φορτία εργασίας και συμβάλλουν στην επεξεργασία εντολών, αλλά παραμένουν ανενεργά για μεγάλο μέρος του χρόνου που χρειάζεται ένα μοντέλο για να παράγει μια απάντηση.
Ικανότητα, μέγεθος και εγκατάσταση
Κατανάλωση ενέργειας
25 W
Jetson Orin Nano Super βαθμολογείται σε 25 W. Η εκτέλεση ενός γλωσσικού μοντέλου κρατά μια κάρτα απασχολημένη σε εκρήξεις παρά συνεχώς — απορροφά έντονα κατά τη διαδικασία παραγωγής και αδρανεί μεταξύ των αιτημάτων — έτσι η διαρκής κατανάλωση κατά τη διάρκεια μιας εργάσιμης ημέρας είναι συνήθως πολύ κάτω από την αναγραφόμενη τιμή.
Η κάρτα καταλαμβάνει igp, μετρήσεις 70 μμ μήκους. Αξίζει να ελεγχθεί σε σχέση με την περίπτωση και την τροφοδοσία που είναι ήδη στη μηχανή, καθώς οι μεγαλύτερες κάρτες χρειάζονται σημαντικά περισσότερα και από τα δύο σε σύγκριση με ό,τι παρέχει ένα τυπικό επιτραπέζιο.
Συνδέεται μέσω PCIe 4.0 x4. Η διεπαφή ρυθμίζει πόσο γρήγορα ένα μοντέλο φορτώνεται από το δίσκο στην κάρτα, όχι πόσο γρήγορα εκτελείται μόλις εκεί, έτσι μια στενότερη σύνδεση κοστίζει μερικά δευτερόλεπτα στην εκκίνηση και τίποτα μετά από αυτό.
Οι ακραίοι
Οι μεγαλύτεροι AI μοντέλα που τρέχουν σε μια Jetson Orin Nano Super
Τα μεγαλύτερα OPEN WEIGHT μοντέλα που ταιριάζουν σε αυτή την CARD, τα νεότερα πρώτα. Κάθε ένα εμφανίζεται με την καλύτερη συμπίεση που μπορεί να κρατήσει η CARD..
Οι ταχύτεροι AI μοντέλα σε μια Jetson Orin Nano Super
Όπου αυτή η ΚΑΡΤΑ παράγει τούβλα γρηγορότερα. Μικρότερα μοντέλα κυριαρχούν εδώ, επειδή η παραγωγή κάθε τούβλου σημαίνει να διαβάζουμε ολόκληρο το μοντέλο από τη μνήμη μία φορά..
Βήμα προς βήμα
Πώς να υπολογίσετε τους TOKENS ανά ΔΕΥΤΕΡΟΛΕΠΤΟ ενός Jetson Orin Nano Super
Δεν χρειάζεται να υπολογίσετε τίποτα με το χέρι — ο υπολογιστής gputps.com σε αυτή τη σελίδα έχει ήδη υπολογίσει για κάθε μοντέλο που μπορεί να κρατήσει αυτή η κάρτα. Η ανάγνωση της απάντησης απαιτεί έξι βήματα..
-
01
Βρείτε το μοντέλο στον πίνακα
Ο πίνακας απαριθμεί 337 μοντέλα που αυτή η κάρτα μπορεί να τρέξει. Αναζητήστε με όνομα, ή με μέγεθος — η πληκτρολόγηση 27b ταιριάζει στον αριθμό παραμέτρων ακόμα κι αν το όνομα δεν το αναφέρει ποτέ.
-
02
Ορίστε το μήκος του πλαισίου (context length) που θα χρησιμοποιήσεις πραγματικά
Οι μεγαλύτερες συζητήσεις κοστίζουν VRAM πάνω από τα βάρη. Εναντίον 8 GB έτσι οι ρυθμίσεις αξίζουν να γίνουν σωστά.
-
03
Επιλέξτε πόσο μακριά θα συμπιέσετε
Από προεπιλογή, ο πίνακας επιλέγει την λιγότερο συμπιεσμένη αντιγραφή που χωράει. Η ρύθμιση ενός κατωφλιού αφαιρεί τα μοντέλα που πληρούν προϋποθέσεις μόνο μέσω βαριάς συμπίεσης.
-
04
Κοίτα το φάσμα, όχι μόνο τον αριθμό
Κάθε ταχύτητα είναι μια εκτίμηση για μια μεμονωμένη συνομιλία, με μια κλίμακα από κάτω της. Η κορυφαία τιμή εδώ είναι 43.4 τόκ/σ σε Gemma 3 QAT 1B. Η ίδια κάρτα και μοντέλο διαφέρει κατά τριάντα έως πενήντα τοις εκατό μεταξύ των χρόνων εκτέλεσης συμπερασμάτων.
-
05
Έλέγξτε τον χώρο πριν αποφασίσετε
Μια στενή εφαρμογή τρέχει αλλά δεν αφήνει χώρο για να αυξήσει το context αργότερα; άνετη έχει περιθώριο. Η στήλη μνήμης δείχνει τι χρειάζεται κάθε μοντέλο σε σχέση με διαθέσιμο. 8 GB.
-
06
Έλεγξε το ίδιο μοντέλο από την άλλη πλευρά
Κάθε όνομα μοντέλου στον πίνακα συνδέεται με τη δική του σελίδα, η οποία εκτελεί τον ίδιο υπολογισμό σε κάθε κάρτα που διατηρούμε. Εκεί είναι που βλέπετε εάν η σωστή αγορά είναι Jetson Orin Nano Super.
Απαντήσεις
Jetson Orin Nano Super — κοινές ερωτήσεις
Jetson Orin Nano Super— ποιο τύπο μνήμης χρησιμοποιεί;
Χρησιμοποιεί LPDDR5 χρονισμένος σε 800 MHz. Οι τύποι HBM βρίσκονται σε επιταχυντές κέντρων δεδομένων και διαθέτουν πολύ περισσότερη εύρυθμη απόδοση από την GDDR που χρησιμοποιείται σε GPU καρτών επιτραπέζιου υπολογιστή, γι' αυτό και δημιουργούν tokens σημαντικά πιο γρήγορα με την ίδια χωρητικότητα.
Jetson Orin Nano Super— ποιος το κατασκευάζει;
Αυτό είναι ένα προϊόν του NVIDIA, με το τσιπ που κατασκευάστηκε από Samsung, σε μια διαδικασία της 8 νμ.
Jetson Orin Nano Super— πότε κυκλοφόρησε;
Δημοσιεύτηκε το December 2024.
Jetson Orin Nano Super— πόση ισχύς χρησιμοποιεί;
Η αξιολογούμενη ισχύς της κάρτας είναι 25 W. Η δημιουργία κειμένου απαιτεί ένταση σε εκρήξεις και είναι σε κατάσταση αναμονής μεταξύ των αιτημάτων, οπότε η μέση κατανάλωση κατά τη διάρκεια μιας εργάσιμης συνεδρίας είναι κανονικά πολύ κάτω από την αξιολογούμενη τιμή.
Jetson Orin Nano Super— πόσο cache έχει;
Η μνήμη L1 είναι 128 KB, και η L2 cache είναι 2 MB. Η Cache απορροφά μέρος της μνήμης κυκλοφορίας που θα έφτανε αλλιώς στον κύριο διαδικτυακό κόμβο, έτσι μια μεγαλύτερη L2 δίνει μια μέτρια αύξηση στην ταχύτητα γενετικά πέρα από αυτό που προ predicts η μόνο πλά bandwidth.
Jetson Orin Nano Super— ποιοι είναι οι TFLOPS του;
Αξιολογείται σε 4.2 TFLOPS σε μισή ακρίβεια και 2.1 TFLOPS σε μονή ακρίβεια. Αυτά είναι αιχμές αριθμητικών ανώτατων ορίων αντί για επιτεύξιμες τιμές, και η παραγωγή κειμένου φτάνει μόνο ένα μικρό κλάσμα αυτών επειδή περιορίζεται από την μπαλαντέρ μνήμης αντί.
Jetson Orin Nano Super— πόσους πυρήνες τензόρ έχει;
Έχει 32 Πυρήνες Tensor διάσπαρτα 8 Ροή πολλών επεξεργαστών. επιταχύνουν την αρνητική άλγεβρα από την οποία είναι χτισμένος ένας μετασχηματιστής, ο οποίος κυρίως επιταχύνει την επεξεργασία μιας μεγάλης πρότασης παρά την παραγωγή της απάντησης.
Jetson Orin Nano Super— υποστηρίζει CUDA;
Ναι. Αναφέρει την ικανότητα υπολογισμού CUDA. 8.7. Η δυνατότητα 7.0 και άνω έχει πυρήνες τανυστών, τους οποίους χρησιμοποιεί λογισμικό σύγχρονης inference. Κάτω από αυτό, επιστρέφει σε πιο αργές διαδρομές κώδικα για μοντέλα ποσοτικοποίησης.
Jetson Orin Nano Super— ποια είναι η διεπαφή bus που χρησιμοποιεί;
Χρησιμοποιεί PCIe 4.0 x4. Αυτό διέπει πόσο γρήγορα φορτώνεται ένα μοντέλο στην κάρτα αντί για το πόσο γρήγορα τρέχει μόλις φορτωθεί, οπότε κοστίζει μερικά δευτερόλεπτα κατά την εκκίνηση και τίποτα κατά τη διάρκεια της γεννήσεως.
Jetson Orin Nano Super— είναι καλό για να τρέξετε τοπικά AI μοντέλα;
Η μνήμη του περιορίζει τα μικρότερα μοντέλα, αν και το εύρος ζώνης του σημαίνει ότι η γενιά θα είναι αργή σε μεγαλύτερα μοντέλα. Στην συνολική του λειτουργία είναι 337 των μοντέλων που παρακολουθούμε. Εάν αυτό είναι αρκετό εξαρτάται αποκλειστικά από το ποιο μοντέλο θέλετε — ο παραπάνω πίνακας απαντά σε αυτό απευθείας.
Jetson Orin Nano Super— μπορεί να τρέξει ένα μοντέλο που δεν χωράει στη μνήμη του;
Μόνο μερικώς. Επίπεδα πέρα από την κάρτα. 8 GB είναι πιθανό και συνήθως μια ψευδής οικονομία: το ποσοστό μνήμης-συστήματος είναι αρκετά αργό ώστε να κυριαρχεί στο αποτέλεσμα.
Θα μπορούσαν δύο Jetson Orin Nano Super οι κάρτες θα είναι δύο φορές πιο γρήγορες;
Η ζεύγωση τους αγοράζει περιθώριο αντί για ταχύτητα: 16 GB συνδυασμένης μνήμης, με περίπου την ίδια ταχύτητα γενιάς όπως μία.
Jetson Orin Nano Super— ποια AI μοντέλα μπορεί να εκτελέσει;
337 του 679 Οι ανοιχτού τύπου γλωσσικοί μοντέλοι που παρακολουθούμε ταιριάζουν σε αυτή την κάρτα και μπορούν να εκτελούνται τοπικά. Ο πίνακας σε αυτή τη σελίδα απαριθμεί τον καθένα, με τη μνήμη που χρειάζεται, την ποσοτικοποίηση στην οποία εκτελείται και μια εκτιμώμενη ταχύτητα παραγωγής.
Jetson Orin Nano Super— ποιο είναι το μεγαλύτερο AI μοντέλο που μπορεί να τρέξει;
Το μεγαλύτερο μοντέλο στον κατάλογό μας που χωράει είναι Baichuan 1-13B σε 13.3B παραμέτρους, συμπιεσμένο σε Q3_K_M. Παράγει περίπου 8.8 δεσμεύσεις ανά δευτερόλεπτο και χρειάζονται περίπου 7.2 GB της μνήμης της κάρτας.
Jetson Orin Nano Super— πόσοι τόκεν ανά δευτερόλεπτο παράγει;
Εξαρτάται από το ΜΟΝΤΕΛΟ. Το πιο γρήγορο ΜΟΝΤΕΛΟ που παρακολουθούμε εδώ είναι Gemma 3 QAT 1B γύρω από 43.4 διακυμάνσεις ανά δευτερόλεπτο, ενώ μεγαλύτερα μοντέλα τρέχουν αναλογικά πιο αργά επειδή κάθε διακυμάνση απαιτεί την ανάγνωση ολόκληρου του μοντέλου από τη μνήμη μία φορά. Οι ταχύτητες είναι εκτιμήσεις για μία μόνο συνομιλία τη φορά.
Jetson Orin Nano Super— μπορεί να τρέξει 7B μοντέλα;
Ναι. Για παράδειγμα τρέχει. MetaMath 7B (LLaMa finetune) σε Q4_K_M, χρησιμοποιώντας περίπου 6.5 GB μνήμης και δημιουργία γύρω από 14.3 tokens ανά δευτερόλεπτο
Jetson Orin Nano Super— μπορεί να τρέξει 13B μοντέλα;
Ναι. Για παράδειγμα τρέχει. Gemma 4 12B σε Q3_K_M, χρησιμοποιώντας περίπου 6.5 GB μνήμης και δημιουργία γύρω από 9.8 tokens ανά δευτερόλεπτο
Jetson Orin Nano Super— πόση μνήμη έχει;
Αυτή η GPU έχει 8 GB του LPDDR5. Γύρω από το ένα δέκατο είναι δεσμευμένο από την εκτέλεση συμπερασμού και τον οδηγό, αφήνοντας περίπου 7.2 GB διαθέσιμο για ένα μοντέλο και τη συζήτησή του.
Jetson Orin Nano Super— ποια είναι η εύρος ζώνης μνήμης της;
Η μνημονική εύρος ζώνης φτάνει 102 GB/s πέρα από ένα λεωφορείο του 128 μπίτ. Αυτή είναι η μοναδική καλύτερη πρόβλεψη για το πόσο γρήγορα παράγει κείμενο, επειδή η παραγωγή κάθε token σημαίνει την ανάγνωση ολόκληρου του μοντέλου έξω από τη μνήμη μία φορά.
Η άλλη κατεύθυνση
Κοιτάζοντας το από την άλλη πλευρά;
Αυτή η σελίδα ξεκινά από το υλικό. Αν ήδη ξέρετε ποιο ΜΟΝΤΕΛ θέλετε και χρειάζεστε να ξέρετε τι απαιτείται για να το ΤΡΕΞΕΤΕ., Αρχίστε από το ΜΟΝΤΕΛΟ..