SAF R-CNN
Καμία εκτίμηση
Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο
Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..
Σε καταγραφή
Πλήρης προδιαγραφή
Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..
Προέλευση
Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.
- Οργάνωση
- Beijing Institute of Technology,Sun Yat-sen University,Panasonic R&D,National University of Singapore
- Τύπος οργανισμού
- Academia,Academia,Industry,Academia
- Χώρα
- China, Singapore
- Δημοσιευμένο
- 28 October 2015
- Συγγραφείς
- Jianan Li, Xiaodan Liang, ShengMei Shen, Tingfa Xu, Jiashi Feng, Shuicheng Yan
Τι κάνει
Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.
- τομέας
- Vision
- Εργασία
- Object detection
- Προσέγγιση
- Supervised
- Βασικό μοντέλο
- VGG16
Μέγεθος
Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.
- παράμετροι
- 138M
- Δεδομένα εκπαίδευσης
- 350,000 tokens
- Εποχές
- 7
Taken from VGG16 base model, ignoring minor architectural changes
"There are totally 350,000 bounding boxes of about 2,300 unique pedestrians labeled in 250,000 frames" "We use dense sampling of the training data (every 4th frame"
Εκπαίδευση υπολογιστών
Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.
- Εκπαίδευση υπολογιστών
- 1.2 × 10¹⁹ FLOP
- Πώς ιδρύθηκε
- Operation counting
- Ρύθμιση υπολογιστών
- 2 × 10¹⁶ FLOP
Base model: 12291000000000002000 Base model inference FLOP: 15300000000 Finetune for 7 epochs with 62500 training examples 15300000000*3*62500*7=20081250000000000=2e16 Total compute: 12291000000000002000+20081250000000000=12311081250000002000
15300000000*3*62500*7=20081250000000000=2e16
Η εκπαίδευση run
Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.
- Υλικό εκπαίδευσης
- NVIDIA GeForce GTX TITAN X
- χρησιμοποιούμενα τσιπ
- 1
- Κατανάλωση ενέργειας
- 291 W
Διαθεσιμότητα
Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.
- Βάρη
- Closed — provider access only
- Πρόσβαση μοντέλου
- Unreleased
Πώς ταξινομείται
Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.
- Μοντέλο Frontier
- Yes
- Γιατί παρακολουθείται
- SOTA improvement
- Εγγραφή εμπιστοσύνης
- Likely
Pedestrian Detection on Caltech benchmark "our method achieves state-of-the-art performance on Caltech, INRIA, and ETH, and obtains competitive results on KITTI. "
Πηγές
Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.
- Αναφορά
- Scale-aware Fast R-CNN for Pedestrian Detection
- Τελευταία ενημέρωση
- 28 November 2025
Τι σημαίνουν οι αριθμοί
Τι είναι αυτό το μοντέλο
SAF R-CNN δημοσιεύθηκε από Beijing Institute of Technology,Sun Yat-sen University,Panasonic R&D,National University of Singapore, στην χώρα καταγεγραμμένη ως China, κατά τη διάρκεια October 2015. Ο εκδοτικός οργανισμός κατηγοριοποιείται ως academia,Academia,Industry,Academia.
Λειτουργεί στον τομέα της Vision, και καταγράφεται ότι εκτελεί την εργασία του object detection.
Το σημείο εκκίνησής του ήταν ένα υπάρχον μοντέλο βάσης, VGG16. Οι περισσότεροι μοντέλα σε αυτή την κλίμακα προσαρμόζονται από μια υπάρχουσα βάση παρά κατασκευάζονται από το μηδέν.
Αυτό είναι ένα κλειστό μοντέλο: οι εκπαιδευμένες τιμές παρέμειναν με όποιον τις παρήγαγε, και δεν υπάρχει τοπική έκδοση για να τρέξει.
Τι χρειάστηκε για την κατασκευή του
Η παραγωγή του απαιτούσε αριθμητική που ανήλθε περίπου 1.2 × 10¹⁹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA GeForce GTX TITAN X. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.
Το σύνολο εκπαίδευσης εκτελέστηκε σε περίπου 350,000 κωδικοί κειμένου
Το κριτήριο συμπερασμού του: sOTA improvement.
Απαντήσεις
SAF R-CNN — κοινές ερωτήσεις
SAF R-CNN— είναι ανοιχτού κώδικα;
Όχι. Τα βάρη του δεν έχουν δημοσιευθεί, οπότε υπάρχει μόνο ως υπηρεσία που ελέγχεται από τον ιδιοκτήτη του.
SAF R-CNN— πόσες παραμέτρους έχει;
Έχει αριθμό παραμέτρων 138M. Taken from VGG16 base model, ignoring minor architectural changes. Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.
SAF R-CNN— ποιος το δημιούργησε;
Δημοσιεύθηκε από Beijing Institute of Technology,Sun Yat-sen University,Panasonic R&D,National University of Singapore, βασισμένο σε China, μία οργάνωση κατηγοριοποιημένη ως academia,Academia,Industry,Academia.
SAF R-CNN— πότε κυκλοφόρησε;
Δημοσιεύθηκε σε October 2015. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.
SAF R-CNN— για τί χρησιμοποιείται;
Λειτουργεί στον τομέα της Vision, και καταγράφεται ως διαχείριση της εργασίας του object detection. Αυτές είναι οι περιοχές γύρω από τις οποίες σχεδιάστηκε; Περιγράφουν την πρόθεση παρά ένα αυστηρό όριο.
SAF R-CNN— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;
Η εκπαίδευση κατανάλωσε περίπου 1.2 × 10¹⁹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA GeForce GTX TITAN X. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.
SAF R-CNN— ποια GPU χρειάζομαι για να το τρέξω;
Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.
Η άλλη κατεύθυνση
Κοιτάζοντας το από την άλλη πλευρά;
Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.