JFT

Κλειστές βαρύτητες Google Research,Carnegie Mellon University (CMU) 44.7M παράμετροι July 2017

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
Google Research,Carnegie Mellon University (CMU)
Τύπος οργανισμού
Industry,Academia
Χώρα
United States of America
Δημοσιευμένο
10 July 2017
Συγγραφείς
Chen Sun, Abhinav Shrivastava, Saurabh Singh, Abhinav Gupta

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Vision
Εργασία
Image classification, Object detection, Semantic segmentation, Pose estimation
Αριθμητική μορφή
FP32

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
44.7M

Uses ResNet-101 architecture, which has 44,654,504 parameters: https://resources.wolframcloud.com/NeuralNetRepository/resources/ResNet-101-Trained-on-ImageNet-Competition-Data/

Δεδομένα εκπαίδευσης
5,487,300,000,000 tokens
Εποχές
4
Μέγεθος παρτίδας
32

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Εκπαίδευση υπολογιστών
8.4 × 10²⁰ FLOP

Tesla K80 performance: 8.13 TFLOP/s Assume 40% utilization 60 days * 50 GPUs * 40% utilization * 8.13 TFLOP/s/GPU = 8.43*10^20 FLOP

Πώς ιδρύθηκε
Hardware

Η εκπαίδευση run

Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.

Υλικό εκπαίδευσης
NVIDIA Tesla K80
χρησιμοποιούμενα τσιπ
50
Τσιπ-ώρες
72,000
Χρόνος τοίχου
1,440 hours (60 days)
Κατανάλωση ενέργειας
31.3 kW
Κόστος υπολογισμού
$17,911

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Μοντέλο Frontier
Yes
Γιατί παρακολουθείται
SOTA improvement

SOTA on COCO and PASCAL VOC

Εγγραφή εμπιστοσύνης
Confident
Παραπομπές
2,712

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Revisiting Unreasonable Effectiveness of Data in Deep Learning Era.
Τελευταία ενημέρωση
25 May 2026

Τι σημαίνουν οι αριθμοί

Από πού προήλθε

JFT δημοσιεύθηκε από Google Research,Carnegie Mellon University (CMU), στην χώρα καταγεγραμμένη ως United States of America, κατά τη διάρκεια July 2017. Ο εκδοτικός οργανισμός κατηγοριοποιείται ως industry,Academia.

Λειτουργεί στον τομέα της Vision, και καταγράφεται ότι εκτελεί την εργασία του image classification, Object detection, Semantic segmentation, Pose estimation.

Αυτό είναι ένα κλειστό μοντέλο: οι εκπαιδευμένες τιμές παρέμειναν με όποιον τις παρήγαγε, και δεν υπάρχει τοπική έκδοση για να τρέξει.

Πώς εκπαιδεύτηκε

Η εκπαιδευτική εκτέλεση καταναλώνει περίπου 8.4 × 10²⁰ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA Tesla K80. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.

Εκπαιδεύτηκε σε ένα σώμα περίπου 5,487,300,000,000 κωδικοί κειμένου

Το κριτήριο συμπερασμού του: sOTA improvement.

Απαντήσεις

JFT — κοινές ερωτήσεις

01

JFT— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 44.7M. Uses ResNet-101 architecture, which has 44,654,504 parameters: https://resources.wolframcloud.com/NeuralNetRepository/resources/ResNet-101-Trained-on-ImageNet-Competition-Data/. Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

02

JFT— ποιος το δημιούργησε;

Δημοσιεύθηκε από Google Research,Carnegie Mellon University (CMU), βασισμένο σε United States of America, μία οργάνωση κατηγοριοποιημένη ως industry,Academia.

03

JFT— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε July 2017. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

04

JFT— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Vision, και καταγράφεται ως διαχείριση της εργασίας του image classification, Object detection, Semantic segmentation, Pose estimation. Αυτές είναι οι περιοχές γύρω από τις οποίες σχεδιάστηκε; Περιγράφουν την πρόθεση παρά ένα αυστηρό όριο.

05

JFT— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;

Η εκπαίδευση κατανάλωσε περίπου 8.4 × 10²⁰ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA Tesla K80. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.

06

JFT— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

07

JFT— είναι ανοιχτού κώδικα;

Η αδειοδότηση δεν καταγράφηκε ποτέ στα πηγά μας δεδομένα. Αντιμετωπίζουμε τις μη δηλωμένες άδειες ως κλειστές, επειδή μια μη καταγεγραμμένη άδεια δεν είναι μία στην οποία μπορείς να βασιστείς.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 25 May 2026

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.