LBL

Κλειστές βαρύτητες University College London (UCL) 2M παράμετροι June 2012

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
University College London (UCL)
Τύπος οργανισμού
Academia
Χώρα
United Kingdom of Great Britain and Northern Ireland
Δημοσιευμένο
27 June 2012
Συγγραφείς
Andriy Mnih, Yee Whye Teh

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Language
Εργασία
Language modeling

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
2M

Vocabulary size (V) = 10,000 words Context size (c) = 2 words Feature dimension (d) = 100 Plugging this into the parameter count: Context word features: 10,000 x 100 = 1,000,000 Target word features: 10,000 x 100 = 1,000,000 Context weights: 2 x 100 x 100 = 20,000 Total parameters: 1,000,000 + 1,000,000 + 20,000 = 2,020,000 So for the LBL model configuration used in the experiments in this paper, with a 10K word vocabulary, 2-word context, and 100D feature vectors, the total number of parameter…

Δεδομένα εκπαίδευσης
929,000 tokens

The paper does not explicitly state the number of epochs used for training the LBL models. However, it provides some relevant information: In Section 4, it mentions that the learning rates were adapted at the end of each epoch based on the validation set perplexity. In Section 4.1, it states: "NCE took about twice as many epochs as ML to converge." For maximum likelihood (ML) training, the training time is reported as 21 hours. So we can deduce: ML training took 21 hours and NCE took twice …

Εποχές
45

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Εκπαίδευση υπολογιστών
5 × 10¹⁴ FLOP

6 FLOP / parameter / token * 2000000 parameters ['Likely' confidence] * 929000 tokens * 45 epochs ["Likely" confidence] = 5.0166e+14 FLOP

Πώς ιδρύθηκε
Operation counting

Διαθεσιμότητα

Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.

Βάρη
Closed — provider access only
Πρόσβαση μοντέλου
Unreleased
Κωδικός εκπαίδευσης
Unreleased

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Εγγραφή εμπιστοσύνης
Likely
Παραπομπές
835
Δεδομένα αναφοράς
LBL

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
A Fast and Simple Algorithm for Training Neural Probabilistic Language Models
Τελευταία ενημέρωση
28 November 2025

Τι σημαίνουν οι αριθμοί

Σχετικά με αυτό το μοντέλο

LBL δημοσιεύθηκε από University College London (UCL), στην χώρα καταγεγραμμένη ως United Kingdom of Great Britain and Northern Ireland, κατά τη διάρκεια June 2012. Η κατηγορία στην οποία υπάγεται ο εκδότης είναι academia.

Λειτουργεί στον τομέα της Language, και καταγράφεται ότι εκτελεί την εργασία του language modeling.

Επειδή τα WEIGHTS δεν είναι διαθέσιμα, κανένα από τα figures του HARDWARE αλλού σε αυτό το SITE δεν ισχύει γι' αυτό.

Πώς εκπαιδεύτηκε

Η εκπαιδευτική εκτέλεση καταναλώνει περίπου 5 × 10¹⁴ FLOP. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.

Το σύνολο εκπαίδευσης εκτελέστηκε σε περίπου 929,000 κωδικοί κειμένου

Απαντήσεις

LBL — κοινές ερωτήσεις

01

LBL— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

02

LBL— είναι ανοιχτού κώδικα;

Όχι. Τα βάρη του δεν έχουν δημοσιευθεί, οπότε υπάρχει μόνο ως υπηρεσία που ελέγχεται από τον ιδιοκτήτη του.

03

LBL— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 2M. Vocabulary size (V) = 10,000 words Context size (c) = 2 words Feature dimension (d) = 100 Plugging this into the parameter count: Context word features: 10,000 x 100 = 1,000,000 Target word features: 10,000 x 100 = 1,000,000 Context weights: 2 x 100 x 100 = 20,000 Total parameters: 1,000,000 + 1,000,000 + 20,000 = 2,020,000 So for the LBL model configuration used in the experiments in this paper, with a 10K word vocabulary, 2-word context, and 100D feature vectors, the total number of parameters is approximately 2 million. Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

04

LBL— ποιος το δημιούργησε;

Δημοσιεύθηκε από University College London (UCL), βασισμένο σε United Kingdom of Great Britain and Northern Ireland, μία οργάνωση κατηγοριοποιημένη ως academia.

05

LBL— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε June 2012. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

06

LBL— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Language, και καταγράφεται ως διαχείριση της εργασίας του language modeling. Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

07

LBL— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;

Η εκπαίδευση κατανάλωσε περίπου 5 × 10¹⁴ FLOP. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 28 November 2025

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.