Image generation

Κλειστές βαρύτητες University of Amsterdam 784K παράμετροι December 2013

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
University of Amsterdam
Τύπος οργανισμού
Academia
Χώρα
Netherlands
Δημοσιευμένο
20 December 2013
Συγγραφείς
DP Kingma, M Welling

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Vision
Εργασία
Image clustering

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
784K

"We trained generative models (decoders) and corresponding encoders (a.k.a. recognition models) having 500 hidden units in case of MNIST" 784*500*2=784000 (Ignoring latent dimension)

Δεδομένα εκπαίδευσης
47,040,000 tokens

"We trained generative models of images from the MNIST and Frey Face datasets" MNIST has 60k images https://en.wikipedia.org/wiki/MNIST_database Frey Face has 2k images https://cs.nyu.edu/~roweis/data.html

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Εκπαίδευση υπολογιστών
4.8 × 10¹⁴ FLOP

From https://openai.com/blog/ai-and-compute/ Appendix "less than 0.0000055 pfs-days" (86400*10^15*0.0000055) Figure 2 shows evaluations with 10^8 training samples 6*784000*100000000=470400000000000

Πώς ιδρύθηκε
Third-party estimation

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Γιατί παρακολουθείται
Highly cited
Εγγραφή εμπιστοσύνης
Confident
Παραπομπές
21,760

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Auto-Encoding Variational Bayes
Τελευταία ενημέρωση
28 November 2025

Τι σημαίνουν οι αριθμοί

Υπόβαθρο

Image generation δημοσιεύθηκε από University of Amsterdam, στην χώρα καταγεγραμμένη ως Netherlands, κατά τη διάρκεια December 2013. Προέρχεται από έναν οργανισμό που κατατάσσεται ως academia.

Λειτουργεί στον τομέα της Vision, και καταγράφεται ότι εκτελεί την εργασία του image clustering.

Αυτό είναι ένα κλειστό μοντέλο: οι εκπαιδευμένες τιμές παρέμειναν με όποιον τις παρήγαγε, και δεν υπάρχει τοπική έκδοση για να τρέξει.

Τι χρειάστηκε για την κατασκευή του

Η παραγωγή του απαιτούσε αριθμητική που ανήλθε περίπου 4.8 × 10¹⁴ FLOP. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.

Το σύνολο εκπαίδευσης εκτελέστηκε σε περίπου 47,040,000 κωδικοί κειμένου

Αυτή παρακολουθείται στο υποκείμενο σύνολο δεδομένων για έναν συγκεκριμένο λόγο: highly cited.

Απαντήσεις

Image generation — κοινές ερωτήσεις

01

Image generation— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 784K. "We trained generative models (decoders) and corresponding encoders (a.k.a. recognition models) having 500 hidden units in case of MNIST" 784*500*2=784000 (Ignoring latent dimension). Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

02

Image generation— ποιος το δημιούργησε;

Δημοσιεύθηκε από University of Amsterdam, βασισμένο σε Netherlands, μία οργάνωση κατηγοριοποιημένη ως academia.

03

Image generation— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε December 2013. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

04

Image generation— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Vision, και καταγράφεται ως διαχείριση της εργασίας του image clustering. Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

05

Image generation— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;

Η εκπαίδευση κατανάλωσε περίπου 4.8 × 10¹⁴ FLOP. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.

06

Image generation— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

07

Image generation— είναι ανοιχτού κώδικα;

Η αδειοδότηση δεν καταγράφηκε ποτέ στα πηγά μας δεδομένα. Αντιμετωπίζουμε τις μη δηλωμένες άδειες ως κλειστές, επειδή μια μη καταγεγραμμένη άδεια δεν είναι μία στην οποία μπορείς να βασιστείς.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 28 November 2025

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.