LBSTER
Καμία εκτίμηση
Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο
Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..
Σε καταγραφή
Πλήρης προδιαγραφή
Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..
Προέλευση
Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.
- Οργάνωση
- Prescient Design,Genentech
- Τύπος οργανισμού
- Industry,Industry
- Χώρα
- United States of America
- Δημοσιευμένο
- 15 May 2024
- Συγγραφείς
- Nathan C. Frey, Taylor Joren, Aya Abdelsalam Ismail, Allen Goodman, Richard Bonneau, Kyunghyun Cho, Vladimir Gligorijević
Τι κάνει
Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.
- τομέας
- Biology
- Εργασία
- Protein or nucleotide language model (pLM/nLM)
Μέγεθος
Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.
- παράμετροι
- 67M
- Δεδομένα εκπαίδευσης
- 3,375,000,000 tokens
- Εποχές
- 4.06
"we are able to train a 67 million parameter model"
UniRef50 dataset size calculation: 43,000,000 sequences × 300 tokens/sequence = 1.29 × 10¹⁰ tokens Training process calculation: 1,048,576 tokens/step × 50,000 steps = 5.24288 × 10¹⁰ total tokens Epochs calculation: 5.24288 × 10¹⁰ / 1.29 × 10¹⁰ = 4.06 epochs Final unique tokens (first epoch only): 1.3 × 10¹⁰ tokens
Εκπαίδευση υπολογιστών
Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.
- Εκπαίδευση υπολογιστών
- 1.1 × 10¹⁹ FLOP
- Πώς ιδρύθηκε
- Hardware
1 day on 1 A100 312000000000000*1day*0.4=10782720000000000000
Η εκπαίδευση run
Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.
- Υλικό εκπαίδευσης
- NVIDIA A100 SXM4 80 GB
- χρησιμοποιούμενα τσιπ
- 1
- Χρόνος τοίχου
- 24 hours
- Κατανάλωση ενέργειας
- 434 W
"we are able to train a 67 million parameter model in a single day
Πώς ταξινομείται
Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.
- Εγγραφή εμπιστοσύνης
- Confident
- Παραπομπές
- 4
Πηγές
Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.
- Αναφορά
- Cramming Protein Language Model Training in 24 GPU Hours
- Τελευταία ενημέρωση
- 28 November 2025
Τι σημαίνουν οι αριθμοί
Τι είναι αυτό το μοντέλο
LBSTER δημοσιεύθηκε από Prescient Design,Genentech, στην χώρα καταγεγραμμένη ως United States of America, κατά τη διάρκεια May 2024. Προέρχεται από έναν οργανισμό που κατατάσσεται ως industry,Industry.
Λειτουργεί στον τομέα της Biology, και καταγράφεται ότι εκτελεί την εργασία του protein or nucleotide language model (pLM/nLM).
Τα βάρη του δεν έχουν δημοσιευθεί ποτέ, οπότε μπορεί να προσεγγιστεί μόνο μέσω του παρόχου του. Καμία κάρτα γραφικών δεν αλλάζει αυτό.
Πώς εκπαιδεύτηκε
Η εκπαίδευση απαιτούσε έναν υπολογιστικό προϋπολογισμό περίπου 1.1 × 10¹⁹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA A100 SXM4 80 GB. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.
Το σύνολο εκπαίδευσης εκτελέστηκε σε περίπου 3,375,000,000 κωδικοί κειμένου
Απαντήσεις
LBSTER — κοινές ερωτήσεις
LBSTER— ποιος το δημιούργησε;
Δημοσιεύθηκε από Prescient Design,Genentech, βασισμένο σε United States of America, μία οργάνωση κατηγοριοποιημένη ως industry,Industry.
LBSTER— πότε κυκλοφόρησε;
Δημοσιεύθηκε σε May 2024. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.
LBSTER— για τί χρησιμοποιείται;
Λειτουργεί στον τομέα της Biology, και καταγράφεται ως διαχείριση της εργασίας του protein or nucleotide language model (pLM/nLM). Αυτές είναι οι περιοχές γύρω από τις οποίες σχεδιάστηκε; Περιγράφουν την πρόθεση παρά ένα αυστηρό όριο.
LBSTER— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;
Η εκπαίδευση κατανάλωσε περίπου 1.1 × 10¹⁹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA A100 SXM4 80 GB. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.
LBSTER— ποια GPU χρειάζομαι για να το τρέξω;
Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.
LBSTER— είναι ανοιχτού κώδικα;
Η αδειοδότηση δεν καταγράφηκε ποτέ στα πηγά μας δεδομένα. Αντιμετωπίζουμε τις μη δηλωμένες άδειες ως κλειστές, επειδή μια μη καταγεγραμμένη άδεια δεν είναι μία στην οποία μπορείς να βασιστείς.
LBSTER— πόσες παραμέτρους έχει;
Έχει αριθμό παραμέτρων 67M. "we are able to train a 67 million parameter model". Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.
Η άλλη κατεύθυνση
Κοιτάζοντας το από την άλλη πλευρά;
Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.