PMLM-large

Κλειστές βαρύτητες Microsoft Research Asia,Nanyang Technological University,Xi’an Jiaotong University,Sun Yat-sen University 250M παράμετροι October 2021

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
Microsoft Research Asia,Nanyang Technological University,Xi’an Jiaotong University,Sun Yat-sen University
Τύπος οργανισμού
Industry,Academia,Academia,Academia
Χώρα
China, Singapore
Δημοσιευμένο
21 October 2021
Συγγραφείς
Liang He, Shizhuo Zhang, Lijun Wu, Huanhuan Xia, Fusong Ju, He Zhang, Siyuan Liu, Yingce Xia, Jianwei Zhu, Pan Deng, Bin Shao, Tao Qin, Tie-Yan Liu

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Biology
Εργασία
Protein or nucleotide language model (pLM/nLM)

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
250M

"Following the RoBERTa-base setting, the hidden size, feed forward dimension, number of encoder layers, and attention heads of the base models are set as 768, 3072, 12, 12 re- spectively (denoted as MLM-base for MLM and PMLM-base for PMLM). A larger model named PMLM-large is pre-trained with the same setting except using 34 as the number of encoder layers."

Δεδομένα εκπαίδευσης
tokens

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Εκπαίδευση υπολογιστών
3.8 × 10²¹ FLOP

1176*60*60*125000000000000*24*0.3=3.81024e+21

Πώς ιδρύθηκε
Hardware

Η εκπαίδευση run

Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.

Υλικό εκπαίδευσης
NVIDIA V100
χρησιμοποιούμενα τσιπ
24
Χρόνος τοίχου
1,176 hours (49 days)

"about seven weeks for PMLM-large"

Κατανάλωση ενέργειας
14.5 kW

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Εγγραφή εμπιστοσύνης
Confident
Παραπομπές
36

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Pre-Training Co-Evolutionary Protein Representation via a Pairwise Masked Language Model
Τελευταία ενημέρωση
25 May 2026

Τι σημαίνουν οι αριθμοί

Από πού προήλθε

PMLM-large δημοσιεύθηκε από Microsoft Research Asia,Nanyang Technological University,Xi’an Jiaotong University,Sun Yat-sen University, στην χώρα καταγεγραμμένη ως China, κατά τη διάρκεια October 2021. Η κατηγορία στην οποία υπάγεται ο εκδότης είναι industry,Academia,Academia,Academia.

Λειτουργεί στον τομέα της Biology, και καταγράφεται ότι εκτελεί την εργασία του protein or nucleotide language model (pLM/nLM).

Τα βάρη του δεν έχουν δημοσιευθεί ποτέ, οπότε μπορεί να προσεγγιστεί μόνο μέσω του παρόχου του. Καμία κάρτα γραφικών δεν αλλάζει αυτό.

Τι χρειάστηκε για την κατασκευή του

Η εκπαιδευτική εκτέλεση καταναλώνει περίπου 3.8 × 10²¹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA V100. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.

Απαντήσεις

PMLM-large — κοινές ερωτήσεις

01

PMLM-large— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

02

PMLM-large— είναι ανοιχτού κώδικα;

Η αδειοδότηση δεν καταγράφηκε ποτέ στα πηγά μας δεδομένα. Αντιμετωπίζουμε τις μη δηλωμένες άδειες ως κλειστές, επειδή μια μη καταγεγραμμένη άδεια δεν είναι μία στην οποία μπορείς να βασιστείς.

03

PMLM-large— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 250M. "Following the RoBERTa-base setting, the hidden size, feed forward dimension, number of encoder layers, and attention heads of the base models are set as 768, 3072, 12, 12 re- spectively (denoted as MLM-base for MLM and PMLM-base for PMLM). A larger model named PMLM-large is pre-trained with the same setting except using 34 as the number of encoder layers.". Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

04

PMLM-large— ποιος το δημιούργησε;

Δημοσιεύθηκε από Microsoft Research Asia,Nanyang Technological University,Xi’an Jiaotong University,Sun Yat-sen University, βασισμένο σε China, μία οργάνωση κατηγοριοποιημένη ως industry,Academia,Academia,Academia.

05

PMLM-large— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε October 2021. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

06

PMLM-large— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Biology, και καταγράφεται ως διαχείριση της εργασίας του protein or nucleotide language model (pLM/nLM). Ένα ΜΟΝΤΕΛ μπορεί να φέρει πολλά από το καθένα, οπότε αυτές είναι οι περιοχές για τις οποίες κατασκευάστηκε παρά περιορισμός σε ό,τι θα προσπαθήσει.

07

PMLM-large— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;

Η εκπαίδευση κατανάλωσε περίπου 3.8 × 10²¹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA V100. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 25 May 2026

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.