LSTM(medium)+Sememe+cell (WT2)

Κλειστές βαρύτητες Tsinghua University,Beijing University of Posts and Telecommunications,Huawei Noah's Ark Lab 24M παράμετροι October 2019

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
Tsinghua University,Beijing University of Posts and Telecommunications,Huawei Noah's Ark Lab
Τύπος οργανισμού
Academia,Academia,Industry
Χώρα
China
Δημοσιευμένο
20 October 2019
Συγγραφείς
Yujia Qin, Fanchao Qi, Sicong Ouyang, Zhiyuan Liu, Cheng Yang, Yasheng Wang, Qun Liu, Maosong Sun

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Language
Εργασία
Language modeling

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
24M

" the “large” vanilla LSTM has much more parameters than “medium” LSTM+cell (76M vs. 24M), it is still outper- formed by the latter."

Δεδομένα εκπαίδευσης
2,088,628 tokens
Εποχές
40

Διαθεσιμότητα

Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.

Βάρη
Closed — provider access only
Πρόσβαση μοντέλου
Unreleased
Κωδικός εκπαίδευσης
Open (non-commercial)

code for Wikitext/PTB. no license. https://github.com/thunlp/SememeRNN/blob/master/LM/main.py

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Εγγραφή εμπιστοσύνης
Confident
Δεδομένα αναφοράς
LSTM(medium)+Sememe+cell

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Improving Sequence Modeling Ability of Recurrent Neural Networks via Sememes
Τελευταία ενημέρωση
11 February 2026

Τι σημαίνουν οι αριθμοί

Υπόβαθρο

LSTM(medium)+Sememe+cell (WT2) δημοσιεύθηκε από Tsinghua University,Beijing University of Posts and Telecommunications,Huawei Noah's Ark Lab, στην χώρα καταγεγραμμένη ως China, κατά τη διάρκεια October 2019. Προέρχεται από έναν οργανισμό που κατατάσσεται ως academia,Academia,Industry.

Λειτουργεί στον τομέα της Language, και καταγράφεται ότι εκτελεί την εργασία του language modeling.

Αυτό είναι ένα κλειστό μοντέλο: οι εκπαιδευμένες τιμές παρέμειναν με όποιον τις παρήγαγε, και δεν υπάρχει τοπική έκδοση για να τρέξει.

Τι χρειάστηκε για την κατασκευή του

Εκπαιδεύτηκε σε ένα σώμα περίπου 2,088,628 κωδικοί κειμένου

Απαντήσεις

LSTM(medium)+Sememe+cell (WT2) — κοινές ερωτήσεις

01

LSTM(medium)+Sememe+cell (WT2)— είναι ανοιχτού κώδικα;

Όχι. Τα βάρη του δεν έχουν δημοσιευθεί, οπότε υπάρχει μόνο ως υπηρεσία που ελέγχεται από τον ιδιοκτήτη του.

02

LSTM(medium)+Sememe+cell (WT2)— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 24M. " the “large” vanilla LSTM has much more parameters than “medium” LSTM+cell (76M vs. 24M), it is still outper- formed by the latter.". Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

03

LSTM(medium)+Sememe+cell (WT2)— ποιος το δημιούργησε;

Δημοσιεύθηκε από Tsinghua University,Beijing University of Posts and Telecommunications,Huawei Noah's Ark Lab, βασισμένο σε China, μία οργάνωση κατηγοριοποιημένη ως academia,Academia,Industry.

04

LSTM(medium)+Sememe+cell (WT2)— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε October 2019. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

05

LSTM(medium)+Sememe+cell (WT2)— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Language, και καταγράφεται ως διαχείριση της εργασίας του language modeling. Ένα ΜΟΝΤΕΛ μπορεί να φέρει πολλά από το καθένα, οπότε αυτές είναι οι περιοχές για τις οποίες κατασκευάστηκε παρά περιορισμός σε ό,τι θα προσπαθήσει.

06

LSTM(medium)+Sememe+cell (WT2)— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 11 February 2026

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.