CTC-Trained LSTM

Κλειστές βαρύτητες IDSIA,Technical University of Munich 114.7K παράμετροι June 2006

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
IDSIA,Technical University of Munich
Τύπος οργανισμού
Academia,Academia
Χώρα
Switzerland, Germany
Δημοσιευμένο
25 June 2006
Συγγραφείς
Alex Graves, Santiago Fernández, Faustino Gómez, Jürgen Schmidhuber

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Speech
Εργασία
Speech recognition (ASR)

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
114.7K

"The hidden layers were fully connected to themselves and the output layer, and fully connected from the input layer. The input layer was size 26, the softmax output layer size 62 (61 phoneme categories plus the blank label), and the total number of weights was 114, 662." https://www.cs.toronto.edu/~graves/icml_2006.pdf

Δεδομένα εκπαίδευσης
tokens

4162 utterances, guesstimated avg 10 words per utterance

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Παραπομπές
4,862

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Connectionist Temporal Classification: Labelling Unsegmented Sequence Data with Recurrent Neural Networks
Τελευταία ενημέρωση
28 November 2025

Τι σημαίνουν οι αριθμοί

Υπόβαθρο

CTC-Trained LSTM δημοσιεύθηκε από IDSIA,Technical University of Munich, στην χώρα καταγεγραμμένη ως Switzerland, κατά τη διάρκεια June 2006. Ο εκδοτικός οργανισμός κατηγοριοποιείται ως academia,Academia.

Λειτουργεί στον τομέα της Speech, και καταγράφεται ότι εκτελεί την εργασία του speech recognition (ASR).

Τα βάρη του δεν έχουν δημοσιευθεί ποτέ, οπότε μπορεί να προσεγγιστεί μόνο μέσω του παρόχου του. Καμία κάρτα γραφικών δεν αλλάζει αυτό.

Απαντήσεις

CTC-Trained LSTM — κοινές ερωτήσεις

01

CTC-Trained LSTM— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

02

CTC-Trained LSTM— είναι ανοιχτού κώδικα;

Η αδειοδότηση δεν καταγράφηκε ποτέ στα πηγά μας δεδομένα. Αντιμετωπίζουμε τις μη δηλωμένες άδειες ως κλειστές, επειδή μια μη καταγεγραμμένη άδεια δεν είναι μία στην οποία μπορείς να βασιστείς.

03

CTC-Trained LSTM— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 114.7K. "The hidden layers were fully connected to themselves and the output layer, and fully connected from the input layer. The input layer was size 26, the softmax output layer size 62 (61 phoneme categories plus the blank label), and the total number of weights was 114, 662." https://www.cs.toronto.edu/~graves/icml_2006.pdf. Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

04

CTC-Trained LSTM— ποιος το δημιούργησε;

Δημοσιεύθηκε από IDSIA,Technical University of Munich, βασισμένο σε Switzerland, μία οργάνωση κατηγοριοποιημένη ως academia,Academia.

05

CTC-Trained LSTM— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε June 2006. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

06

CTC-Trained LSTM— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Speech, και καταγράφεται ως διαχείριση της εργασίας του speech recognition (ASR). Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 28 November 2025

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.