Mamba-24M (SC09)

Κλειστές βαρύτητες Carnegie Mellon University (CMU),Princeton University 23.4M παράμετροι December 2023

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
Carnegie Mellon University (CMU),Princeton University
Τύπος οργανισμού
Academia,Academia
Χώρα
United States of America
Δημοσιευμένο
1 December 2023
Συγγραφείς
Albert Gu, Tri Dao

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Speech
Εργασία
Audio generation, Speech synthesis, Text-to-speech (TTS)

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
23.4M

Table 4

Δεδομένα εκπαίδευσης
96,672 tokens

Section 4.4.2: "We largely follow the autoregressive training setup and generation protocol of Goel et al. (2022)" In which they model raw audio waveforms, such that each sample is a datapoint. SC09 is 5.3 hours long. 5.3h * 3600 sec/h * 16k samples/sec = 305,280,000 samples Appendix E.4.2: "We used a learning rate of 0.002 and 200000 training steps at a batch size of 16... training went through 100 epochs"

Εποχές
100

Διαθεσιμότητα

Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.

Βάρη
Closed — provider access only
Πρόσβαση μοντέλου
Unreleased
Κωδικός εκπαίδευσης
Unreleased

no code or weights for 24M Mamaba model, but there are code and weights for other Mamba models: https://github.com/state-spaces/mamba

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Γιατί παρακολουθείται
SOTA improvement

"SC09 is a benchmark speech generation dataset (Donahue, McAuley, and Puckette 2019; Warden 2018), consisting of 1-second clips sampled at 16000 Hz of the digits “zero” through “nine” with highly variable characteristics. We largely follow the autoregressive training setup and generation protocol of Goel et al. (2022). Table 4 shows automated metrics of the Mamba-UNet model compared to a variety of baselines from Goel et al. (2022): WaveNet (Oord et al. 2016), SampleRNN (Mehri et al. 2017), Wav…

Εγγραφή εμπιστοσύνης
Confident
Παραπομπές
7,063

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Mamba: Linear-Time Sequence Modeling with Selective State Spaces
Τελευταία ενημέρωση
25 May 2026

Τι σημαίνουν οι αριθμοί

Τι είναι αυτό το μοντέλο

Mamba-24M (SC09) δημοσιεύθηκε από Carnegie Mellon University (CMU),Princeton University, στην χώρα καταγεγραμμένη ως United States of America, κατά τη διάρκεια December 2023. Ο εκδοτικός οργανισμός κατηγοριοποιείται ως academia,Academia.

Λειτουργεί στον τομέα της Speech, και καταγράφεται ότι εκτελεί την εργασία του audio generation, Speech synthesis, Text-to-speech (TTS).

Αυτό είναι ένα κλειστό μοντέλο: οι εκπαιδευμένες τιμές παρέμειναν με όποιον τις παρήγαγε, και δεν υπάρχει τοπική έκδοση για να τρέξει.

Τι χρειάστηκε για την κατασκευή του

Εκπαιδεύτηκε σε ένα σώμα περίπου 96,672 κωδικοί κειμένου

Ο λόγος που εμφανίζεται σε αυτόν τον κατάλογο είναι: sOTA improvement.

Απαντήσεις

Mamba-24M (SC09) — κοινές ερωτήσεις

01

Mamba-24M (SC09)— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε December 2023. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

02

Mamba-24M (SC09)— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Speech, και καταγράφεται ως διαχείριση της εργασίας του audio generation, Speech synthesis, Text-to-speech (TTS). Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

03

Mamba-24M (SC09)— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

04

Mamba-24M (SC09)— είναι ανοιχτού κώδικα;

Όχι. Τα βάρη του δεν έχουν δημοσιευθεί, οπότε υπάρχει μόνο ως υπηρεσία που ελέγχεται από τον ιδιοκτήτη του.

05

Mamba-24M (SC09)— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 23.4M. Table 4. Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

06

Mamba-24M (SC09)— ποιος το δημιούργησε;

Δημοσιεύθηκε από Carnegie Mellon University (CMU),Princeton University, βασισμένο σε United States of America, μία οργάνωση κατηγοριοποιημένη ως academia,Academia.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 25 May 2026

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.