MusicLM

Geschlossene Gewichtungen Google 860M Parameter January 2023

Keine Schätzung

Keine Hardwareanforderungen für dieses Modell

Die Gewichte für dieses Modell wurden nicht veröffentlicht, daher kann es nicht heruntergeladen oder auf Ihrer eigenen Hardware in beliebiger Größe betrieben werden. Es ist nur über seinen Anbieter erreichbar, und keine Grafikkarte ändert das..

Aufgezeichnet

Volle Spezifikation

Alles, was in unserer Datenbank für dieses Modell aufgezeichnet ist. Der Großteil beschreibt, wie es trainiert wurde, anstatt wie es läuft — nützlicher Kontext zur Beurteilung, wie viel Arbeit darin steckt und wie es sich mit Modellen vergleicht, die in einem anderen Maßstab erstellt wurden..

Ursprung

Wer hat dieses Modell gebaut, wo und wann es veröffentlicht wurde.

Organisation
Google
Organisationsart
Industry
Land
United States of America
Veröffentlicht
26 January 2023
Autoren
Andrea Agostinelli, Timo I. Denk, Zalán Borsos, Jesse Engel, Mauro Verzetti, Antoine Caillon, Qingqing Huang, Aren Jansen, Adam Roberts, Marco Tagliasacchi, Matt Sharifi, Neil Zeghidour, Christian Frank

Was es tut

Die Problemfelder, für die das Modell entwickelt wurde. Ein Modell kann mehrere davon tragen.

Domain
Audio
Aufgabe
Audio generation
Basis-Modell
W2v-BERT

Größe

Wie groß das Modell ist und wie viele Daten damit trainiert wurden. Parameter sind die Zahl, die entscheidet, ob es auf einer bestimmten GPU-Karte passt.

Parameter
860M

"We use decoder-only Transformers for modeling the semantic stage and the acoustic stages of AudioLM. The models share the same architecture, composed of 24 layers, 16 attention heads, an embedding dimension of 1024, feed-forward layers of dimensionality 4096, dropout of 0.1, and relative positional embeddings (Raffel et al., 2020), resulting in 430M parameters per stage." "stage" seems to mean semantic + acoustic, so 860M total

Trainingsdaten
tokens

>280k hours

Verfügbarkeit

Ob Sie das Modell beziehen und es auf Ihrer eigenen Hardware ausführen können, bestimmt, ob eine der Grafikkarten-Zahlen auf dieser Seite zutrifft.

Gewichte
Closed — provider access only
Modellzugang
Unreleased
Training-Code
Unreleased

Wie es klassifiziert ist

Labels, die das Quell-Datenset anwendet, wenn bemerkenswerte Modelle verfolgt werden, und wie zuversichtlich es in den Eintrag ist.

Grundmodell
Yes
Warum es verfolgt wird
SOTA improvement

"We demonstrate that our method outperforms baselines on MusicCaps, a hand-curated, high-quality dataset of 5.5k music-text pairs prepared by musicians."

Aufzeichnungsgenauigkeit
Confident
Zitationen
671

Quellen

Woher dieser Datensatz stammt und wann er zuletzt überprüft wurde.

Referenz
MusicLM: Generating Music From Text
Zuletzt aktualisiert
25 May 2026

Was die Zahlen bedeuten

Was dieses Modell ist

MusicLM wurde veröffentlicht von Google, im Land aufgezeichnet als United States of America, während January 2023. Es stammt aus einer Organisation, die kategorisiert ist als industry.

Es funktioniert im Bereich von Audio, und wird als die Aufgabe von aufgezeichnet audio generation.

Anstatt von Grund auf neu trainiert zu werden, ist es abgeleitet von W2v-BERT. Das ist der Grund, warum es die allgemeine Form und Größe des Basis-Modells teilt.

Seine Gewichte wurden niemals veröffentlicht, daher kann es nur über seinen Anbieter erreicht werden. Keine Grafikkarten ändern das.

Wie es trainiert wurde

Es wird aus einem bestimmten Grund im zugrunde liegenden Datensatz verfolgt: sOTA improvement.

Antworten

MusicLM — Häufige Fragen

01

MusicLM— Wie viele Parameter hat es?

Es hat eine Parameteranzahl von 860M. "We use decoder-only Transformers for modeling the semantic stage and the acoustic stages of AudioLM. The models share the same architecture, composed of 24 layers, 16 attention heads, an embedding dimension of 1024, feed-forward layers of dimensionality 4096, dropout of 0.1, and relative positional embeddings (Raffel et al., 2020), resulting in 430M parameters per stage." "stage" seems to mean semantic + acoustic, so 860M total. Diese Zahl ist die Gesamtsumme, und sie bestimmt, wie viel MEMORY das MODEL benötigt – ungefähr ein halbes Gigabyte pro Milliarde bei der Kompression, die die meisten Menschen verwenden.

02

MusicLM— Wer hat es erstellt?

Es wurde veröffentlicht von Google, basiert auf United States of America, eine als kategorisierte Organisation industry.

03

MusicLM— Wann wurde es veröffentlicht?

Es wurde veröffentlicht in January 2023. Die Fähigkeit pro Parameter hat sich erheblich verbessert, sodass ein neueres Modell derselben Größe oft die bessere Nutzung derselben Hardware darstellt.

04

MusicLM— Wofür wird es verwendet?

Es funktioniert im Bereich von Audio, und wird als Bewältigung der Aufgabe von audio generation. Ein Modell kann mehrere von jedem tragen, daher sind dies die Bereiche, für die es gebaut wurde, anstatt eine Begrenzung dafür, was es versuchen wird.

05

MusicLM— Welche GPU benötige ich, um es auszuführen?

Dieses ist ein geschlossenes Modell — seine Gewichte wurden nie veröffentlicht, sodass es zu keinem Preis heruntergeladen oder auf Ihrer eigenen Hardware ausgeführt werden kann. Es ist nur über seinen Anbieter erreichbar.

06

MusicLM— Ist es Open-Source?

Nein. Seine Gewichte wurden nicht veröffentlicht, daher existiert es nur als ein Dienst, der von seinem Eigentümer kontrolliert wird.

Quelle

Originalveröffentlichung

Letzte Aktualisierung des Protokolls 25 May 2026

Die andere Richtung

Von der anderen Seite aus betrachten?

Diese Seite beginnt mit dem Modell. Wenn Sie bereits eine Karte besitzen und alles wissen möchten, was sie ausführen wird, Starte stattdessen von der Hardware.