Qwen3-Max
Keine Schätzung
Keine Hardwareanforderungen für dieses Modell
Die Gewichte für dieses Modell wurden nicht veröffentlicht, sodass es nicht heruntergeladen oder auf eigener Hardware in irgendeiner Größe ausgeführt werden kann. Es ist nur über seinen Anbieter erreichbar, und keine Grafikkarte ändert das..
Aufzeichnen
Vollständige Spezifikation
Alles, was für dieses Modell aufgezeichnet wurde. Der Großteil beschreibt, wie es trainiert wurde, anstatt wie es läuft – nützlicher Kontext, um zu beurteilen, wie viel Arbeit darin steckt und wie es sich mit Modellen vergleicht, die in unterschiedlichem Maßstab erstellt wurden..
Ursprung
Wer hat dieses Modell erstellt, wo und wann es veröffentlicht wurde.
- Organisation
- Alibaba
- Typ der Organisation
- Industry
- Land
- China
- Veröffentlicht
- 5 September 2025
Was es tut
Die Problembereiche, für die das Modell entwickelt wurde. Ein Modell kann mehrere von jedem tragen.
- Domäne
- Language
- Aufgabe
- Language modeling/generation, Question answering, Mathematical reasoning, Code generation, Quantitative reasoning, Retrieval-augmented generation, Translation
Größe
Wie groß das Modell ist und wie viele Daten es trainiert wurde. Parameter sind die Werte, die entscheiden, ob es auf eine bestimmte Grafikkarte passt.
- Parameter
- 1T
- Modell/Modelle können auf der GPU nicht passen. Eng = kaum auszuführen, komfortabel = läuft problemlos mit Spielraum.
- 36,000,000,000,000 tokens
MoE architecture
"was pretrained on 36 trillion tokens"
Training-Berechnung
Die Berechnungen, die zum Trainieren des Modells durchgeführt werden, gemessen in Gleitkommaoperationen. Es ist ein Maß dafür, was der Trainingslauf gekostet hat, nicht dafür, wie schnell das fertige Modell Ihnen antwortet.
- Training-Berechnung
- 1.5 × 10²⁵ FLOP
- Wie es etabliert wurde
- Operation counting
6ND with: 36T tokens is taken from the qwen3 technical report 70B active params is based on it having >1T params, and the architectures of Qwen3-235B-A22B and Qwen3-Coder-480B-A35B
Verfügbarkeit
Ob Sie das Modell erhalten und es auf Ihrer eigenen Hardware ausführen können, was entscheidet, ob eine der Grafikkartenfiguren auf dieser Seite zutrifft.
- Gewichte
- Closed — provider access only
- Modellzugriff
- API access
- Trainingscode
- Unreleased
Wie es klassifiziert ist
Labels, die auf das Quell-Dataset angewendet werden, wenn bemerkenswerte Modelle verfolgt werden, und wie zuversichtlich es in den Eintrag ist.
- Wahrscheinlich über 10²³ FLOP
- Yes
- Warum es verfolgt wird
- Discretionary
- Modell/Modelle können auf der GPU ausgeführt werden. Es passt nicht / wird nicht passen. Eng = kaum ausführbar, komfortabel = läuft problemlos mit Spielraum.
- Speculative
Model/Modelle laufen nicht / wird nicht passen
Woher dieser Datensatz stammt und wann er zuletzt überprüft wurde.
- Referenz
- Introducing Qwen3-Max-Preview (Instruct) — our biggest model yet, with over 1 trillion parameters!
- Modell/Modelle können von der GPU nicht ausgeführt werden. Es passt nicht. Zu eng. Lauffähig. Bequem.
- 18 December 2025
Was die Zahlen bedeuten
Was dieses Modell ist
Qwen3-Max wurde im September 2025 von Alibaba in China veröffentlicht. branche ist die Kategorie, in der der Herausgeber fällt.
Es funktioniert in Deutsch und wird als Sprachmodellierung/-generierung, Fragenbeantwortung, Mathematisches Denken, Codegenerierung, Quantitatives Denken, Retrieval-unterstützte Generierung, Übersetzung aufgezeichnet.
Dies ist ein geschlossenes Modell: Die trainierten Werte bleiben bei demjenigen, der sie produziert hat, und es gibt keine lokale Version, die ausgeführt werden kann.
Training und Herkunft
Das Training benötigte etwa 1,5 × 10²⁵ FLOP an Berechnungen — ein Maß dafür, was die Erstellung des Modells gekostet hat, nicht dafür, wie schnell es antwortet.
Etwa 36.000.000.000.000 Tokens flossen in das Training ein.
Es wird aus einem bestimmten Grund im zugrunde liegenden Datensatz verfolgt: Ermessensspielraum.
Antworten
Qwen3-Max — Häufige Fragen
Wer hat Qwen3-Max erstellt?
Qwen3-Max wurde von Alibaba veröffentlicht, mit Sitz in China, kategorisiert als Industrie.
Wann wurde Qwen3-Max veröffentlicht?
Qwen3-Max wurde im September 2025 veröffentlicht.
Wofür wird Qwen3-Max verwendet?
Qwen3-Max funktioniert in Sprache und ist dafür ausgelegt, Sprachmodellierung/-generierung, Fragenbeantwortung, Mathematisches Schließen, Code-Generierung, Quantitatives Schließen, Retrieval-unterstützte Generation, Übersetzung zu bearbeiten. Dies sind die Bereiche, um die es konzipiert wurde; sie beschreiben die Absicht und nicht eine feste Grenze.
Wie viel Rechenleistung wurde verwendet, um Qwen3-Max zu trainieren?
Ungefähr 1,5 × 10²⁵ FLOP. Das misst, was die Erstellung des Modells gekostet hat und sagt nichts darüber aus, wie schnell es nach dem Training antwortet – die Inferenzgeschwindigkeit hängt von der Speicherbandbreite ab, nicht vom Trainingsbudget.
Welche GPU benötige ich, um Qwen3-Max auszuführen?
Qwen3-Max ist ein geschlossenes Modell - seine Gewichte wurden nie veröffentlicht, daher kann es nicht heruntergeladen oder auf eigener Hardware zu einem beliebigen Preis ausgeführt werden. Es ist nur über seinen Anbieter erreichbar.
Ist Qwen3-Max Open Source?
Qwen3-Max hat seine Gewichte nicht veröffentlicht, daher existiert es nur als Dienst, der von seinem Eigentümer kontrolliert wird.
Wie viele Parameter hat Qwen3-Max?
Qwen3-Max hat 1 T Parameter. MoE-Architektur. Diese Zahl ist die Gesamtmenge und entscheidet, wie viel Speicher das Modell benötigt – ungefähr ein halbes Gigabyte pro Milliarde bei der Kompression, die die meisten Menschen verwenden.
Die andere Richtung
Von der anderen Seite betrachten?
Diese Seite beginnt vom Modell. Wenn Sie bereits eine Karte besitzen und alles erfahren möchten, was sie ausführen kann., Modell/Modelle laufen GPU AI-Modell. passt nicht/wird nicht passen. eng = kaum lauffähig, komfortabel = läuft problemlos mit Spielraum..