Qwen3-Max
Geen schatting
Geen hardwarevereisten voor dit model
De gewichten voor dit model zijn niet gepubliceerd, dus het kan niet worden gedownload of uitgevoerd op je eigen hardware in welke grootte dan ook. Het is alleen bereikbaar via zijn aanbieder, en geen enkele grafische kaart verandert dat..
Opname
Volledige specificatie
Alles op record voor dit model. Het meeste beschrijft hoe het is getraind in plaats van hoe het draait — nuttige context om te beoordelen hoeveel werk erin is gestoken en hoe het zich verhoudt tot modellen die op een andere schaal zijn gebouwd..
Origine
Wie heeft dit model gebouwd, waar, en wanneer het is gepubliceerd.
- Organisatie
- Alibaba
- Organisatietype
- Industry
- Land
- China
- Gepubliceerd
- 5 September 2025
Wat het doet
De probleemgebieden waarvoor het model is gebouwd. Een model kan er verschillende van elk dragen.
- Domein
- Language
- Model/modelen kunnen niet passen in de GPU VRAM. Tight = bijna uitvoerbaar, comfortabel = draait eenvoudig met ruimte. Wat AI-model kan de GPU draaien?
- Language modeling/generation, Question answering, Mathematical reasoning, Code generation, Quantitative reasoning, Retrieval-augmented generation, Translation
Grootte
Hoe groot het model is en hoeveel data erop is getraind. Parameters zijn de cijfers die bepalen of het past op een bepaalde grafische kaart.
- Parameters
- 1T
- Training gegevens
- 36,000,000,000,000 tokens
MoE architecture
"was pretrained on 36 trillion tokens"
Trainingsberekeningen
De rekensom die is uitgevoerd om het model te trainen, gemeten in drijvende-komma-bewerkingen. Het is een maat voor de kosten van de trainingsrun, niet voor hoe snel het voltooide model je antwoorden geeft.
- Trainingsberekeningen
- 1.5 × 10²⁵ FLOP
- Hoe het is vastgesteld
- Operation counting
6ND with: 36T tokens is taken from the qwen3 technical report 70B active params is based on it having >1T params, and the architectures of Qwen3-235B-A22B and Qwen3-Coder-480B-A35B
Beschikbaarheid
Of u het model kunt verkrijgen en het op uw eigen hardware kunt draaien, wat bepaalt of een van de specificaties van de GPU op deze pagina van toepassing is.
- Gewichten
- Closed — provider access only
- Model toegang
- API access
- Training code
- Unreleased
Hoe het is geclassificeerd
Labels die op de bron-dataset van toepassing zijn bij het volgen van opvallende modellen, en hoe zeker het is van de invoer.
- Waarschijnlijk boven de 10²³ FLOP
- Yes
- Waarom het wordt gevolgd
- Discretionary
- Model/modellen past niet / past niet.
- Speculative
Bronnen
Waar deze registratie vandaan komt en wanneer deze voor het laatst is gecontroleerd.
- Referentie
- Introducing Qwen3-Max-Preview (Instruct) — our biggest model yet, with over 1 trillion parameters!
- Laatste update
- 18 December 2025
Wat de getallen betekenen
Wat dit model is
Qwen3-Max was published by Alibaba, in China, in September 2025. industry is the category the publisher falls under.
It works in Language, and is recorded as doing language modeling/generation, Question answering, Mathematical reasoning, Code generation, Quantitative reasoning, Retrieval-augmented generation, Translation.
Dit is een gesloten model: de getrainde waarden bleven bij degene die ze geproduceerd heeft, en er is geen lokale versie om te draaien.
Training en afkomst
Training it took roughly 1.5 × 10²⁵ FLOP of computation — a measure of what producing the model cost, not of how fast it answers.
Around 36,000,000,000,000 tokens went into training it.
It is tracked in the underlying dataset for one reason in particular: discretionary.
Antwoorden
Qwen3-Max — Voor veelgebruikte vragen
Who created Qwen3-Max?
Qwen3-Max was published by Alibaba, based in China, categorised as industry.
When was Qwen3-Max released?
Qwen3-Max was published in September 2025.
What is Qwen3-Max used for?
Qwen3-Max works in Language, and is recorded as handling language modeling/generation, Question answering, Mathematical reasoning, Code generation, Quantitative reasoning, Retrieval-augmented generation, Translation. These are the areas it was designed around; they describe intent rather than a hard boundary.
How much compute was used to train Qwen3-Max?
Around 1.5 × 10²⁵ FLOP. That measures what producing the model cost and says nothing about how quickly it answers once trained — inference speed comes from memory bandwidth, not from the training budget.
What GPU do I need to run Qwen3-Max?
None. Qwen3-Max is a closed model — its weights were never published, so it cannot be downloaded or run on your own hardware at any price. It is reachable only through its provider.
Is Qwen3-Max open source?
No. Qwen3-Max has not had its weights published, so it exists only as a service controlled by its owner.
How many parameters does Qwen3-Max have?
Qwen3-Max has 1T parameters. MoE architecture. That figure is the total, and it is what decides how much memory the model needs — roughly half a gigabyte per billion at the compression most people use.
Bron
Model/modelen kunnen niet passen in de GPU VRAM. Tight = nauwelijks uitvoerbaar, comfortabel = draait gemakkelijk met ruimte. Welke AI model kan de GPU draaien? 18 December 2025
De andere richting
Kijk je er van de andere kant naar?
Deze pagina begint bij het model. Als je al een kaart hebt en alles wilt weten wat het kan draaien., model/modellen draait/draaien past niet/past niet goed strak = nauwelijks uitvoerbaar, comfortabel = draait gemakkelijk met speling.