Qwen3-Max

Zárt súlyok Alibaba 1T paraméterek September 2025

Nincs becslés

Ennek a modellnek nincs hardverigénye

A súlyok ehhez a modellhez nincsenek publikálva, így nem lehet letölteni vagy futtatni a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül elérhető, és egyetlen grafikus kártya sem változtat ezen..

A nyilvántartásban

Teljes specifikáció

Minden rögzítve van ennek a modellnek a számára. A legtöbb arról szól, hogyan lett betanítva, nem arról, hogyan fut. — Hasznos háttérinformáció annak megítélésére, hogy mennyi munka fektetődött bele, és hogyan viszonyul más, eltérő méretű modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezés
Alibaba
Szervezet típus
Industry
Ország
China
Közzétéve
5 September 2025

Mit csinál

A problémás területek, amelyekre a modellt építették. Egy modell többből is eltarthat minden egyesből.

Domain
Language
Fut / futás AI modell. Nem illik / nem fog illeni, szoros = alig futtatható, kényelmes = könnyen fut, van hely. Melyik AI modellt tud futtatni a GPU?
Language modeling/generation, Question answering, Mathematical reasoning, Code generation, Quantitative reasoning, Retrieval-augmented generation, Translation

Méret

Mekkora a modell és mennyi adaton lett betanítva. A paraméterek határozzák meg, hogy elfér-e egy adott grafikus kártyán.

paraméterek
1T

MoE architecture

Tréning adatok
36,000,000,000,000 tokens

"was pretrained on 36 trillion tokens"

Képzés számítás

A modell tréningjéhez végzett aritmetika, lebegőpontos műveletekben mérve. Ez a tréning futás költségének mértéke, nem pedig annak, mennyire gyorsan válaszol a kész modell.

Képzés számítás
1.5 × 10²⁵ FLOP

6ND with: 36T tokens is taken from the qwen3 technical report 70B active params is based on it having >1T params, and the architectures of Qwen3-235B-A22B and Qwen3-Coder-480B-A35B

Hogyan hozták létre
Operation counting

Elérhetőség

Hogy megszerezheti a modellt és futtathatja saját hardverén, ami meghatározza, hogy az ezen az oldalon szereplő grafikus kártya adatai vonatkoznak-e.

Súlyok
Closed — provider access only
Modell hozzáférés
API access
Képzés kód
Unreleased

Hogyan van besorolva

A forrásadatláncok bejegyzéseinél alkalmazott címkék és a bejegyzés melletti bizalmi szint.

Valószínűleg 10²³ FLOP felett
Yes
Miért követik nyomon
Discretionary
Speculative

Model/modellek mindig AI modellek. Futás/futás azt jelenti, hogy fut egy AI modellt. Ha csak a "fut" szót kapod, az valószínűleg egy megosztott mondatból származik, mint például, hogy milyen AI modellt tud a GPU futtatni. Nem illik / nem fog illeni azt jelenti, hogy az AI modell nem fér el a GPU VRAM-jában. Szűk = alig futtatható, kényelmes = könnyen fut, van tartalék. Rövid összekötő szavak, mint az, a, egy, hogy, számára, vele, normálisan fordítva jelennek meg, mert a szöveg meg van osztva - csak fordítsd le őket. Tartásd meg a technikai kifejezéseket, mint a GPU, AI, TPS, VRAM, CUDA, Tensor, Inference, Quantization, LoRA, GGUF, FP16, INT4, INT8 angolul (vagy az adott nyelv elterjedt formájában). Mindig írj GPU, AI, TPS, VRAM, CUDA nagybetűkkel. Ha megkérdezik egy nyelv nevét (pl. spanyol, angol, nyelv) akkor fordítsd le a szót helyesen (spanyol→Spanyol, angol→Német, nyelv→Nyelv). CSAK a tiszta fordítást add meg magyarul. Nincsenek megjegyzések, nincsenek kérdések, semmi más. Ha üres, válaszolj egyetlen szóközzel: Sources

A GPU milyen AI modellt tud futtatni? Nem illik / nem fog illeni. szoros = alig futtatható, kényelmes = könnyen futtatja, van tartalék.

Referencia
Introducing Qwen3-Max-Preview (Instruct) — our biggest model yet, with over 1 trillion parameters!
Legutoljára frissítve
18 December 2025

Mit jelentenek a számok

Mi ez a modell

Qwen3-Max was published by Alibaba, in China, in September 2025. industry is the category the publisher falls under.

It works in Language, and is recorded as doing language modeling/generation, Question answering, Mathematical reasoning, Code generation, Quantitative reasoning, Retrieval-augmented generation, Translation.

Ez egy zárt modell: a betanított értékek azzal maradtak, aki előállította őket, és nincs helyi verzió a futtatáshoz.

Képzés és származás

Training it took roughly 1.5 × 10²⁵ FLOP of computation — a measure of what producing the model cost, not of how fast it answers.

Around 36,000,000,000,000 tokens went into training it.

Az alapul szolgáló adatbázisban egy konkrét ok miatt követik nyomon: diszkrecionális.

válik / nem fér el

Qwen3-Max — Gyakori kérdések

01

Who created Qwen3-Max?

Qwen3-Max was published by Alibaba, based in China, categorised as industry.

02

When was Qwen3-Max released?

Qwen3-Max was published in September 2025.

03

What is Qwen3-Max used for?

Qwen3-Max works in Language, and is recorded as handling language modeling/generation, Question answering, Mathematical reasoning, Code generation, Quantitative reasoning, Retrieval-augmented generation, Translation. These are the areas it was designed around; they describe intent rather than a hard boundary.

04

How much compute was used to train Qwen3-Max?

Around 1.5 × 10²⁵ FLOP. That measures what producing the model cost and says nothing about how quickly it answers once trained — inference speed comes from memory bandwidth, not from the training budget.

05

What GPU do I need to run Qwen3-Max?

None. Qwen3-Max is a closed model — its weights were never published, so it cannot be downloaded or run on your own hardware at any price. It is reachable only through its provider.

06

Is Qwen3-Max open source?

No. Qwen3-Max has not had its weights published, so it exists only as a service controlled by its owner.

07

How many parameters does Qwen3-Max have?

Qwen3-Max has 1T parameters. MoE architecture. That figure is the total, and it is what decides how much memory the model needs — roughly half a gigabyte per billion at the compression most people use.

Eredeti kiadás

Modell/modelek mindig mesterséges intelligenciát (MI) jelentenek. Futtatás/járás azt jelenti, hogy egy MI modellt futtatunk. Ha csak a run szót kapod, valószínűleg egy felosztott mondatból származik, például: Milyen MI modellt tud futtatni a GPU. Nem illik / nem fog illeni azt jelenti, hogy az MI modell nem fér el a GPU VRAM-jában. Szoros = alig futtatható, kényelmes = könnyen fut, van tartalék. Rövid kapcsolatkozó szavak, mint az, a, egy, -hoz, -t, -val, önállóan jelennek meg, mert a szöveg fel van osztva - csak fordítsd le őket normálisan. Tartsd meg a technikai kifejezéseket, mint GPU, AI, TPS, VRAM, CUDA, Tensor, Inference, Quantization, LoRA, GGUF, FP16, INT4, INT8 angolul (vagy az adott nyelv általános formájában). Mindig írd a GPU, AI, TPS, VRAM, CUDA nagybetűvel. Ha nyelvnevet kérnek lefordítani, fordítsd le helyesen (spanyol→Spanisch, angol→Deutsch, nyelv→Sprache). CSAK a tiszta fordítást add meg magyarul. Nincs megjegyzés, nincs kérdés, semmi más. Ha üres, egyetlen szóközzel válaszolj: A rekord utolsó frissítése. 18 December 2025

Az ellenkező irányban

Egy másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van egy kártyád, és szeretnéd tudni, mit fog futtatni., modell/modellek nem illeszkedik / nem fog illeszkedni szoros = alig futtatható, kényelmes = könnyen fut, van mozgástér..