GLM-5.2 TPS kalkulačka

Otevřít váhy Z.ai (Zhipu AI) 744B Parametry June 2026

Každá karta níže je hodnocena podle tohoto modelu při zvolené délce kontextu a minimální kvalitě. Rychlost je odhad pro jednotlivý požadavek, vypočtený z šířky paměťové pásma karty a velikosti modelu po kompresi..

Vypočítáno pro tento model

0 modely/modelem GPU nevyhovuje / nebude vyhovovat 818 karty, které to zvládnou

Které GPU mohou běžet GLM-5.2?

Nastavte vstupy, přečtěte odpověď.

Delší konverzace vyžaduje více paměti, což může způsobit, že tento model nebude fit na menších kartách..

Skrývá karty, které by se do modelu vešly pouze stlačením pod tento bod..

0 karty se shodují

Vypočítávání
Má modely, které GPU nedokáže spustit, GPUS s nedostatečnou VRAM. GPT za 100 TPS, modely jsou těsné. Kvantizace Fit

Žádná karta v našem katalogu nemůže tento model spustit s těmito nastaveními..

Rychlosti jsou odhady pro jednotlivé požadavky - jednu konverzaci najednou - vypočítané na základě šířky pásma paměti, velikosti modelu a kvantizace. Skutečná propustnost se liší podle doby inference a její verze. Čísla zveřejněná výrobci hardwaru měří mnoho současných požadavků a jsou mnohem vyšší..

Na záznamu

Plná specifikace

Všechno je zaznamenáno pro tento model. Většina z toho popisuje, jak byl trénován, spíše než jak běží — užitečný kontext pro posouzení, kolik práce do toho bylo vloženo, a jak se to srovnává s modely vytvořenými v jiném měřítku..

Origin

Kdo vytvořil tento model, kde a kdy byl publikován.

Organizace
Z.ai (Zhipu AI)
Typ organizace
Industry
Stát
China
Published
16 June 2026

Co to dělá

Problémové oblasti, pro které byl model navržen. Model může mít několik z každé.

Domain
Language
Úloha
Language modeling/generation

Velikost

Jak velký je model a na kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.

Parametry
744B
Tréninková data
tokens

Dostupnost

Zda můžete získat model a spustit ho na vlastním hardwaru, což rozhoduje o tom, zda se zde uvedené hodnoty grafické karty vztahují.

Váhy
Open — downloadable
Přístup k modelu
Open weights (unrestricted)
Hugging Face
zai-org

Jak je to klasifikováno

Štítky, které se aplikují na zdrojový dataset při sledování významných modelů a jakou má jistotu v tomto záznamu.

Model/modely nelze spustit. Tightly = téměř nelze spustit, comfortable = snadno spustitelné s rezervou.
Confident

Model/modely nevyhovuje / nebudou vyhovovat. Těsný = barely runnable, pohodlný = běží snadno s rezervou.

Kde tento záznam pochází a kdy byl naposledy zkontrolován.

Odkaz
GLM-5.2: Built for Long-Horizon Tasks
Poslední aktualizace
10 July 2026

Co znamenají čísla

Co je potřeba k spuštění tohoto modelu

At 744B parameters, GLM-5.2 is beyond what any single graphics card holds. Running it means either splitting it across several cards or renting hardware built for the job — 0 of the cards we track can hold it on their own, and all of them are datacentre parts.

O tomto modelu

GLM-5.2 was published by Z.ai (Zhipu AI), in China, in June 2026. industry is the category the publisher falls under.

Funguje v češtině a je zaznamenáno jako modelování/generování jazyka.

The weights are published, so it can be downloaded and run on your own hardware indefinitely, offline, with no account attached. It is published under the zai-org organisation on Hugging Face.

Krok za krokem

Jak vybrat GPU pro GLM-5.2

Tabulka výše již vyhodnotila všechny karty, které máme, podle specifikací tohoto modelu. K dosažení vaší odpovědi je potřeba šest kroků..

  1. 01

    Přečtěte si nejprve údaj o paměti

    Look at what GLM-5.2 actually needs. No amount of processing power compensates for a card that cannot hold it.

  2. 02

    Set the context length you will work at

    Set the context to what you will actually use. The cache grows with the conversation, and it is the usual reason GLM-5.2 stops fitting a card that seemed fine.

  3. 03

    Rozhodněte, kolik komprese přijmete

    The quantisation column varies by card, because a bigger card holds a more accurate copy of GLM-5.2. Set a floor to hold the comparison at one level.

  4. 04

    Srovnejte TPS, ne specifikace.

    The speed ordering for GLM-5.2 is effectively an ordering by memory bandwidth.

  5. 05

    Zkontrolujte verdikt o vhodnosti před zakoupením

    The fit column separates cards that just manage GLM-5.2 from those with room to spare. Buy for the second if the context might grow.

  6. 06

    Otevřete kartu, na které jste se usadili

    Every card name links to its own page, which runs the same calculation across the whole model catalogue. Worth a look before buying for GLM-5.2 alone — a card is usually bought for more than one model.

GLM-5.2 — Běžné otázky

01

Can I run GLM-5.2 if it does not fit in my GPU?

Only by offloading, which is usually a false economy: the part in system memory drags the whole thing down — the nearest miss we calculate is short by 191.6 GB. Our figures for GLM-5.2 assume it is fully resident.

02

Would two GPUs run GLM-5.2 faster?

Two cards buy memory rather than speed. That matters for GLM-5.2 only if one card cannot hold it — 0 can, so a second adds little.

03

Why does the quantisation differ between cards for GLM-5.2?

A larger card holds a more accurate copy. Across the cards that run GLM-5.2, 1 compression levels are used; the floor control above pins it to one.

04

How accurate are these GLM-5.2 speed estimates?

Každé číslo je odvozeno od šířky paměti a velikosti modelu, není to testováno. Proto je každý zveřejněn jako rozsah, například rozsah pod každým číslem, spíše než jedno číslo.

05

Is GLM-5.2 open source?

Its weights are published, so GLM-5.2 can be downloaded and run on your own hardware. Note that open weights is not the same as open source in the full sense — it says nothing about the training data, the training code, or the commercial terms attached.

06

How many parameters does GLM-5.2 have?

GLM-5.2 has 744B parameters. That figure is the total, and it is what decides how much memory the model needs — roughly half a gigabyte per billion at the compression most people use.

07

Who created GLM-5.2?

GLM-5.2 was published by Z.ai (Zhipu AI), based in China, categorised as industry.

08

When was GLM-5.2 released?

GLM-5.2 was published in June 2026.

09

What is GLM-5.2 used for?

GLM-5.2 works in Language, and is recorded as handling language modeling/generation. These are the areas it was designed around; they describe intent rather than a hard boundary.

10

Where can I download GLM-5.2?

Its weights are published under the zai-org organisation on Hugging Face. We do not host model files — this site calculates what hardware is needed to run them.