Katalog
AI modely a GPU, které je provozují
Každý velký jazykový model, který máme v našem databázi, se svým počtem parametrů, kdo ho vybudoval, a zda jsou váhy dostatečně otevřené, abyste si je mohli stáhnout a spustit sami. Otevřete jakýkoli model, abyste viděli, které GPU karty ho mohou zvládnout, při jaké kvantizaci a přibližně kolik tokenů za sekundu očekávat..
Toto je opačné od začátku od hardwaru. Pokud již víte, který model chcete, zde zjistíte, co je potřeba k jeho spuštění. — GPU katalog funguje to obráceně, začínající od karty, kterou už vlastníte.
3,567
modely v databázi
1,335
s otevřenými váhami
2,232
uzavřený nebo nevyjádřený
1,314
organizace
50
země
Každé slovo musí něco odpovídat, takže více slov zúžuje seznam. Velikost jako 27b odpovídá počtu parametrů i když název to nezmiňuje..
parametry Jaký – Jaký
3,567 modely odpovídají
Aktualizace| Hmotnosti | Doména | ||||
|---|---|---|---|---|---|
| Claude Opus 5 | Anthropic United States of America | — | Jul 2026 | Uzavřený | Language, Vision, Multimodal |
| Gemini 3.5 Flash Cyber | Google DeepMind United States of America | — | Jul 2026 | Uzavřený | Language, Multimodal, Vision |
| Gemini 3.5 Flash-Lite | Google DeepMind United States of America | — | Jul 2026 | Uzavřený | Language, Multimodal, Vision |
| Gemini 3.6 Flash | Google DeepMind United States of America | — | Jul 2026 | Uzavřený | Language, Multimodal, Vision |
| Kimi K3 | Moonshot China | 2.8T | Jul 2026 | Uzavřený | Language, Multimodal, Vision |
| Inkling | Thinking Machines United States of America | 975B | Jul 2026 | Otevřený | Language, Multimodal, Audio, Video, Vision |
| Inkling-Small | Thinking Machines United States of America | 276B | Jul 2026 | Uzavřený | Language, Multimodal, Audio, Video, Vision |
| GPT-5.6 Luna | OpenAI United States of America | — | Jul 2026 | Uzavřený | Multimodal, Language, Vision |
| GPT-5.6 Sol | OpenAI United States of America | — | Jul 2026 | Uzavřený | Multimodal, Language, Vision |
| GPT-5.6 Terra | OpenAI United States of America | — | Jul 2026 | Uzavřený | Multimodal, Language, Vision |
| Muse Spark 1.1 | Meta AI United States of America | — | Jul 2026 | Uzavřený | Language |
| Grok 4.5 | xAI United States of America | 1.5T | Jul 2026 | Uzavřený | Language |
| Muse Image | Meta AI United States of America | — | Jul 2026 | Uzavřený | Image generation |
| GPT-Realtime-2.1-Mini | OpenAI United States of America | — | Jul 2026 | Uzavřený | — |
| Claude Sonnet 5 | Anthropic United States of America | — | Jun 2026 | Uzavřený | Language, Multimodal |
| Solar Open2 250B | Upstage Korea (Republic of) | 250.3B | Jun 2026 | Otevřený | Language |
| GLM-5.2 | Z.ai (Zhipu AI) China | 744B | Jun 2026 | Otevřený | Language |
| Kimi K2.7 Code | Moonshot China | 1T | Jun 2026 | Otevřený | Language, Multimodal, Vision |
| Claude Fable 5 | Anthropic United States of America | — | Jun 2026 | Uzavřený | Language, Multimodal |
| Claude Mythos 5 | Anthropic United States of America | — | Jun 2026 | Uzavřený | Language, Multimodal |
| North Mini Code | Cohere Canada | 30B | Jun 2026 | Otevřený | Language |
| Nemotron 3 Ultra | NVIDIA United States of America | 550B | Jun 2026 | Otevřený | Language |
| Gemma 4 12B | Google DeepMind United States of America | 12B | Jun 2026 | Otevřený | Language, Multimodal, Audio |
| MAI-Image-2.5 | Microsoft United States of America | — | Jun 2026 | Uzavřený | Image generation |
| MAI-Thinking-1 | Microsoft United States of America | 962B | Jun 2026 | Uzavřený | Language |
| MiniMax-M3 | MiniMax China | — | Jun 2026 | Uzavřený | Language, Multimodal |
| Claude Opus 4.8 | Anthropic United States of America | — | May 2026 | Uzavřený | Language |
| Qwen 3.7 Max | Alibaba China | — | May 2026 | Uzavřený | Language |
| Qwen3.7-Max | Alibaba China | — | May 2026 | Uzavřený | Language |
| Composer 2.5 | Cursor United States of America | 1T | May 2026 | Uzavřený | Language |
Krok za krokem
Jak zjistit, která GPU spouští AI model
Každý open-weight model zde byl již posouzen vůči každé GPU kartě, pro kterou máme specifikace. Dostat se k odpovědi trvá šest kroků..
-
01
Najděte model
Hledejte podle názvu nebo podle velikosti — zadání 27b odpovídá počtu parametrů, i když název to nezmiňuje. Každé slovo musí odpovídat něčemu, takže více slov dále zužuje seznam.
-
02
Zúžit na modely, které můžete skutečně spustit
Nastavte dostupnost pouze na otevřené váhy. Zavřené modely nelze stáhnout ani spustit na vlastním hardwaru za žádnou cenu, takže jejich filtrování ponechává pouze modely, kde existuje hardwarová odpověď.
-
03
Nastavte rozsah velikosti, který vyhovuje vaší hardwarové konfiguraci.
Použijte posuvník parametru. Jako hrubý vodítko potřebuje model něco málo přes půl gigabajtu na miliardu parametrů při kompresi, kterou lidé obvykle používají — takže karta s 24 GB VRAM je pohodlná až přibližně na třicet miliard parametrů.
-
04
Otevřít model
Jeho stránka uvádí každou grafickou kartu, která ji může spustit, s nejmenší kartou, která se vejde, nejrychlejší a odhadovaným číslem tokenů za sekundu pro každou. To je opakem začínání od hardware, a obvykle je to užitečnější směr, když už víte, který model chcete.
-
05
Upravte délku kontextu a kvalitu
Na stránce modelu nastavte délku konverzace, se kterou očekáváte práci, a nejnižší kompresi, kterou budete akceptovat. Obě mění odpověď spíše než aby ji filtrovaly — dlouhá konverzace potřebuje podstatně více MEMORY než krátká, a může model posunout mimo dosah karty, která by ho jinak zvládla.
-
06
Přečtěte si rozsah, nejediné číslo
Každá hodnota propustnosti nese rozsah důvěry, a tento rozsah je odpovědí. Tentýž model na téže kartě se liší mezi inferenčními enginy a mezi verzemi jednoho enginu, více než většina rozdílů, které porovnáváte.
Co čísla znamenají
Co je tento katalog
Záznam pokrývající 3,567 modely strojového učení — kdo každý z nich vytvořil, kde, kdy, jak velký je a zda byly jeho váhy zveřejněny. Je to širší než seznam věcí, které můžete spustit: model, který si nikdo nemůže stáhnout, má stále specifikaci, která stojí za přečtení, a vědění o tom, co existuje, je součástí posuzování, co stojí za to spustit.
Co odlišuje tento katalog od prostého indexu, je to, že je připojen k hardwarovému kalkulátoru. Každý model, jehož váhy jsou OTEVŘENÉ a jehož velikost je ZAZNAMENÁNA, byla posouzena vůči každé grafické KARTĚ, pro kterou máme specifikace. Otevřete jeden a řekne vám, které KARTY jej mohou spustit, kolik paměti každá potřebuje a přibližně kolik TOKENŮ za sekundu očekávat.
Otevřené váhy a uzavřené modely
Otevřít váhy
1,335
uzavřený nebo nevyjádřený
2,232
organizace
1,314
Jedním z nejdůležitějších faktů o modelu je, zda byly jeho váhy publikovány. Váhy modelu jsou trénované hodnoty, které z něj dělají to, čím je - stovky miliard čísel dosažených během měsíců výpočtů. Publikování znamená, že si je kdokoli může stáhnout a spustit na vlastním hardwaru, trvale, bez účtu a bez internetového připojení. Nepublikování znamená, že model existuje pouze jako služba, přístupná prostřednictvím rozhraní, které ovládá jeho vlastník.
Toto rozlišení určuje všechno ostatní na tomto webu. Uzavřený model nelze spustit lokálně za žádnou cenu, takže žádná změna grafické karty na odpověď neplatí a žádná hodnota paměti se na to nevztahuje. Otevřený model může spustit kdokoli, kdo má dostatečně velký hardware, aby ho udržel, což mění "jaký model bych měl použít" na otázku s hardwarovou odpovědí.
"Open weights" není totéž co open source v smyslu, jaký tento termín obvykle nese. Možnost stáhnout váhy nic neříká o tréninkových datech, tréninkovém kódu nebo licenci připojené k výsledku — některé publikované modely umožňují komerční použití bez omezení, jiné to omezují. Co je konzistentní, je to, že model běží na vašem stroji spíše než na stroji někoho jiného.
Tento katalog obsahuje 3,567 modely. Z těchto, 1,335 mít open weight a 2,232 ne — zhruba 37 v každém sto je něco, co byste si mohli dnes stáhnout. Kde licenci nikdy nezaznamenali, počítáme to jako uzavřené, na principu, že nevyjádřená licence není na co se spolehnout.
Co vlastně počet parametrů říká?
Parametry jsou naučené hodnoty uvnitř modelu — čísla upravená během trénování, která kódují vše, co ví. Model popsaný jako 8B má kolem osmi miliard z nich, a každé z nich zabírá místo v VRAM. Proto je počet parametrů sloupec, který zde nejvíce záleží: je to nejbližší věc k přímému vyjádření toho, kolik hardwaru model potřebuje.
Vztah je blízký lineární, ale konstanta závisí na tom, jak je model uložen. Při plné přesnosti každá parametr zabírá dva bajty, takže model s osmi miliardami parametrů potřebuje šestnáct gigabajtů, než se zohlední cokoli jiného. Při stlačení na přibližně čtyři bity — což je to, co většina lidí, kteří spouští modely lokálně, skutečně používá — stejný model potřebuje blíže k pěti, za skromnou a obvykle přijatelnou cenu v přesnosti.
Dvě věci to komplikuje. Modely směsi expertů vedou každý token pouze skrze část sebe sama, takže generují text rychlostí něčeho mnohem menšího, přičemž stále potřebují, aby každý parametr byl v paměti — rychlé, ale ne levné na udržení. A samotná konverzace vyžaduje paměť, která roste, jak konverzace probíhá, což je důvod, proč model, který se pohodlně vejde na krátké otázky, může selhat na dlouhém dokumentu.
Větší také není automaticky lepší, a stále častěji není. Schopnost na parametr se výrazně zlepšila, takže nedávný model s osmi miliardami parametrů běžně překonává starší model několikrát větší, přičemž se vejde na hardware, na kterém by se starší model nikdy nevešel. Třídění tohoto katalogu podle data vydání je obvykle lepším vodítkem než třídění podle velikosti.
Jak jazykové modely dorazily sem
Téměř každý model v tomto katalogu pochází z jedné architektonické myšlenky publikované v roce 2017 v článku nazvaném "Attention Is All You Need". Představil transformátor, který zpracovává celou sekvenci najednou a učí se, které její části se vztahují na které – nahrazující krokové rekurentní návrhy, které přišly dříve, a škálující se mnohem lépe než tyto. Každý model uvedený zde, který generuje text, je transformátor nebo jeho blízký příbuzný.
Co následovalo, byla převážně demonstrace, že architektura se zlepšovala s měřítkem. Po sobě jdoucí modely rostly o několik řádů a stávaly se úměrně schopnějšími, což stanovilo vzor na několik let: více parametrů, více tréninkových dat, více výpočtů. Do roku 2020 byly největší modely dostatečně schopné, aby byly komerčně vážné, a bylo je možné dosáhnout pouze jako placené služby – váhy zůstávaly u toho, kdo je trénoval.
Obrat přišel v roce 2023, když několik organizací začalo publikovat váhy pro modely, které byly dostatečně dobré na to, aby stály za spuštění. To změnilo otázku z "k jaké službě se mám přihlásit" na "co může moje vlastní hardware dělat", a je to důvod, proč existuje stránka jako je tato. Předtím na otázku o hardwaru většina lidí neměla smysluplnou odpověď.
Roky, které následovaly, byly méně o škále a více o efektivitě. Lepší tréninkové metody, lepší data a architektonická práce, jako je směs-expertů směrování, všechny zvýšily schopnost na parametr, zatímco kvantizace — ukládání každé váhy ve čtyřech nebo pěti bitech namísto šestnácti — snížila MEMORY, kterou daný MODEL potřebuje, zhruba o tři čtvrtiny. Mezi nimi modely, které by kdysi vyžadovaly datacentrum, nyní běží na desktopové GPU, což je praktický vývoj, na kterém celý tento katalog spočívá.
Katalog, jak stojí
Největší model
173.9T
země
50
Největší model v databázi je BaGuaLu, dosahování 173.9T parametry. V této škále je model infrastrukturní datového centra spíše než něco, co by držela pracovní stanice, a toto číslo je užitečnější jako ukazatel, kde leží hranice, než jako rozhodnutí o nákupu.
Katalog pokrývá práci z 1,314 organizace, rozptýlené 50 země. Ten rozdíl stojí za povšimnutí sám o sobě: vývoj modelů přestal být soustředěn v hrstce laboratoří před nějakým časem a několik z nejpoužívanějších open-weight modelů pochází z organizací, které před několika lety neexistovaly.
Parametrické počty jsou zaznamenávány pro 2,315 záznamy, z katalogu držícího 3,567. Mezery jsou většinou uzavřené modely, jejichž majitelé nikdy nezveřejnili velikost, a občasné otevřené modely, které nikdo neměřil. Model bez této hodnoty je uveden, ale nelze mu poskytnout odhad paměti nebo rychlosti, protože každý z těchto výpočtů vychází z ní.
Vstupy začínají v 1950 a spustit na 2026, tak katalog je záznamem v oboru spíše než snímkem toho, co je aktuální. Filtrace podle roku vydání je nejrychlejší způsob, jak to zúžit na modely, které stojí za to skutečně zvážit.
Přístupová hranice
Deset největších open-weight AI modelů
Největší modely, které si může kdokoli skutečně stáhnout, nejnovější jako první, kde se velikosti shodují. Toto jsou horní hranice toho, co je možné spustit na vlastním hardwaru — i když v této velikosti to obvykle znamená několik karet spíše než jednu..
- 01 DeepSeek-V4-Pro DeepSeek · Apr 2026 1.6T
- 02 QMoE: compressed SwitchTransformer Institute of Science and Technology Austria (ISTA),Neural Magic · Oct 2023 1.6T
- 03 Switch Google · Jan 2021 1.6T
- 04 MoE-1.1T Meta AI · Dec 2021 1.1T
- 05 Kimi K2.7 Code Moonshot · Jun 2026 1T
- 06 Kimi K2.6 Moonshot · Apr 2026 1T
- 07 Kimi K2.5 Moonshot · Feb 2026 1T
- 08 MiMo-V2.5-Pro Xiaomi Corp · Apr 2026 1T
- 09 Kimi K2 Thinking Moonshot · Nov 2025 1T
- 10 Ring-1T Ant Group · Oct 2025 1T
Deset největších uzavřených AI modelů
Největší modely, jejichž váhy nebyly nikdy zveřejněny. Žádný z nich nelze spustit na vašem vlastním hardwaru za žádnou cenu — jsou uvedeny, protože představují hranici, vůči které jsou měřeny open-weight modely..
- 01 BaGuaLu Tsinghua University,Zhejiang Lab,Beijing Academy of Artificial Intelligence / BAAI,Alibaba · Mar 2022 173.9T
- 02 Persia ETH Zurich,Kuaishou Technology · Nov 2021 100T
- 03 DLRM-12T Meta AI,Carnegie Mellon University (CMU) · Apr 2021 12T
- 04 M6-10T Alibaba · Oct 2021 10T
- 05 Grok 4 xAI · Jul 2025 3T
- 06 Grok 3 xAI · Feb 2025 3T
- 07 DLRM-2022 Facebook · Sep 2021 3T
- 08 Kimi K3 Moonshot · Jul 2026 2.8T
- 09 Llama 4 Behemoth (preview) Meta AI · Apr 2025 2T
- 10 GPT-4 (Jun 2023) OpenAI · Jun 2023 1.8T
Nejnovější open-weight releases
Nejnovější přídavky s publikovanými OPEN WEIGHT. Schopnost na parametr se postupně zlepšila, takže nedávný MODEL je obvykle lepším využitím stejné MEMORY než starší, větší..
Čtení tabulky
Jak číst tento katalog
- parametry
- Celkový počet naučených hodnot, napsaný způsobem, jakým to pole píše: 8B je osm miliard, 1.6T je 1.6 trilionu. Toto je celkový počet, ne počet použitý na slovo — modely směsi expertů používají pouze zlomek na token, ale stále musí mít vše v paměti.
- Otevřít váhy
- Zda lze stažené hodnoty spustit na vlastní hardwaru. Uzavřený model je přístupný pouze prostřednictvím jeho poskytovatele, takže žádná grafická karta jej neumožňuje spustit lokálně. Kde nebylo nikdy zaznamenáno licencování, považujeme jej za uzavřený, spíše než abychom předpokládali opak.
- Doména a úkol
- Na čem byl model postaven, aby fungoval. Model může nést několik z každého, což je důvod, proč výběr domény zužuje seznam úkolů spíše než aby ho nahrazoval.
- Organizace a země
- Kdo publikoval model a kde sídlí? Užitečné, když nasazení musí splnit pravidlo o tom, odkud model pochází.
- Uvolněno
- Když byl model zveřejněn. Obvykle je lepší příručka k kvalitě než velikost, protože schopnost na parametr se výrazně zlepšila.
Odpovědi
běžné otázky
Jak mohu zjistit, který GPU může spustit daný AI model?
Najděte model v tabulce výše a otevřete ho. Jeho stránka uvádí každou grafickou kartu v našem katalogu, která ho může pojmout, s potřebnou pamětí, se kterou by běžel, a odhadovanou hodnotou tokenů za sekundu. Můžete také přistupovat z druhé strany a začít od karty, kterou již vlastníte.
Kolik AI modelů je v této databázi?
Katalog obsahuje 3,567 modely. Otevřené váhy, ke stažení a spuštění na vlastním hardwaru, pokrývají 1,335 z nich 2,232 jsou zavřené, nebo jejich licencování nikdy nebylo zaznamenáno.
Jaký je rozdíl mezi open-weight a closed model?
Otevřený model měl zveřejněny své trénované hodnoty, takže si ho kdokoli může stáhnout a spustit na svém vlastním stroji, neomezeně a offline. Uzavřený model existuje pouze jako služba řízená jeho vlastníkem. Pouze otevřené modely mají smysluplné požadavky na hardware, což je důvod, proč uzavřené modely na této stránce mají specifikaci, ale žádnou tabulku grafických karet.
Jsou OPEN WEIGHTS totéž co open source?
Ne docela. Publikované váhy neříkají nic o tréninkových datech, tréninkovém kódu nebo licenci připojené k výsledku — některé povolují komerční použití volně, jiné to omezují. Co zaručují, je, že model běží na vaší hardwaru, nikoli na někom jiném, což je část, která je důležitá pro tuto stránku.
Kdo staví tyto AI modely?
Katalog pokrývá 1,314 organizace, rozptýlené 50 země — univerzitní skupiny, nezávislé laboratoře a výzkumné oddělení velkých technologických společností. Vývoj modelů přestal být soustředěn na několika místech před nějakým časem a několik široce používaných open-weight modelů pochází z organizací, které existují pouze několik let.
Jaký je největší AI model?
Největší na file je BaGuaLu, dosahování 173.9T parametry. Při této velikosti je model infrastrukturním datového centra, spíše než něčím, co by mohla pojmout jediná grafická karta — největší open-weight modely, které se vejdou na jednu kartu, jsou výrazně menší a jsou uvedeny níže na této stránce.
Co znamenají parametry?
Parametry jsou naučené hodnoty uvnitř modelu a jejich počet je nejbližší přímému vyjádření, kolik paměti potřebuje. Hrubý návod je něco málo přes půl gigabajtu na miliardu parametrů při kompresi, kterou používá většina lidí — takže model s osmi miliardami parametrů je pohodlný na osmi gigabajtech a třicet miliard potřebuje kolem dvaceti čtyř.
Je vždy větší AI model lepší?
Ne, a stále více ne. Schopnost na parametr se výrazně zlepšila, takže nedávný model s osmi miliardami parametrů často překonává starší model, který je několikrát větší, a to na hardwaru, na kterém by starší model nikdy nefungoval. Řazení podle data vydání je obvykle lepším vodítkem než řazení podle velikosti.
Co je model mixture-of-experts?
Jedna, která směruje každý token pouze frakcí sebe sama, spíše než skrze každý parametr. To jí umožňuje generovat text rychlostí mnohem menšího modelu — ale každý expert stále musí být rezidentem v paměti, takže je rychlá, aniž by byla levná na udržení. Katalog uvádí celkový počet parametrů, což je číslo, které rozhoduje, zda se vejde.
Proč některé modely nemají počet parametrů?
proto, protože organizace nikdy jednoho nezveřejnila. To je běžné pro uzavřené modely a občas se to stává u otevřených. Počty se zaznamenávají pro 2,315 záznamy, z katalogu držícího 3,567. Uvádíme zbytek spíše než abychom je skrývali, ale žádné číslo paměti nebo rychlosti nemůže být vyprodukováno bez tohoto čísla.
Mohu tyto modely spustit bez připojení k internetu?
Jakýkoli OPEN WEIGHT model, ano — to je smysl publikovaných vah. Jakmile je stažen, běží zcela na vaší vlastní mašině bez účtu a bez sítě. Uzavřené modely nelze vůbec spustit offline, protože nikdy nedržíte samotný model.
Jak přesné jsou odhady hardwaru na této stránce?
Jsou vypočteny z specifikací spíše než měřeny, a každé číslo je publikováno jako rozsah spíše než jako jediné číslo. Stejný model a karta se liší o třicet až padesát procent v závislosti na tom, jaký inference software je použit a kterou verzi, kterou žádný výpočet ze specifikací nemůže předpovědět. Považujte rozsah za čestnou odpověď.
Už mám grafickou kartu. Mohu hledat opačně?
Ano. Katalog GPU uvádí každou kartu, pro kterou máme specifikace, a na stránce každé karty jsou uvedeny všechny modely, které může provozovat, seřazené podle rychlosti. To je stejný výpočet, přistupující z pohledu hardwaru.
Druhý směr
Díváte se na to z druhé strany?
Tato stránka začíná od modelu a ptá se, jaký hardware potřebuje. Pokud již vlastníte kartu a chcete vědět, co na ní poběží, začněte raději tam. — uvádí každou kartu v databázi a každá z nich uvádí modely, které může spustit, nejrychlejší první.