Katalog

AI modely a GPU, které je provozují

Každý velký jazykový model, který máme v našem databázi, se svým počtem parametrů, kdo ho vybudoval, a zda jsou váhy dostatečně otevřené, abyste si je mohli stáhnout a spustit sami. Otevřete jakýkoli model, abyste viděli, které GPU karty ho mohou zvládnout, při jaké kvantizaci a přibližně kolik tokenů za sekundu očekávat..

Toto je opačné od začátku od hardwaru. Pokud již víte, který model chcete, zde zjistíte, co je potřeba k jeho spuštění. — GPU katalog funguje to obráceně, začínající od karty, kterou už vlastníte.

3,567

modely v databázi

1,335

s otevřenými váhami

2,232

uzavřený nebo nevyjádřený

1,314

organizace

50

země

Každé slovo musí něco odpovídat, takže více slov zúžuje seznam. Velikost jako 27b odpovídá počtu parametrů i když název to nezmiňuje..

parametry Jaký – Jaký

3,567 modely odpovídají

Aktualizace
Hmotnosti Doména
Claude Opus 5 Anthropic United States of America Jul 2026 Uzavřený Language, Vision, Multimodal
Gemini 3.5 Flash Cyber Google DeepMind United States of America Jul 2026 Uzavřený Language, Multimodal, Vision
Gemini 3.5 Flash-Lite Google DeepMind United States of America Jul 2026 Uzavřený Language, Multimodal, Vision
Gemini 3.6 Flash Google DeepMind United States of America Jul 2026 Uzavřený Language, Multimodal, Vision
Kimi K3 Moonshot China 2.8T Jul 2026 Uzavřený Language, Multimodal, Vision
Inkling Thinking Machines United States of America 975B Jul 2026 Otevřený Language, Multimodal, Audio, Video, Vision
Inkling-Small Thinking Machines United States of America 276B Jul 2026 Uzavřený Language, Multimodal, Audio, Video, Vision
GPT-5.6 Luna OpenAI United States of America Jul 2026 Uzavřený Multimodal, Language, Vision
GPT-5.6 Sol OpenAI United States of America Jul 2026 Uzavřený Multimodal, Language, Vision
GPT-5.6 Terra OpenAI United States of America Jul 2026 Uzavřený Multimodal, Language, Vision
Muse Spark 1.1 Meta AI United States of America Jul 2026 Uzavřený Language
Grok 4.5 xAI United States of America 1.5T Jul 2026 Uzavřený Language
Muse Image Meta AI United States of America Jul 2026 Uzavřený Image generation
GPT-Realtime-2.1-Mini OpenAI United States of America Jul 2026 Uzavřený
Claude Sonnet 5 Anthropic United States of America Jun 2026 Uzavřený Language, Multimodal
Solar Open2 250B Upstage Korea (Republic of) 250.3B Jun 2026 Otevřený Language
GLM-5.2 Z.ai (Zhipu AI) China 744B Jun 2026 Otevřený Language
Kimi K2.7 Code Moonshot China 1T Jun 2026 Otevřený Language, Multimodal, Vision
Claude Fable 5 Anthropic United States of America Jun 2026 Uzavřený Language, Multimodal
Claude Mythos 5 Anthropic United States of America Jun 2026 Uzavřený Language, Multimodal
North Mini Code Cohere Canada 30B Jun 2026 Otevřený Language
Nemotron 3 Ultra NVIDIA United States of America 550B Jun 2026 Otevřený Language
Gemma 4 12B Google DeepMind United States of America 12B Jun 2026 Otevřený Language, Multimodal, Audio
MAI-Image-2.5 Microsoft United States of America Jun 2026 Uzavřený Image generation
MAI-Thinking-1 Microsoft United States of America 962B Jun 2026 Uzavřený Language
MiniMax-M3 MiniMax China Jun 2026 Uzavřený Language, Multimodal
Claude Opus 4.8 Anthropic United States of America May 2026 Uzavřený Language
Qwen 3.7 Max Alibaba China May 2026 Uzavřený Language
Qwen3.7-Max Alibaba China May 2026 Uzavřený Language
Composer 2.5 Cursor United States of America 1T May 2026 Uzavřený Language

Krok za krokem

Jak zjistit, která GPU spouští AI model

Každý open-weight model zde byl již posouzen vůči každé GPU kartě, pro kterou máme specifikace. Dostat se k odpovědi trvá šest kroků..

  1. 01

    Najděte model

    Hledejte podle názvu nebo podle velikosti — zadání 27b odpovídá počtu parametrů, i když název to nezmiňuje. Každé slovo musí odpovídat něčemu, takže více slov dále zužuje seznam.

  2. 02

    Zúžit na modely, které můžete skutečně spustit

    Nastavte dostupnost pouze na otevřené váhy. Zavřené modely nelze stáhnout ani spustit na vlastním hardwaru za žádnou cenu, takže jejich filtrování ponechává pouze modely, kde existuje hardwarová odpověď.

  3. 03

    Nastavte rozsah velikosti, který vyhovuje vaší hardwarové konfiguraci.

    Použijte posuvník parametru. Jako hrubý vodítko potřebuje model něco málo přes půl gigabajtu na miliardu parametrů při kompresi, kterou lidé obvykle používají — takže karta s 24 GB VRAM je pohodlná až přibližně na třicet miliard parametrů.

  4. 04

    Otevřít model

    Jeho stránka uvádí každou grafickou kartu, která ji může spustit, s nejmenší kartou, která se vejde, nejrychlejší a odhadovaným číslem tokenů za sekundu pro každou. To je opakem začínání od hardware, a obvykle je to užitečnější směr, když už víte, který model chcete.

  5. 05

    Upravte délku kontextu a kvalitu

    Na stránce modelu nastavte délku konverzace, se kterou očekáváte práci, a nejnižší kompresi, kterou budete akceptovat. Obě mění odpověď spíše než aby ji filtrovaly — dlouhá konverzace potřebuje podstatně více MEMORY než krátká, a může model posunout mimo dosah karty, která by ho jinak zvládla.

  6. 06

    Přečtěte si rozsah, nejediné číslo

    Každá hodnota propustnosti nese rozsah důvěry, a tento rozsah je odpovědí. Tentýž model na téže kartě se liší mezi inferenčními enginy a mezi verzemi jednoho enginu, více než většina rozdílů, které porovnáváte.

Co čísla znamenají

Co je tento katalog

Záznam pokrývající 3,567 modely strojového učení — kdo každý z nich vytvořil, kde, kdy, jak velký je a zda byly jeho váhy zveřejněny. Je to širší než seznam věcí, které můžete spustit: model, který si nikdo nemůže stáhnout, má stále specifikaci, která stojí za přečtení, a vědění o tom, co existuje, je součástí posuzování, co stojí za to spustit.

Co odlišuje tento katalog od prostého indexu, je to, že je připojen k hardwarovému kalkulátoru. Každý model, jehož váhy jsou OTEVŘENÉ a jehož velikost je ZAZNAMENÁNA, byla posouzena vůči každé grafické KARTĚ, pro kterou máme specifikace. Otevřete jeden a řekne vám, které KARTY jej mohou spustit, kolik paměti každá potřebuje a přibližně kolik TOKENŮ za sekundu očekávat.

Otevřené váhy a uzavřené modely

Otevřít váhy

1,335

uzavřený nebo nevyjádřený

2,232

organizace

1,314

Jedním z nejdůležitějších faktů o modelu je, zda byly jeho váhy publikovány. Váhy modelu jsou trénované hodnoty, které z něj dělají to, čím je - stovky miliard čísel dosažených během měsíců výpočtů. Publikování znamená, že si je kdokoli může stáhnout a spustit na vlastním hardwaru, trvale, bez účtu a bez internetového připojení. Nepublikování znamená, že model existuje pouze jako služba, přístupná prostřednictvím rozhraní, které ovládá jeho vlastník.

Toto rozlišení určuje všechno ostatní na tomto webu. Uzavřený model nelze spustit lokálně za žádnou cenu, takže žádná změna grafické karty na odpověď neplatí a žádná hodnota paměti se na to nevztahuje. Otevřený model může spustit kdokoli, kdo má dostatečně velký hardware, aby ho udržel, což mění "jaký model bych měl použít" na otázku s hardwarovou odpovědí.

"Open weights" není totéž co open source v smyslu, jaký tento termín obvykle nese. Možnost stáhnout váhy nic neříká o tréninkových datech, tréninkovém kódu nebo licenci připojené k výsledku — některé publikované modely umožňují komerční použití bez omezení, jiné to omezují. Co je konzistentní, je to, že model běží na vašem stroji spíše než na stroji někoho jiného.

Tento katalog obsahuje 3,567 modely. Z těchto, 1,335 mít open weight a 2,232 ne — zhruba 37 v každém sto je něco, co byste si mohli dnes stáhnout. Kde licenci nikdy nezaznamenali, počítáme to jako uzavřené, na principu, že nevyjádřená licence není na co se spolehnout.

Co vlastně počet parametrů říká?

Parametry jsou naučené hodnoty uvnitř modelu — čísla upravená během trénování, která kódují vše, co ví. Model popsaný jako 8B má kolem osmi miliard z nich, a každé z nich zabírá místo v VRAM. Proto je počet parametrů sloupec, který zde nejvíce záleží: je to nejbližší věc k přímému vyjádření toho, kolik hardwaru model potřebuje.

Vztah je blízký lineární, ale konstanta závisí na tom, jak je model uložen. Při plné přesnosti každá parametr zabírá dva bajty, takže model s osmi miliardami parametrů potřebuje šestnáct gigabajtů, než se zohlední cokoli jiného. Při stlačení na přibližně čtyři bity — což je to, co většina lidí, kteří spouští modely lokálně, skutečně používá — stejný model potřebuje blíže k pěti, za skromnou a obvykle přijatelnou cenu v přesnosti.

Dvě věci to komplikuje. Modely směsi expertů vedou každý token pouze skrze část sebe sama, takže generují text rychlostí něčeho mnohem menšího, přičemž stále potřebují, aby každý parametr byl v paměti — rychlé, ale ne levné na udržení. A samotná konverzace vyžaduje paměť, která roste, jak konverzace probíhá, což je důvod, proč model, který se pohodlně vejde na krátké otázky, může selhat na dlouhém dokumentu.

Větší také není automaticky lepší, a stále častěji není. Schopnost na parametr se výrazně zlepšila, takže nedávný model s osmi miliardami parametrů běžně překonává starší model několikrát větší, přičemž se vejde na hardware, na kterém by se starší model nikdy nevešel. Třídění tohoto katalogu podle data vydání je obvykle lepším vodítkem než třídění podle velikosti.

Jak jazykové modely dorazily sem

Téměř každý model v tomto katalogu pochází z jedné architektonické myšlenky publikované v roce 2017 v článku nazvaném "Attention Is All You Need". Představil transformátor, který zpracovává celou sekvenci najednou a učí se, které její části se vztahují na které – nahrazující krokové rekurentní návrhy, které přišly dříve, a škálující se mnohem lépe než tyto. Každý model uvedený zde, který generuje text, je transformátor nebo jeho blízký příbuzný.

Co následovalo, byla převážně demonstrace, že architektura se zlepšovala s měřítkem. Po sobě jdoucí modely rostly o několik řádů a stávaly se úměrně schopnějšími, což stanovilo vzor na několik let: více parametrů, více tréninkových dat, více výpočtů. Do roku 2020 byly největší modely dostatečně schopné, aby byly komerčně vážné, a bylo je možné dosáhnout pouze jako placené služby – váhy zůstávaly u toho, kdo je trénoval.

Obrat přišel v roce 2023, když několik organizací začalo publikovat váhy pro modely, které byly dostatečně dobré na to, aby stály za spuštění. To změnilo otázku z "k jaké službě se mám přihlásit" na "co může moje vlastní hardware dělat", a je to důvod, proč existuje stránka jako je tato. Předtím na otázku o hardwaru většina lidí neměla smysluplnou odpověď.

Roky, které následovaly, byly méně o škále a více o efektivitě. Lepší tréninkové metody, lepší data a architektonická práce, jako je směs-expertů směrování, všechny zvýšily schopnost na parametr, zatímco kvantizace — ukládání každé váhy ve čtyřech nebo pěti bitech namísto šestnácti — snížila MEMORY, kterou daný MODEL potřebuje, zhruba o tři čtvrtiny. Mezi nimi modely, které by kdysi vyžadovaly datacentrum, nyní běží na desktopové GPU, což je praktický vývoj, na kterém celý tento katalog spočívá.

Katalog, jak stojí

Největší model

173.9T

země

50

Největší model v databázi je BaGuaLu, dosahování 173.9T parametry. V této škále je model infrastrukturní datového centra spíše než něco, co by držela pracovní stanice, a toto číslo je užitečnější jako ukazatel, kde leží hranice, než jako rozhodnutí o nákupu.

Katalog pokrývá práci z 1,314 organizace, rozptýlené 50 země. Ten rozdíl stojí za povšimnutí sám o sobě: vývoj modelů přestal být soustředěn v hrstce laboratoří před nějakým časem a několik z nejpoužívanějších open-weight modelů pochází z organizací, které před několika lety neexistovaly.

Parametrické počty jsou zaznamenávány pro 2,315 záznamy, z katalogu držícího 3,567. Mezery jsou většinou uzavřené modely, jejichž majitelé nikdy nezveřejnili velikost, a občasné otevřené modely, které nikdo neměřil. Model bez této hodnoty je uveden, ale nelze mu poskytnout odhad paměti nebo rychlosti, protože každý z těchto výpočtů vychází z ní.

Vstupy začínají v 1950 a spustit na 2026, tak katalog je záznamem v oboru spíše než snímkem toho, co je aktuální. Filtrace podle roku vydání je nejrychlejší způsob, jak to zúžit na modely, které stojí za to skutečně zvážit.

Přístupová hranice

Nejnovější open-weight releases

Nejnovější přídavky s publikovanými OPEN WEIGHT. Schopnost na parametr se postupně zlepšila, takže nedávný MODEL je obvykle lepším využitím stejné MEMORY než starší, větší..

  1. Inkling 975B Jul 2026
  2. Solar Open2 250B 250.3B Jun 2026
  3. GLM-5.2 744B Jun 2026
  4. Kimi K2.7 Code 1T Jun 2026
  5. North Mini Code 30B Jun 2026
  6. Nemotron 3 Ultra 550B Jun 2026
  7. Gemma 4 12B 12B Jun 2026
  8. Mistral Medium 3.5 128B Apr 2026
  9. DeepSeek-V4-Pro 1.6T Apr 2026
  10. DeepSeek-V4-Flash 284B Apr 2026

Čtení tabulky

Jak číst tento katalog

parametry
Celkový počet naučených hodnot, napsaný způsobem, jakým to pole píše: 8B je osm miliard, 1.6T je 1.6 trilionu. Toto je celkový počet, ne počet použitý na slovo — modely směsi expertů používají pouze zlomek na token, ale stále musí mít vše v paměti.
Otevřít váhy
Zda lze stažené hodnoty spustit na vlastní hardwaru. Uzavřený model je přístupný pouze prostřednictvím jeho poskytovatele, takže žádná grafická karta jej neumožňuje spustit lokálně. Kde nebylo nikdy zaznamenáno licencování, považujeme jej za uzavřený, spíše než abychom předpokládali opak.
Doména a úkol
Na čem byl model postaven, aby fungoval. Model může nést několik z každého, což je důvod, proč výběr domény zužuje seznam úkolů spíše než aby ho nahrazoval.
Organizace a země
Kdo publikoval model a kde sídlí? Užitečné, když nasazení musí splnit pravidlo o tom, odkud model pochází.
Uvolněno
Když byl model zveřejněn. Obvykle je lepší příručka k kvalitě než velikost, protože schopnost na parametr se výrazně zlepšila.

Odpovědi

běžné otázky

01

Jak mohu zjistit, který GPU může spustit daný AI model?

Najděte model v tabulce výše a otevřete ho. Jeho stránka uvádí každou grafickou kartu v našem katalogu, která ho může pojmout, s potřebnou pamětí, se kterou by běžel, a odhadovanou hodnotou tokenů za sekundu. Můžete také přistupovat z druhé strany a začít od karty, kterou již vlastníte.

02

Kolik AI modelů je v této databázi?

Katalog obsahuje 3,567 modely. Otevřené váhy, ke stažení a spuštění na vlastním hardwaru, pokrývají 1,335 z nich 2,232 jsou zavřené, nebo jejich licencování nikdy nebylo zaznamenáno.

03

Jaký je rozdíl mezi open-weight a closed model?

Otevřený model měl zveřejněny své trénované hodnoty, takže si ho kdokoli může stáhnout a spustit na svém vlastním stroji, neomezeně a offline. Uzavřený model existuje pouze jako služba řízená jeho vlastníkem. Pouze otevřené modely mají smysluplné požadavky na hardware, což je důvod, proč uzavřené modely na této stránce mají specifikaci, ale žádnou tabulku grafických karet.

04

Jsou OPEN WEIGHTS totéž co open source?

Ne docela. Publikované váhy neříkají nic o tréninkových datech, tréninkovém kódu nebo licenci připojené k výsledku — některé povolují komerční použití volně, jiné to omezují. Co zaručují, je, že model běží na vaší hardwaru, nikoli na někom jiném, což je část, která je důležitá pro tuto stránku.

05

Kdo staví tyto AI modely?

Katalog pokrývá 1,314 organizace, rozptýlené 50 země — univerzitní skupiny, nezávislé laboratoře a výzkumné oddělení velkých technologických společností. Vývoj modelů přestal být soustředěn na několika místech před nějakým časem a několik široce používaných open-weight modelů pochází z organizací, které existují pouze několik let.

06

Jaký je největší AI model?

Největší na file je BaGuaLu, dosahování 173.9T parametry. Při této velikosti je model infrastrukturním datového centra, spíše než něčím, co by mohla pojmout jediná grafická karta — největší open-weight modely, které se vejdou na jednu kartu, jsou výrazně menší a jsou uvedeny níže na této stránce.

07

Co znamenají parametry?

Parametry jsou naučené hodnoty uvnitř modelu a jejich počet je nejbližší přímému vyjádření, kolik paměti potřebuje. Hrubý návod je něco málo přes půl gigabajtu na miliardu parametrů při kompresi, kterou používá většina lidí — takže model s osmi miliardami parametrů je pohodlný na osmi gigabajtech a třicet miliard potřebuje kolem dvaceti čtyř.

08

Je vždy větší AI model lepší?

Ne, a stále více ne. Schopnost na parametr se výrazně zlepšila, takže nedávný model s osmi miliardami parametrů často překonává starší model, který je několikrát větší, a to na hardwaru, na kterém by starší model nikdy nefungoval. Řazení podle data vydání je obvykle lepším vodítkem než řazení podle velikosti.

09

Co je model mixture-of-experts?

Jedna, která směruje každý token pouze frakcí sebe sama, spíše než skrze každý parametr. To jí umožňuje generovat text rychlostí mnohem menšího modelu — ale každý expert stále musí být rezidentem v paměti, takže je rychlá, aniž by byla levná na udržení. Katalog uvádí celkový počet parametrů, což je číslo, které rozhoduje, zda se vejde.

10

Proč některé modely nemají počet parametrů?

proto, protože organizace nikdy jednoho nezveřejnila. To je běžné pro uzavřené modely a občas se to stává u otevřených. Počty se zaznamenávají pro 2,315 záznamy, z katalogu držícího 3,567. Uvádíme zbytek spíše než abychom je skrývali, ale žádné číslo paměti nebo rychlosti nemůže být vyprodukováno bez tohoto čísla.

11

Mohu tyto modely spustit bez připojení k internetu?

Jakýkoli OPEN WEIGHT model, ano — to je smysl publikovaných vah. Jakmile je stažen, běží zcela na vaší vlastní mašině bez účtu a bez sítě. Uzavřené modely nelze vůbec spustit offline, protože nikdy nedržíte samotný model.

12

Jak přesné jsou odhady hardwaru na této stránce?

Jsou vypočteny z specifikací spíše než měřeny, a každé číslo je publikováno jako rozsah spíše než jako jediné číslo. Stejný model a karta se liší o třicet až padesát procent v závislosti na tom, jaký inference software je použit a kterou verzi, kterou žádný výpočet ze specifikací nemůže předpovědět. Považujte rozsah za čestnou odpověď.

13

Už mám grafickou kartu. Mohu hledat opačně?

Ano. Katalog GPU uvádí každou kartu, pro kterou máme specifikace, a na stránce každé karty jsou uvedeny všechny modely, které může provozovat, seřazené podle rychlosti. To je stejný výpočet, přistupující z pohledu hardwaru.

Druhý směr

Díváte se na to z druhé strany?

Tato stránka začíná od modelu a ptá se, jaký hardware potřebuje. Pokud již vlastníte kartu a chcete vědět, co na ní poběží, začněte raději tam. — uvádí každou kartu v databázi a každá z nich uvádí modely, které může spustit, nejrychlejší první.

GPU