Kimi K2.6 TPS kalkulačka
Každá karta níže je hodnocena podle tohoto modelu při zvolené délce kontextu a minimální kvalitě. Rychlost je odhad pro jednotlivý požadavek, vypočtený z šířky paměťové pásma karty a velikosti modelu po kompresi..
Vypočítáno pro tento model
Které GPU mohou běžet Kimi K2.6?
Nastavte vstupy, přečtěte odpověď.
Delší konverzace vyžaduje více paměti, což může způsobit, že tento model nebude fit na menších kartách..
Skrývá karty, které by se do modelu vešly pouze stlačením pod tento bod..
0 karty se shodují
Vypočítávání| Má modely, které GPU nedokáže spustit, GPUS s nedostatečnou VRAM. GPT za 100 TPS, modely jsou těsné. | Kvantizace | Fit | |||||
|---|---|---|---|---|---|---|---|
|
Žádná karta v našem katalogu nemůže tento model spustit s těmito nastaveními.. |
|||||||
Rychlosti jsou odhady pro jednotlivé požadavky - jednu konverzaci najednou - vypočítané na základě šířky pásma paměti, velikosti modelu a kvantizace. Skutečná propustnost se liší podle doby inference a její verze. Čísla zveřejněná výrobci hardwaru měří mnoho současných požadavků a jsou mnohem vyšší..
Na záznamu
Plná specifikace
Všechno je zaznamenáno pro tento model. Většina z toho popisuje, jak byl trénován, spíše než jak běží — užitečný kontext pro posouzení, kolik práce do toho bylo vloženo, a jak se to srovnává s modely vytvořenými v jiném měřítku..
Origin
Kdo vytvořil tento model, kde a kdy byl publikován.
- Organizace
- Moonshot
- Typ organizace
- Industry
- Stát
- China
- Published
- 20 April 2026
Co to dělá
Problémové oblasti, pro které byl model navržen. Model může mít několik z každé.
- Domain
- Language
- Úloha
- Language modeling/generation
- Base model
- Kimi K2.5
Velikost
Jak velký je model a na kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.
- Parametry
- 1T
- Tréninková data
- tokens
Dostupnost
Zda můžete získat model a spustit ho na vlastním hardwaru, což rozhoduje o tom, zda se zde uvedené hodnoty grafické karty vztahují.
- Váhy
- Open — downloadable
- Přístup k modelu
- Open weights (unrestricted)
Jak je to klasifikováno
Štítky, které se aplikují na zdrojový dataset při sledování významných modelů a jakou má jistotu v tomto záznamu.
- Proč je to sledováno
- Discretionary
- Model/modely nelze spustit. Tightly = téměř nelze spustit, comfortable = snadno spustitelné s rezervou.
- Confident
Cost-competitive and widely used in the open-weight AI industry
Model/modely nevyhovuje / nebudou vyhovovat. Těsný = barely runnable, pohodlný = běží snadno s rezervou.
Kde tento záznam pochází a kdy byl naposledy zkontrolován.
- Odkaz
- Kimi K2.6: From Code to Creation, From One to Many
- Poslední aktualizace
- 13 May 2026
Co znamenají čísla
Co je potřeba k spuštění tohoto modelu
At 1T parameters, Kimi K2.6 is beyond what any single graphics card holds. Running it means either splitting it across several cards or renting hardware built for the job — 0 of the cards we track can hold it on their own, and all of them are datacentre parts.
O tomto modelu
Kimi K2.6 was published by Moonshot, in China, in April 2026. The organisation is categorised as industry.
Funguje v češtině a je zaznamenáno jako modelování/generování jazyka.
Its starting point was Kimi K2.5 — most models at this scale are adapted from an existing base rather than built from nothing.
Otevřené váhy jsou tím, co dává této stránce místo v kalkulačce, spíše než pouze v katalogu: je to model, který můžeš skutečně držet.
Co šlo do jeho výstavby
Jeho zahrnutí je na uvážení.
Krok za krokem
Jak vybrat GPU pro Kimi K2.6
Tabulka výše již vyhodnotila všechny karty, které máme, podle specifikací tohoto modelu. K dosažení vaší odpovědi je potřeba šest kroků..
-
01
Zkontrolujte, co potřebuje, než něco jiného.
Every card here has been checked against Kimi K2.6. Capacity is the gate — a card either holds it or it does not.
-
02
Zajistit, aby model fungoval optimálně v GPU.
Longer conversations cost memory on top of what the weights need. Move the slider to your real working length before trusting any row for Kimi K2.6.
-
03
Choose how far you will compress it
The quantisation column varies by card, because a bigger card holds a more accurate copy of Kimi K2.6. Set a floor to hold the comparison at one level.
-
04
Sort by speed
The speed ordering for Kimi K2.6 is effectively an ordering by memory bandwidth.
-
05
Zkontrolujte verdikt o vhodnosti před zakoupením
The fit column separates cards that just manage Kimi K2.6 from those with room to spare. Buy for the second if the context might grow.
-
06
Zjistěte, co dalšího tato karta zvládne.
Following a card through to its own page shows every other model it can hold, which is the question that follows once Kimi K2.6 is settled.
Kimi K2.6 — Běžné otázky
Where can I download Kimi K2.6?
The weights for Kimi K2.6 are published, though we do not hold a repository link for it. This site calculates hardware requirements rather than hosting model files.
Can I run Kimi K2.6 if it does not fit in my GPU?
Only by offloading, which is usually a false economy: the part in system memory drags the whole thing down — the nearest miss we calculate is short by 370.7 GB. Our figures for Kimi K2.6 assume it is fully resident.
Would two GPUs run Kimi K2.6 faster?
Capacity adds across cards; throughput does not. Since 0 of the cards we track already hold Kimi K2.6 on their own, a second card is rarely the answer here.
Why does the quantisation differ between cards for Kimi K2.6?
Each card is shown running the least-compressed copy it can hold, and Kimi K2.6 appears at 1 different compression levels across the cards that fit it. Bigger cards get the more accurate version.
How accurate are these Kimi K2.6 speed estimates?
They are calculated from specifications rather than measured, and each carries a range — the range beneath each figure, for instance. The same model and card vary by thirty to fifty per cent depending on the inference software and its version.
Is Kimi K2.6 open source?
Its weights are published, so Kimi K2.6 can be downloaded and run on your own hardware. Note that open weights is not the same as open source in the full sense — it says nothing about the training data, the training code, or the commercial terms attached.
How many parameters does Kimi K2.6 have?
Kimi K2.6 has 1T parameters. That figure is the total, and it is what decides how much memory the model needs — roughly half a gigabyte per billion at the compression most people use.
Who created Kimi K2.6?
Kimi K2.6 was published by Moonshot, based in China, categorised as industry.
When was Kimi K2.6 released?
Kimi K2.6 was published in April 2026.
What is Kimi K2.6 used for?
Kimi K2.6 works in Language, and is recorded as handling language modeling/generation. These are the areas it was designed around; they describe intent rather than a hard boundary.
Pulsování AI modelu GPU nefunguje.
Návrh modelu není vhodný pro GPU VRAM. Model běží hladce s rezervou. 13 May 2026
Druhý směr