Kimi K2.5 TPS kalkulátor
Az alábbi kártyákat ebben a modellben értékeljük a kiválasztott kontextus hossz és minimális minőség alapján. A sebesség egy becslés egyetlen kérésre, amelyet a kártya memória sávszélessége és a tömörített modell mérete alapján számolunk ki..
Számítások ennél a modellenél
818 kártyák, amelyekhez specifikációkat tartunk fenn
Mely GPU-k képesek futtatni Kimi K2.5?
Állítsa be a bemeneteket, olvassa el a választ
Egy hosszabb beszélgetés több memóriát igényel, ami elmozdíthatja ezt a modellt kisebb kártyákról.
Elrejti azokat a kártyákat, amelyek csak a modellhez illeszkednének, ha azt ennél az értéknél kisebbre tömörítené.
0 kártyák egyezése
Számítás| Szükségletek | Kvantizáció | Arányosítva | |||||
|---|---|---|---|---|---|---|---|
|
Egy kártya sincs a katalógusunkban, amely ezeket a beállításokat futtatná ezen a modellen.. |
|||||||
A sebességek egyetlen kérésre vonatkoznak — egy beszélgetésenként —, a memória sávszélesség, a modell mérete és a kvantálás alapján számítva. A valós átvitel a felismerési futásidőtől és annak verziójától függően változik. A hardvergyártók által közzétett adatokat több egyidejű kérés mérésére mérik, és sokkal magasabbak.
Felvételen
Teljes specifikáció
Minden adatok ezen a modellen. A legtöbb leírás arról szól, hogyan volt kiképzve, nem pedig arról, hogyan fut — hasznos háttérinformáció arra vonatkozóan, hogy mennyi munka került bele, és hogyan viszonyul más méretű modellekhez..
Eredet
Ki építette ezt a modellt, hol, és mikor publikálták.
- Szervezet
- Moonshot
- Szervezet típusa
- Industry
- Ország
- China
- Kiadva
- 2 February 2026
- Szerzők
- Tongtong Bai, Yifan Bai, Yiping Bao, S.H. Cai, Yuan Cao, Y. Charles, H.S. Che, Cheng Chen, Guanduo Chen, Huarong Chen, Jia Chen, Jiahao Chen, Jianlong Chen, Jun Chen, Kefan Chen, Liang Chen, Ruijue Chen, Xinhao Chen, Yanru Chen, Yanxu Chen, Yicun Chen, Yimin Chen, Yingjiang Chen, Yuankun Chen, Yujie Chen, Yutian Chen, Zhirong Chen, Ziwei Chen, Dazhi Cheng, Minghan Chu, Jialei Cui, Jiaqi Deng, Muxi…
Mit csinál
A modell által épített probléma területek. Egy modell több különbözőt is tartalmazhat.
- Irányítószám
- Language
- Feladat
- Language modeling/generation
Méret
Mekkora a modell és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek meghatározzák, hogy illeszkedik-e egy adott grafikus kártyára.
- Paraméterek
- 1T
- Képzési adatok
- tokens
"The model comprises 1.04 trillion total parameters"
Képzés számítás
A modell betanításához végzett aritmetikai műveletek, amelyet lebegőpontos műveletekben mérnek. Ez a tréning futásának költségét méri, nem azt, hogy mennyire gyorsan válaszol a kész modell.
- Képzés számítás
- 5.8 × 10²⁴ FLOP
Per section 3.2, "The joint pre-training stage continues from a near-end Kimi K2 checkpoint over additional 15T vision-text tokens at 4K sequence length" Kimi K2 was pretrained on 15T tokens. A near-end checkpoint of K2 was trained into K2.5 over another 15T tokens (or 15.2 to 15.5T tokens). This makes for a total of ~30T. There are an additional 1T tokens in "Stage 1" used to train the ViT encoder, which is likely much smaller than the full LLM, so we omit those tokens to calculate training c…
A képzési futam
A kiképzéshez fizikailag szükséges volt: milyen chipek, hány, meddig és mennyi áramot vett le a hálózatról.
- Képzési hardver
- NVIDIA H800 SXM5
Elérhetőség
Hogy megszerezheted-e a modellt és futtathatod a saját hardvereden, ami eldönti, hogy a ezen az oldalon szereplő grafikus kártyák adatai alkalmazhatóak-e.
- Súlyok
- Open — downloadable
- Modell hozzáférés
- Open weights (unrestricted)
- Hugging Face
- moonshotai
Hogyan van besorolva
Címkék, amelyeket a forráshalmaz alkalmaz, amikor figyelemmel kíséri a figyelemre méltó modelleket, és mennyire biztos a bejegyzésben.
- Miért követik nyomon
- Discretionary
- Rögzítési bizalom
- Likely
Cost-competitive and widely used in the open-weight AI industry
Források
Honnan származik ez a rekord és mikor ellenőrizték utoljára.
- Referencia
- Kimi K2.5: Visual Agentic Intelligence
- Utoljára frissítve
- 28 May 2026
Mit jelentek a számok
Mi kell ennek a modellnek a futtatásához
1T paraméternél a Kimi K2.5 túl van azon, amit bármelyik egyetlen grafikus kártya tartalmaz. Futásához vagy több kártyára kell osztani, vagy kölcsönözni kell a feladatra készült hardvert — az általunk nyomon követett kártyák közül egyetlen sem képes önállóan tartani, és mindegyik adatközponti alkatrész.
Erről a modellről
A Kimi K2.5-öt a Moonshot adta ki, Kínában, 2026 februárjában. Az iparból származik.
Működik a Nyelven, és nyelvi modellezés/generálás közben rögzítik.
A súlyok közzétéve, így letölthető és saját hardveren korlátlan ideig, offline, bármiféle fiók nélkül futtatható. A moonshotai szervezet keretein belül került közzétételre a Hugging Face-en.
Hogyan lett betanítva
A betanítása körülbelül 5,8 × 10²⁴ FLOP számítási teljesítményt igényelt, az NVIDIA H800 SXM5-en — a modell előállításának költségét mérő érték, nem pedig azt, hogy milyen gyorsan válaszol.
Az oka, hogy egyáltalán megjelenik ebben a katalógusban, szubjektív.
Lépésről lépésre
Hogyan válasszon GPU-t Kimi K2.5
A fent továbbiakban ismertetett táblázat már értékelte az összes kártyát, amelynek specifikációit e modellhez viszonyítottuk. A válasz eléréséhez hat lépést kell megtennie..
-
01
Nézd meg, mire van szüksége, mielőtt bármi mást csinálnál.
Nézd meg, hogy valójában mire van szüksége a Kimi K2.5-nek. Semmilyen feldolgozási teljesítmény nem kompenzál egy olyan kártyát, amely nem tudja megtartani.
-
02
Döntse el, mennyi ideig tartanak a beszélgetései.
Állítsd be a kontextust arra, amit valóban használni fogsz. A gyorsítótár a beszélgetéssel növekszik, és ez a szokásos oka annak, hogy a Kimi K2.5 miért áll meg egy kártya használatától, ami jónak tűnt.
-
03
Válaszd ki, mennyire akarod tömöríteni.
Minden kártya a lehető legkevésbé tömörített másolatot futtatja, amit tud. A padló beállítása eltávolítja azokat a kártyákat, amelyek csak a Kimi K2.5-öt kezelik, mivel tovább tömörítik, mint amit szeretnél.
-
04
Hasonlítsa össze a másodpercenkénti tokeneket, ne a specifikációkat.
A Kimi K2.5 esetében a másodpercenkénti tokenek szerinti rangsor a memória sávszélesség alapján alakul, nem a magok számát figyelembe véve.
-
05
Nézd a fejlesztési lehetőséget, ne csak a méretet.
A fit oszlop elválasztja azokat a kártyákat, amelyek éppen csak elérik a Kimi K2.5-öt azoktól, amelyeknek van szabad helyük. Vásárolj a másodikért, ha a kontextus nőhet.
-
06
Nézd meg a kártyát a másik oldalról
Minden kártya név az saját oldalára mutat, amely ugyanazt a számítást végzi az egész modell katalóguson. Érdemes megnézni a Kimi K2.5 előtt — egy kártyát általában több modellhez vásárolnak.
Válaszok
Kimi K2.5 — Gyakran ismételt kérdések
Miért különbözik a kvantálás a Kimi K2.5 esetében a kártyák között?
Egy nagyobb kártya pontosabb másolatot tart. A Kimi K2.5-öt futtató kártyákon 1 tömörítési szintet használnak; a padlóvezérlés a felett rögzíti azt egyhez.
Mennyire pontosak ezek a Kimi K2.5 sebességbecslések?
A specifikációkból számolják ki őket, nem pedig mérik, és mindegyik hordoz egy tartományt — a számok alatti tartományt, például. Ugyanaz a modell és kártya harminc és ötven százalék között változik, attól függően, hogy milyen inferencia szoftver és annak verziója van.
Kimi K2.5 nyílt forráskódú?
A súlyai nyilvánosak, így a Kimi K2.5 letölthető és futtatható a saját hardvereden. Fontos megjegyezni, hogy a nyílt súlyok nem ugyanazok, mint a nyílt forráskód teljes értelemben — nem mond semmit a tanító adatról, a tanító kódról vagy a csatolt kereskedelmi feltételekről.
Hány paramétere van a Kimi K2.5-nek?
A Kimi K2.5-nek 1T paramétere van. "A modell összesen 1,04 billió paramétert tartalmaz". Ez a szám az összes, és ez határozza meg, hogy mennyi memória szükséges a modellnek — nagyjából fél gigabájt egy milliárdra a legtöbb ember által használt tömörítésnél.
Ki alkotta a Kimi K2.5-öt?
A Kimi K2.5-öt a Kínában működő Moonshot adta ki, ipari kategóriába sorolva.
Mikor jelent meg a Kimi K2.5?
Kimi K2.5 2026 februárjában jelent meg.
Mire használják a Kimi K2.5-öt?
Kimi K2.5 dolgozik Nyelven, és nyelvi modellezés / generálás kezelését rögzítették. A modellek gyakran több mint egyet hordoznak belőlük, és a címkék a célt írják le, nem pedig a képességek határait.
Hol tudom letölteni a Kimi K2.5-öt?
Súlyai a moonshotai szervezet által publikálva vannak a Hugging Face-en. Nem tárolunk modelfájlokat — ez az oldal kiszámítja, hogy milyen hardver szükséges a futtatásukhoz.
Mennyi számítási kapacitást használtak a Kimi K2.5 betanításához?
Körülbelül 5.8 × 10²⁴ FLOP, az NVIDIA H800 SXM5-en. Ez azt méri, hogy mennyibe került a modell előállítása, és nem mond semmit arról, hogy milyen gyorsan válaszol, miután ki van képezve — a következtetési sebesség a memória sávszélességéből származik, nem a tréning költségvetéséből.
Futtathatom a Kimi K2.5-öt, ha nem fér el a GPU-mban?
Elosztható a kártya és a rendszer memória között, de a Kimi K2.5 így fájdalmasan lassan generál — a legközelebbi hiány, amit kiszámolunk, 370,7 GB-ral marad el. Ezen az oldalon semmi sem számít a terheléskihelyezésre.
Futna két GPU Kimi K2.5-öt gyorsabban?
Egy második kártya körülbelül megháromszorozza a rendelkezésre álló memóriát, de nem a generálási sebességet. Mivel 0 kártya már képes önállóan futtatni a Kimi K2.5-öt, a párba állítás indoklása gyenge.
A másik irány
Másik oldalról nézve?
Ez az oldal a modellel kezdődik. Ha már rendelkezik egy kártyával és szeretné tudni, hogy minden mit fog futtatni, kérjük, folytassa., kezdje a hardverrel inkább.