MiniMax-M1-40k TPS kalkulátor
Minden kártyát az alábbiak szerint értékelünk e modell alapján a választott kontextus hossza és minimális minőség szerint. A sebesség egy becslés egyetlen kérésre, amelyet a kártya memória sávszélessége és a modell mérete alapján számítunk ki, miután tömörítettük..
Kiszámítva ehhez a MODElhez
818 kártyák, amelyek specifikációs adataink vannak
Legkisebb kártya, ami elfér
Radeon Instinct MI325X
256 GB · Q3_K_M · 11.7 tok/s
Leggyorsabb kártya
B300
18.3 tok/s · 288 GB
Melyik GPU képes futtatni MiniMax-M1-40k?
Állítsa be a bemeneteket, olvassa el a választ
Egy hosszabb beszélgetés több memóriaigényt támaszt, ami kiszoríthatja ezt a modellt a kisebb kártyákról..
Elrejti azokat a GPU-kártyákat, amelyek csak a modellbe illeszkednének a compressziójuk ezen pont alá..
4 kártyák illeszkednek
Számítás| Szükséges | Kvantisálás | Illeszkedik | |||||
|---|---|---|---|---|---|---|---|
|
18.3
tok/s
11–29 · alacsony bizalom |
B300 NVIDIA | 288 GB | 8,000 GB/s | Sep 2025 | 250.0 GB | IQ4_XS | Szoros |
|
14.6
tok/s
9–23 · alacsony bizalom |
Radeon Instinct MI350X AMD | 288 GB | 8,190 GB/s | Jan 2025 | 250.0 GB | IQ4_XS | Szoros |
|
14.6
tok/s
9–23 · alacsony bizalom |
Radeon Instinct MI355X AMD | 288 GB | 8,190 GB/s | Jan 2025 | 250.0 GB | IQ4_XS | Szoros |
|
11.7
tok/s
7–19 · alacsony bizalom |
Radeon Instinct MI325X AMD | 256 GB | 6,000 GB/s | Oct 2024 | 223.5 GB | Q3_K_M | Szoros |
A sebességek egyetlen kérésre - egy beszélgetés egy időben - vonatkozó becslések, amelyeket a MEMORY BANDWIDTH, a MODEL SIZE és a QUANTISATION alapján számítanak ki. A valós áteresztőképesség változik az INFERENCE RUNTIME és annak verziója szerint. A HARDWARE VENDORS által közzétett számok sok párhuzamos kérést mérnek, és sokkal magasabbak..
Nyilvántartásban
Teljes specifikáció
Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..
Eredet
Ki építette ezt a modellt, hol, és mikor publikálták.
- Szervezet
- MiniMax
- Szervezet típusa
- Industry
- Ország
- China
- Közölt
- 13 June 2025
- Szerzők
- MiniMax: Aili Chen, Aonian Li, Bangwei Gong, Binyang Jiang, Bo Fei, Bo Yang, Boji Shan, Changqing Yu, Chao Wang, Cheng Zhu, Chengjun Xiao, Chengyu Du, Chi Zhang, Chu Qiao, Chunhao Zhang, Chunhui Du, Congchao Guo, Da Chen, Deming Ding, Dianjun Sun, Dong Li, Enwei Jiao, Haigang Zhou, Haimo Zhang, Han Ding, Haohai Sun, Haoyu Feng, Huaiguang Cai, Haichao Zhu, Jian Sun, Jiaqi Zhuang, Jiaren Cai, Jiayua…
Mit csinál
A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.
- Tartomány
- Language
- Feladat
- Language modeling/generation, Question answering, Code generation, Quantitative reasoning
- Alapmodell
- MiniMax-Text-01
Méret
Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.
- Paraméterek
- 456B
- Képzési adatok
- 7,500,000,000,000 tokens
from the base model: Total Parameters: 456B Activated Parameters per Token: 45.9B (matches safetensors)
7.5T tokens "To enhance the reasoning and long context capabilities of the foundation model while ensuring diversity, we continue training the MiniMax-Text-01 model with additional 7.5T tokens with optimized data quality and mixture."
Képzés számítás
A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.
- Képzés számítás
- 4.2 × 10²⁴ FLOP
- Finomhangolás számítás
- 2.2 × 10²⁴ FLOP
1.9828799999999997e+24 FLOP [base model compute] + 2.2033131e+24 FLOP [see finetune compute notes] = 4.1861931e+24 FLOP
1. Continual pre-training for 7.5T tokens: 6 FLOP / token / active parameter * 45.9 * 10^9 activated parameters * 7.5 * 10^12 tokens = 2.0655e+24 FLOP 2. RL (3 weeks on 512 H800 GPUs for full training, 40k version was stopped in the ~middle of it): 989000000000000 FLOP / GPU / sec [bf16 assumed] * 512 GPUs * 1.5 weeks * 168 hours / week * 3600 sec / hour * 0.3 [assimed utilization] = 1.3781311e+23 FLOP 2.0655e+24 FLOP + 1.3781311e+23 FLOP = 2.2033131e+24 FLOP *there was also SFT stage with …
A tréning futás
Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.
- Képzési hardver
- NVIDIA H800 SXM5
Elérhetőség
Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.
- Súlyok
- Open — downloadable
- Modell hozzáférés
- Open weights (unrestricted)
- Képzés kód
- Unreleased
- Hugging Face
- MiniMaxAI
Apache 2,0 https://huggingface.co/MiniMaxAI/MiniMax-M1-40k
Hogyan van besorolva
Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.
- Nyilvántartási bizalom
- Likely
Források
Honnan származik ez a felvétel és mikor ellenőrizték utoljára.
- Referencia
- MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention
- Utoljára frissítve
- 28 November 2025
Az extremitások
A tíz leggyorsabb GPU, amely képes futtatni MiniMax-M1-40k
A másodpercenkénti becsült tokenek alapján rangsorolva, a legújabb kártyát először, ahol a sebességek azonosak. Mivel a generálás a MEMÓRIA SZÉLESSÉGÉhez van kötve, ez a sorrend a sávszélességet követi, nem pedig bármilyen játékbeli tesztet..
A legkisebb GPU-k, amik még futnak MiniMax-M1-40k
A legolcsóbb út, a memória kapacitás alapján. Egy szoros illeszkedés futtatja a modellt, de semmit sem hagy a hosszabb beszélgetésre..
- 01 Radeon Instinct MI325X 256 GB · Szükséges 223.5 GB · Q3_K_M · Szoros 11.7 tok/s
- 02 B300 288 GB · Szükséges 250.0 GB · IQ4_XS · Szoros 18.3 tok/s
- 03 Radeon Instinct MI350X 288 GB · Szükséges 250.0 GB · IQ4_XS · Szoros 14.6 tok/s
- 04 Radeon Instinct MI355X 288 GB · Szükséges 250.0 GB · IQ4_XS · Szoros 14.6 tok/s
Mit jelentenek a számok
Ami szükséges a futtatásához
Minimális kártya
Radeon Instinct MI325X
Szükséges memória
223.5 GB
Leggyorsabb
18.3 tok/s
MiniMax-M1-40k eléri a paraméterek számát 456B. Ez túl van azon, amit bármelyik egyedi GPU kártya kezelni tud. A futtatása azt jelenti, hogy vagy több kártyára osztja, vagy olyan hardvert bérel, amelyet erre a feladatra terveztek, és minden olyan kártya, amely egyedül képes kezelni, egy adatközponti alkatrész. Az a szám, amely képes rá: 4.
A legkevesebb hardver, ami működik, az Radeon Instinct MI325X, memória kapacitással rendelkezik 256 GB, futtatás egy tömörítési arányon Q3_K_M és körülbelül előállítva 11.7 tokenek másodpercenként
A leggyorsabb eredmény a következőből származik B300, nagyjából generálás 18.3 másodpercenkénti tokenek egy memória sávszélesség erejében 8,000 GB/s.
Honnan jött
MiniMax-M1-40k ki lett adva által MiniMax, az országban rögzítve mint China, alatt June 2025. A kiadó kategóriája alá tartozik industry.
Működik a területen a Language, és úgy van rögzítve, mint a feladat végrehajtása language modeling/generation, Question answering, Code generation, Quantitative reasoning.
Ahelyett, hogy nulláról lenne betanítva, az származik MiniMax-Text-01. Ezért osztja a bázismodell általános formáját és méretét.
A nyílt súlyok az okai annak, hogy ez az oldal a kalkulátorban van, és nem csak a katalógusban: ez egy olyan modell, amit valójában meg tudsz tartani. A Hugging Face-en az alábbi szervezet alatt van publikálva MiniMaxAI.
A sebességek megértése
A medián eredmény körül 14.6 másodpercenkénti tokenek 4 tőlük
Minden súly részt vesz minden tokenben itt, így a sávszélesség a teljes történet: az alábbi rangsor lényegében a memória átbocsátóképességének rangsora.
A belső architektúrája nincs nyilvántartásban, így a memória a paraméterek száma alapján van megbecsülve és ennek megfelelően van megjelölve. Várhatóan a tényleges érték eltér, különösen hosszú CONTEXT LENGTH esetén.
Mi került a felépítésébe
A képzés futás körülbelül 4.2 × 10²⁴ FLOP, hardveren rögzítve NVIDIA H800 SXM5. Ez a szám azt méri, hogy mennyibe került a modell előállítása, és nincs hatással arra, hogy milyen gyorsan válaszol.
A tanító készlet kb. futott 7,500,000,000,000 szöveg tokenjei
Lépésről lépésre
Hogyan válasszunk GPU-t a MiniMax-M1-40k
A fenti táblázat már értékelte az összes kártyát, amelynek specifikációi elérhetők ennek a modellen. A válaszod megszerzése hat lépést igényel..
-
01
Olvasd el a MEMORY adatokat először.
Minden kártyát itt leellenőriztünk a következőkkel szemben MiniMax-M1-40k, körülbelül szükséges 223.5 GB a tömörítésnél Q3_K_M. A kapacitás a kapu — egy kártya vagy tartalmazza, vagy nem.
-
02
Illeszd a kontextust a tényleges használatodhoz.
Állítsa be a kontextust arra, amit valójában használni fog. A cache a beszélgetéssel nő, és ez a szokásos oka annak, hogy egy kártya, amelynek korábban rendben kellett volna lennie, egyszer csak nem fér el. MiniMax-M1-40k.
-
03
Állítsa be a minőségi minimumot
Minden KÁRTYA a legkevésbé tömörített másolatot futtatja, amelyet el tud tartani., elérni egy tömörítést a Q3_K_M a legkisebb kártyán, ami elfér. A minimális minőség beállítása eldobja azokat a kártyákat, amelyek csak úgy tudják kezelni, hogy tovább szorítanak, mint amit szeretnél, és egy szinten tartja az összehasonlítást.
-
04
Rendezés sebesség szerint
A sebességsorrend lényegében egy sorrend a MEMÓRIA-SÁV szerint, a MiniMax-M1-40k. Nem fog illeszkedni egy gaming rendeléshez, mert a generálás a memória sávszélesség által kötött. A listát vezető KÁRTYA B300, at 18.3 tok/s
-
05
Olvasd el az illeszkedés oszlopot utoljára.
A megfelelő oszlop elválasztja azokat a kártyákat, amelyek épp hogy elboldogulnak, azoktól, amelyeknek van szabad helyük, az esetében MiniMax-M1-40k. A Kényelmes azt jelenti, hogy később bővítheted a contextet. Ez a különbség fontosabb, mint néhány token másodpercenként, így kényelmeset vásárolj, ha ezt várod.
-
06
Nyisd meg a kiválasztott kártyát.
Minden kártyanév egy saját oldalra mutat, amely ugyanazt a számítást végzi el az egész modell kataloguson. Egy kártyát általában több modellhez is vásárolnak, ezért érdemes megnézni vásárlás előtt. MiniMax-M1-40k.
Válaszok
MiniMax-M1-40k — gyakori kérdések
MiniMax-M1-40k— mennyi VRAM-ra van szüksége?
Kb. 223.5 GB tömörítési arányban Q3_K_M, melyik az a legkisebb KÁRTYA, amelyik futtatni tudja. Kevesebb tömörítés több szükséges: a fentebbi memória oszlop számai minden KÁRTYÁRA újraszámításra kerülnek, mert mindegyik tartalmazza a legkevésbé tömörített verziót, amit csak tud.
MiniMax-M1-40k— Nyílt forráskódú?
Súlyai közzétételre kerültek, így letölthető és futtatható a saját hardvereden. Ne feledd, hogy az open weight nem azonos az open source teljes értelmében — nem mond semmit a tanulási adatokkal, a tanulási kóddal vagy a kereskedelmi feltételekkel kapcsolatban.
MiniMax-M1-40k— Hány paramétere van?
Paraméterszáma 456B. from the base model: Total Parameters: 456B Activated Parameters per Token: 45.9B (matches safetensors). Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.
MiniMax-M1-40k— Ki készítette ezt?
Kiadta MiniMax, alapján China, egy szervezet, amelyet kategorizáltak mint industry.
MiniMax-M1-40k— Mikor adták ki?
Kibocsátották a June 2025.
MiniMax-M1-40k— Mire használják?
Működik a területen a Language, és rögzítve van, hogy kezeli a feladatot language modeling/generation, Question answering, Code generation, Quantitative reasoning. Ezek azok a területek, amelyek köré tervezték; ezek a szándékot írják le, nem pedig egy szigorú határt.
MiniMax-M1-40k— Hol tudom letölteni?
Súlyait a Hugging Face-en tette közzé, a szervezet alatt MiniMaxAI. Nem tárolunk modell fájlokat — ez az oldal kiszámolja, hogy milyen hardver szükséges a futtatásukhoz.
MiniMax-M1-40k— mennyi számítási kapacitást használtak annak a betanításához?
A képzés körülbelül elfogyasztott 4.2 × 10²⁴ FLOP, hardveren rögzítve NVIDIA H800 SXM5. Ez azt méri, hogy mennyibe került a modell előállítása, és semmit nem mond arról, hogy milyen gyorsan válaszol, miután betanult — a következtetési sebesség a memória sávszélességéből származik, nem az edzési költségvetésből.
MiniMax-M1-40k— Futtathatom, ha nem fér el a GPU-mban?
Elosztható a kártya és a rendszer MEMÓRIA között, de így fájdalmasan lassan generálódik. A legközelebbi hiba, amit számítunk, alulmúlja 103.8 GB Minden ábra azt feltételezi, hogy az egész model a kártyán tartózkodik.
MiniMax-M1-40k— Futtatna-e két GPU gyorsabban?
Egy második Kártya körülbelül megduplázza a rendelkezésre álló MEMÓRIÁT, de nem a generálási sebességet. A szám, amely már képes egyedül futtatni: 4. Tehát egy második KÁRTYA ritkán a megoldás itt.
MiniMax-M1-40k— miért különbözik a kvantálás a kártyák között?
Minden kártya a lehető legkevésbé tömörített másolatát futtatva jelenik meg, amit képes tárolni. A kártyákon elférő különböző tömörítési szintek száma: 2. A nagyobb kártyák a pontosabb verziót kapják, és a minőségi küszöb felett a összehasonlítást egy szinten rögzíti.
MiniMax-M1-40k— Mennyire pontosak ezek a sebességbecslések?
Minden szám a memória sávszélességből és a modell méretéből származik, nem benchmarkolták, ezért mindet tartományként tették közzé, nem pedig egyetlen számként. Egy például: 11–29 tok/s a fájlban B300. Ugyanaz a modell és kártya harminc és ötven százalék között változik a következtetési szoftvertől és annak verziójától függően.
MiniMax-M1-40k— Milyen GPU-ra van szükségem, hogy futtathassam?
A katalógusunk legkisebb kártyája, ami ezt tartja, az Radeon Instinct MI325X, memória kapacitással rendelkezik 256 GB. A modell egy tömörítéssel fut. Q3_K_M használva körülbelül 223.5 GB, és körülbelül 11.7 másodpercenkénti tokenek. A kártyák összes száma, amelyek képesek futtatni. 4.
MiniMax-M1-40k— mennyi idő alatt fut a GPU-n?
A kártyától függ. A leggyorsabb, amit számolunk, az B300, körülbelül 18.3 tokenek másodpercenként; a leglassabb, ami még fut, jelentősen kevesebbet képes kezelni. Az olvasási sebesség körülbelül tíz token másodpercenként, és a kártyák száma, amelyek ezt meg tudják tisztítani: 4.
A másik irány
Másik oldalról nézve?
Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..