MiniMax-M2.7 Kalkulator TPS
Każda karta poniżej jest oceniana na podstawie tego modelu przy wybranej przez Państwa długości kontekstu i minimalnej jakości. Szybkość to szacunkowa wartość dla pojedynczego żądania, obliczana na podstawie przepustowości pamięci karty i rozmiaru modelu po kompresji..
Obliczono dla tego modelu
818 karty, dla których posiadamy specyfikacje
Najmniejsza karta, która pasuje
Radeon Instinct MI250
128 GB · Q3_K_M · 12.8 tok/s
Najszybsza karta
B200
34.2 tok/s · 180 GB
Karty graficzne, które mogą uruchomić MiniMax-M2.7?
Ustaw wejścia, odczytaj odpowiedź
Dłuższa rozmowa wymaga więcej pamięci, co może spowodować, że ten model wykraczy poza możliwości mniejszych kart.
Chowa karty, które pasowałyby tylko do modelu, poprzez jego skompresowanie poniżej tego punktu.
17 dopasowanie kart
Obliczanie| Potrzeby | Kwantaizacja | Fit | |||||
|---|---|---|---|---|---|---|---|
|
34.2
tok/s
20–55 · niskie zaufanie |
B200 NVIDIA | 180 GB | 8,000 GB/s | Jan 2024 | 139.2 GB | Q4_K_M | Ścisły |
|
25.5
tok/s
15–41 · niskie zaufanie |
Radeon Instinct MI300 AMD | 128 GB | 6,550 GB/s | Jan 2023 | 112.6 GB | Q3_K_M | Ścisły |
|
22.2
tok/s
13–36 · niskie zaufanie |
H200 NVL NVIDIA | 141 GB | 4,890 GB/s | Nov 2024 | 125.9 GB | IQ4_XS | Ścisły |
|
22.2
tok/s
13–36 · niskie zaufanie |
H200 SXM 141 GB NVIDIA | 141 GB | 4,890 GB/s | Nov 2024 | 125.9 GB | IQ4_XS | Ścisły |
|
20.7
tok/s
12–33 · niskie zaufanie |
Radeon Instinct MI300A AMD | 128 GB | 5,325 GB/s | Dec 2023 | 112.6 GB | Q3_K_M | Ścisły |
|
14.8
tok/s
9–24 · niskie zaufanie |
B300 NVIDIA | 288 GB | 8,000 GB/s | Sep 2025 | 245.9 GB | Q8_0 | Ścisły |
|
13.7
tok/s
8–22 · niskie zaufanie |
Radeon Instinct MI300X AMD | 192 GB | 5,325 GB/s | Dec 2023 | 165.9 GB | Q5_K_M | Ścisły |
|
13.7
tok/s
8–22 · niskie zaufanie |
Radeon Instinct MI308X AMD | 192 GB | 5,325 GB/s | Dec 2023 | 165.9 GB | Q5_K_M | Ścisły |
|
12.8
tok/s
8–20 · niskie zaufanie |
Radeon Instinct MI250 AMD | 128 GB | 3,280 GB/s | Nov 2021 | 112.6 GB | Q3_K_M | Ścisły |
|
12.8
tok/s
8–20 · niskie zaufanie |
Radeon Instinct MI250X AMD | 128 GB | 3,280 GB/s | Nov 2021 | 112.6 GB | Q3_K_M | Ścisły |
|
12.6
tok/s
8–20 · niskie zaufanie |
Radeon Instinct MI325X AMD | 256 GB | 6,000 GB/s | Oct 2024 | 192.6 GB | Q6_K | Ścisły |
|
11.8
tok/s
7–19 · niskie zaufanie |
Radeon Instinct MI350X AMD | 288 GB | 8,190 GB/s | Jan 2025 | 245.9 GB | Q8_0 | Ścisły |
|
11.8
tok/s
7–19 · niskie zaufanie |
Radeon Instinct MI355X AMD | 288 GB | 8,190 GB/s | Jan 2025 | 245.9 GB | Q8_0 | Ścisły |
|
10.6
tok/s
6–17 · niskie zaufanie |
Data Center GPU Max 1550 Intel | 128 GB | 3,280 GB/s | Jan 2023 | 112.6 GB | Q3_K_M | Ścisły |
|
10.4
tok/s
6–17 · niskie zaufanie |
Data Center GPU Max Subsystem Intel | 128 GB | 3,210 GB/s | Jan 2023 | 112.6 GB | Q3_K_M | Ścisły |
|
1.4
tok/s
1–2 · niskie zaufanie |
GB10 NVIDIA | 128 GB | 273 GB/s | Oct 2025 | 112.6 GB | Q3_K_M | Ścisły |
|
1.4
tok/s
1–2 · niskie zaufanie |
Jetson T5000 NVIDIA | 128 GB | 273 GB/s | Aug 2025 | 112.6 GB | Q3_K_M | Ścisły |
Prędkości są szacunkowe dla pojedynczego żądania — jednej rozmowy naraz — obliczane na podstawie przepustowości pamięci, rozmiaru modelu i kwantyzacji. Rzeczywista przepustowość zależy od czasu wykonywania inferencji oraz jej wersji. Wyniki publikowane przez dostawców sprzętu mierzą wiele równoczesnych żądań i są znacznie wyższe.
Na nagraniu
Pełna specyfikacja
Wszystko, co jest dostępne na temat tego modelu. Większość z tego opisuje, jak został wytrenowany, a nie jak działa — przydatny kontekst do oceny, ile pracy w to włożono i jak wypada na tle modeli zbudowanych na innym poziomie skali..
Pochodzenie
Kto zbudował ten model, gdzie i kiedy został opublikowany.
- Organizacja
- MiniMax
- Typ organizacji
- Industry
- Kraj
- China
- Opublikowane
- 18 March 2026
Co to robi
Obszary problemowe, dla których stworzono model. Model może zawierać kilka z każdej.
- Domena
- Language
- Zadanie
- Language modeling/generation
Rozmiar
Jakiej wielkości jest model i na ile danych był szkolony. Parametry to liczba, która decyduje, czy mieści się na danej karcie graficznej.
- Parametry
- 229B
- Dane treningowe
- tokens
Per HuggingFace page: https://huggingface.co/MiniMaxAI/MiniMax-M2.7
Dostępność
Czy możesz zdobyć model i uruchomić go na swoim własnym sprzęcie, co decyduje, czy jakiekolwiek z danych dotyczących karty graficznej na tej stronie mają zastosowanie.
- Wagi
- Open — downloadable
- Dostęp do modelu
- Open weights (non-commercial)
Jak jest klasyfikowane
Etykiety stosowane przez źródłowy zbiór danych podczas śledzenia znaczących modeli oraz jak pewny jest w danym wpisie.
- Zaufanie do nagrania
- Confident
Źródła
Skąd pochodzi ten rekord i kiedy był ostatnio sprawdzany.
- Referencja
- MiniMax M2.7: Early Echoes of Self-Evolution
- Ostatnia aktualizacja
- 21 July 2026
Ekstrema
Dziesięć najszybszych GPU, które działają MiniMax-M2.7
Posortowane według szacowanej liczby tokenów na sekundę, najnowsza karta na pierwszym miejscu pod względem prędkości. Ponieważ generacja jest ograniczona przez przepustowość pamięci, to porządkuje się według przepustowości, a nie według jakiegokolwiek benchmarka gier..
- 01 B200 180 GB · 8,000 GB/s · Q4_K_M 34.2 tok/s
- 02 Radeon Instinct MI300 128 GB · 6,550 GB/s · Q3_K_M 25.5 tok/s
- 03 H200 NVL 141 GB · 4,890 GB/s · IQ4_XS 22.2 tok/s
- 04 H200 SXM 141 GB 141 GB · 4,890 GB/s · IQ4_XS 22.2 tok/s
- 05 Radeon Instinct MI300A 128 GB · 5,325 GB/s · Q3_K_M 20.7 tok/s
- 06 B300 288 GB · 8,000 GB/s · Q8_0 14.8 tok/s
- 07 Radeon Instinct MI300X 192 GB · 5,325 GB/s · Q5_K_M 13.7 tok/s
- 08 Radeon Instinct MI308X 192 GB · 5,325 GB/s · Q5_K_M 13.7 tok/s
- 09 Radeon Instinct MI250 128 GB · 3,280 GB/s · Q3_K_M 12.8 tok/s
- 10 Radeon Instinct MI250X 128 GB · 3,280 GB/s · Q3_K_M 12.8 tok/s
Najmniejsze GPU, które nadal działają MiniMax-M2.7
Najtańsza droga do środka, według pojemności pamięci. Napięty montaż uruchamia model, ale nie pozostawia nic na dłuższą rozmowę..
- 01 GB10 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 1.4 tok/s
- 02 Jetson T5000 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 1.4 tok/s
- 03 Radeon Instinct MI300A 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 20.7 tok/s
- 04 Data Center GPU Max 1550 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 10.6 tok/s
- 05 Data Center GPU Max Subsystem 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 10.4 tok/s
- 06 Radeon Instinct MI300 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 25.5 tok/s
- 07 Radeon Instinct MI250 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 12.8 tok/s
- 08 Radeon Instinct MI250X 128 GB · Potrzeby 112.6 GB · Q3_K_M · Ścisły 12.8 tok/s
- 09 H200 NVL 141 GB · Potrzeby 125.9 GB · IQ4_XS · Ścisły 22.2 tok/s
- 10 H200 SXM 141 GB 141 GB · Potrzeby 125.9 GB · IQ4_XS · Ścisły 22.2 tok/s
Co oznaczają liczby
Wymagania sprzętowe w praktyce
Minimalna karta
Radeon Instinct MI250
Potrzebna pamięć
112.6 GB
Najszybszy
34.2 tok/s
W przypadku 229B parametrów, MiniMax-M2.7 wykracza poza możliwości jakiejkolwiek pojedynczej karty graficznej. Uruchomienie go oznacza albo podział na kilka kart, albo wynajęcie sprzętu stworzonego do tego zadania — 17 kart, które śledzimy, może to pomieścić samodzielnie, a wszystkie z nich są częścią datacenter.
Punkt wejścia to Radeon Instinct MI250: 128 GB pamięci, kompresja Q3_K_M, około 12,8 tokenów na sekundę.
Najszybszy wynik pochodzi z B200 z prędkością około 34,2 tokenów na sekundę — to jego 8 000 GB/s przepustowości to zakupuje.
Tło
MiniMax-M2.7 został opublikowany przez MiniMax w Chinach w marcu 2026 roku. Pochodzi z branży.
Działa w Języku i jest rejestrowany jako wykonujący modelowanie/generację języka.
Wagi są publikowane, więc można je pobrać i uruchomić na własnym sprzęcie bez ograniczeń czasowych, offline, bez powiązanego konta.
Czytanie danych o wydajności
Na każdej karcie, która może to uruchomić, środek przedziału wynosi około 12,8 tokenów na sekundę, a 15 z nich przekracza dziesięć tokenów na sekundę, co mniej więcej odpowiada prędkości czytania.
Będąc gęstym, odczytuje wszystko samodzielnie per token, co jest powodem, dla którego porządek według prędkości poniżej tak blisko pokrywa się z porządkiem według przepustowości pamięci.
Bez layoutu uwagi na rekord, kolumna pamięci jest przybliżeniem. Jest wystarczająco blisko, aby wybrać sprzęt, a najmniej niezawodna w przypadku długiego kontekstu.
Krok po kroku
Jak wybrać GPU dla MiniMax-M2.7
Powyższa tabela już oceniła wszystkie karty, dla których posiadamy specyfikacje, w odniesieniu do tego modelu. Aby uzyskać odpowiedź, należy przejść przez sześć kroków..
-
01
Zacznij od kolumny pamięci
Tabela wymienia każdą kartę, która może obsługiwać MiniMax-M2.7 — około 112.6 GB przy Q3_K_M. To wartość, a nie główna wydajność karty, decyduje o tym, czy działa.
-
02
Ustaw długość kontekstu, z którą będziesz pracować
Rozmowa zajmuje również pamięć i rośnie wraz z jej trwaniem. Ustaw suwak na długość, którą oczekujesz: przy długim kontekście MiniMax-M2.7 może zjechać z karty, która łatwo obsługuje krótkie pytania.
-
03
Wybierz, jak mocno chcesz to skompresować
Kolumna kwantyzacji różni się w zależności od karty, ponieważ większa karta przechowuje dokładniejszą kopię MiniMax-M2.7 — Q3_K_M na najmniejszej karcie, która się mieści. Ustaw podłogę, aby utrzymać porównanie na jednym poziomie.
-
04
Porównaj tokeny na sekundę, a nie specyfikacje
Sortuj według prędkości, aby zobaczyć, jak karty klasyfikują się dla MiniMax-M2.7. Nie będzie to odpowiadać zamówieniu gier — generacja jest ograniczona przez przepustowość pamięci, dlatego B200 osiąga najwyższe miejsce z wynikiem 34.2 tok/s.
-
05
Spójrz na zapas, nie tylko na dopasowanie
Tight oznacza, że MiniMax-M2.7 ładuje i działa, bez możliwości zwiększenia kontekstu później. Comfortable oznacza, że możesz. Różnica ma większe znaczenie niż kilka tokenów na sekundę.
-
06
Sprawdź kartę z drugiej strony
Śledzenie karty do jej własnej strony pokazuje każdy inny model, który może pomieścić, co jest pytaniem, które następuje po ustabilizowaniu MiniMax-M2.7.
Odpowiedzi
MiniMax-M2.7 — Często zadawane pytania
Do czego służy MiniMax-M2.7?
MiniMax-M2.7 działa w Języku i jest zapisany jako obsługujący modelowanie/generację języka. To są obszary, wokół których został zaprojektowany; opisują zamiar, a nie twardą granicę.
Gdzie mogę pobrać MiniMax-M2.7?
Wagi dla MiniMax-M2.7 zostały opublikowane, chociaż nie posiadamy linku do repozytorium. Ta strona oblicza wymagania sprzętowe, a nie hostuje plików modelu.
Czy mogę uruchomić MiniMax-M2.7, jeśli nie mieści się w moim GPU?
Może być podzielona między pamięć karty a pamięć systemową, ale MiniMax-M2.7 generuje boleśnie wolno w ten sposób — najbliższy błąd, który obliczamy, brakuje 52,8 GB. Nic na tej stronie nie zakłada przenoszenia obciążenia.
Czy dwa GPU uruchomią MiniMax-M2.7 szybciej?
Dwie karty kupują pamięć, a nie prędkość. To ma znaczenie dla MiniMax-M2.7 tylko wtedy, gdy jedna karta nie może jej pomieścić — 17 może, więc druga dodaje niewiele.
Dlaczego kwantyzacja różni się między kartami dla MiniMax-M2.7?
Każda karta jest prezentowana uruchamiając najmniej skompresowaną kopię, jaką może pomieścić, a MiniMax-M2.7 pojawia się na 6 różnych poziomach kompresji w kartach, które mogą ją pomieścić. Większe karty otrzymują dokładniejszą wersję.
Jak dokładne są te oszacowania prędkości MiniMax-M2.7?
Każda figura pochodzi z pasma pamięci i rozmiaru modelu, nie jest benchmarkowana. Dlatego każda jest publikowana jako zakres, taki jak 20–55 tok/s na B200, a nie jako pojedyncza liczba.
Jaką GPU potrzebuję, aby uruchomić MiniMax-M2.7?
Najmniejsza karta w naszym katalogu, która obsługuje MiniMax-M2.7, to Radeon Instinct MI250 z 128 GB pamięci. Uruchamia model na Q3_K_M, używając około 112,6 GB, i generuje około 12,8 tokenów na sekundę. W sumie 17 kart może go uruchomić.
Jak szybki jest MiniMax-M2.7 na GPU?
To zależy od karty. Najszybsza, jaką obliczamy, to B200 przy około 34,2 tokenów na sekundę; najwolniejsza, która nadal działa, radzi sobie znacznie gorzej. Prędkość odczytu wynosi około dziesięciu tokenów na sekundę, a 15 kart, które mogą uruchomić MiniMax-M2.7, przekracza to.
Ile VRAM potrzebuje MiniMax-M2.7?
Około 112,6 GB przy kompresji Q3_K_M, co jest tym, co używa najmniejsza karta, która to uruchamia. Mniejsza kompresja potrzebuje więcej: liczby w kolumnie pamięci powyżej są przeliczane dla każdej karty, ponieważ każda z nich przechowuje wersję o najmniejszej kompresji, jaką może.
Czy MiniMax-M2.7 jest otwartym źródłem?
Jego wagi są opublikowane, więc MiniMax-M2.7 można pobrać i uruchomić na własnym sprzęcie. Zauważ, że otwarte wagi to nie to samo co otwarte źródło w pełnym tego słowa znaczeniu — nie mówi to nic o danych treningowych, kodzie treningowym ani warunkach komercyjnych związanych z nimi.
Ile parametrów ma MiniMax-M2.7?
MiniMax-M2.7 ma 229B parametrów. Zgodnie z stroną HuggingFace: https://huggingface.co/MiniMaxAI/MiniMax-M2.7. Ta liczba jest całkowita i decyduje o tym, ile pamięci potrzebuje model — mniej więcej pół gigabajta na miliard przy kompresji, którą większość ludzi używa.
Kto stworzył MiniMax-M2.7?
MiniMax-M2.7 został opublikowany przez MiniMax, z siedzibą w Chinach, zakwalifikowany jako przemysł.
Kiedy wydano MiniMax-M2.7?
MiniMax-M2.7 został opublikowany w marcu 2026 roku.
W innym kierunku
Patrząc na to z drugiej strony?
Ta strona zaczyna się od modelu. Jeśli już posiadasz kartę i chcesz wiedzieć, wszystko co będzie ona obsługiwać, Rozpocznij od sprzętu..