MindLink-72B
Brak oszacowania
Brak wymagań sprzętowych dla tego modelu
Wagi dla tego modelu nie zostały opublikowane, więc nie można ich pobrać ani uruchomić na własnym sprzęcie w żadnym rozmiarze. Jest dostępny tylko za pośrednictwem swojego dostawcy, a zmiana karty graficznej tego nie zmienia..
Na nagranie
Pełna specyfikacja
Wszystko na rekord dla tego modelu. Większość z tego opisuje, jak był trenowany, a nie jak działa — użyteczny kontekst do oceny, ile pracy włożono w to, i jak wypada w porównaniu z modelami budowanymi w innym skali..
Pochodzenie
Kto zbudował ten model, gdzie i kiedy został opublikowany.
- Organizacja
- Kunlun Inc.
- Typ organizacji
- Industry
- Kraj
- China
- Opublikowany
- 1 August 2025
Co to robi
Obszary problemowe, dla których stworzono model. Model może mieć kilka z każdego.
- Domena
- Language
- Zadanie
- Code generation, Mathematical reasoning
- Model bazowy
- Qwen2.5-72B
Rozmiar
Jak duży jest model i na ile danych był trenowany. Parametry to liczba, która decyduje, czy mieści się na danej karcie graficznej.
- parametry
- 72B
- Dane treningowe
- tokens
72B
Przebieg szkolenia
Co fizycznie było potrzebne do treningu: jakie chipy, ile, na jak długo i co to pobierało z sieci.
- Sprzęt do trenowania
- NVIDIA A800 PCIe 80 GB
Jak jest klasyfikowane
Etykiety, które źródłowy zbiór danych stosuje podczas śledzenia znaczących modeli oraz jak pewny jest tego wpisu.
- Dlaczego to jest śledzone
- SOTA improvement
- Zapisz pewność
- Confident
Table 4 MindLink achieves superior performance overs SOTA methods in terms of MMLU-Pro and various mathematics and reasoning benchmarks - better performance than DeepSeek R1
Źródła
Skąd pochodzi ten rekord i kiedy był ostatnio sprawdzany.
- Referencja
- MindLink: Adaptive Multi-step Planning for Large Language Models
- Ostatnio zaktualizowane
- 28 November 2025
Co oznaczają liczby
Skąd to pochodzi
MindLink-72B został opublikowany przez Kunlun Inc., w kraju zapisanym jako China, podczas August 2025. Organizacja publikująca jest klasyfikowana jako industry.
Działa w dziedzinie Language, i jest zapisany jako wykonujący zadanie code generation, Mathematical reasoning.
Jego punktem wyjścia był istniejący model podstawowy, Qwen2.5-72B. Dlatego dzieli ogólny kształt i rozmiar modelu bazowego.
Ponieważ wagi nie są dostępne, żadne z danych dotyczących sprzętu gdzie indziej na tej stronie się do niego nie odnoszą.
Szkolenie i pochodzenie
Kryterium włączenia: sOTA improvement.
Odpowiedzi
MindLink-72B — częste pytania
MindLink-72B— ile ma parametrów?
Ma liczbę parametrów równą 72B. 72B. Ta liczba to całkowita, i to ona decyduje o tym, ile pamięci potrzebuje model — mniej więcej pół gigabajta na miliard przy kompresji, którą używa większość ludzi.
MindLink-72B— kto to stworzył?
Zostało opublikowane przez Kunlun Inc., oparty na China, organizacja sklasyfikowana jako industry.
MindLink-72B— kiedy to zostało wydane?
Zostało opublikowane w August 2025.
MindLink-72B— do czego to służy?
Działa w dziedzinie Language, i jest zarejestrowany jako realizujący zadanie code generation, Mathematical reasoning. Model może obsługiwać kilka z każdego, więc to są obszary, dla których został zbudowany, a nie ograniczenie tego, co będzie próbował.
MindLink-72B— Jaką GPU potrzebuję, aby ją uruchomić?
Żaden. To jest zamknięty model — jego wagi nigdy nie zostały opublikowane, więc nie można go pobrać ani uruchomić na własnym sprzęcie za żadną cenę. Jest dostępny tylko przez jego dostawcę.
MindLink-72B— czy jest open weight?
Licencja nigdy nie została zarejestrowana w naszych danych źródłowych. Traktujemy niewskazaną licencję jako zamkniętą, ponieważ niezarejestrowana licencja nie jest na którą można polegać.
Druga strona
Patrząc na to z drugiej strony?
Ta strona zaczyna się od modelu. Jeśli już posiadasz kartę i chcesz wiedzieć, co wszystko będzie działać., Zacznij od sprzętu zamiast.