DeepSeek-V3.2
Brak oszacowania
Brak wymagań sprzętowych dla tego modelu
Wagi tego modelu są OPEN, ale nie opublikowano liczby parametrów. Każda figura dotycząca MEMORY i prędkości zaczyna się od tej liczby, więc wolelibyśmy nic nie pokazywać niż wymyśloną estymację..
Na nagranie
Pełna specyfikacja
Wszystko na rekord dla tego modelu. Większość z tego opisuje, jak był trenowany, a nie jak działa — użyteczny kontekst do oceny, ile pracy włożono w to, i jak wypada w porównaniu z modelami budowanymi w innym skali..
Pochodzenie
Kto zbudował ten model, gdzie i kiedy został opublikowany.
- Organizacja
- DeepSeek
- Typ organizacji
- Industry
- Kraj
- China
- Opublikowany
- 1 December 2025
Rozmiar
Jak duży jest model i na ile danych był trenowany. Parametry to liczba, która decyduje, czy mieści się na danej karcie graficznej.
- Dane treningowe
- tokens
Obliczenia treningowe
Arytmetyka wykonywana w celu wytrenowania modelu, mierzona w operacjach zmiennoprzecinkowych. Jest to miara kosztów przeprowadzenia treningu, a nie tego, jak szybko gotowy model odpowiada na twoje pytania.
- Obliczenia treningowe
- 4.2 × 10²⁴ FLOP
Pre-trained base was DeepSeek-V3.1-Terminus 3.594058e+24 FLOP [base model] + 2.095014e+23 FLOP = 3.8035594e+24 FLOP for pre-training plus continued pre-training Then, "this framework allocates a post-training computational budget exceeding 10% of the pre-training cost", so 4.18e24
Dostępność
Czy możesz zdobyć model i uruchomić go na swoim sprzęcie, co decyduje o tym, czy którakolwiek z cyfr karty graficznej na tej stronie ma zastosowanie.
- Wagi
- Open — downloadable
- Dostęp do modelu
- Open weights (unrestricted)
Jak jest klasyfikowane
Etykiety, które źródłowy zbiór danych stosuje podczas śledzenia znaczących modeli oraz jak pewny jest tego wpisu.
- Zapisz pewność
- Likely
Źródła
Skąd pochodzi ten rekord i kiedy był ostatnio sprawdzany.
- Ostatnio zaktualizowane
- 8 April 2026
Co oznaczają liczby
Co to jest model?
DeepSeek-V3.2 został opublikowany przez DeepSeek, w kraju zapisanym jako China, podczas December 2025. Kategoria, do której należy wydawca, to industry.
Opublikowane wagi oznaczają, że model działa na twojej maszynie, a nie na czyjejś, co sprawia, że poniższe pytanie dotyczące sprzętu jest w ogóle możliwe do odpowiedzi.
Jak to zostało wytrenowane
Trening zajmował około 4.2 × 10²⁴ FLOP. Ta liczba mierzy, ile kosztowało wyprodukowanie modelu i nie ma wpływu na to, jak szybko odpowiada.
Odpowiedzi
DeepSeek-V3.2 — częste pytania
DeepSeek-V3.2— Jaką GPU potrzebuję, aby ją uruchomić?
Nie możemy powiedzieć. Ma otwarte wagi, ale nie opublikowano liczby parametrów, a wszelkie obliczenia pamięci i prędkości zaczynają się od tej liczby. Wolimy nie pokazywać niczego niż fałszywą szacunkową wartość.
DeepSeek-V3.2— czy jest open weight?
Jego wagi są opublikowane, więc można je pobrać i uruchomić na własnym sprzęcie. Zauważ, że OPEN WEIGHTS nie są tym samym co OPEN SOURCE w pełnym sensie — nie mówi nic o danych treningowych, kodzie treningowym, ani warunkach komercyjnych.
DeepSeek-V3.2— ile ma parametrów?
Nie opublikowano liczby parametrów, dlatego na tej stronie nie pojawia się żaden wskaźnik pamięci ani prędkości.
DeepSeek-V3.2— kto to stworzył?
Zostało opublikowane przez DeepSeek, oparty na China, organizacja sklasyfikowana jako industry.
DeepSeek-V3.2— kiedy to zostało wydane?
Zostało opublikowane w December 2025.
DeepSeek-V3.2— Gdzie mogę to pobrać?
Wagi są opublikowane, chociaż nie posiadamy linku do repozytorium. Ta strona oblicza wymagania sprzętowe, a nie hostuje pliki modelu.
DeepSeek-V3.2— ile mocy obliczeniowej użyto do jego trenowania?
Szkolenie zajęło około 4.2 × 10²⁴ FLOP. To mierzy, ile kosztowało wyprodukowanie modelu i nie mówi nic o tym, jak szybko odpowiada po wytrenowaniu — prędkość wnioskowania pochodzi z SZEROKOŚCI PASMA, a nie z budżetu treningowego.
Druga strona
Patrząc na to z drugiej strony?
Ta strona zaczyna się od modelu. Jeśli już posiadasz kartę i chcesz wiedzieć, co wszystko będzie działać., Zacznij od sprzętu zamiast.