Multiresolution CNN

Zamknięte wagi Google,Stanford University 126.1M parametry June 2014

Brak oszacowania

Brak wymagań sprzętowych dla tego modelu

Wagi dla tego modelu nie zostały opublikowane, więc nie można ich pobrać ani uruchomić na własnym sprzęcie w żadnym rozmiarze. Jest dostępny tylko za pośrednictwem swojego dostawcy, a zmiana karty graficznej tego nie zmienia..

Na nagranie

Pełna specyfikacja

Wszystko na rekord dla tego modelu. Większość z tego opisuje, jak był trenowany, a nie jak działa — użyteczny kontekst do oceny, ile pracy włożono w to, i jak wypada w porównaniu z modelami budowanymi w innym skali..

Pochodzenie

Kto zbudował ten model, gdzie i kiedy został opublikowany.

Organizacja
Google,Stanford University
Typ organizacji
Industry,Academia
Kraj
United States of America
Opublikowany
23 June 2014
Autorzy
A Karpathy, G Toderici, S Shetty, T Leung

Co to robi

Obszary problemowe, dla których stworzono model. Model może mieć kilka z każdego.

Domena
Video
Zadanie
Video classification

Rozmiar

Jak duży jest model i na ile danych był trenowany. Parametry to liczba, która decyduje, czy mieści się na danej karcie graficznej.

parametry
126.1M

"Using shorthand notation, the full [single frame] architecture is C(96, 11, 3)-N-P-C(256, 5, 1)-N-P-C(384, 3, 1)-C(384, 3, 1)-C(256, 3, 1)-P-FC(4096)-FC(4096), where C(d, f, s) indicates a convolutional layer with d filters of spatial size f ×f, applied to the input with stride s" Two such single-frame architectures are concatenated as shown in figure 2 "Since the input is only of half the spatial size as the full-frame models, we take out the last pooling layer to ensure that both streams st…

Dane treningowe
50,000,000 tokens

"We further estimate the size of our dataset of sampled frames to be on the order of 50 million examples and that our networks have each seen approximately 500 million examples throughout the training period in total." So 5e+7 datapoints and 10 epochs.

Jak jest klasyfikowane

Etykiety, które źródłowy zbiór danych stosuje podczas śledzenia znaczących modeli oraz jak pewny jest tego wpisu.

Dlaczego to jest śledzone
Highly cited
Cytaty
6,254

Źródła

Skąd pochodzi ten rekord i kiedy był ostatnio sprawdzany.

Referencja
Large-Scale Video Classification with Convolutional Neural Networks
Ostatnio zaktualizowane
28 November 2025

Co oznaczają liczby

Tło

Multiresolution CNN został opublikowany przez Google,Stanford University, w kraju zapisanym jako United States of America, podczas June 2014. Wychodzi z organizacji zaklasyfikowanej jako industry,Academia.

Działa w dziedzinie Video, i jest zapisany jako wykonujący zadanie video classification.

Jego wagi nigdy nie zostały opublikowane, więc można go osiągnąć tylko przez jego dostawcę. Żaden procesor graficzny tego nie zmieni.

Jak to zostało wytrenowane

Zbiór treningowy trwał około 50,000,000 Tokeny tekstu.

Kryterium włączenia: highly cited.

Odpowiedzi

Multiresolution CNN — częste pytania

01

Multiresolution CNN— czy jest open weight?

Licencja nigdy nie została zarejestrowana w naszych danych źródłowych. Traktujemy niewskazaną licencję jako zamkniętą, ponieważ niezarejestrowana licencja nie jest na którą można polegać.

02

Multiresolution CNN— ile ma parametrów?

Ma liczbę parametrów równą 126.1M. "Using shorthand notation, the full [single frame] architecture is C(96, 11, 3)-N-P-C(256, 5, 1)-N-P-C(384, 3, 1)-C(384, 3, 1)-C(256, 3, 1)-P-FC(4096)-FC(4096), where C(d, f, s) indicates a convolutional layer with d filters of spatial size f ×f, applied to the input with stride s" Two such single-frame architectures are concatenated as shown in figure 2 "Since the input is only of half the spatial size as the full-frame models, we take out the last pooling layer to ensure that both streams still terminate in a layer of size 7×7×256. " We assume the input are T=10 frames with C=3 color channels each 2*(256*(10*3*5*5+1) + 384*(256*3*3+1) + 384*(384*3*3+1) + 256*(384*3*3+1)) + (2*7*7*256 + 1)*4096 + (4096+1)*4096. Ta liczba to całkowita, i to ona decyduje o tym, ile pamięci potrzebuje model — mniej więcej pół gigabajta na miliard przy kompresji, którą używa większość ludzi.

03

Multiresolution CNN— kto to stworzył?

Zostało opublikowane przez Google,Stanford University, oparty na United States of America, organizacja sklasyfikowana jako industry,Academia.

04

Multiresolution CNN— kiedy to zostało wydane?

Zostało opublikowane w June 2014. Możliwość na parametr znacznie się poprawiła, więc nowszy model tej samej wielkości często lepiej wykorzystuje ten sam sprzęt.

05

Multiresolution CNN— do czego to służy?

Działa w dziedzinie Video, i jest zarejestrowany jako realizujący zadanie video classification. Modele często mają więcej niż jeden z każdego, a etykiety opisują cel, a nie ograniczenia możliwości.

06

Multiresolution CNN— Jaką GPU potrzebuję, aby ją uruchomić?

Żaden. To jest zamknięty model — jego wagi nigdy nie zostały opublikowane, więc nie można go pobrać ani uruchomić na własnym sprzęcie za żadną cenę. Jest dostępny tylko przez jego dostawcę.

Źródło

Oryginalna publikacja

Ostatnia aktualizacja rekordu 28 November 2025

Druga strona

Patrząc na to z drugiej strony?

Ta strona zaczyna się od modelu. Jeśli już posiadasz kartę i chcesz wiedzieć, co wszystko będzie działać., Zacznij od sprzętu zamiast.