Multiresolution CNN

Uzavřené váhy Google,Stanford University 126.1M parametry June 2014

Žádný odhad

Žádné hardwarové požadavky pro tento model

Hmotnosti pro tento model nebyly zveřejněny, takže jej nelze stáhnout ani spustit na vlastním hardwaru v žádné velikosti. Je dostupný pouze prostřednictvím svého poskytovatele, a žádná změna grafické karty to nezmění..

Na záznamu

Plná specifikace

Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..

Původ

Kdo vytvořil tento model, kde a kdy byl publikován.

Organizace
Google,Stanford University
Typ organizace
Industry,Academia
Země
United States of America
Publikováno
23 June 2014
Autoři
A Karpathy, G Toderici, S Shetty, T Leung

Co to dělá

Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.

Doména
Video
Úkol
Video classification

Velikost

Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.

parametry
126.1M

"Using shorthand notation, the full [single frame] architecture is C(96, 11, 3)-N-P-C(256, 5, 1)-N-P-C(384, 3, 1)-C(384, 3, 1)-C(256, 3, 1)-P-FC(4096)-FC(4096), where C(d, f, s) indicates a convolutional layer with d filters of spatial size f ×f, applied to the input with stride s" Two such single-frame architectures are concatenated as shown in figure 2 "Since the input is only of half the spatial size as the full-frame models, we take out the last pooling layer to ensure that both streams st…

Výcviková data
50,000,000 tokens

"We further estimate the size of our dataset of sampled frames to be on the order of 50 million examples and that our networks have each seen approximately 500 million examples throughout the training period in total." So 5e+7 datapoints and 10 epochs.

Jak je to klasifikováno

Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.

Proč je to sledováno
Highly cited
Citace
6,254

Žrovy

Odkud tento záznam pochází a kdy byl naposledy zkontrolován.

Reference
Large-Scale Video Classification with Convolutional Neural Networks
Nap poslední aktualizace
28 November 2025

Co čísla znamenají

Pozadí

Multiresolution CNN byl zveřejněn Google,Stanford University, v zemi zaznamenané jako United States of America, během June 2014. Vychází z organizace, která je kategorizována jako industry,Academia.

funguje v oblasti Video, a je zaznamenán jako vykonávající úkol video classification.

Jeho váhy nikdy nebyly zveřejněny, takže k němu lze přistupovat pouze prostřednictvím jeho poskytovatele. Žádná změna grafické karty to nezmění.

Jak bylo trénováno

Tréninková sada běžela na přibližně 50,000,000 tokeny textu

Jeho kritérium zahrnutí: highly cited.

Odpovědi

Multiresolution CNN — běžné otázky

01

Multiresolution CNN— Je to OPEN SOURCE?

Licencování nikdy nebylo zaznamenáno v našich zdrojových datech. Neuváděné licencování považujeme za uzavřené, protože nezaznamenaná licence není na kterou by se dalo spoléhat.

02

Multiresolution CNN— kolik má parametrů?

Má počet parametrů 126.1M. "Using shorthand notation, the full [single frame] architecture is C(96, 11, 3)-N-P-C(256, 5, 1)-N-P-C(384, 3, 1)-C(384, 3, 1)-C(256, 3, 1)-P-FC(4096)-FC(4096), where C(d, f, s) indicates a convolutional layer with d filters of spatial size f ×f, applied to the input with stride s" Two such single-frame architectures are concatenated as shown in figure 2 "Since the input is only of half the spatial size as the full-frame models, we take out the last pooling layer to ensure that both streams still terminate in a layer of size 7×7×256. " We assume the input are T=10 frames with C=3 color channels each 2*(256*(10*3*5*5+1) + 384*(256*3*3+1) + 384*(384*3*3+1) + 256*(384*3*3+1)) + (2*7*7*256 + 1)*4096 + (4096+1)*4096. Tato cifra je celková a rozhoduje o tom, kolik VRAM model potřebuje — přibližně půl gigabajtu na miliardu při kompresi, kterou většina lidí používá.

03

Multiresolution CNN— Kdo to vytvořil?

Bylo to publikováno společností Google,Stanford University, zakládající se na United States of America, organizace zařazená jako industry,Academia.

04

Multiresolution CNN— Kdy byl vydán?

Bylo to zveřejněno v June 2014. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.

05

Multiresolution CNN— K čemu se to používá?

funguje v oblasti Video, a je zaznamenáno jako zpracovávající úkol video classification. Modely často obsahují více než jeden z každého a štítky popisují účel spíše než omezení schopností.

06

Multiresolution CNN— Jakou GPU potřebuji k jejímu spuštění?

Žádné. Toto je uzavřený model — jeho váhy nikdy nebyly zveřejněny, takže jej nelze stáhnout nebo spustit na vlastním hardwaru za žádnou cenu. Je dostupný pouze prostřednictvím jeho poskytovatele.

Zdroj

Původní publikace

Nahrávka naposledy aktualizována 28 November 2025

Druhý směr

Díváte se na to z druhé strany?

Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.