Multiresolution CNN

Zárt súlyok Google,Stanford University 126.1M Paraméterek June 2014

Nincs becslés

Nincs hardver követelmény ennek a modellnek

A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
Google,Stanford University
Szervezet típusa
Industry,Academia
Ország
United States of America
Közölt
23 June 2014
Szerzők
A Karpathy, G Toderici, S Shetty, T Leung

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Video
Feladat
Video classification

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Paraméterek
126.1M

"Using shorthand notation, the full [single frame] architecture is C(96, 11, 3)-N-P-C(256, 5, 1)-N-P-C(384, 3, 1)-C(384, 3, 1)-C(256, 3, 1)-P-FC(4096)-FC(4096), where C(d, f, s) indicates a convolutional layer with d filters of spatial size f ×f, applied to the input with stride s" Two such single-frame architectures are concatenated as shown in figure 2 "Since the input is only of half the spatial size as the full-frame models, we take out the last pooling layer to ensure that both streams st…

Képzési adatok
50,000,000 tokens

"We further estimate the size of our dataset of sampled frames to be on the order of 50 million examples and that our networks have each seen approximately 500 million examples throughout the training period in total." So 5e+7 datapoints and 10 epochs.

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Miért követik nyomon
Highly cited
Hivatkozások
6,254

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
Large-Scale Video Classification with Convolutional Neural Networks
Utoljára frissítve
28 November 2025

Mit jelentenek a számok

Háttér

Multiresolution CNN ki lett adva által Google,Stanford University, az országban rögzítve mint United States of America, alatt June 2014. Egy olyan szervezetből származik, amelyet kategorizálnak mint industry,Academia.

Működik a területen a Video, és úgy van rögzítve, mint a feladat végrehajtása video classification.

Súlyait soha nem tették közzé, így csak a szolgáltatóján keresztül érhető el. Nincs grafikus kártya, ami ezt megváltoztatná.

Hogyan lett betanítva

A tanító készlet kb. futott 50,000,000 szöveg tokenjei

A kiválasztási kritériuma: highly cited.

Válaszok

Multiresolution CNN — gyakori kérdések

01

Multiresolution CNN— Nyílt forráskódú?

A licencálás sosem volt rögzítve a forrásadatainkban. Az állandóan nem megadott licencet zártnak tekintjük, mert a nem rögzített licenc nem egy megbízható.

02

Multiresolution CNN— Hány paramétere van?

Paraméterszáma 126.1M. "Using shorthand notation, the full [single frame] architecture is C(96, 11, 3)-N-P-C(256, 5, 1)-N-P-C(384, 3, 1)-C(384, 3, 1)-C(256, 3, 1)-P-FC(4096)-FC(4096), where C(d, f, s) indicates a convolutional layer with d filters of spatial size f ×f, applied to the input with stride s" Two such single-frame architectures are concatenated as shown in figure 2 "Since the input is only of half the spatial size as the full-frame models, we take out the last pooling layer to ensure that both streams still terminate in a layer of size 7×7×256. " We assume the input are T=10 frames with C=3 color channels each 2*(256*(10*3*5*5+1) + 384*(256*3*3+1) + 384*(384*3*3+1) + 256*(384*3*3+1)) + (2*7*7*256 + 1)*4096 + (4096+1)*4096. Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.

03

Multiresolution CNN— Ki készítette ezt?

Kiadta Google,Stanford University, alapján United States of America, egy szervezet, amelyet kategorizáltak mint industry,Academia.

04

Multiresolution CNN— Mikor adták ki?

Kibocsátották a June 2014. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.

05

Multiresolution CNN— Mire használják?

Működik a területen a Video, és rögzítve van, hogy kezeli a feladatot video classification. A modellek gyakran több mint egyet hordoznak mindegyikből, és a címkék a célra, nem pedig a képességek határaira utalnak.

06

Multiresolution CNN— Milyen GPU-ra van szükségem, hogy futtathassam?

Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 28 November 2025

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..