Trajectory-pooled conv nets

Zárt súlyok Chinese University of Hong Kong (CUHK),Chinese Academy of Sciences 9.1M Paraméterek May 2015

Nincs becslés

Nincs hardver követelmény ennek a modellnek

A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
Chinese University of Hong Kong (CUHK),Chinese Academy of Sciences
Szervezet típusa
Academia,Academia
Ország
Hong Kong, China
Közölt
19 May 2015
Szerzők
Limin Wang, Yu Qiao, Xiaoou Tang

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Video
Feladat
Action recognition
Numerikus formátum
FP32

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Paraméterek
9.1M

The input layer takes either a single RGB frame (224x224x3) for the spatial stream or a stack of 10 optical flow frames (224x224x20) for the temporal stream. The first convolutional layer has 96 filters of size 7x7 with stride 2. This is followed by max pooling with size 3x3 and stride 2. The second convolutional layer has 256 filters of size 5x5 with stride 2. After that is another max pooling layer (3x3, stride 2). The third convolutional layer has 512 filters of size 3x3 with stride 1. The fo…

Képzési adatok
tokens

They pretrain on ImageNet, and use UCF101 for actions. Its paper says "We introduce UCF101 which is currently the largest dataset of human actions. It consists of 101 action classes, over 13k clips and 27 hours of video data".

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Hivatkozások
3,786

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
Action Recognition with Trajectory-Pooled Deep-Convolutional Descriptors
Utoljára frissítve
28 November 2025

Mit jelentenek a számok

Háttér

Trajectory-pooled conv nets ki lett adva által Chinese University of Hong Kong (CUHK),Chinese Academy of Sciences, az országban rögzítve mint Hong Kong, alatt May 2015. A kiadó szervezet a következő kategóriába tartozik academia,Academia.

Működik a területen a Video, és úgy van rögzítve, mint a feladat végrehajtása action recognition.

Mivel a súlyok nem elérhetők, ezért ezen az oldalon máshol található hardveradatok egyike sem vonatkozik rá.

Válaszok

Trajectory-pooled conv nets — gyakori kérdések

01

Trajectory-pooled conv nets— Ki készítette ezt?

Kiadta Chinese University of Hong Kong (CUHK),Chinese Academy of Sciences, alapján Hong Kong, egy szervezet, amelyet kategorizáltak mint academia,Academia.

02

Trajectory-pooled conv nets— Mikor adták ki?

Kibocsátották a May 2015. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.

03

Trajectory-pooled conv nets— Mire használják?

Működik a területen a Video, és rögzítve van, hogy kezeli a feladatot action recognition. Ezek azok a területek, amelyek köré tervezték; ezek a szándékot írják le, nem pedig egy szigorú határt.

04

Trajectory-pooled conv nets— Milyen GPU-ra van szükségem, hogy futtathassam?

Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.

05

Trajectory-pooled conv nets— Nyílt forráskódú?

A licencálás sosem volt rögzítve a forrásadatainkban. Az állandóan nem megadott licencet zártnak tekintjük, mert a nem rögzített licenc nem egy megbízható.

06

Trajectory-pooled conv nets— Hány paramétere van?

Paraméterszáma 9.1M. The input layer takes either a single RGB frame (224x224x3) for the spatial stream or a stack of 10 optical flow frames (224x224x20) for the temporal stream. The first convolutional layer has 96 filters of size 7x7 with stride 2. This is followed by max pooling with size 3x3 and stride 2. The second convolutional layer has 256 filters of size 5x5 with stride 2. After that is another max pooling layer (3x3, stride 2). The third convolutional layer has 512 filters of size 3x3 with stride 1. The fourth convolutional layer has 512 filters of size 3x3 with stride 1. The fifth convolutional layer has 512 filters of size 3x3 with stride 1. Next is a max pooling layer (3x3, stride 2). The fully-connected layers have 4096, 2048, and 101 neurons respectively. (7*7*20+1)*96 + (5*5*20+1)*256 + (3*3*20+1)*512 + (3*3*20+1)*512 + (3*3*20+1)*512 + 2*4096 + (4096+1)*2048 + (2048+1)*101 = 9106245. Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 28 November 2025

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..