LSTM with forget gates
Nincs becslés
Nincs hardver követelmény ennek a modellnek
A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..
Nyilvántartásban
Teljes specifikáció
Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..
Eredet
Ki építette ezt a modellt, hol, és mikor publikálták.
- Szervezet
- IDSIA
- Szervezet típusa
- Academia
- Ország
- Switzerland
- Közölt
- 2 January 1999
- Szerzők
- F. A. Gers, J. Schmidhuber, and F. Cummins
Mit csinál
A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.
- Tartomány
- Language
- Feladat
- Language Structure Modeling
Méret
Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.
- Paraméterek
- 0.3K
- Képzési adatok
- 140,870,000 tokens
See Table 1
Training was stopped after at most 30000 training streams, each of which was ended when the first prediction error or the 100000th successive input symbol occurred NOTE this is a weird task. Not sure how to measure dataset size (#seqs? #symbols?)
Hogyan van besorolva
Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.
- Miért követik nyomon
- Highly cited
- Hivatkozások
- 6,283
Források
Honnan származik ez a felvétel és mikor ellenőrizték utoljára.
- Referencia
- Learning to forget: Continual prediction with LSTM
- Utoljára frissítve
- 28 November 2025
Mit jelentenek a számok
Mit jelent ez a modell
LSTM with forget gates ki lett adva által IDSIA, az országban rögzítve mint Switzerland, alatt January 1999. Egy olyan szervezetből származik, amelyet kategorizálnak mint academia.
Működik a területen a Language, és úgy van rögzítve, mint a feladat végrehajtása language Structure Modeling.
Ez egy zárt modell: a betanított értékek azoknál maradtak, akik előállították őket, és nincs helyi verzió a futtatáshoz.
Képzés és származás
Körülbelül egy korpuszon lett betanítva 140,870,000 szöveg tokenjei
Az oka, hogy egyáltalán megjelenik ebben a katalógusban: highly cited.
Válaszok
LSTM with forget gates — gyakori kérdések
LSTM with forget gates— Mire használják?
Működik a területen a Language, és rögzítve van, hogy kezeli a feladatot language Structure Modeling. A modellek gyakran több mint egyet hordoznak mindegyikből, és a címkék a célra, nem pedig a képességek határaira utalnak.
LSTM with forget gates— Milyen GPU-ra van szükségem, hogy futtathassam?
Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.
LSTM with forget gates— Nyílt forráskódú?
A licencálás sosem volt rögzítve a forrásadatainkban. Az állandóan nem megadott licencet zártnak tekintjük, mert a nem rögzített licenc nem egy megbízható.
LSTM with forget gates— Hány paramétere van?
Paraméterszáma 0.3K. See Table 1. Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.
LSTM with forget gates— Ki készítette ezt?
Kiadta IDSIA, alapján Switzerland, egy szervezet, amelyet kategorizáltak mint academia.
LSTM with forget gates— Mikor adták ki?
Kibocsátották a January 1999. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.
A másik irány
Másik oldalról nézve?
Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..