NPLM (Brown)
Žádný odhad
Žádné hardwarové požadavky pro tento model
Hmotnosti pro tento model nebyly zveřejněny, takže jej nelze stáhnout ani spustit na vlastním hardwaru v žádné velikosti. Je dostupný pouze prostřednictvím svého poskytovatele, a žádná změna grafické karty to nezmění..
Na záznamu
Plná specifikace
Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..
Původ
Kdo vytvořil tento model, kde a kdy byl publikován.
- Organizace
- University of Montreal / Université de Montréal
- Typ organizace
- Academia
- Země
- Canada
- Publikováno
- 15 March 2003
- Autoři
- Yoshua Bengio, Réjean Ducharme, Pascal Vincent, Christian Jauvin
Co to dělá
Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.
- Doména
- Language
- Úkol
- Text autocompletion
Velikost
Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.
- parametry
- 4.1M
- Výcviková data
- 13,994,528 tokens
"The number of free parameters is |V|(1 + nm + h) + h(1 + (n − 1)m) [...] For example, consider the following architecture used in the experiments on the AP (Associated Press) news data: the vocabulary size is |V| = 17,964, the number of hidden units is h = 60, the order of the model is n = 6, the number of word features is m = 100" Brown corpus: n=5, h=100, m=30, |V|=16383 16383*(1+5*30+100)+100*(1+(5-1)*30)=4124233
"Comparative experiments were performed on the Brown corpus which is a stream of 1,181,041 words, from a large variety of English texts and books. The first 800,000 words were used for training, the following 200,000 for validation (model selection, weight decay, early stopping) and the remaining 181,041 for testing. The number of different words is 47,578 (including punctuation, distinguishing between upper and lower case, and including the syntactical marks used to separate texts and paragraph…
Výpočty pro trénink
Aritmetika prováděná k trénování modelu, měřená v operacích s plovoucí desetinnou čárkou. Je to měřítko toho, kolik stál tréninkový běh, ne jak rychle hotový model na vás odpovídá.
- Výpočty pro trénink
- 1.3 × 10¹⁴ FLOP
- Jak bylo ustanoveno
- Operation counting
"For example, consider the following architecture used in the experiments on the AP (Associated Press) news data: the vocabulary size is |V| = 17,964, the number of hidden units is h = 60, the order of the model is n = 6, the number of word features is m = 100. The total number of numerical operations to process a single training example is approximately |V|(1+nm+h)+h(1+nm)+nm" Brown corpus: n=5, h=100, m=30, |V|=16383, dataset size = 800000, epochs=20 Forward FLOP: 16383*(1+5*30+100)+100*(1+5*…
Jak je to klasifikováno
Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.
- Frontier model
- Yes
- Proč je to sledováno
- Highly cited
- Záznam důvěry
- Confident
- Citace
- 7,637
Žrovy
Odkud tento záznam pochází a kdy byl naposledy zkontrolován.
- Reference
- A Neural Probabilistic Language Model
- Nap poslední aktualizace
- 11 February 2026
Co čísla znamenají
Pozadí
NPLM (Brown) byl zveřejněn University of Montreal / Université de Montréal, v zemi zaznamenané jako Canada, během March 2003. Kategorie, do které vydavatel spadá, je academia.
funguje v oblasti Language, a je zaznamenán jako vykonávající úkol text autocompletion.
Toto je uzavřený model: trénované hodnoty zůstaly u toho, kdo je vyprodukoval, a není k dispozici žádná místní verze k spuštění.
Jak bylo trénováno
Trenovací běh spotřeboval asi 1.3 × 10¹⁴ FLOP. Tato částka měří, kolik stál výroba modelu, a nemá žádný vliv na to, jak rychle odpovídá.
Trénink spotřeboval korpus kolem 13,994,528 tokeny textu
Je sledováno v základním datasetu z jednoho konkrétního důvodu: highly cited.
Odpovědi
NPLM (Brown) — běžné otázky
NPLM (Brown)— Je to OPEN SOURCE?
Licencování nikdy nebylo zaznamenáno v našich zdrojových datech. Neuváděné licencování považujeme za uzavřené, protože nezaznamenaná licence není na kterou by se dalo spoléhat.
NPLM (Brown)— kolik má parametrů?
Má počet parametrů 4.1M. "The number of free parameters is |V|(1 + nm + h) + h(1 + (n − 1)m) [...] For example, consider the following architecture used in the experiments on the AP (Associated Press) news data: the vocabulary size is |V| = 17,964, the number of hidden units is h = 60, the order of the model is n = 6, the number of word features is m = 100" Brown corpus: n=5, h=100, m=30, |V|=16383 16383*(1+5*30+100)+100*(1+(5-1)*30)=4124233. Tato cifra je celková a rozhoduje o tom, kolik VRAM model potřebuje — přibližně půl gigabajtu na miliardu při kompresi, kterou většina lidí používá.
NPLM (Brown)— Kdo to vytvořil?
Bylo to publikováno společností University of Montreal / Université de Montréal, zakládající se na Canada, organizace zařazená jako academia.
NPLM (Brown)— Kdy byl vydán?
Bylo to zveřejněno v March 2003. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.
NPLM (Brown)— K čemu se to používá?
funguje v oblasti Language, a je zaznamenáno jako zpracovávající úkol text autocompletion. Modely často obsahují více než jeden z každého a štítky popisují účel spíše než omezení schopností.
NPLM (Brown)— kolik výpočetního výkonu bylo použito k jeho trénování?
Trénink spotřeboval kolem 1.3 × 10¹⁴ FLOP. To měří, co stálo výrobu modelu, a neříká nic o tom, jak rychle odpovídá po natrénování — rychlost inferencí závisí na šířce pásma paměti, nikoli na rozpočtu na trénink.
NPLM (Brown)— Jakou GPU potřebuji k jejímu spuštění?
Žádné. Toto je uzavřený model — jeho váhy nikdy nebyly zveřejněny, takže jej nelze stáhnout nebo spustit na vlastním hardwaru za žádnou cenu. Je dostupný pouze prostřednictvím jeho poskytovatele.
Druhý směr
Díváte se na to z druhé strany?
Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.