NLP from scratch

Uzavřené váhy NEC Laboratories,Princeton University 5M parametry November 2011

Žádný odhad

Žádné hardwarové požadavky pro tento model

Hmotnosti pro tento model nebyly zveřejněny, takže jej nelze stáhnout ani spustit na vlastním hardwaru v žádné velikosti. Je dostupný pouze prostřednictvím svého poskytovatele, a žádná změna grafické karty to nezmění..

Na záznamu

Plná specifikace

Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..

Původ

Kdo vytvořil tento model, kde a kdy byl publikován.

Organizace
NEC Laboratories,Princeton University
Typ organizace
Industry,Academia
Země
United States of America
Publikováno
8 November 2011
Autoři
Ronan Collobert, J. Weston, L. Bottou, Michael Karlen, K. Kavukcuoglu, P. Kuksa

Co to dělá

Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.

Doména
Language
Úkol
Language Structure Modeling

Velikost

Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.

parametry
5M

"The capacity of our network architectures lies mainly in the word lookup table, which contains 50 × 100,000 parameters to train. [...] most of the trainable parameters are located in the lookup tables."

Výcviková data
852,000,000 tokens

"Section 4 leverages large unlabeled data sets (∼ 852 million words)"

Tréninkový běh

Co fyzicky vyžadovalo trénování: které čipy, kolik, jak dlouho a co to vyžadovalo ze zásuvky.

Doba reálného času
72 hours

"Chunking and NER take about one hour to train, POS takes few hours, and SRL takes about three days." SRL is the longest task.

Jak je to klasifikováno

Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.

Proč je to sledováno
Highly cited
Citace
7,640

Žrovy

Odkud tento záznam pochází a kdy byl naposledy zkontrolován.

Reference
Natural Language Processing (Almost) from Scratch
Nap poslední aktualizace
28 November 2025

Co čísla znamenají

Odkud to přišlo

NLP from scratch byl zveřejněn NEC Laboratories,Princeton University, v zemi zaznamenané jako United States of America, během November 2011. Vychází z organizace, která je kategorizována jako industry,Academia.

funguje v oblasti Language, a je zaznamenán jako vykonávající úkol language Structure Modeling.

Protože váhy nejsou k dispozici, žádné z hardwarových údajů na tomto webu se na něj nevztahují.

Trénink a původ

Trénink spotřeboval korpus kolem 852,000,000 tokeny textu

Jeho kritérium zahrnutí: highly cited.

Odpovědi

NLP from scratch — běžné otázky

01

NLP from scratch— Jakou GPU potřebuji k jejímu spuštění?

Žádné. Toto je uzavřený model — jeho váhy nikdy nebyly zveřejněny, takže jej nelze stáhnout nebo spustit na vlastním hardwaru za žádnou cenu. Je dostupný pouze prostřednictvím jeho poskytovatele.

02

NLP from scratch— Je to OPEN SOURCE?

Licencování nikdy nebylo zaznamenáno v našich zdrojových datech. Neuváděné licencování považujeme za uzavřené, protože nezaznamenaná licence není na kterou by se dalo spoléhat.

03

NLP from scratch— kolik má parametrů?

Má počet parametrů 5M. "The capacity of our network architectures lies mainly in the word lookup table, which contains 50 × 100,000 parameters to train. [...] most of the trainable parameters are located in the lookup tables.". Tato cifra je celková a rozhoduje o tom, kolik VRAM model potřebuje — přibližně půl gigabajtu na miliardu při kompresi, kterou většina lidí používá.

04

NLP from scratch— Kdo to vytvořil?

Bylo to publikováno společností NEC Laboratories,Princeton University, zakládající se na United States of America, organizace zařazená jako industry,Academia.

05

NLP from scratch— Kdy byl vydán?

Bylo to zveřejněno v November 2011. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.

06

NLP from scratch— K čemu se to používá?

funguje v oblasti Language, a je zaznamenáno jako zpracovávající úkol language Structure Modeling. Toto jsou oblasti, kolem nichž byl navržen; popisují záměr spíše než tvrdou hranici.

Zdroj

Původní publikace

Nahrávka naposledy aktualizována 28 November 2025

Druhý směr

Díváte se na to z druhé strany?

Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.