Cross-lingual alignment
Žádný odhad
Žádné hardwarové požadavky pro tento model
Hmotnosti tohoto modelu jsou otevřené, ale žádný počet parametrů pro něj nebyl zveřejněn. Každé číslo týkající se paměti a rychlosti vychází z této hodnoty, takže bychom raději nic neukázali, než fabrikaovaný odhad..
Na záznamu
Plná specifikace
Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..
Původ
Kdo vytvořil tento model, kde a kdy byl publikován.
- Organizace
- Tel Aviv University,Massachusetts Institute of Technology (MIT)
- Typ organizace
- Academia,Academia
- Země
- Israel, United States of America
- Publikováno
- 4 April 2019
- Autoři
- Tal Schuster, Ori Ram, Regina Barzilay, and Amir Globerson.
Co to dělá
Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.
- Doména
- Language
- Úkol
- Translation
- Základní model
- ELMo
Velikost
Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.
- Výcviková data
- tokens
Výpočty pro trénink
Aritmetika prováděná k trénování modelu, měřená v operacích s plovoucí desetinnou čárkou. Je to měřítko toho, kolik stál tréninkový běh, ne jak rychle hotový model na vás odpovídá.
- Výpočty pro trénink
- 2.6 × 10¹⁸ FLOP
- Jak bylo ustanoveno
- Hardware
From author communication: Precision: float32 Hardware: 4 GPU NVIDIA 1080Ti NVIDIA 1080Ti: 1.06E+13 Compute: 7 GPU-days 0.4 * 1.06E+13 FLOP/s * 7 days * 24h/day * 3600s/h = 2.56E+18
Tréninkový běh
Co fyzicky vyžadovalo trénování: které čipy, kolik, jak dlouho a co to vyžadovalo ze zásuvky.
- Tréninkový hardware
- NVIDIA GeForce GTX 1080 Ti
Dostupnost
Zda můžete získat model a spustit ho na svém vlastním hardwaru, což rozhoduje o tom, zda se některé z čísel grafických karet na této stránce vztahují.
- Hmotnosti
- Open — downloadable
- Přístup k modelu
- Open weights (unrestricted)
- Tréninkový kód
- Open source
MIT license https://github.com/TalSchuster/CrossLingualContextualEmb
Jak je to klasifikováno
Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.
- Proč je to sledováno
- SOTA improvement
- Záznam důvěry
- Speculative
- Citace
- 221
"our method consistently outperforms the previous state-of-the-art on 6 tested languages" "Table 3 summarizes the results for our zero-shot, multi-source experiments on six languages from Google universal dependency treebank version 2.0." "Table 5 summarizes the results, showing that our algorithm outperforms the best model from the shared task by 5.05 LAS points and improves by over 10 points over a FASTTEXT baseline"
Žrovy
Odkud tento záznam pochází a kdy byl naposledy zkontrolován.
- Reference
- Cross-lingual alignment of contextual word embeddings, with applications to zero- shot dependency parsing.
- Nap poslední aktualizace
- 25 May 2026
Co čísla znamenají
O tomto modelu
Cross-lingual alignment byl zveřejněn Tel Aviv University,Massachusetts Institute of Technology (MIT), v zemi zaznamenané jako Israel, během April 2019. Vydavatelská organizace je kategorizována jako academia,Academia.
funguje v oblasti Language, a je zaznamenán jako vykonávající úkol translation.
Jeho výchozím bodem byl existující základní model, ELMo. To je obvyklý způsob, jak je specializovaný model vytvářen.
Protože byly jeho váhy uvolněny, nic ohledně jeho spuštění nezávisí na dostupnosti poskytovatele - je to vaše, jakmile je stáhnuto.
Co bylo zapotřebí k jeho vybudování
Produkce toho vyžadovala aritmetiku v celkové výši přibližně 2.6 × 10¹⁸ FLOP, na hardwaru zaznamenáno jako NVIDIA GeForce GTX 1080 Ti. Tato částka měří, kolik stál výroba modelu, a nemá žádný vliv na to, jak rychle odpovídá.
Jeho kritérium zahrnutí: sOTA improvement.
Odpovědi
Cross-lingual alignment — běžné otázky
Cross-lingual alignment— kolik výpočetního výkonu bylo použito k jeho trénování?
Trénink spotřeboval kolem 2.6 × 10¹⁸ FLOP, na hardwaru zaznamenáno jako NVIDIA GeForce GTX 1080 Ti. To měří, co stálo výrobu modelu, a neříká nic o tom, jak rychle odpovídá po natrénování — rychlost inferencí závisí na šířce pásma paměti, nikoli na rozpočtu na trénink.
Cross-lingual alignment— Jakou GPU potřebuji k jejímu spuštění?
Nemůžeme říct. Má otevřené váhy, ale žádný počet parametrů pro něj nebyl zveřejněn a každý výpočet paměti a rychlosti začíná od toho čísla. Raději bychom ukázali nic než vykonstruovaný odhad.
Cross-lingual alignment— Je to OPEN SOURCE?
Jeho váhy jsou zveřejněny, takže si je lze stáhnout a spustit na vlastním hardwaru. Všimněte si, že open WEIGHTS není totéž co open SOURCE v plném smyslu — neříká nic o tréninkových datech, tréninkovém kódu nebo obchodních podmínkách připojených.
Cross-lingual alignment— kolik má parametrů?
Pro něj nebyl zveřejněn žádný počet parametrů, a proto se na této stránce neobjevují žádné údaje o paměti nebo rychlosti.
Cross-lingual alignment— Kdo to vytvořil?
Bylo to publikováno společností Tel Aviv University,Massachusetts Institute of Technology (MIT), zakládající se na Israel, organizace zařazená jako academia,Academia.
Cross-lingual alignment— Kdy byl vydán?
Bylo to zveřejněno v April 2019. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.
Cross-lingual alignment— K čemu se to používá?
funguje v oblasti Language, a je zaznamenáno jako zpracovávající úkol translation. Toto jsou oblasti, kolem nichž byl navržen; popisují záměr spíše než tvrdou hranici.
Cross-lingual alignment— kde si to mohu stáhnout?
Váhy jsou zveřejněny, i když nemáme odkaz na repozitář. Tato stránka vypočítává hardwarové požadavky spíše než aby hostila modelové soubory.
Druhý směr
Díváte se na to z druhé strany?
Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.