RoBERTa (PFAM)
Žádný odhad
Žádné hardwarové požadavky pro tento model
Hmotnosti tohoto modelu jsou otevřené, ale žádný počet parametrů pro něj nebyl zveřejněn. Každé číslo týkající se paměti a rychlosti vychází z této hodnoty, takže bychom raději nic neukázali, než fabrikaovaný odhad..
Na záznamu
Plná specifikace
Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..
Původ
Kdo vytvořil tento model, kde a kdy byl publikován.
- Organizace
- IBM Research,ETH Zurich
- Typ organizace
- Industry,Academia
- Země
- United States of America, Switzerland
- Publikováno
- 5 December 2020
- Autoři
- Modestas Filipavicius, Matteo Manica, Joris Cadow, Maria Rodriguez Martinez
Co to dělá
Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.
- Doména
- Biology
- Úkol
- Protein or nucleotide language model (pLM/nLM)
Velikost
Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.
- Výcviková data
- tokens
- Epochy
- 2
31M sequences with an estiamted length of 300: 31M*300=9300000000
Výpočty pro trénink
Aritmetika prováděná k trénování modelu, měřená v operacích s plovoucí desetinnou čárkou. Je to měřítko toho, kolik stál tréninkový běh, ne jak rychle hotový model na vás odpovídá.
- Výpočty pro trénink
- 1.2 × 10¹⁹ FLOP
- Jak bylo ustanoveno
- Operation counting
1. Hardware: 4x NVIDIA Tesla P100 SXM2 GPUs (18.7 TFLOP/s per GPU in FP16) The architecture is based on Bert-base, with 110M parameters 6*9300000000*2*110000000=1.2276e+19
Tréninkový běh
Co fyzicky vyžadovalo trénování: které čipy, kolik, jak dlouho a co to vyžadovalo ze zásuvky.
- Tréninkový hardware
- NVIDIA P100
- Používané čipy
- 4
- Příkon
- 2.0 kW
Dostupnost
Zda můžete získat model a spustit ho na svém vlastním hardwaru, což rozhoduje o tom, zda se některé z čísel grafických karet na této stránce vztahují.
- Hmotnosti
- Open — downloadable
- Přístup k modelu
- Open weights (unrestricted)
- Tréninkový kód
- Open source
MIT license https://github.com/PaccMann/paccmann_proteomics
Jak je to klasifikováno
Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.
- Záznam důvěry
- Likely
- Citace
- 19
Žrovy
Odkud tento záznam pochází a kdy byl naposledy zkontrolován.
- Reference
- Pre-training Protein Language Models with Label-Agnostic Binding Pairs Enhances Performance in Downstream Tasks
- Nap poslední aktualizace
- 11 February 2026
Co čísla znamenají
O tomto modelu
RoBERTa (PFAM) byl zveřejněn IBM Research,ETH Zurich, v zemi zaznamenané jako United States of America, během December 2020. Vydavatelská organizace je kategorizována jako industry,Academia.
funguje v oblasti Biology, a je zaznamenán jako vykonávající úkol protein or nucleotide language model (pLM/nLM).
Váhy jsou zveřejněny, takže si je můžete stáhnout a spustit na své vlastní hardwaru neomezeně, offline, bez připojeného účtu.
Trénink a původ
Trenovací běh spotřeboval asi 1.2 × 10¹⁹ FLOP, na hardwaru zaznamenáno jako NVIDIA P100. Tato částka měří, kolik stál výroba modelu, a nemá žádný vliv na to, jak rychle odpovídá.
Odpovědi
RoBERTa (PFAM) — běžné otázky
RoBERTa (PFAM)— Kdo to vytvořil?
Bylo to publikováno společností IBM Research,ETH Zurich, zakládající se na United States of America, organizace zařazená jako industry,Academia.
RoBERTa (PFAM)— Kdy byl vydán?
Bylo to zveřejněno v December 2020. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.
RoBERTa (PFAM)— K čemu se to používá?
funguje v oblasti Biology, a je zaznamenáno jako zpracovávající úkol protein or nucleotide language model (pLM/nLM). Model může nést několik z každého, takže to jsou oblasti, pro které byl navržen, spíše než omezení toho, co se pokusí.
RoBERTa (PFAM)— kde si to mohu stáhnout?
Váhy jsou zveřejněny, i když nemáme odkaz na repozitář. Tato stránka vypočítává hardwarové požadavky spíše než aby hostila modelové soubory.
RoBERTa (PFAM)— kolik výpočetního výkonu bylo použito k jeho trénování?
Trénink spotřeboval kolem 1.2 × 10¹⁹ FLOP, na hardwaru zaznamenáno jako NVIDIA P100. To měří, co stálo výrobu modelu, a neříká nic o tom, jak rychle odpovídá po natrénování — rychlost inferencí závisí na šířce pásma paměti, nikoli na rozpočtu na trénink.
RoBERTa (PFAM)— Jakou GPU potřebuji k jejímu spuštění?
Nemůžeme říct. Má otevřené váhy, ale žádný počet parametrů pro něj nebyl zveřejněn a každý výpočet paměti a rychlosti začíná od toho čísla. Raději bychom ukázali nic než vykonstruovaný odhad.
RoBERTa (PFAM)— Je to OPEN SOURCE?
Jeho váhy jsou zveřejněny, takže si je lze stáhnout a spustit na vlastním hardwaru. Všimněte si, že open WEIGHTS není totéž co open SOURCE v plném smyslu — neříká nic o tréninkových datech, tréninkovém kódu nebo obchodních podmínkách připojených.
RoBERTa (PFAM)— kolik má parametrů?
Pro něj nebyl zveřejněn žádný počet parametrů, a proto se na této stránce neobjevují žádné údaje o paměti nebo rychlosti.
Druhý směr
Díváte se na to z druhé strany?
Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.