MoLFormer-XL

Otevřít váhy IBM January 2023

Žádný odhad

Žádné hardwarové požadavky pro tento model

Hmotnosti tohoto modelu jsou otevřené, ale žádný počet parametrů pro něj nebyl zveřejněn. Každé číslo týkající se paměti a rychlosti vychází z této hodnoty, takže bychom raději nic neukázali, než fabrikaovaný odhad..

Na záznamu

Plná specifikace

Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..

Původ

Kdo vytvořil tento model, kde a kdy byl publikován.

Organizace
IBM
Typ organizace
Industry
Země
United States of America
Publikováno
25 January 2023
Autoři
Jerret Ross, Brian Belgodere, Vijil Chenthamarakshan, Inkit Padhi, Youssef Mroueh, Payel Das

Co to dělá

Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.

Doména
Biology
Úkol
Protein generation, Protein folding prediction

Velikost

Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.

Výcviková data
tokens

"MoLFormer-XL has been pretrained on 1.1 billion molecules represented as machine-readable strings of text." 15K steps "PubChem+ZINC (>1 billion data points) datasets" mean token amount (table 4 from supplementary materials): 44.76 44.76*1.1*10^9 = 49236000000 tokens

Epochy
4

Výpočty pro trénink

Aritmetika prováděná k trénování modelu, měřená v operacích s plovoucí desetinnou čárkou. Je to měřítko toho, kolik stál tréninkový běh, ne jak rychle hotový model na vás odpovídá.

Výpočty pro trénink
4.5 × 10²⁰ FLOP

125000000000000 FLOP / GPU / sec *(208 hours * 16 GPUs +1 GPU * 12 hours) [see training time notes] * 3600 sec / hour * 0.3 [assumed utilization] = 4.509e+20 FLOP

Jak bylo ustanoveno
Hardware

Tréninkový běh

Co fyzicky vyžadovalo trénování: které čipy, kolik, jak dlouho a co to vyžadovalo ze zásuvky.

Tréninkový hardware
NVIDIA V100
Používané čipy
16
Doba reálného času
208 hours (8.7 days)

"Together, both techniques raised our per-GPU processing costs from 50 molecules to 1,600 molecules, allowing us to get away with 16 GPUs instead of 1,000. By eliminating hundreds of unnecessary GPUs, we consumed 61 times less energy and still had a trained model in five days. " "Our pretraining task consists of training on the full dataset to 4 epochs. Training a single epoch of just PubChem on a single NVIDIA V100 GPU would take approximately 60 hours. Utilizing Distributed Data Parallel, pre…

Příkon
9.6 kW

Dostupnost

Zda můžete získat model a spustit ho na svém vlastním hardwaru, což rozhoduje o tom, zda se některé z čísel grafických karet na této stránce vztahují.

Hmotnosti
Open — downloadable
Přístup k modelu
Open weights (unrestricted)
Tréninkový kód
Open source

Python codes for MoLFormer training and fine-tuning, and Python notebooks for MoLFormer attention visualization, as well as instances of pretrained models, are available at https://github.com/IBM/molformer. Apache 2.0

Jak je to klasifikováno

Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.

Záznam důvěry
Confident

Žrovy

Odkud tento záznam pochází a kdy byl naposledy zkontrolován.

Reference
An AI foundation model that learns the grammar of molecules
Nap poslední aktualizace
28 November 2025

Co čísla znamenají

O tomto modelu

MoLFormer-XL byl zveřejněn IBM, v zemi zaznamenané jako United States of America, během January 2023. Vychází z organizace, která je kategorizována jako industry.

funguje v oblasti Biology, a je zaznamenán jako vykonávající úkol protein generation, Protein folding prediction.

Otevřené váhy jsou to, co dává této stránce místo v kalkulátoru spíše než pouze v katalogu: je to model, který můžeš skutečně držet.

Trénink a původ

Trenovací běh spotřeboval asi 4.5 × 10²⁰ FLOP, na hardwaru zaznamenáno jako NVIDIA V100. Tato částka měří, kolik stál výroba modelu, a nemá žádný vliv na to, jak rychle odpovídá.

Odpovědi

MoLFormer-XL — běžné otázky

01

MoLFormer-XL— K čemu se to používá?

funguje v oblasti Biology, a je zaznamenáno jako zpracovávající úkol protein generation, Protein folding prediction. Modely často obsahují více než jeden z každého a štítky popisují účel spíše než omezení schopností.

02

MoLFormer-XL— kde si to mohu stáhnout?

Váhy jsou zveřejněny, i když nemáme odkaz na repozitář. Tato stránka vypočítává hardwarové požadavky spíše než aby hostila modelové soubory.

03

MoLFormer-XL— kolik výpočetního výkonu bylo použito k jeho trénování?

Trénink spotřeboval kolem 4.5 × 10²⁰ FLOP, na hardwaru zaznamenáno jako NVIDIA V100. To měří, co stálo výrobu modelu, a neříká nic o tom, jak rychle odpovídá po natrénování — rychlost inferencí závisí na šířce pásma paměti, nikoli na rozpočtu na trénink.

04

MoLFormer-XL— Jakou GPU potřebuji k jejímu spuštění?

Nemůžeme říct. Má otevřené váhy, ale žádný počet parametrů pro něj nebyl zveřejněn a každý výpočet paměti a rychlosti začíná od toho čísla. Raději bychom ukázali nic než vykonstruovaný odhad.

05

MoLFormer-XL— Je to OPEN SOURCE?

Jeho váhy jsou zveřejněny, takže si je lze stáhnout a spustit na vlastním hardwaru. Všimněte si, že open WEIGHTS není totéž co open SOURCE v plném smyslu — neříká nic o tréninkových datech, tréninkovém kódu nebo obchodních podmínkách připojených.

06

MoLFormer-XL— kolik má parametrů?

Pro něj nebyl zveřejněn žádný počet parametrů, a proto se na této stránce neobjevují žádné údaje o paměti nebo rychlosti.

07

MoLFormer-XL— Kdo to vytvořil?

Bylo to publikováno společností IBM, zakládající se na United States of America, organizace zařazená jako industry.

08

MoLFormer-XL— Kdy byl vydán?

Bylo to zveřejněno v January 2023. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.

Zdroj

Původní publikace

Nahrávka naposledy aktualizována 28 November 2025

Druhý směr

Díváte se na to z druhé strany?

Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.