AlphaFold
Nincs becslés
Nincs hardver követelmény ennek a modellnek
A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..
Nyilvántartásban
Teljes specifikáció
Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..
Eredet
Ki építette ezt a modellt, hol, és mikor publikálták.
- Szervezet
- DeepMind
- Szervezet típusa
- Industry
- Ország
- United Kingdom of Great Britain and Northern Ireland
- Közölt
- 15 January 2020
- Szerzők
- Andrew W. Senior, Richard Evans, John Jumper, James Kirkpatrick, Laurent Sifre, Tim Green, Chongli Qin, Augustin Žídek, Alexander W. R. Nelson, Alex Bridgland, Hugo Penedones, Stig Petersen, Karen Simonyan, Steve Crossan, Pushmeet Kohli, David T. Jones, David Silver, Koray Kavukcuoglu, Demis Hassabis
Mit csinál
A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.
- Tartomány
- Biology
- Feladat
- Protein folding prediction, Proteins
- Megközelítés
- Self-supervised learning
Méret
Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.
- Paraméterek
- 16.3M
- Képzési adatok
- 6,622,252,080 tokens
"Neural network hyperparameters" section of https://www.nature.com/articles/s41586-019-1923-7: “7 × 4 Blocks with 256 channels, cycling through dilations 1, 2, 4, 8” “48 × 4 Blocks with 128 channels, cycling through dilations 1, 2, 4, 8” "Distogram prediction" section: "For the final layer, a position-specific bias was used" Extended Data Fig.1 (b): Shows that each block consists of 9 layers: (1) Batch norm (2) Elu (3) Project down (halves number of dimensions) (4) Batch norm (5) Elu (6) 3x3 …
Training Domains: 29,427 Average Residues per Domain: 100 Data Points per Domain: 100 × 100 = 10,000 Total Data Points = 29,427 × 10,000 = 294,270,000 ≈ 3.0 × 10⁸
Képzés számítás
A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.
- Képzés számítás
- 1 × 10²⁰ FLOP
- Hogyan jött létre
- Hardware,Third-party estimation
Estimated in the blogpost below https://www.lesswrong.com/posts/wfpdejMWog4vEDLDg/ai-and-compute-trend-isn-t-predictive-of-what-is-happening "AlphaFold: they say they trained on GPU and not TPU. Assuming V100 GPU, it's 5 days * 24 hours/day * 3600 sec/hour * 8 V100 GPU * 100*10^12 FLOP/s * 33% actual GPU utilization = 10^20 FLOP."
A tréning futás
Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.
- Fali óra idő
- 120 hours
"Training time: about 5 days for 600,000 steps"
Elérhetőség
Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.
- Súlyok
- Closed — provider access only
- Modell hozzáférés
- Unreleased
- Képzés kód
- Unreleased
Hogyan van besorolva
Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.
- Miért követik nyomon
- SOTA improvement,Highly cited
- Nyilvántartási bizalom
- Speculative
- Hivatkozások
- 2,773
"AlphaFold represents a considerable advance in protein-structure prediction." [Abstract]
Források
Honnan származik ez a felvétel és mikor ellenőrizték utoljára.
- Referencia
- Improved protein structure prediction using potentials from deep learning
- Utoljára frissítve
- 28 November 2025
Mit jelentenek a számok
Mit jelent ez a modell
AlphaFold ki lett adva által DeepMind, az országban rögzítve mint United Kingdom of Great Britain and Northern Ireland, alatt January 2020. A kiadó szervezet a következő kategóriába tartozik industry.
Működik a területen a Biology, és úgy van rögzítve, mint a feladat végrehajtása protein folding prediction, Proteins.
Ez egy zárt modell: a betanított értékek azoknál maradtak, akik előállították őket, és nincs helyi verzió a futtatáshoz.
Képzés és származás
A betanításhoz körülbelül egy számítási költségvetés kellett 1 × 10²⁰ FLOP. Ez a szám azt méri, hogy mennyibe került a modell előállítása, és nincs hatással arra, hogy milyen gyorsan válaszol.
A tanító készlet kb. futott 6,622,252,080 szöveg tokenjei
Egy különös okból nyomon követik az alapul szolgáló adatbázisban: sOTA improvement,Highly cited.
Válaszok
AlphaFold — gyakori kérdések
AlphaFold— mennyi számítási kapacitást használtak annak a betanításához?
A képzés körülbelül elfogyasztott 1 × 10²⁰ FLOP. Ez azt méri, hogy mennyibe került a modell előállítása, és semmit nem mond arról, hogy milyen gyorsan válaszol, miután betanult — a következtetési sebesség a memória sávszélességéből származik, nem az edzési költségvetésből.
AlphaFold— Milyen GPU-ra van szükségem, hogy futtathassam?
Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.
AlphaFold— Nyílt forráskódú?
Nem. A súlyai nincsenek közzétéve, így csak a tulajdonosa által ellenőrzött szolgáltatásként létezik.
AlphaFold— Hány paramétere van?
Paraméterszáma 16.3M. "Neural network hyperparameters" section of https://www.nature.com/articles/s41586-019-1923-7: “7 × 4 Blocks with 256 channels, cycling through dilations 1, 2, 4, 8” “48 × 4 Blocks with 128 channels, cycling through dilations 1, 2, 4, 8” "Distogram prediction" section: "For the final layer, a position-specific bias was used" Extended Data Fig.1 (b): Shows that each block consists of 9 layers: (1) Batch norm (2) Elu (3) Project down (halves number of dimensions) (4) Batch norm (5) Elu (6) 3x3 kernel with dilation (7) Batch norm (8) Elu (9) Project up (doubles number of dimensions) Dilations don't change the number of parameters in each filter Assuming that projection layers are convolutional layers with 1x1 kernels Parameter estimate for each layer in a 256 channel block: (1) 256*2 = 512 (2) 0 (3) 1*1*256*128 = 32768 (4) 128*2 = 256 (5) 0 (6) 3*3*128*128 = 147456 (7) 128*2 = 256 (8) 0 (9) 1*1*128*256 + 256 = 33024 Total = 214272 Parameter estimate for each layer in a 128 channel block: (1) 128*2 = 256 (2) 0 (3) 1*1*128*64 = 8192 (4) 64*2 = 128 (5) 0 (6) 3*3*64*64 = 36864 (7) 64*2 = 128 (8) 0 (9) 1*1*64*128 + 128 = 8320 Total = 53897 Estimate total network = 7*4*214272 + 48*4*53897 = 5992616 + 10348224 = 16340840 ~ 16e6 Within a factor of 2 of the estimate of 21M parameters stated in: https://www.ncbi.nlm.nih.gov/pmc/articles/PMC7305407/ [Previous approximation: 7 * 4 * 256 * 3 * 3 * 256 + 48 * 4 * 128 * 3 * 3 * 128 = 44826624]. Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.
AlphaFold— Ki készítette ezt?
Kiadta DeepMind, alapján United Kingdom of Great Britain and Northern Ireland, egy szervezet, amelyet kategorizáltak mint industry.
AlphaFold— Mikor adták ki?
Kibocsátották a January 2020. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.
AlphaFold— Mire használják?
Működik a területen a Biology, és rögzítve van, hogy kezeli a feladatot protein folding prediction, Proteins. A modellek gyakran több mint egyet hordoznak mindegyikből, és a címkék a célra, nem pedig a képességek határaira utalnak.
A másik irány
Másik oldalról nézve?
Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..