LIMoE-H/14
Nincs becslés
Nincs hardver követelmény ennek a modellnek
A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..
Nyilvántartásban
Teljes specifikáció
Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..
Eredet
Ki építette ezt a modellt, hol, és mikor publikálták.
- Szervezet
- Szervezet típusa
- Industry
- Ország
- United States of America
- Közölt
- 6 June 2022
- Szerzők
- Basil Mustafa, Carlos Riquelme, Joan Puigcerver, Rodolphe Jenatton, Neil Houlsby
Mit csinál
A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.
- Tartomány
- Multimodal, Vision, Language
- Feladat
- Image classification
Méret
Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.
- Paraméterek
- 5.6B
- Képzési adatok
- 4,575,625,612,000 tokens
Section 1: "We scale this up to a large 5.6B parameter LIMoE-H/14"
"By default, all models are trained on paired image-text data used in [16], consisting of 3.6B images and alt-texts scraped from the web. For large LIMoE-H/14 experiment, we also co-train with JFT-4B [17]." "The largest scale model is trained at batch size 21502, with resolution 288 and text sequence length 16." "The model was trained for 700k steps pre-cooldown. There was one cooldown of length 125k steps from the final step, and 3 of length 40k steps starting from step 650k" 21502*288*70000…
Képzés számítás
A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.
- Képzés számítás
- 1.8 × 10²² FLOP
- Hogyan jött létre
- Operation counting
Section 3.2: "The model contains 5.6B parameters in total, but only applies 675M parameters per token" From Section A.3, "batch size 21502 with resolution 288 and text sequence length16". "The model was trained for 700k steps pre-cooldown. There was one cooldown of length 125k steps from the final step, and 3 of length 40k steps starting from step 650k". Patch size 14 for images. Assume C = 6*N*D. C = 6*675e6*21.5e3*1e6*(16+(288/14)**2)/2 = 1.8e22 This is broadly consistent with ViT-H/14's c…
A tréning futás
Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.
- Képzési hardver
- Google TPU v2,Google TPU v3,Google TPU v4
Elérhetőség
Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.
- Súlyok
- Closed — provider access only
- Modell hozzáférés
- Unreleased
- Képzés kód
- Unreleased
Hogyan van besorolva
Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.
- Nyilvántartási bizalom
- Confident
- Hivatkozások
- 317
Források
Honnan származik ez a felvétel és mikor ellenőrizték utoljára.
- Referencia
- Multimodal Contrastive Learning with LIMoE: the Language-Image Mixture of Experts
- Utoljára frissítve
- 25 May 2026
Mit jelentenek a számok
Erről a modelről
LIMoE-H/14 ki lett adva által Google, az országban rögzítve mint United States of America, alatt June 2022. A kiadó szervezet a következő kategóriába tartozik industry.
Működik a területen a Multimodal, Vision, Language, és úgy van rögzítve, mint a feladat végrehajtása image classification.
Mivel a súlyok nem elérhetők, ezért ezen az oldalon máshol található hardveradatok egyike sem vonatkozik rá.
Képzés és származás
A betanításhoz körülbelül egy számítási költségvetés kellett 1.8 × 10²² FLOP, hardveren rögzítve Google TPU v2,Google TPU v3,Google TPU v4. Ez a szám azt méri, hogy mennyibe került a modell előállítása, és nincs hatással arra, hogy milyen gyorsan válaszol.
A tanító készlet kb. futott 4,575,625,612,000 szöveg tokenjei
Válaszok
LIMoE-H/14 — gyakori kérdések
LIMoE-H/14— Mikor adták ki?
Kibocsátották a June 2022. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.
LIMoE-H/14— Mire használják?
Működik a területen a Multimodal, Vision, Language, és rögzítve van, hogy kezeli a feladatot image classification. A modellek gyakran több mint egyet hordoznak mindegyikből, és a címkék a célra, nem pedig a képességek határaira utalnak.
LIMoE-H/14— mennyi számítási kapacitást használtak annak a betanításához?
A képzés körülbelül elfogyasztott 1.8 × 10²² FLOP, hardveren rögzítve Google TPU v2,Google TPU v3,Google TPU v4. Ez azt méri, hogy mennyibe került a modell előállítása, és semmit nem mond arról, hogy milyen gyorsan válaszol, miután betanult — a következtetési sebesség a memória sávszélességéből származik, nem az edzési költségvetésből.
LIMoE-H/14— Milyen GPU-ra van szükségem, hogy futtathassam?
Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.
LIMoE-H/14— Nyílt forráskódú?
Nem. A súlyai nincsenek közzétéve, így csak a tulajdonosa által ellenőrzött szolgáltatásként létezik.
LIMoE-H/14— Hány paramétere van?
Paraméterszáma 5.6B. Section 1: "We scale this up to a large 5.6B parameter LIMoE-H/14". Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.
LIMoE-H/14— Ki készítette ezt?
Kiadta Google, alapján United States of America, egy szervezet, amelyet kategorizáltak mint industry.
A másik irány
Másik oldalról nézve?
Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..