Florence-2-L (large)

Zárt súlyok Microsoft 771M Paraméterek July 2024

Nincs becslés

Nincs hardver követelmény ennek a modellnek

A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
Microsoft
Szervezet típusa
Industry
Ország
United States of America
Közölt
29 July 2024
Szerzők
Bin Xiao, Haiping Wu, Weijian Xu, Xiyang Dai, Houdong Hu, Yumao Lu, Michael Zeng, Ce Liu, Lu Yuan

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Vision
Feladat
Image captioning, Visual question answering, Image classification, Object detection

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Paraméterek
771M

771 million

Képzési adatok
22,879,290,000 tokens

We train our models with a mini-batch size of 2048/3072 (base/large) and an image size of 384×384 until reaching 3 billion effective training samples. Similar to [15, 29, 64, 92, 95], we further conduct high-resolution tuning with an image size of 768×768 for 0.5 billion samples for the base model and 0.1 billion samples for the large model. assuming (!) patches 14*14 and avg of 40 text tokens per image: 3*10^9*((384/14)^2+40) + 0.1*10^9*((768/14)^2+40) = 2.6819102e+12 tokens (Likely confide…

Képzés számítás

A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.

Képzés számítás
1.2 × 10²² FLOP

6ND = 6*771000000.00*2681910200000 = 1.2406517e+22

Hogyan jött létre
Operation counting

Elérhetőség

Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.

Súlyok
Closed — provider access only
Modell hozzáférés
Unreleased
Képzés kód
Unreleased

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Nyilvántartási bizalom
Likely

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
Florence-2: Advancing a Unified Representation for a Variety of Vision Tasks
Utoljára frissítve
11 February 2026

Mit jelentenek a számok

Honnan jött

Florence-2-L (large) ki lett adva által Microsoft, az országban rögzítve mint United States of America, alatt July 2024. Egy olyan szervezetből származik, amelyet kategorizálnak mint industry.

Működik a területen a Vision, és úgy van rögzítve, mint a feladat végrehajtása image captioning, Visual question answering, Image classification, Object detection.

Mivel a súlyok nem elérhetők, ezért ezen az oldalon máshol található hardveradatok egyike sem vonatkozik rá.

Képzés és származás

A betanításhoz körülbelül egy számítási költségvetés kellett 1.2 × 10²² FLOP. Ez a szám azt méri, hogy mennyibe került a modell előállítása, és nincs hatással arra, hogy milyen gyorsan válaszol.

A tanító készlet kb. futott 22,879,290,000 szöveg tokenjei

Válaszok

Florence-2-L (large) — gyakori kérdések

01

Florence-2-L (large)— Mire használják?

Működik a területen a Vision, és rögzítve van, hogy kezeli a feladatot image captioning, Visual question answering, Image classification, Object detection. A modellek gyakran több mint egyet hordoznak mindegyikből, és a címkék a célra, nem pedig a képességek határaira utalnak.

02

Florence-2-L (large)— mennyi számítási kapacitást használtak annak a betanításához?

A képzés körülbelül elfogyasztott 1.2 × 10²² FLOP. Ez azt méri, hogy mennyibe került a modell előállítása, és semmit nem mond arról, hogy milyen gyorsan válaszol, miután betanult — a következtetési sebesség a memória sávszélességéből származik, nem az edzési költségvetésből.

03

Florence-2-L (large)— Milyen GPU-ra van szükségem, hogy futtathassam?

Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.

04

Florence-2-L (large)— Nyílt forráskódú?

Nem. A súlyai nincsenek közzétéve, így csak a tulajdonosa által ellenőrzött szolgáltatásként létezik.

05

Florence-2-L (large)— Hány paramétere van?

Paraméterszáma 771M. 771 million. Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.

06

Florence-2-L (large)— Ki készítette ezt?

Kiadta Microsoft, alapján United States of America, egy szervezet, amelyet kategorizáltak mint industry.

07

Florence-2-L (large)— Mikor adták ki?

Kibocsátották a July 2024. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 11 February 2026

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..