UniDiffuser (多模态大模型)

Nyitott súlyok ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI May 2023

Nincs becslés

Nincs hardver követelmény ennek a modellnek

Ez a modell súlyai nyilvánosak, de a paraméterszámokat nem tették közzé. Minden memória- és sebességszám ebből a számból indul, ezért inkább nem mutatunk semmit, mint egy hamisított becslést..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI
Szervezet típusa
Industry,Academia,Academia
Ország
China
Közölt
30 May 2023
Szerzők
Fan Bao, Shen Nie, Kaiwen Xue, Chongxuan Li, Shi Pu, Yaole Wang, Gang Yue, Yue Cao, Hang Su, Jun Zhu

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Image generation
Feladat
Text-to-image, Image captioning, Image generation, Image-to-image

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Képzési adatok
tokens

"The training is multiple-staged following Stable Diffusion (Rombach et al., 2022). In the first stage, we train 250K steps at 256×256 resolution on laion2B-en with a batch size of 11264 and 5K warm-up steps. In the second stage, we fine-tune the model with 200K steps at 512×512 resolution on laion-high-resolution with a batch size of 2112 and 5K warm-up steps. In the last stage, we resume from the last checkpoint of the second stage (including both weights of the model and states of the optimiz…

Képzés számítás

A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.

Képzés számítás
2 × 10²² FLOP

312000000000000 FLOP/GPU/sec * 672 hours * 3600 sec / hour * 88 GPUs * 0.3 [assumed utilization] = 1.992646656e+22 FLOP

Hogyan jött létre
Hardware

A tréning futás

Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.

Képzési hardver
NVIDIA A100 SXM4 80 GB
Használt chipek
88
Fali óra idő
672 hours (28 days)

"The training takes around 28 days on 88 A100 (80GB) GPUs" 28 days = 672 hours

Teljesítményfogyasztás
70.1 kW

Elérhetőség

Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.

Súlyok
Open — downloadable
Modell hozzáférés
Open weights (unrestricted)
Képzés kód
Unreleased

AGPL-3.0 https://github.com/thu-ml/unidiffuser https://huggingface.co/thu-ml/unidiffuser-v1

Hugging Face
thu-ml

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Nyilvántartási bizalom
Confident

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
One Transformer Fits All Distributions in Multi-Modal Diffusion at Scale
Utoljára frissítve
11 February 2026

Mit jelentenek a számok

Honnan jött

UniDiffuser (多模态大模型) ki lett adva által ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI, az országban rögzítve mint China, alatt May 2023. A kiadó kategóriája alá tartozik industry,Academia,Academia.

Működik a területen a Image generation, és úgy van rögzítve, mint a feladat végrehajtása text-to-image, Image captioning, Image generation, Image-to-image.

A nyílt súlyok az okai annak, hogy ez az oldal a kalkulátorban van, és nem csak a katalógusban: ez egy olyan modell, amit valójában meg tudsz tartani. A Hugging Face-en az alábbi szervezet alatt van publikálva thu-ml.

Képzés és származás

A képzés futás körülbelül 2 × 10²² FLOP, hardveren rögzítve NVIDIA A100 SXM4 80 GB. Ez a szám azt méri, hogy mennyibe került a modell előállítása, és nincs hatással arra, hogy milyen gyorsan válaszol.

Válaszok

UniDiffuser (多模态大模型) — gyakori kérdések

01

UniDiffuser (多模态大模型)— Milyen GPU-ra van szükségem, hogy futtathassam?

Nem tudjuk megmondani. Nyílt súlyai vannak, de a paraméterek számát nem tették közzé, és minden memória- és sebességszámítás ebből a számból indul. Inkább nem mutatunk semmit, mint egy hamisított becslést.

02

UniDiffuser (多模态大模型)— Nyílt forráskódú?

Súlyai közzétételre kerültek, így letölthető és futtatható a saját hardvereden. Ne feledd, hogy az open weight nem azonos az open source teljes értelmében — nem mond semmit a tanulási adatokkal, a tanulási kóddal vagy a kereskedelmi feltételekkel kapcsolatban.

03

UniDiffuser (多模态大模型)— Hány paramétere van?

Nincs közzétéve paraméterszám, ezért ez az oldal nem tartalmaz memóriával vagy sebességgel kapcsolatos adatokat.

04

UniDiffuser (多模态大模型)— Ki készítette ezt?

Kiadta ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI, alapján China, egy szervezet, amelyet kategorizáltak mint industry,Academia,Academia.

05

UniDiffuser (多模态大模型)— Mikor adták ki?

Kibocsátották a May 2023. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.

06

UniDiffuser (多模态大模型)— Mire használják?

Működik a területen a Image generation, és rögzítve van, hogy kezeli a feladatot text-to-image, Image captioning, Image generation, Image-to-image. A modell több mindenből is képes cipelni, így ezek azok a területek, amelyekre épült, nem pedig egy korlát arra, amit meg fog próbálni.

07

UniDiffuser (多模态大模型)— Hol tudom letölteni?

Súlyait a Hugging Face-en tette közzé, a szervezet alatt thu-ml. Nem tárolunk modell fájlokat — ez az oldal kiszámolja, hogy milyen hardver szükséges a futtatásukhoz.

08

UniDiffuser (多模态大模型)— mennyi számítási kapacitást használtak annak a betanításához?

A képzés körülbelül elfogyasztott 2 × 10²² FLOP, hardveren rögzítve NVIDIA A100 SXM4 80 GB. Ez azt méri, hogy mennyibe került a modell előállítása, és semmit nem mond arról, hogy milyen gyorsan válaszol, miután betanult — a következtetési sebesség a memória sávszélességéből származik, nem az edzési költségvetésből.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 11 February 2026

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..