UniDiffuser (多模态大模型)

Apri i pesi ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI May 2023

Nessuna stima

Nessun requisito hardware per questo modello

I pesi di questo modello sono open weight, ma non è stato pubblicato alcun conteggio dei parametri. Ogni figura di memory e velocità parte da quel numero, quindi preferiremmo non mostrare nulla piuttosto che una stima fabbricata..

In registrazione

specifiche complete

Tutto in archivio per questo modello. La maggior parte descrive come è stato addestrato piuttosto che come gira — contesto utile per giudicare quanto lavoro c'è stato dietro, e come si confronta con i modelli costruiti su una scala diversa..

Origine

Chi ha costruito questo modello, dove e quando è stato pubblicato.

Organizzazione
ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI
Tipo di organizzazione
Industry,Academia,Academia
Paese
China
Pubblicato
30 May 2023
Autori
Fan Bao, Shen Nie, Kaiwen Xue, Chongxuan Li, Shi Pu, Yaole Wang, Gang Yue, Yue Cao, Hang Su, Jun Zhu

Cosa fa

Le aree problematiche per cui è stato progettato il modello. Un modello può contenere diversi di ciascuno.

Dominio
Image generation
Compito
Text-to-image, Image captioning, Image generation, Image-to-image

Dimensione

Quanto è grande il modello e su quanti dati è stato addestrato. I parametri sono la cifra che decide se si adatta a una determinata scheda grafica.

Dati di addestramento
tokens

"The training is multiple-staged following Stable Diffusion (Rombach et al., 2022). In the first stage, we train 250K steps at 256×256 resolution on laion2B-en with a batch size of 11264 and 5K warm-up steps. In the second stage, we fine-tune the model with 200K steps at 512×512 resolution on laion-high-resolution with a batch size of 2112 and 5K warm-up steps. In the last stage, we resume from the last checkpoint of the second stage (including both weights of the model and states of the optimiz…

Calcolo di addestramento

L'aritmetica eseguita per addestrare il modello, misurata in operazioni in virgola mobile. È una misura di quanto è costato il run di addestramento, e non di quanto velocemente il modello finito ti risponde.

Calcolo di addestramento
2 × 10²² FLOP

312000000000000 FLOP/GPU/sec * 672 hours * 3600 sec / hour * 88 GPUs * 0.3 [assumed utilization] = 1.992646656e+22 FLOP

Come è stato stabilito
Hardware

La corsa di addestramento

Cosa ha richiesto fisicamente per addestrare: quali chip, quanti, per quanto tempo e cosa ha prelevato dalla presa.

Hardware di addestramento
NVIDIA A100 SXM4 80 GB
Chip utilizzati
88
Tempo di parete
672 hours (28 days)

"The training takes around 28 days on 88 A100 (80GB) GPUs" 28 days = 672 hours

Consumo energetico
70.1 kW

Disponibilità

Se puoi ottenere il modello e farlo funzionare sul tuo hardware, il che decide se alcune delle cifre della scheda grafica su questa pagina sono applicabili.

Pesi
Open — downloadable
Accesso al modello
Open weights (unrestricted)
Codice di addestramento
Unreleased

AGPL-3.0 https://github.com/thu-ml/unidiffuser https://huggingface.co/thu-ml/unidiffuser-v1

Hugging Face
thu-ml

Come è classificato

Etichette del dataset sorgente si applicano quando si tracciano modelli notevoli, e quanto è sicuro nell'entry.

Record fiducia
Confident

Fonti

Da dove proviene questo record e quando è stato controllato l'ultima volta.

Riferimento
One Transformer Fits All Distributions in Multi-Modal Diffusion at Scale
Ultimo aggiornamento
11 February 2026

Cosa significano i numeri

Da dove è venuto

UniDiffuser (多模态大模型) è stato pubblicato da ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI, nel paese registrato come China, durante May 2023. La categoria sotto cui rientra l'editore è industry,Academia,Academia.

Funziona nel dominio di Image generation, ed è registrato come eseguire il compito di text-to-image, Image captioning, Image generation, Image-to-image.

I pesi aperti sono ciò che mette questa pagina nel calcolatore piuttosto che solo nel catalogo: è un modello che puoi effettivamente tenere. Su Hugging Face è pubblicato sotto l'organizzazione thu-ml.

Addestramento e provenienza

Il run di addestramento ha consumato circa 2 × 10²² FLOP, su hardware registrato come NVIDIA A100 SXM4 80 GB. Quella cifra misura quanto è costata la produzione del modello e non ha alcun impatto su quanto velocemente risponde.

Risposte

UniDiffuser (多模态大模型) — domande comuni

01

UniDiffuser (多模态大模型)— che GPU ho bisogno per eseguirlo?

Non possiamo dire. Ha pesi aperti, ma non è stato pubblicato alcun conteggio dei parametri per esso, e ogni calcolo di memoria e velocità parte da quel numero. Preferiremmo non mostrare nulla piuttosto che una stima fabbricata.

02

UniDiffuser (多模态大模型)— è open-source?

I suoi pesi sono pubblicati, quindi può essere scaricato e eseguito sul proprio hardware. Si noti che OPEN WEIGHTS non è lo stesso di OPEN SOURCE nel senso completo — non dice nulla sui dati di addestramento, sul codice di addestramento o sui termini commerciali allegati.

03

UniDiffuser (多模态大模型)— quanti parametri ha?

Non è stato pubblicato alcun conteggio dei parametri per esso, motivo per cui non appare alcun dato sulla memoria o sulla velocità su questa pagina.

04

UniDiffuser (多模态大模型)— chi l'ha creato?

È stato pubblicato da ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI, basato su China, un'organizzazione categorizzata come industry,Academia,Academia.

05

UniDiffuser (多模态大模型)— quando è stato rilasciato?

È stato pubblicato in May 2023. La capacità per parametro è migliorata considerevolmente da allora, quindi un modello più recente della stessa dimensione è spesso un uso migliore dello stesso hardware.

06

UniDiffuser (多模态大模型)— A cosa serve?

Funziona nel dominio di Image generation, e viene registrato come gestire il compito di text-to-image, Image captioning, Image generation, Image-to-image. Un modello può gestire diversi di ciascuno, quindi queste sono le aree per cui è stato costruito piuttosto che un limite su ciò che tenterà.

07

UniDiffuser (多模态大模型)— Dove posso scaricarlo?

I suoi pesi sono pubblicati su Hugging Face, sotto l'organizzazione thu-ml. Non ospitiamo file di modelli — questo sito calcola quale hardware è necessario per eseguirli.

08

UniDiffuser (多模态大模型)— quanto calcolo è stato utilizzato per addestrarlo?

L'addestramento ha consumato circa 2 × 10²² FLOP, su hardware registrato come NVIDIA A100 SXM4 80 GB. Questo misura quanto costa produrre il modello e non dice nulla su quanto rapidamente risponde una volta addestrato — la velocità di inferenza deriva dalla larghezza di banda della memoria, non dal budget di addestramento.

Fonte

Pubblicazione originale

Ultimo aggiornamento del record 11 February 2026

L'altra direzione

Guardandolo dall'altro lato?

Questa pagina parte dal modello. Se possiedi già una scheda e vuoi sapere tutto ciò che farà funzionare, inizia dall'hardware invece.