UniDiffuser (多模态大模型)
Καμία εκτίμηση
Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο
Τα βάρη αυτού του μοντέλου είναι OPEN, αλλά κανένας αριθμός παραμέτρων δεν έχει δημοσιευθεί γι' αυτό. Κάθε FIGURE μνήμης και ταχύτητας ξεκινά από αυτόν τον αριθμό, οπότε θα προτιμούσαμε να μην δείξουμε τίποτα παρά μια κατασκευασμένη εκτίμηση..
Σε καταγραφή
Πλήρης προδιαγραφή
Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..
Προέλευση
Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.
- Οργάνωση
- ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI
- Τύπος οργανισμού
- Industry,Academia,Academia
- Χώρα
- China
- Δημοσιευμένο
- 30 May 2023
- Συγγραφείς
- Fan Bao, Shen Nie, Kaiwen Xue, Chongxuan Li, Shi Pu, Yaole Wang, Gang Yue, Yue Cao, Hang Su, Jun Zhu
Τι κάνει
Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.
- τομέας
- Image generation
- Εργασία
- Text-to-image, Image captioning, Image generation, Image-to-image
Μέγεθος
Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.
- Δεδομένα εκπαίδευσης
- tokens
"The training is multiple-staged following Stable Diffusion (Rombach et al., 2022). In the first stage, we train 250K steps at 256×256 resolution on laion2B-en with a batch size of 11264 and 5K warm-up steps. In the second stage, we fine-tune the model with 200K steps at 512×512 resolution on laion-high-resolution with a batch size of 2112 and 5K warm-up steps. In the last stage, we resume from the last checkpoint of the second stage (including both weights of the model and states of the optimiz…
Εκπαίδευση υπολογιστών
Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.
- Εκπαίδευση υπολογιστών
- 2 × 10²² FLOP
- Πώς ιδρύθηκε
- Hardware
312000000000000 FLOP/GPU/sec * 672 hours * 3600 sec / hour * 88 GPUs * 0.3 [assumed utilization] = 1.992646656e+22 FLOP
Η εκπαίδευση run
Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.
- Υλικό εκπαίδευσης
- NVIDIA A100 SXM4 80 GB
- χρησιμοποιούμενα τσιπ
- 88
- Χρόνος τοίχου
- 672 hours (28 days)
- Κατανάλωση ενέργειας
- 70.1 kW
"The training takes around 28 days on 88 A100 (80GB) GPUs" 28 days = 672 hours
Διαθεσιμότητα
Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.
- Βάρη
- Open — downloadable
- Πρόσβαση μοντέλου
- Open weights (unrestricted)
- Κωδικός εκπαίδευσης
- Unreleased
- Αγκαλιάζοντας το Πρόσωπο
- thu-ml
AGPL-3.0 https://github.com/thu-ml/unidiffuser https://huggingface.co/thu-ml/unidiffuser-v1
Πώς ταξινομείται
Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.
- Εγγραφή εμπιστοσύνης
- Confident
Πηγές
Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.
- Αναφορά
- One Transformer Fits All Distributions in Multi-Modal Diffusion at Scale
- Τελευταία ενημέρωση
- 11 February 2026
Τι σημαίνουν οι αριθμοί
Από πού προήλθε
UniDiffuser (多模态大模型) δημοσιεύθηκε από ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI, στην χώρα καταγεγραμμένη ως China, κατά τη διάρκεια May 2023. Η κατηγορία στην οποία υπάγεται ο εκδότης είναι industry,Academia,Academia.
Λειτουργεί στον τομέα της Image generation, και καταγράφεται ότι εκτελεί την εργασία του text-to-image, Image captioning, Image generation, Image-to-image.
Τα ανοιχτά βάρη είναι αυτά που τοποθετούν αυτή τη σελίδα στον υπολογιστή αντί να είναι μόνο στον κατάλογο: είναι ένα μοντέλο που μπορείς να κρατήσεις πραγματικά. Στο Hugging Face δημοσιεύεται υπό την οργάνωση thu-ml.
Εκπαίδευση και προελεύσεις
Η εκπαιδευτική εκτέλεση καταναλώνει περίπου 2 × 10²² FLOP, σε υλικό καταγεγραμμένο ως NVIDIA A100 SXM4 80 GB. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.
Απαντήσεις
UniDiffuser (多模态大模型) — κοινές ερωτήσεις
UniDiffuser (多模态大模型)— ποια GPU χρειάζομαι για να το τρέξω;
Δεν μπορούμε να πούμε. Έχει OPEN WEIGHTS, αλλά δεν έχει δημοσιευτεί καμία μέτρηση παραμέτρων για αυτό, και όλοι οι υπολογισμοί ΜΝΗΜΗΣ και ταχύτητας ξεκινούν από αυτόν τον αριθμό. Θα προτιμούσαμε να μην δείξουμε τίποτα από το να δώσουμε μια κατασκευασμένη εκτίμηση.
UniDiffuser (多模态大模型)— είναι ανοιχτού κώδικα;
Οι βάσεις του είναι δημοσιευμένες, οπότε μπορεί να κατέβει και να τρέξει σε δικό σας υλικό. Σημειώστε ότι τα open weights δεν είναι το ίδιο με το open source με την πλήρη έννοια — δεν λέει τίποτα για τα δεδομένα εκπαίδευσης, τον κώδικα εκπαίδευσης ή τους εμπορικούς όρους που συσχετίζονται.
UniDiffuser (多模态大模型)— πόσες παραμέτρους έχει;
Δεν έχει δημοσιευθεί αριθμός παραμέτρων γι' αυτό, γι' αυτό και δεν εμφανίζεται καμία τιμή μνήμης ή ταχύτητας σε αυτή τη σελίδα.
UniDiffuser (多模态大模型)— ποιος το δημιούργησε;
Δημοσιεύθηκε από ShengShu,Tsinghua University,Beijing Academy of Artificial Intelligence / BAAI, βασισμένο σε China, μία οργάνωση κατηγοριοποιημένη ως industry,Academia,Academia.
UniDiffuser (多模态大模型)— πότε κυκλοφόρησε;
Δημοσιεύθηκε σε May 2023. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.
UniDiffuser (多模态大模型)— για τί χρησιμοποιείται;
Λειτουργεί στον τομέα της Image generation, και καταγράφεται ως διαχείριση της εργασίας του text-to-image, Image captioning, Image generation, Image-to-image. Ένα ΜΟΝΤΕΛ μπορεί να φέρει πολλά από το καθένα, οπότε αυτές είναι οι περιοχές για τις οποίες κατασκευάστηκε παρά περιορισμός σε ό,τι θα προσπαθήσει.
UniDiffuser (多模态大模型)— πού μπορώ να το κατεβάσω;
Τα βάρη του είναι δημοσιευμένα στο Hugging Face, υπό την οργάνωση thu-ml. Δεν φιλοξενούμε αρχεία μοντέλων — αυτός ο ιστότοπος υπολογίζει ποιο υλικό απαιτείται για να τα εκτελέσετε.
UniDiffuser (多模态大模型)— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;
Η εκπαίδευση κατανάλωσε περίπου 2 × 10²² FLOP, σε υλικό καταγεγραμμένο ως NVIDIA A100 SXM4 80 GB. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.
Η άλλη κατεύθυνση
Κοιτάζοντας το από την άλλη πλευρά;
Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.