Stable Video Diffusion

Ανοιχτά βάρη Stability AI November 2023

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Τα βάρη αυτού του μοντέλου είναι OPEN, αλλά κανένας αριθμός παραμέτρων δεν έχει δημοσιευθεί γι' αυτό. Κάθε FIGURE μνήμης και ταχύτητας ξεκινά από αυτόν τον αριθμό, οπότε θα προτιμούσαμε να μην δείξουμε τίποτα παρά μια κατασκευασμένη εκτίμηση..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
Stability AI
Τύπος οργανισμού
Industry
Χώρα
United Kingdom of Great Britain and Northern Ireland
Δημοσιευμένο
25 November 2023
Συγγραφείς
Andreas Blattmann, Tim Dockhorn, Sumith Kulal, Daniel Mendelevitch, Maciej Kilian, Dominik Lorenz, Yam Levi, Zion English, Vikram Voleti, Adam Letts, Varun Jampani, Robin Rombach

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Image generation, Video
Εργασία
Image generation, Video generation, Text-to-video, Image-to-video

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

Δεδομένα εκπαίδευσης
tokens

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Εκπαίδευση υπολογιστών
6.7 × 10²² FLOP

312000000000000 FLOP / GPU / sec [bf16 assumed] * 200000 GPU-hours * 3600 sec / hour * 0.3 [assumed utilization] = 6.7392e+22 FLOP

Πώς ιδρύθηκε
Hardware

Η εκπαίδευση run

Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.

Υλικό εκπαίδευσης
NVIDIA A100 SXM4 80 GB
χρησιμοποιούμενα τσιπ
384
Τσιπ-ώρες
200,000
Κατανάλωση ενέργειας
304.6 kW

Διαθεσιμότητα

Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.

Βάρη
Open — downloadable
Πρόσβαση μοντέλου
Open weights (restricted use)
Κωδικός εκπαίδευσης
Open (non-commercial)

https://huggingface.co/stabilityai/stable-video-diffusion-img2vid-xt Community License: Free for research, non-commercial, and commercial use by organizations and individuals generating annual revenue of US $1,000,000 (or local currency equivalent) or less, regardless of the source of that revenue. https://github.com/Stability-AI/generative-models

Αγκαλιάζοντας το Πρόσωπο
stabilityai

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Πιθανώς πάνω από 10²³ FLOP
Yes
Εγγραφή εμπιστοσύνης
Confident

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets
Τελευταία ενημέρωση
28 November 2025

Τι σημαίνουν οι αριθμοί

Σχετικά με αυτό το μοντέλο

Stable Video Diffusion δημοσιεύθηκε από Stability AI, στην χώρα καταγεγραμμένη ως United Kingdom of Great Britain and Northern Ireland, κατά τη διάρκεια November 2023. Η κατηγορία στην οποία υπάγεται ο εκδότης είναι industry.

Λειτουργεί στον τομέα της Image generation, Video, και καταγράφεται ότι εκτελεί την εργασία του image generation, Video generation, Text-to-video, Image-to-video.

Οι δημοσιευμένοι σταθμισμένοι παράμετροι σημαίνουν ότι το μοντέλο εκτελείται στον υπολογιστή σας αντί για κάποιου άλλου, το οποίο είναι αυτό που καθιστά την ερώτηση για το υλικό παρακάτω απαντήσιμη σε κάθε περίπτωση. Στο Hugging Face δημοσιεύεται υπό την οργάνωση stabilityai.

Εκπαίδευση και προελεύσεις

Η εκπαίδευση απαιτούσε έναν υπολογιστικό προϋπολογισμό περίπου 6.7 × 10²² FLOP, σε υλικό καταγεγραμμένο ως NVIDIA A100 SXM4 80 GB. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.

Απαντήσεις

Stable Video Diffusion — κοινές ερωτήσεις

01

Stable Video Diffusion— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Image generation, Video, και καταγράφεται ως διαχείριση της εργασίας του image generation, Video generation, Text-to-video, Image-to-video. Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

02

Stable Video Diffusion— πού μπορώ να το κατεβάσω;

Τα βάρη του είναι δημοσιευμένα στο Hugging Face, υπό την οργάνωση stabilityai. Δεν φιλοξενούμε αρχεία μοντέλων — αυτός ο ιστότοπος υπολογίζει ποιο υλικό απαιτείται για να τα εκτελέσετε.

03

Stable Video Diffusion— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;

Η εκπαίδευση κατανάλωσε περίπου 6.7 × 10²² FLOP, σε υλικό καταγεγραμμένο ως NVIDIA A100 SXM4 80 GB. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.

04

Stable Video Diffusion— ποια GPU χρειάζομαι για να το τρέξω;

Δεν μπορούμε να πούμε. Έχει OPEN WEIGHTS, αλλά δεν έχει δημοσιευτεί καμία μέτρηση παραμέτρων για αυτό, και όλοι οι υπολογισμοί ΜΝΗΜΗΣ και ταχύτητας ξεκινούν από αυτόν τον αριθμό. Θα προτιμούσαμε να μην δείξουμε τίποτα από το να δώσουμε μια κατασκευασμένη εκτίμηση.

05

Stable Video Diffusion— είναι ανοιχτού κώδικα;

Οι βάσεις του είναι δημοσιευμένες, οπότε μπορεί να κατέβει και να τρέξει σε δικό σας υλικό. Σημειώστε ότι τα open weights δεν είναι το ίδιο με το open source με την πλήρη έννοια — δεν λέει τίποτα για τα δεδομένα εκπαίδευσης, τον κώδικα εκπαίδευσης ή τους εμπορικούς όρους που συσχετίζονται.

06

Stable Video Diffusion— πόσες παραμέτρους έχει;

Δεν έχει δημοσιευθεί αριθμός παραμέτρων γι' αυτό, γι' αυτό και δεν εμφανίζεται καμία τιμή μνήμης ή ταχύτητας σε αυτή τη σελίδα.

07

Stable Video Diffusion— ποιος το δημιούργησε;

Δημοσιεύθηκε από Stability AI, βασισμένο σε United Kingdom of Great Britain and Northern Ireland, μία οργάνωση κατηγοριοποιημένη ως industry.

08

Stable Video Diffusion— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε November 2023. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 28 November 2025

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.