AlphaStar

Κλειστές βαρύτητες DeepMind 139M παράμετροι October 2019

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
DeepMind
Τύπος οργανισμού
Industry
Χώρα
United Kingdom of Great Britain and Northern Ireland
Δημοσιευμένο
30 October 2019
Συγγραφείς
Oriol Vinyals,Igor Babuschkin,Wojciech M. Czarnecki,Michaël Mathieu,Andrew Dudzik,Junyoung Chung,David H. Choi,Richard Powell,Timo Ewalds,Petko Georgiev,Junhyuk Oh,Dan Horgan,Manuel Kroiss,Ivo Danihelka,Aja Huang,Laurent Sifre,Trevor Cai,John P. Agapiou,Max Jaderberg,Alexander S. Vezhnevets,Rémi Leblond,Tobias Pohlen,Valentin Dalibard,David Budden,Yury Sulsky,James Molloy,Tom L. Paine,Caglar Gulce…

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Games
Εργασία
StarCraft

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
139M

AlphaStar has 139 million weights, but only 55 million weights are required during inference.

Δεδομένα εκπαίδευσης
tokens

Multiple data types. First supervised learning, then other stuff

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Εκπαίδευση υπολογιστών
1.1 × 10²³ FLOP

(Estimate by James Sanders, checked by Robi Rahman) Fig 6 indicates that the learner uses 16 TPU "devices" which are 128 TPU cores total, which matches 4 TPUs per device, and 2 cores per TPU. Fig 6 indicates that 64 TPUs are used for training, and 64 are used for inference. (128 TPUs)*(12 agents)*(44 days)*(123 TFLOPS)*(0.3 utilization) = 2.15e23 FLOP (total), of which 1.07e23 FLOP are for training.

Πώς ιδρύθηκε
Hardware

Η εκπαίδευση run

Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.

Υλικό εκπαίδευσης
Google TPU v3
χρησιμοποιούμενα τσιπ
384
Τσιπ-ώρες
405,504
Χρόνος τοίχου
1,056 hours (44 days)

"Each agent was trained using 32 third-generation tensor processing units (TPUs) over 44 days"

Κατανάλωση ενέργειας
354.2 kW
Κόστος υπολογισμού
$130,654

Διαθεσιμότητα

Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.

Βάρη
Closed — provider access only
Πρόσβαση μοντέλου
Unreleased
Κωδικός εκπαίδευσης
Open source

Apache 2.0, training tools: https://github.com/google-deepmind/alphastar training instructions here: https://github.com/google-deepmind/alphastar/blob/main/alphastar/unplugged/README.md

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Μοντέλο Frontier
Yes
Γιατί παρακολουθείται
Discretionary
Εγγραφή εμπιστοσύνης
Confident
Παραπομπές
4,093

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
Grandmaster level in StarCraft II using multi-agent reinforcement learning
Τελευταία ενημέρωση
1 January 2026

Τι σημαίνουν οι αριθμοί

Υπόβαθρο

AlphaStar δημοσιεύθηκε από DeepMind, στην χώρα καταγεγραμμένη ως United Kingdom of Great Britain and Northern Ireland, κατά τη διάρκεια October 2019. Προέρχεται από έναν οργανισμό που κατατάσσεται ως industry.

Λειτουργεί στον τομέα της Games, και καταγράφεται ότι εκτελεί την εργασία του starCraft.

Αυτό είναι ένα κλειστό μοντέλο: οι εκπαιδευμένες τιμές παρέμειναν με όποιον τις παρήγαγε, και δεν υπάρχει τοπική έκδοση για να τρέξει.

Πώς εκπαιδεύτηκε

Η εκπαιδευτική εκτέλεση καταναλώνει περίπου 1.1 × 10²³ FLOP, σε υλικό καταγεγραμμένο ως Google TPU v3. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.

Το κριτήριο συμπερασμού του: discretionary.

Απαντήσεις

AlphaStar — κοινές ερωτήσεις

01

AlphaStar— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Games, και καταγράφεται ως διαχείριση της εργασίας του starCraft. Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

02

AlphaStar— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;

Η εκπαίδευση κατανάλωσε περίπου 1.1 × 10²³ FLOP, σε υλικό καταγεγραμμένο ως Google TPU v3. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.

03

AlphaStar— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

04

AlphaStar— είναι ανοιχτού κώδικα;

Όχι. Τα βάρη του δεν έχουν δημοσιευθεί, οπότε υπάρχει μόνο ως υπηρεσία που ελέγχεται από τον ιδιοκτήτη του.

05

AlphaStar— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 139M. AlphaStar has 139 million weights, but only 55 million weights are required during inference. Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

06

AlphaStar— ποιος το δημιούργησε;

Δημοσιεύθηκε από DeepMind, βασισμένο σε United Kingdom of Great Britain and Northern Ireland, μία οργάνωση κατηγοριοποιημένη ως industry.

07

AlphaStar— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε October 2019. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 1 January 2026

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.