Llama 4 Scout + ScaleRL

Κλειστές βαρύτητες Meta AI 109B παράμετροι October 2025

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
Meta AI
Τύπος οργανισμού
Industry
Χώρα
United States of America
Δημοσιευμένο
15 October 2025
Συγγραφείς
Devvrit Khatri, Lovish Madaan, Rishabh Tiwari, Rachit Bansal, Sai Surya Duvvuri, Manzil Zaheer, Inderjit S. Dhillon, David Brandfonbrener, Rishabh Agarwal

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Language
Εργασία
Language modeling/generation, Question answering, Code generation
Βασικό μοντέλο
Llama 4 Scout

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
109B

17Bx16 MoE (Scout) 109B total parameters

Δεδομένα εκπαίδευσης
tokens

"7100 steps for Scout" SFT. "We run SFT using a batch size of 2M tokens, max sequence length of 12288 <..> on 32 H100 GPU nodes for approximately 4 epochs and 32B tokens in total." RL. "We allocate 14k generation budget during RL training, where 12k tokens are allocated to the intermediate reasoning (“thinking”), followed by 2k tokens for the final solution and answer. We sample 48 prompts in each batch, each with 16 generations per prompt. Thus, we get the total batch size as 768 completions …

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Πώς ιδρύθηκε
Hardware
Ρύθμιση υπολογιστών
1.4 × 10²³ FLOP

2500000000000000 FLOP/GPU/sec [GB200 reported] * 50000 GPU-hours * 3600 sec / hour * 0.3 [assumed utilization] = 1.35e+23 FLOP

Η εκπαίδευση run

Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.

Υλικό εκπαίδευσης
NVIDIA GB200
χρησιμοποιούμενα τσιπ
80
Τσιπ-ώρες
50,000
Κατανάλωση ενέργειας
187.5 kW

Διαθεσιμότητα

Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.

Βάρη
Closed — provider access only
Πρόσβαση μοντέλου
Unreleased
Κωδικός εκπαίδευσης
Unreleased

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Εγγραφή εμπιστοσύνης
Confident

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
The Art of Scaling Reinforcement Learning Compute for LLMs
Τελευταία ενημέρωση
28 November 2025

Τι σημαίνουν οι αριθμοί

Από πού προήλθε

Llama 4 Scout + ScaleRL δημοσιεύθηκε από Meta AI, στην χώρα καταγεγραμμένη ως United States of America, κατά τη διάρκεια October 2025. Η κατηγορία στην οποία υπάγεται ο εκδότης είναι industry.

Λειτουργεί στον τομέα της Language, και καταγράφεται ότι εκτελεί την εργασία του language modeling/generation, Question answering, Code generation.

Το σημείο εκκίνησής του ήταν ένα υπάρχον μοντέλο βάσης, Llama 4 Scout. Γι' αυτό μοιράζεται τη γενική μορφή και μέγεθος του βασικού μοντέλου.

Τα βάρη του δεν έχουν δημοσιευθεί ποτέ, οπότε μπορεί να προσεγγιστεί μόνο μέσω του παρόχου του. Καμία κάρτα γραφικών δεν αλλάζει αυτό.

Απαντήσεις

Llama 4 Scout + ScaleRL — κοινές ερωτήσεις

01

Llama 4 Scout + ScaleRL— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 109B. 17Bx16 MoE (Scout) 109B total parameters. Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

02

Llama 4 Scout + ScaleRL— ποιος το δημιούργησε;

Δημοσιεύθηκε από Meta AI, βασισμένο σε United States of America, μία οργάνωση κατηγοριοποιημένη ως industry.

03

Llama 4 Scout + ScaleRL— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε October 2025.

04

Llama 4 Scout + ScaleRL— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Language, και καταγράφεται ως διαχείριση της εργασίας του language modeling/generation, Question answering, Code generation. Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

05

Llama 4 Scout + ScaleRL— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

06

Llama 4 Scout + ScaleRL— είναι ανοιχτού κώδικα;

Όχι. Τα βάρη του δεν έχουν δημοσιευθεί, οπότε υπάρχει μόνο ως υπηρεσία που ελέγχεται από τον ιδιοκτήτη του.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 28 November 2025

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.