Llama 4 Scout + ScaleRL

Zárt súlyok Meta AI 109B Paraméterek October 2025

Nincs becslés

Nincs hardver követelmény ennek a modellnek

A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
Meta AI
Szervezet típusa
Industry
Ország
United States of America
Közölt
15 October 2025
Szerzők
Devvrit Khatri, Lovish Madaan, Rishabh Tiwari, Rachit Bansal, Sai Surya Duvvuri, Manzil Zaheer, Inderjit S. Dhillon, David Brandfonbrener, Rishabh Agarwal

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Language
Feladat
Language modeling/generation, Question answering, Code generation
Alapmodell
Llama 4 Scout

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Paraméterek
109B

17Bx16 MoE (Scout) 109B total parameters

Képzési adatok
tokens

"7100 steps for Scout" SFT. "We run SFT using a batch size of 2M tokens, max sequence length of 12288 <..> on 32 H100 GPU nodes for approximately 4 epochs and 32B tokens in total." RL. "We allocate 14k generation budget during RL training, where 12k tokens are allocated to the intermediate reasoning (“thinking”), followed by 2k tokens for the final solution and answer. We sample 48 prompts in each batch, each with 16 generations per prompt. Thus, we get the total batch size as 768 completions …

Képzés számítás

A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.

Hogyan jött létre
Hardware
Finomhangolás számítás
1.4 × 10²³ FLOP

2500000000000000 FLOP/GPU/sec [GB200 reported] * 50000 GPU-hours * 3600 sec / hour * 0.3 [assumed utilization] = 1.35e+23 FLOP

A tréning futás

Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.

Képzési hardver
NVIDIA GB200
Használt chipek
80
Chip-óra
50,000
Teljesítményfogyasztás
187.5 kW

Elérhetőség

Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.

Súlyok
Closed — provider access only
Modell hozzáférés
Unreleased
Képzés kód
Unreleased

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Nyilvántartási bizalom
Confident

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
The Art of Scaling Reinforcement Learning Compute for LLMs
Utoljára frissítve
28 November 2025

Mit jelentenek a számok

Honnan jött

Llama 4 Scout + ScaleRL ki lett adva által Meta AI, az országban rögzítve mint United States of America, alatt October 2025. A kiadó kategóriája alá tartozik industry.

Működik a területen a Language, és úgy van rögzítve, mint a feladat végrehajtása language modeling/generation, Question answering, Code generation.

A kiindulópontja egy meglévő alapmodell volt, Llama 4 Scout. Ezért osztja a bázismodell általános formáját és méretét.

Súlyait soha nem tették közzé, így csak a szolgáltatóján keresztül érhető el. Nincs grafikus kártya, ami ezt megváltoztatná.

Válaszok

Llama 4 Scout + ScaleRL — gyakori kérdések

01

Llama 4 Scout + ScaleRL— Hány paramétere van?

Paraméterszáma 109B. 17Bx16 MoE (Scout) 109B total parameters. Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.

02

Llama 4 Scout + ScaleRL— Ki készítette ezt?

Kiadta Meta AI, alapján United States of America, egy szervezet, amelyet kategorizáltak mint industry.

03

Llama 4 Scout + ScaleRL— Mikor adták ki?

Kibocsátották a October 2025.

04

Llama 4 Scout + ScaleRL— Mire használják?

Működik a területen a Language, és rögzítve van, hogy kezeli a feladatot language modeling/generation, Question answering, Code generation. A modellek gyakran több mint egyet hordoznak mindegyikből, és a címkék a célra, nem pedig a képességek határaira utalnak.

05

Llama 4 Scout + ScaleRL— Milyen GPU-ra van szükségem, hogy futtathassam?

Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.

06

Llama 4 Scout + ScaleRL— Nyílt forráskódú?

Nem. A súlyai nincsenek közzétéve, így csak a tulajdonosa által ellenőrzött szolgáltatásként létezik.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 28 November 2025

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..