Llama-3.1-Nemotron-70B-Instruct

Nyitott súlyok NVIDIA,Meta AI June 2024

Nincs becslés

Nincs hardver követelmény ennek a modellnek

Ez a modell súlyai nyilvánosak, de a paraméterszámokat nem tették közzé. Minden memória- és sebességszám ebből a számból indul, ezért inkább nem mutatunk semmit, mint egy hamisított becslést..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
NVIDIA,Meta AI
Szervezet típusa
Industry,Industry
Ország
United States of America
Közölt
12 June 2024
Szerzők
Zhilin Wang, Yi Dong, Olivier Delalleau, Jiaqi Zeng, Gerald Shen, Daniel Egert, Jimmy Zhang, Makesh Narsimhan Sreedhar, Oleksii Kuchaiev

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Language
Feladat
Language modeling
Megközelítés
Reinforcement learning
Alapmodell
Llama 3.1-70B

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Képzési adatok
tokens

Képzés számítás

A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.

Képzés számítás
7.9 × 10²⁴ FLOP

Taken from Llama 3.1 70B as the finetuning compute is multiple orders of magnitude lower

Hogyan jött létre
Hardware
Finomhangolás számítás
1 × 10²⁰ FLOP

Llama 3.1 70B: 7.929e+24 FT (see Appendix F): 32+64=96 hours on a single H100 Compute: 96*60*60*989500000000000*0.3=102591360000000000000=1e20

A tréning futás

Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.

Fali óra idő
96 hours

Elérhetőség

Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.

Súlyok
Open — downloadable
Modell hozzáférés
Open weights (restricted use)
Képzés kód
Unreleased

Your use of this model is governed by the NVIDIA Open Model License. Additional Information: Llama 3.1 Community License Agreement (branding restrictions + cap size of 700M MAu for commercial use). https://huggingface.co/nvidia/Llama-3.1-Nemotron-70B-Instruct-HF

Hugging Face
nvidia

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Valószínűleg 10²³ FLOP felett
Yes
Miért követik nyomon
SOTA improvement

"As of 1 Oct 2024, Llama-3.1-Nemotron-70B-Instruct performs best on Arena Hard, AlpacaEval 2 LC (verified tab) and MT Bench (GPT-4-Turbo)"

Nyilvántartási bizalom
Confident

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
https://www.semanticscholar.org/paper/HelpSteer2%3A-Open-source-dataset-for-training-reward-Wang-Dong/f590d8926dd12345a3bd22253461850f5ca4b3ed
Utoljára frissítve
28 November 2025

Mit jelentenek a számok

Mit jelent ez a modell

Llama-3.1-Nemotron-70B-Instruct ki lett adva által NVIDIA,Meta AI, az országban rögzítve mint United States of America, alatt June 2024. A kiadó kategóriája alá tartozik industry,Industry.

Működik a területen a Language, és úgy van rögzítve, mint a feladat végrehajtása language modeling.

Ahelyett, hogy nulláról lenne betanítva, az származik Llama 3.1-70B. Ez a szokásos módja egy specializált modell előállításának.

Mivel a súlyai ki lettek adva, semmi sem függ attól, hogy egy szolgáltató elérhető marad-e - a tiéd, amint letöltötted. A Hugging Face-en az alábbi szervezet alatt van publikálva nvidia.

Képzés és származás

A létrehozásához körülbelül összesítő aritmetikára volt szükség. 7.9 × 10²⁴ FLOP. Ez a szám azt méri, hogy mennyibe került a modell előállítása, és nincs hatással arra, hogy milyen gyorsan válaszol.

Az oka, hogy egyáltalán megjelenik ebben a katalógusban: sOTA improvement.

Válaszok

Llama-3.1-Nemotron-70B-Instruct — gyakori kérdések

01

Llama-3.1-Nemotron-70B-Instruct— Milyen GPU-ra van szükségem, hogy futtathassam?

Nem tudjuk megmondani. Nyílt súlyai vannak, de a paraméterek számát nem tették közzé, és minden memória- és sebességszámítás ebből a számból indul. Inkább nem mutatunk semmit, mint egy hamisított becslést.

02

Llama-3.1-Nemotron-70B-Instruct— Nyílt forráskódú?

Súlyai közzétételre kerültek, így letölthető és futtatható a saját hardvereden. Ne feledd, hogy az open weight nem azonos az open source teljes értelmében — nem mond semmit a tanulási adatokkal, a tanulási kóddal vagy a kereskedelmi feltételekkel kapcsolatban.

03

Llama-3.1-Nemotron-70B-Instruct— Hány paramétere van?

Nincs közzétéve paraméterszám, ezért ez az oldal nem tartalmaz memóriával vagy sebességgel kapcsolatos adatokat.

04

Llama-3.1-Nemotron-70B-Instruct— Ki készítette ezt?

Kiadta NVIDIA,Meta AI, alapján United States of America, egy szervezet, amelyet kategorizáltak mint industry,Industry.

05

Llama-3.1-Nemotron-70B-Instruct— Mikor adták ki?

Kibocsátották a June 2024. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.

06

Llama-3.1-Nemotron-70B-Instruct— Mire használják?

Működik a területen a Language, és rögzítve van, hogy kezeli a feladatot language modeling. A modellek gyakran több mint egyet hordoznak mindegyikből, és a címkék a célra, nem pedig a képességek határaira utalnak.

07

Llama-3.1-Nemotron-70B-Instruct— Hol tudom letölteni?

Súlyait a Hugging Face-en tette közzé, a szervezet alatt nvidia. Nem tárolunk modell fájlokat — ez az oldal kiszámolja, hogy milyen hardver szükséges a futtatásukhoz.

08

Llama-3.1-Nemotron-70B-Instruct— mennyi számítási kapacitást használtak annak a betanításához?

A képzés körülbelül elfogyasztott 7.9 × 10²⁴ FLOP. Ez azt méri, hogy mennyibe került a modell előállítása, és semmit nem mond arról, hogy milyen gyorsan válaszol, miután betanult — a következtetési sebesség a memória sávszélességéből származik, nem az edzési költségvetésből.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 28 November 2025

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..