Reka Core

Zárt súlyok Reka AI 67B Paraméterek April 2024

Nincs becslés

Nincs hardver követelmény ennek a modellnek

A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..

Nyilvántartásban

Teljes specifikáció

Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..

Eredet

Ki építette ezt a modellt, hol, és mikor publikálták.

Szervezet
Reka AI
Szervezet típusa
Industry
Ország
United States of America
Közölt
15 April 2024
Szerzők
Aitor Ormazabal, Che Zheng, Cyprien de Masson d'Autume, Dani Yogatama, Deyu Fu, Donovan Ong, Eric Chen, Eugenie Lamprecht, Hai Pham, Isaac Ong, Kaloyan Aleksiev, Lei Li, Matthew Henderson, Max Bain, Mikel Artetxe, Nishant Relan, Piotr Padlewski, Qi Liu, Ren Chen, Samuel Phua, Yazheng Yang, Yi Tay, Yuqi Wang, Zhongkai Zhu, Zhihui Xie

Mit csinál

A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.

Tartomány
Multimodal, Language, Vision, Video, Speech
Feladat
Chat, Language modeling/generation, Image captioning, Code generation, Code autocompletion, Question answering, Visual question answering, Video description, Speech recognition (ASR), Speech-to-text, Quantitative reasoning
Numerikus formátum
BF16

Méret

Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.

Paraméterek
67B
Képzési adatok
tokens

Képzés számítás

A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.

Képzés számítás
8.4 × 10²⁴ FLOP

No direct information about Reka Core model ("Reka Core has not finished training and is still improving.") The smaller dense model Reka Flash has 21B parameters and was trained on 5 trillion language tokens. There is information about compute: "Our setup comprises of clusters from a mixture of vendors with our peak compute being approximately 2.5K H100s and 2.5K A100s." If we assume 2 months of training with 2.5k H100s and 2.5k A100s at utilization 0.5 we get 8.4e24 FLOP (2500*9.9e14+2500*3.…

Hogyan jött létre
Hardware
Plauzibilis tartomány
6.3 × 10²³ – 2.7 × 10²⁶ FLOP

A tréning futás

Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.

Képzési hardver
NVIDIA A100,NVIDIA H100 SXM5 80GB

Elérhetőség

Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.

Súlyok
Closed — provider access only
Modell hozzáférés
API access
Képzés kód
Unreleased

Hogyan van besorolva

Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.

Valószínűleg 10²³ FLOP felett
Yes
Miért követik nyomon
Training cost
Nyilvántartási bizalom
Speculative

Források

Honnan származik ez a felvétel és mikor ellenőrizték utoljára.

Referencia
Reka Core, Flash, and Edge: A Series of Powerful Multimodal Language Models
Utoljára frissítve
28 November 2025

Mit jelentenek a számok

Honnan jött

Reka Core ki lett adva által Reka AI, az országban rögzítve mint United States of America, alatt April 2024. A kiadó szervezet a következő kategóriába tartozik industry.

Működik a területen a Multimodal, Language, Vision, Video, Speech, és úgy van rögzítve, mint a feladat végrehajtása chat, Language modeling/generation, Image captioning, Code generation, Code autocompletion, Question answering, Visual question answering, Video description, Speech recognition (ASR), Speech-to-text, Quantitative reasoning.

Ez egy zárt modell: a betanított értékek azoknál maradtak, akik előállították őket, és nincs helyi verzió a futtatáshoz.

Képzés és származás

A létrehozásához körülbelül összesítő aritmetikára volt szükség. 8.4 × 10²⁴ FLOP, hardveren rögzítve NVIDIA A100,NVIDIA H100 SXM5 80GB. Ez a szám azt méri, hogy mennyibe került a modell előállítása, és nincs hatással arra, hogy milyen gyorsan válaszol.

A kiválasztási kritériuma: training cost.

Válaszok

Reka Core — gyakori kérdések

01

Reka Core— mennyi számítási kapacitást használtak annak a betanításához?

A képzés körülbelül elfogyasztott 8.4 × 10²⁴ FLOP, hardveren rögzítve NVIDIA A100,NVIDIA H100 SXM5 80GB. Ez azt méri, hogy mennyibe került a modell előállítása, és semmit nem mond arról, hogy milyen gyorsan válaszol, miután betanult — a következtetési sebesség a memória sávszélességéből származik, nem az edzési költségvetésből.

02

Reka Core— Milyen GPU-ra van szükségem, hogy futtathassam?

Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.

03

Reka Core— Nyílt forráskódú?

Nem. A súlyai nincsenek közzétéve, így csak a tulajdonosa által ellenőrzött szolgáltatásként létezik.

04

Reka Core— Hány paramétere van?

Paraméterszáma 67B. Ez a szám a teljes összeg, és ez határozza meg, hogy mennyi VRAM-ra van szüksége a modelleknek — körülbelül fél gigabájt milliárdonként a legtöbb ember által használt tömörítési módban.

05

Reka Core— Ki készítette ezt?

Kiadta Reka AI, alapján United States of America, egy szervezet, amelyet kategorizáltak mint industry.

06

Reka Core— Mikor adták ki?

Kibocsátották a April 2024. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.

07

Reka Core— Mire használják?

Működik a területen a Multimodal, Language, Vision, Video, Speech, és rögzítve van, hogy kezeli a feladatot chat, Language modeling/generation, Image captioning, Code generation, Code autocompletion, Question answering, Visual question answering, Video description, Speech recognition (ASR), Speech-to-text, Quantitative reasoning. A modell több mindenből is képes cipelni, így ezek azok a területek, amelyekre épült, nem pedig egy korlát arra, amit meg fog próbálni.

Forrás

Eredeti kiadvány

Az utolsó frissítés időpontja 28 November 2025

A másik irány

Másik oldalról nézve?

Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..