GLM-4 (0116)
Nincs becslés
Nincs hardver követelmény ennek a modellnek
A modellhez tartozó súlyokat nem tették közzé, így nem tölthető le vagy futtatható a saját hardverén bármilyen méretben. Csak a szolgáltatóján keresztül érhető el, és egyetlen grafikus kártya sem változtat ezen..
Nyilvántartásban
Teljes specifikáció
Minden feljegyzett ezzel a modellel kapcsolatban. A legtöbbje azt írja le, hogyan képezték ki, nem pedig azt, hogyan fut — hasznos kontextus annak megítéléséhez, hogy mennyi munka ment bele, és hogyan viszonyul a más méretben épített modellekhez..
Eredet
Ki építette ezt a modellt, hol, és mikor publikálták.
- Szervezet
- Z.ai (Zhipu AI)
- Szervezet típusa
- Industry
- Ország
- China
- Közölt
- 17 January 2024
- Szerzők
- Aohan Zeng, Bin Xu, Bowen Wang, Chenhui Zhang, Da Yin, Diego Rojas, Guanyu Feng, Hanlin Zhao, Hanyu Lai, Hao Yu, Hongning Wang, Jiadai Sun, Jiajie Zhang, Jiale Cheng, Jiayi Gui, Jie Tang, Jing Zhang, Juanzi Li, Lei Zhao, Lindong Wu, Lucen Zhong, Mingdao Liu, Minlie Huang, Peng Zhang, Qinkai Zheng, Rui Lu, Shuaiqi Duan, Shudan Zhang, Shulin Cao, Shuxun Yang, Weng Lam Tam, Wenyi Zhao, Xiao Liu, Xiao…
Mit csinál
A probléma területek, amelyekre a modell készült. Egy modell több mindegyikből hordozhat.
- Tartomány
- Language
- Feladat
- Language modeling/generation, Question answering, Code generation, Quantitative reasoning, Translation
Méret
Mekkora a modell, és mennyi adatot használtak a betanításához. A paraméterek azok a számok, amelyek eldöntik, hogy az adott grafikus kártyára illeszkedik-e.
- Képzési adatok
- 10,000,000,000,000 tokens
Képzés számítás
A modell tanításához végrehajtott aritmetika, lebegőpontos műveletekben mérve. Ez a tanítási futás költségének mértéke, nem pedig annak, hogy mennyire gyorsan válaszol a kész modell.
- Hogyan jött létre
- Operation counting
A tréning futás
Ami fizikailag szükséges volt a betanításhoz: mely chipek, hány, mennyi ideig, és ez mit fogyasztott a falból.
- Adatközpont
- The paper does not mention any hardware, GPUs or any information regarding the hardware used.
Elérhetőség
Hogy meg tudja-e szerezni a modellt és futtatni a saját hardverén, ez dönt arról, hogy alkalmazhatóak-e a lap ezen oldalán feltüntetett grafikus kártya adatok.
- Súlyok
- Closed — provider access only
- Modell hozzáférés
- API access
- Képzés kód
- Unreleased
GLM-4 (0116) has been made available through the GLM-4 API at https://bigmodel.cn
Hogyan van besorolva
Címkék a forráshalmazra, amelyeket a figyelemre méltó modellek nyomon követésekor alkalmaznak, és hogy mennyire biztos az adatbevitelben.
- Határmodell
- Yes
- Valószínűleg 10²³ FLOP felett
- Yes
- Miért követik nyomon
- Training cost
- Nyilvántartási bizalom
- Likely
Trained on 10T tokens with similar architecture to GPT-4, probably >$1M compute cost.
Források
Honnan származik ez a felvétel és mikor ellenőrizték utoljára.
- Referencia
- ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools
- Utoljára frissítve
- 11 February 2026
Mit jelentenek a számok
Honnan jött
GLM-4 (0116) ki lett adva által Z.ai (Zhipu AI), az országban rögzítve mint China, alatt January 2024. A kiadó kategóriája alá tartozik industry.
Működik a területen a Language, és úgy van rögzítve, mint a feladat végrehajtása language modeling/generation, Question answering, Code generation, Quantitative reasoning, Translation.
Mivel a súlyok nem elérhetők, ezért ezen az oldalon máshol található hardveradatok egyike sem vonatkozik rá.
Mi került a felépítésébe
Körülbelül egy korpuszon lett betanítva 10,000,000,000,000 szöveg tokenjei
Az oka, hogy egyáltalán megjelenik ebben a katalógusban: training cost.
Válaszok
GLM-4 (0116) — gyakori kérdések
GLM-4 (0116)— Nyílt forráskódú?
Nem. A súlyai nincsenek közzétéve, így csak a tulajdonosa által ellenőrzött szolgáltatásként létezik.
GLM-4 (0116)— Hány paramétere van?
Nincs közzétéve paraméterszám, ezért ez az oldal nem tartalmaz memóriával vagy sebességgel kapcsolatos adatokat.
GLM-4 (0116)— Ki készítette ezt?
Kiadta Z.ai (Zhipu AI), alapján China, egy szervezet, amelyet kategorizáltak mint industry.
GLM-4 (0116)— Mikor adták ki?
Kibocsátották a January 2024. A paraméterenkénti képesség lényegesen javult azóta, így egy újabb, azonos méretű modell gyakran jobb felhasználása a same hardvernek.
GLM-4 (0116)— Mire használják?
Működik a területen a Language, és rögzítve van, hogy kezeli a feladatot language modeling/generation, Question answering, Code generation, Quantitative reasoning, Translation. A modell több mindenből is képes cipelni, így ezek azok a területek, amelyekre épült, nem pedig egy korlát arra, amit meg fog próbálni.
GLM-4 (0116)— Milyen GPU-ra van szükségem, hogy futtathassam?
Ez egy zárt modell — a súlyait soha nem tették közzé, így nem tölthető le és nem futtatható a saját hardverén semmilyen áron. Csak a szolgáltatóján keresztül érhető el.
A másik irány
Másik oldalról nézve?
Ez az oldal a modellel kezdődik. Ha már van kártyád, és szeretnéd tudni, hogy mindent futtat-e, Kezdj a hardverből..