JetFire (GPT2-LARGE)
Žádný odhad
Žádné hardwareové požadavky na tento model
Hmotnosti tohoto modelu nebyly publikovány, takže jej nelze stáhnout ani spustit na vlastním hardwaru v jakékoli velikosti. Je dostupný pouze prostřednictvím svého poskytovatele a žádná grafická karta to nezmění..
Záznam.
Plná specifikace
Všechno zaznamenané k tomuto modelu. Většina z toho popisuje, jak byl trénován, nikoli jak běží — užitečný kontext pro posouzení, kolik práce do něj bylo vloženo, a jak se srovnává s modely postavenými na jinou škálu.
Původ
Kdo vybudoval tento model, kde a kdy byl publikován.
- Organizace
- Tsinghua University
- Typ organizace
- Academia
- Země
- China
- Publikováno
- 19 March 2024
- Autoři
- Haocheng Xi, Yuxiang Chen, Kang Zhao, Kaijun Zheng, Jianfei Chen, Jun Zhu
Co to dělá
Problémové oblasti, pro které byl model vyvinut. Model může obsahovat několik z každého.
- Doména
- Language
- Úkol
- Language modeling/generation
Velikost
Jak velký je model a na kolik dat byl vytrénován. Parametry jsou číslo, které rozhoduje o tom, zda se vejde na danou grafickou kartu.
- Parametry
- 774M
- Tréninková data
- tokens
Table 4.
Tréninkový běh
Co fyzicky vyžadovalo trénování: které čipy, kolik, jak dlouho a co to bralo ze zásuvky.
- Tréninkové hardwarové zařízení
- NVIDIA GeForce RTX 4090
Jak je klasifikováno
Labely, které se na zdrojovém datovém souboru používají při sledování významných modelů, a jak moc si je jistý touto položkou.
- Záznam důvěry
- Confident
Zdroje
Odkud tento záznam pochází a kdy byl naposled zkontrolován.
- Odkaz
- Jetfire: Efficient and Accurate Transformer Pretraining with INT8 Data Flow and Per-Block Quantization
- Naposledy aktualizováno
- 11 February 2026
Co čísla znamenají
Odkud to přišlo
JetFire (GPT2-LARGE) was published by Tsinghua University, in China, in March 2024. It comes out of academia.
It works in Language, and is recorded as doing language modeling/generation.
Jeho váhy nikdy nebyly zveřejněny, takže je možné ho dosáhnout pouze prostřednictvím jeho poskytovatele. Žádná grafická karta to nezmění.
Odpovědi
JetFire (GPT2-LARGE) — Časté dotazy
How many parameters does JetFire (GPT2-LARGE) have?
JetFire (GPT2-LARGE) has 774M parameters. Table 4. That figure is the total, and it is what decides how much memory the model needs — roughly half a gigabyte per billion at the compression most people use.
Who created JetFire (GPT2-LARGE)?
JetFire (GPT2-LARGE) was published by Tsinghua University, based in China, categorised as academia.
When was JetFire (GPT2-LARGE) released?
JetFire (GPT2-LARGE) was published in March 2024. Capability per parameter has improved considerably since, so a newer model of the same size is often the better use of the same hardware.
What is JetFire (GPT2-LARGE) used for?
JetFire (GPT2-LARGE) works in Language, and is recorded as handling language modeling/generation. These are the areas it was designed around; they describe intent rather than a hard boundary.
What GPU do I need to run JetFire (GPT2-LARGE)?
None. JetFire (GPT2-LARGE) is a closed model — its weights were never published, so it cannot be downloaded or run on your own hardware at any price. It is reachable only through its provider.
Is JetFire (GPT2-LARGE) open source?
The licensing for JetFire (GPT2-LARGE) was never recorded in our source data. We treat unstated licensing as closed, because an unrecorded licence is not one to rely on.
Druhý směr
Když se na to podíváte z druhé strany?
Tato stránka začíná modelem. Pokud již vlastníte kartu a chcete vědět, co vše bude schopna spustit, Začněte raději od hardwaru.