Rólunk

A gputps.com-ról

A specifikációs lapok elmondják, hogy mi a GPU. Nem mondják el, hogy mit csinál egy AI modellel. Ez az a rés, amit azért hoztunk létre, hogy áthidaljuk..

Mi ez

Mit csinálunk

Bármely GPU esetén megbecsüljük, hogy másodpercenként hány tokent tud generálni egy adott open weight nyelvi modell futtatásakor, függetlenül attól, hogy az a modell valóban elfér-e a memória méretében, és hogy melyik kvantálásnál. Ezen adatokat párhuzamosan közzétesszük a specifikációs táblázatokkal, így a vásárlási döntés egy tényleges válaszon alapul, nem csupán a nyers VRAM és FLOPS számokon, amelyek önmagukban nem mondanak semmit az inferencia sebességről..

Miért becslés, és nem egyetlen szám?

Egy token generálása azt jelenti, hogy egy modell súlyait egyszer olvassuk ki a MEMÓRIÁBÓL, így a dekódolási sebesség a MEMÓRIA SÁVSZÉLE és a modell méretének hányadosával van korlátozva — ez a számítás áll minden szám mögött ezen az oldalon. De ugyanaz a KÁRTYA és modell 20–40%-kal eltér a következtetési motorok, motor verziók és kvantálási formátumok között, és egyik műszaki adatlap sem jósolja meg ezt. Egy magabiztosnak tűnő szám közzététele tiszteletteljes lenne a pontos becslés mértékével kapcsolatban, amelyet ez a fajta becslés valójában képvisel. Így minden szám ezen az oldalon skálaként kerül közzétételre, a mögöttes módszerrel és bemenetekkel együtt, nem pedig egy puszta pontértékként..

A beszállító piactér

A becslések mellett a gyártók közvetlenül az adott KÁRTYA oldalán listázhatják a GPU-kat, a "mit is futtat ez valójában" kérdésre adott válasz mellett, ami az a hely, ahol ez a döntés megszületik..

Tanulj meg árusnak lenni.

Kezdj itt

Mindkét irány, egy számítás

Kezdj egy kártyával, amelyet birtokolsz vagy mérlegelsz, vagy a modellel, amelyet futtatni szeretnél..

Lépj kapcsolatba

Talált valami hibát?

Talált egy hibás számot, hiányzó GPU-t, vagy van egy javaslata? Szeretnénk hallani..

Kezelték

GPU AI Benchmark LLC 1209 Mountain Road Pl NE, Ste R
Albuquerque, NM 87110
USA